Testa il tuo Agent in Playground
Playground è la superficie di test interattiva per l’Agent rivolto ai clienti. Consente ai membri autorizzati del team di provare conversazioni realistiche senza fare affidamento sulla vetrina pubblica. L’area di lavo...
Playground è la superficie di test interattiva per l’Agent rivolto ai clienti. Consente ai membri autorizzati del team di provare conversazioni realistiche senza fare affidamento sulla vetrina pubblica. L’area di lavoro B2B apre Playground tramite un passaggio sicuro e di breve durata, quindi usa l’azione nel prodotto invece di salvare un vecchio URL di test.
Questa guida mostra come progettare scenari utili, ispezionare l’intera risposta, classificare gli errori e trasformare i casi importanti in test batch ripetibili. Spiega inoltre cosa Playground non può dimostrare riguardo a un’installazione live.
Come si inserisce in Humind
AI Agent è lo spazio di configurazione per l’assistente rivolto ai clienti. Knowledge e Catalog forniscono i fatti, Guidance modella il comportamento della risposta, Tools aggiunge azioni, Escalation definisce il supporto umano, le superfici di test consentono di controllare il risultato prima della distribuzione.
Le modifiche possono influire su molte conversazioni, quindi testa scenari rappresentativi di acquisto e supporto dopo ogni aggiornamento significativo. Una chat visivamente corretta non basta: verifica insieme la risposta, il contesto prodotto, l’azione disponibile e il comportamento di passaggio.
Prima di iniziare
Accesso: Playground richiede accesso in lettura alla configurazione dell’Agent. La correzione della fonte può richiedere anche accesso in scrittura a Knowledge, Catalog o alla configurazione dell’Agent.
- Conferma l’azienda attiva, il mercato del catalogo, la configurazione dell’Agent e la lingua.
- Prepara i risultati attesi per domande su prodotti, policy, supporto e casi limite.
- Usa dati di test non sensibili e separa chiaramente le conversazioni di test dal lavoro reale con i clienti.
Flusso di lavoro passo dopo passo
Apri una nuova sessione di Playground
Apri AI Agent e scegli Playground. Humind apre la superficie dedicata per l’azienda attiva. Avvia una nuova conversazione quando convalidi una modifica alla fonte, in modo che i messaggi precedenti non influenzino il risultato.
Registra la modifica di configurazione o contenuto in test e la domanda esatta. Un’affermazione vaga come 'l’Agent è migliore' non può essere ripetuta né revisionata da un altro membro del team.
Esegui un set di scenari bilanciato
Testa una comune scoperta di prodotto, un dettaglio specifico di prodotto, una policy archiviata in Knowledge, una richiesta di supporto, un caso non disponibile o senza risultati, una domanda di follow-up e un input che dovrebbe essere moderato o rifiutato in base alla configurazione.
Varia la formulazione e includi ambiguità realistiche. L’obiettivo non è forzare una sola frase memorizzata, ma verificare fatti corretti, incertezza onesta, prodotti pertinenti, strumenti appropriati e il percorso di passaggio previsto.
Ispeziona l’intera risposta
Esamina testo, contenuti citati o collegati, prodotti consigliati, varianti, prezzi, output degli strumenti, suggerimenti di follow-up e comportamento di escalation. Una risposta fluida può comunque essere sbagliata se seleziona il mercato errato, ignora la disponibilità o usa una policy obsoleta.
Quando il risultato fallisce, identifica l’area di origine prima di modificare: Knowledge, Catalog, Guidance, Tools, Escalation, interfaccia o distribuzione. Correggere la fonte di solito produce un risultato più duraturo rispetto all’aggiunta di un’altra istruzione generica.
Crea un controllo di regressione ripetibile
Per gli scenari importanti, apri Batch testing. Crea o seleziona un set di dati, aggiungi domande manualmente, importa un CSV oppure genera domande dal catalogo dove appropriato. Esegui il set, rivedi stato e valutazioni delle risposte e apri le singole conversazioni per i dettagli.
Valuta o documenta il risultato usando uno standard coerente. Esporta il report CSV quando è necessario un artefatto revisionato e riesegui le domande selezionate dopo una modifica mirata.
Concludi con un smoke test live
Playground convalida il comportamento dell’Agent, non l’installazione sulla vetrina. Dopo la distribuzione tramite Sales channels, testa un set più piccolo sul dominio effettivamente consentito in un browser privato su desktop e mobile.
Verifica che il punto di ingresso, il consenso, la raccolta dell’identità del cliente, il contesto prodotto e il passaggio a Inbox funzionino correttamente nell’ambiente live.
Autorizzazioni e avvertenze importanti
- Un passaggio riuscito in Playground non dimostra che il widget sia installato o stilizzato correttamente sulla vetrina.
- Il contesto della conversazione influisce sulle risposte di follow-up, usa una nuova sessione per i controlli di regressione a livello di fonte.
- Le domande batch generate sono materiale iniziale e richiedono comunque la revisione del merchant.
- Non usare dati personali reali dei clienti nei prompt di test.
Verifica il risultato
Usa questa checklist prima di considerare il lavoro completato:
- Ogni scenario ha un fatto atteso, un comportamento del prodotto, un’azione o un risultato di escalation espliciti.
- Gli errori vengono assegnati a un’area di origine prima che vengano apportate modifiche.
- I casi critici esistono in un set di dati Batch testing ripetibile.
- Uno smoke test della vetrina dopo la distribuzione viene superato su desktop e mobile.
Risoluzione dei problemi
Playground non si apre
Torna all’area di lavoro B2B, conferma l’azienda attiva e l’accesso alla configurazione dell’Agent, quindi usa di nuovo l’azione Playground corrente. Non fare affidamento su un URL di passaggio salvato in precedenza.
Una risposta corretta sembra ancora vecchia
Conferma che la fonte sia salvata o pubblicata nell’azienda attiva, rimuovi i conflitti e avvia una nuova conversazione in Playground. Se i dati del catalogo sono cambiati, attendi la sincronizzazione e l’eventuale materializzazione dei filtri.
I risultati batch e quelli interattivi differiscono
Confronta azienda, lingua, contesto prodotto, domanda del set di dati, cronologia della conversazione e momento in cui si è verificata ogni esecuzione. Riesegui esattamente la domanda selezionata dopo aver confermato la stessa configurazione corrente.