Teste o seu Agent no Playground
O Playground é a superfície de teste interativa para o Agent voltado para o cliente. Permite que colegas de equipa autorizados experimentem conversas realistas sem depender da montra pública. O espaço de trabalho B2B...
O Playground é a superfície de teste interativa para o Agent voltado para o cliente. Permite que colegas de equipa autorizados experimentem conversas realistas sem depender da montra pública. O espaço de trabalho B2B abre o Playground através de uma transferência segura e de curta duração, por isso use a ação no produto em vez de guardar um URL de teste antigo.
Este guia mostra como criar cenários úteis, inspecionar a resposta completa, classificar falhas e transformar casos importantes em testes em lote repetíveis. Também explica o que o Playground não consegue comprovar sobre a instalação em produção.
Como isto se enquadra no Humind
O AI Agent é o espaço de configuração do assistente voltado para o cliente. Knowledge e Catalog fornecem os factos, Guidance molda o comportamento da resposta, Tools adiciona ações, Escalation define o apoio humano, as superfícies de teste permitem-lhe rever o resultado antes da implementação.
As alterações podem afetar muitas conversas, por isso teste cenários representativos de compra e apoio após cada atualização significativa. Um chat visualmente correto não é suficiente: verifique em conjunto a resposta, o contexto do produto, a ação disponível e o comportamento de transferência.
Antes de começar
Acesso: O Playground requer acesso de leitura à configuração do Agent. Corrigir a origem também pode exigir acesso de escrita a Knowledge, Catalog ou à configuração do Agent.
- Confirme a empresa ativa, o mercado do catálogo, a configuração do Agent e o idioma.
- Prepare os resultados esperados para perguntas sobre produto, política, apoio e casos limite.
- Use dados de teste não sensíveis e separe claramente as conversas de teste do trabalho real com clientes.
Fluxo de trabalho passo a passo
Abrir uma nova sessão do Playground
Abra o AI Agent e escolha Playground. O Humind abre a superfície dedicada para a empresa ativa. Inicie uma nova conversa ao validar uma alteração na origem, para que as mensagens anteriores não influenciem o resultado.
Registe a alteração de configuração ou de conteúdo em teste e a pergunta exata. Uma afirmação vaga como 'o Agent está melhor' não pode ser repetida nem revista por outro colega de equipa.
Executar um conjunto equilibrado de cenários
Teste uma descoberta comum de produto, um detalhe específico de produto, uma política armazenada em Knowledge, um pedido de apoio, um caso indisponível ou sem resultados, uma pergunta de seguimento e uma entrada que deva ser moderada ou recusada de acordo com a configuração.
Varie a formulação e inclua ambiguidade realista. O objetivo não é forçar uma única frase memorizada, mas verificar factos corretos, incerteza honesta, produtos relevantes, ferramentas adequadas e o percurso de transferência esperado.
Inspecionar a resposta completa
Reveja o texto, o conteúdo citado ou com ligação, os produtos recomendados, as variantes, os preços, o resultado das ferramentas, as sugestões de seguimento e o comportamento de escalonamento. Uma resposta fluente pode ainda assim estar errada se selecionar o mercado errado, ignorar a disponibilidade ou usar uma política desatualizada.
Quando o resultado falhar, identifique a área de origem antes de editar: Knowledge, Catalog, Guidance, Tools, Escalation, interface ou implementação. Corrigir a origem normalmente produz um resultado mais duradouro do que adicionar outra instrução ampla.
Criar uma verificação de regressão repetível
Para cenários importantes, abra Batch testing. Crie ou selecione um conjunto de dados, adicione perguntas manualmente, importe um CSV ou gere perguntas a partir do catálogo, quando apropriado. Execute o conjunto, reveja o estado e as classificações das respostas e abra conversas individuais para obter detalhe.
Atribua classificação ou documente o resultado usando um padrão consistente. Exporte o relatório CSV quando for necessário um artefacto revisto e volte a executar as perguntas selecionadas após uma alteração direcionada.
Terminar com um smoke test em produção
O Playground valida o comportamento do Agent, não a instalação na montra. Após implementar através de Sales channels, teste um conjunto mais pequeno no domínio realmente permitido, num navegador privado, em desktop e mobile.
Verifique se o ponto de entrada, o consentimento, a recolha da identidade do cliente, o contexto do produto e a transferência para o Inbox se comportam corretamente no ambiente em produção.
Permissões e observações importantes
- Uma passagem no Playground não comprova que o widget esteja instalado ou apresentado corretamente na montra.
- O contexto da conversa afeta as respostas de seguimento, use uma sessão nova para verificações de regressão ao nível da origem.
- As perguntas em lote geradas são material inicial e continuam a exigir revisão por parte do comerciante.
- Não use dados pessoais reais de clientes nos pedidos de teste.
Verificar o resultado
Use esta lista de verificação antes de considerar o trabalho concluído:
- Cada cenário tem um facto esperado, comportamento do produto, ação ou resultado de escalonamento explícito.
- As falhas são atribuídas a uma área de origem antes de serem feitas alterações.
- Existem casos críticos num conjunto de dados repetível de Batch testing.
- Um smoke test da montra após a implementação é aprovado em desktop e mobile.
Resolução de problemas
O Playground não abre
Volte ao espaço de trabalho B2B, confirme a empresa ativa e o acesso à configuração do Agent e, em seguida, use novamente a ação atual do Playground. Não dependa de um URL de transferência guardado anteriormente.
Uma resposta corrigida continua a parecer antiga
Confirme que a origem está guardada ou publicada na empresa ativa, remova conflitos e inicie uma nova conversa no Playground. Se os dados do catálogo mudaram, aguarde a sincronização e qualquer materialização de filtros.
Os resultados em lote e interativos são diferentes
Compare a empresa, o idioma, o contexto do produto, a pergunta do conjunto de dados, o histórico da conversa e o momento em que cada execução ocorreu. Volte a executar exatamente a pergunta selecionada depois de confirmar a mesma configuração atual.