Prueba tu Agent en Playground

Playground es la superficie de prueba interactiva para el Agent orientado al cliente. Permite que los compañeros de equipo autorizados prueben conversaciones realistas sin depender del escaparate público. El espacio d...

Playground es la superficie de prueba interactiva para el Agent orientado al cliente. Permite que los compañeros de equipo autorizados prueben conversaciones realistas sin depender del escaparate público. El espacio de trabajo B2B abre Playground mediante una transferencia segura y de corta duración, así que usa la acción dentro del producto en lugar de guardar una URL de prueba antigua.

Esta guía muestra cómo diseñar escenarios útiles, inspeccionar la respuesta completa, clasificar los fallos y convertir los casos importantes en pruebas por lotes repetibles. También explica qué no puede demostrar Playground sobre una instalación en producción.

Cómo encaja esto en Humind

AI Agent es el espacio de configuración del asistente orientado al cliente. Knowledge y Catalog aportan los hechos, Guidance da forma al comportamiento de la respuesta, Tools añade acciones, Escalation define el soporte humano, las superficies de prueba te permiten revisar el resultado antes del despliegue.

Los cambios pueden afectar a muchas conversaciones, así que prueba escenarios representativos de compra y soporte después de cada actualización significativa. Un chat visualmente correcto no es suficiente: verifica conjuntamente la respuesta, el contexto del producto, la acción disponible y el comportamiento de transferencia.

Antes de empezar

Acceso: Playground requiere acceso de lectura a la configuración del Agent. Corregir la fuente también puede requerir acceso de escritura a Knowledge, Catalog o a la configuración del Agent.

  • Confirma la empresa activa, el mercado del catálogo, la configuración del Agent y el idioma.
  • Prepara los resultados esperados para preguntas sobre productos, políticas, soporte y casos límite.
  • Usa datos de prueba no sensibles y separa claramente las conversaciones de prueba del trabajo real con clientes.

Flujo de trabajo paso a paso

  1. Abrir una sesión nueva de Playground

    Abre AI Agent y elige Playground. Humind abre la superficie dedicada para la empresa activa. Inicia una conversación nueva al validar un cambio en la fuente para que los mensajes anteriores no influyan en el resultado.

    Registra el cambio de configuración o de contenido que se está probando y la pregunta exacta. Una afirmación vaga como 'el Agent es mejor' no puede repetirse ni revisarse por otro compañero de equipo.

  2. Ejecutar un conjunto equilibrado de escenarios

    Prueba un descubrimiento de producto común, un detalle específico de producto, una política almacenada en Knowledge, una solicitud de soporte, un caso no disponible o sin resultados, una pregunta de seguimiento y una entrada que debería moderarse o rechazarse según la configuración.

    Varía la redacción e incluye ambigüedad realista. El objetivo no es forzar una sola frase memorizada, sino verificar hechos correctos, incertidumbre honesta, productos relevantes, herramientas adecuadas y la ruta de transferencia esperada.

  3. Inspeccionar la respuesta completa

    Revisa el texto, el contenido citado o enlazado, los productos recomendados, las variantes, los precios, el resultado de las herramientas, las sugerencias de seguimiento y el comportamiento de escalado. Una respuesta fluida puede seguir siendo incorrecta si selecciona el mercado equivocado, ignora la disponibilidad o usa una política desactualizada.

    Cuando el resultado falle, identifica el área de origen antes de editar: Knowledge, Catalog, Guidance, Tools, Escalation, interfaz o despliegue. Corregir la fuente suele producir un resultado más duradero que añadir otra instrucción general.

  4. Crear una comprobación de regresión repetible

    Para escenarios importantes, abre Batch testing. Crea o selecciona un conjunto de datos, añade preguntas manualmente, importa un CSV o genera preguntas a partir del catálogo cuando corresponda. Ejecuta el conjunto, revisa el estado y las valoraciones de las respuestas, y abre conversaciones individuales para ver el detalle.

    Valora o documenta el resultado usando un criterio coherente. Exporta el informe CSV cuando se necesite un artefacto revisado y vuelve a ejecutar las preguntas seleccionadas después de un cambio específico.

  5. Terminar con una prueba rápida en producción

    Playground valida el comportamiento del Agent, no la instalación en el escaparate. Después de desplegar mediante Sales channels, prueba un conjunto más pequeño en el dominio realmente permitido en un navegador privado en escritorio y móvil.

    Verifica que el punto de entrada, el consentimiento, la recopilación de identidad del cliente, el contexto del producto y la transferencia a Inbox funcionen correctamente en el entorno en producción.

Permisos y advertencias importantes

  • Una prueba correcta en Playground no demuestra que el widget esté instalado o diseñado correctamente en el escaparate.
  • El contexto de la conversación afecta a las respuestas de seguimiento, usa una sesión nueva para comprobaciones de regresión a nivel de fuente.
  • Las preguntas por lotes generadas son material inicial y siguen requiriendo revisión por parte del comerciante.
  • No uses datos personales reales de clientes en los mensajes de prueba.

Verifica el resultado

Usa esta lista de comprobación antes de considerar el trabajo terminado:

  • Cada escenario tiene un hecho esperado, comportamiento de producto, acción o resultado de escalado explícito.
  • Los fallos se asignan a un área de origen antes de realizar cambios.
  • Los casos críticos existen en un conjunto de datos repetible de Batch testing.
  • Una prueba rápida del escaparate posterior al despliegue se supera en escritorio y móvil.

Solución de problemas

Playground no se abre

Vuelve al espacio de trabajo B2B, confirma la empresa activa y el acceso a la configuración del Agent, y luego vuelve a usar la acción actual de Playground. No dependas de una URL de transferencia guardada anteriormente.

Una respuesta corregida sigue pareciendo antigua

Confirma que la fuente está guardada o publicada en la empresa activa, elimina conflictos e inicia una nueva conversación en Playground. Si los datos del catálogo cambiaron, espera a la sincronización y a cualquier materialización de filtros.

Los resultados por lotes y los interactivos difieren

Compara la empresa, el idioma, el contexto del producto, la pregunta del conjunto de datos, el historial de la conversación y el momento en que se produjo cada ejecución. Vuelve a ejecutar exactamente la pregunta seleccionada después de confirmar la misma configuración actual.

Guías relacionadas

¿Te ha resultado útil este artículo?