Testez votre Agent dans Playground

Playground est la surface de test interactive de l’Agent destiné aux clients. Il permet aux coéquipiers autorisés d’essayer des conversations réalistes sans dépendre de la vitrine publique. L’espace de travail B2B ouv...

Playground est la surface de test interactive de l’Agent destiné aux clients. Il permet aux coéquipiers autorisés d’essayer des conversations réalistes sans dépendre de la vitrine publique. L’espace de travail B2B ouvre Playground via un transfert sécurisé et de courte durée, utilisez donc l’action intégrée au produit plutôt que d’enregistrer une ancienne URL de test.

Ce guide explique comment concevoir des scénarios utiles, inspecter l’ensemble de la réponse, classer les échecs et transformer les cas importants en tests par lot répétables. Il explique également ce que Playground ne peut pas prouver concernant l’installation en direct.

Comment cela s’intègre à Humind

AI Agent est l’espace de configuration de l’assistant destiné aux clients. Knowledge et Catalog fournissent les faits, Guidance façonne le comportement des réponses, Tools ajoute des actions, Escalation définit le support humain, les surfaces de test vous permettent de vérifier le résultat avant le déploiement.

Les modifications peuvent affecter de nombreuses conversations, testez donc des scénarios représentatifs d’achat et de support après chaque mise à jour significative. Un chat visuellement correct ne suffit pas : vérifiez ensemble la réponse, le contexte produit, l’action disponible et le comportement de transfert.

Avant de commencer

Accès : Playground nécessite un accès en lecture à la configuration de l’Agent. La correction de la source peut également nécessiter un accès en écriture à Knowledge, Catalog ou à la configuration de l’Agent.

  • Confirmez l’entreprise active, le marché du catalogue, la configuration de l’Agent et la langue.
  • Préparez les résultats attendus pour les questions sur les produits, les politiques, le support et les cas limites.
  • Utilisez des données de test non sensibles et séparez clairement les conversations de test du travail réel avec les clients.

Workflow étape par étape

  1. Ouvrir une nouvelle session Playground

    Ouvrez AI Agent et choisissez Playground. Humind ouvre la surface dédiée pour l’entreprise active. Commencez une nouvelle conversation lors de la validation d’une modification de source afin que les messages précédents n’influencent pas le résultat.

    Consignez la modification de configuration ou de contenu en cours de test ainsi que la question exacte. Une déclaration vague telle que 'l’Agent est meilleur' ne peut pas être répétée ni examinée par un autre coéquipier.

  2. Exécuter un ensemble de scénarios équilibré

    Testez une découverte de produit courante, un détail de produit spécifique, une politique stockée dans Knowledge, une demande de support, un cas indisponible ou sans résultat, une question de suivi, et une entrée qui devrait être modérée ou refusée selon la configuration.

    Variez la formulation et incluez une ambiguïté réaliste. L’objectif n’est pas d’imposer une seule phrase mémorisée, mais de vérifier l’exactitude des faits, une incertitude honnête, des produits pertinents, des outils appropriés et le chemin de transfert attendu.

  3. Inspecter l’ensemble de la réponse

    Examinez le texte, le contenu cité ou lié, les produits recommandés, les variantes, les prix, la sortie des outils, les suggestions de suivi et le comportement d’escalade. Une réponse fluide peut tout de même être incorrecte si elle sélectionne le mauvais marché, ignore la disponibilité ou utilise une politique obsolète.

    Lorsque le résultat échoue, identifiez la zone source avant de modifier : Knowledge, Catalog, Guidance, Tools, Escalation, interface ou déploiement. Corriger la source produit généralement un résultat plus durable que d’ajouter une autre instruction générale.

  4. Créer un contrôle de régression répétable

    Pour les scénarios importants, ouvrez Batch testing. Créez ou sélectionnez un jeu de données, ajoutez des questions manuellement, importez un CSV, ou générez des questions à partir du catalogue lorsque cela est approprié. Exécutez l’ensemble, examinez le statut et les évaluations des réponses, et ouvrez les conversations individuelles pour plus de détails.

    Évaluez ou documentez le résultat en utilisant une norme cohérente. Exportez le rapport CSV lorsqu’un artefact révisé est nécessaire, puis relancez les questions sélectionnées après une modification ciblée.

  5. Terminer par un test rapide en direct

    Playground valide le comportement de l’Agent, pas l’installation sur la vitrine. Après le déploiement via Sales channels, testez un ensemble plus réduit sur le domaine réellement autorisé dans un navigateur privé sur ordinateur et mobile.

    Vérifiez que le point d’entrée, le consentement, la collecte de l’identité client, le contexte produit et le transfert vers Inbox se comportent correctement dans l’environnement en direct.

Autorisations et points importants

  • Un passage réussi dans Playground ne prouve pas que le widget est installé ou stylé correctement sur la vitrine.
  • Le contexte de conversation affecte les réponses de suivi, utilisez une nouvelle session pour les contrôles de régression au niveau de la source.
  • Les questions par lot générées constituent un matériau de départ et nécessitent toujours une révision par le marchand.
  • N’utilisez pas de données personnelles réelles de clients dans les invites de test.

Vérifier le résultat

Utilisez cette liste de contrôle avant de considérer le travail comme terminé :

  • Chaque scénario a un fait attendu, un comportement produit, une action ou un résultat d’escalade explicitement définis.
  • Les échecs sont attribués à une zone source avant que des modifications ne soient apportées.
  • Les cas critiques existent dans un jeu de données Batch testing répétable.
  • Un test rapide de la vitrine après déploiement réussit sur ordinateur et mobile.

Dépannage

Playground ne s’ouvre pas

Retournez à l’espace de travail B2B, confirmez l’entreprise active et l’accès à la configuration de l’Agent, puis utilisez à nouveau l’action Playground actuelle. Ne vous fiez pas à une URL de transfert précédemment enregistrée.

Une réponse corrigée semble toujours ancienne

Confirmez que la source est enregistrée ou publiée dans l’entreprise active, supprimez les conflits et démarrez une nouvelle conversation Playground. Si les données du catalogue ont changé, attendez la synchronisation et toute matérialisation des filtres.

Les résultats par lot et interactifs diffèrent

Comparez l’entreprise, la langue, le contexte produit, la question du jeu de données, l’historique de conversation et l’heure à laquelle chaque exécution a eu lieu. Relancez exactement la question sélectionnée après avoir confirmé la même configuration actuelle.

Guides associés

Cet article vous a-t-il été utile ?