Testen Sie Ihren Agent in Playground
Playground ist die interaktive Testoberfläche für den kundenseitigen Agent. Sie ermöglicht autorisierten Teammitgliedern, realistische Gespräche auszuprobieren, ohne sich auf den öffentlichen Shop zu verlassen. Der B2...
Playground ist die interaktive Testoberfläche für den kundenseitigen Agent. Sie ermöglicht autorisierten Teammitgliedern, realistische Gespräche auszuprobieren, ohne sich auf den öffentlichen Shop zu verlassen. Der B2B-Arbeitsbereich öffnet Playground über eine sichere Übergabe mit kurzer Gültigkeitsdauer, verwenden Sie daher die produktinterne Aktion, anstatt eine alte Test-URL zu speichern.
Diese Anleitung zeigt, wie Sie nützliche Szenarien entwerfen, die gesamte Antwort prüfen, Fehler klassifizieren und wichtige Fälle in wiederholbare Batch-Tests umwandeln. Sie erklärt außerdem, was Playground bei einer Live-Installation nicht nachweisen kann.
Wie dies in Humind passt
AI Agent ist der Konfigurationsbereich für den kundenseitigen Assistenten. Knowledge und Catalog liefern Fakten, Guidance formt das Antwortverhalten, Tools fügen Aktionen hinzu, Escalation definiert menschlichen Support, Testoberflächen ermöglichen es Ihnen, das Ergebnis vor der Bereitstellung zu überprüfen.
Änderungen können viele Gespräche beeinflussen, testen Sie daher nach jeder wesentlichen Aktualisierung repräsentative Kauf- und Support-Szenarien. Ein visuell korrekt wirkender Chat reicht nicht aus: Prüfen Sie Antwort, Produktkontext, verfügbare Aktion und Übergabeverhalten gemeinsam.
Bevor Sie beginnen
Zugriff: Playground erfordert Lesezugriff auf die Agent-Konfiguration. Die Korrektur der Quelle kann außerdem Schreibzugriff auf Knowledge, Catalog oder die Agent-Konfiguration erfordern.
- Bestätigen Sie das aktive Unternehmen, den Katalogmarkt, die Agent-Konfiguration und die Sprache.
- Bereiten Sie erwartete Ergebnisse für Produkt-, Richtlinien-, Support- und Grenzfallfragen vor.
- Verwenden Sie nicht sensible Testdaten und trennen Sie Testgespräche klar von echter Kundenarbeit.
Schritt-für-Schritt-Workflow
Eine neue Playground-Sitzung öffnen
Öffnen Sie AI Agent und wählen Sie Playground. Humind öffnet die dedizierte Oberfläche für das aktive Unternehmen. Starten Sie bei der Validierung einer Quelländerung ein neues Gespräch, damit frühere Nachrichten das Ergebnis nicht beeinflussen.
Dokumentieren Sie die Konfigurations- oder Inhaltsänderung, die getestet wird, sowie die genaue Frage. Eine vage Aussage wie 'der Agent ist besser' kann nicht wiederholt oder von einem anderen Teammitglied geprüft werden.
Einen ausgewogenen Satz von Szenarien ausführen
Testen Sie eine häufige Produktfindung, ein spezifisches Produktdetail, eine in Knowledge gespeicherte Richtlinie, eine Supportanfrage, einen nicht verfügbaren oder ergebnislosen Fall, eine Folgefrage sowie eine Eingabe, die gemäß der Konfiguration moderiert oder abgelehnt werden sollte.
Variieren Sie die Formulierung und schließen Sie realistische Mehrdeutigkeit ein. Das Ziel ist nicht, einen einzigen auswendig gelernten Satz zu erzwingen, sondern korrekte Fakten, ehrliche Unsicherheit, relevante Produkte, passende Tools und den erwarteten Übergabepfad zu überprüfen.
Die gesamte Antwort prüfen
Prüfen Sie Text, zitierte oder verlinkte Inhalte, empfohlene Produkte, Varianten, Preise, Tool-Ausgabe, Folgevorschläge und das Eskalationsverhalten. Eine flüssige Antwort kann dennoch falsch sein, wenn sie den falschen Markt auswählt, die Verfügbarkeit ignoriert oder eine veraltete Richtlinie verwendet.
Wenn das Ergebnis fehlschlägt, identifizieren Sie vor dem Bearbeiten den Quellbereich: Knowledge, Catalog, Guidance, Tools, Escalation, Oberfläche oder Bereitstellung. Die Korrektur der Quelle führt in der Regel zu einem dauerhaft besseren Ergebnis als das Hinzufügen einer weiteren allgemeinen Anweisung.
Eine wiederholbare Regressionsprüfung erstellen
Öffnen Sie für wichtige Szenarien Batch testing. Erstellen oder wählen Sie einen Datensatz, fügen Sie Fragen manuell hinzu, importieren Sie eine CSV oder generieren Sie bei Bedarf Fragen aus dem Katalog. Führen Sie den Satz aus, prüfen Sie Antwortstatus und Bewertungen, und öffnen Sie einzelne Gespräche für Details.
Bewerten oder dokumentieren Sie das Ergebnis anhand eines einheitlichen Standards. Exportieren Sie den CSV-Bericht, wenn ein geprüftes Artefakt benötigt wird, und führen Sie ausgewählte Fragen nach einer gezielten Änderung erneut aus.
Mit einem Live-Smoketest abschließen
Playground validiert das Verhalten des Agent, nicht die Shop-Installation. Testen Sie nach der Bereitstellung über Vertriebskanäle einen kleineren Satz auf der tatsächlich erlaubten Domain in einem privaten Browser auf Desktop und Mobilgerät.
Prüfen Sie, ob Einstiegspunkt, Einwilligung, Erfassung der Kundenidentität, Produktkontext und die Übergabe an Inbox in der Live-Umgebung korrekt funktionieren.
Berechtigungen und wichtige Hinweise
- Ein erfolgreicher Durchlauf in Playground beweist nicht, dass das Widget im Shop korrekt installiert oder gestaltet ist.
- Der Gesprächskontext beeinflusst Folgeantworten, verwenden Sie für Regressionsprüfungen auf Quellenebene eine neue Sitzung.
- Generierte Batch-Fragen sind Ausgangsmaterial und erfordern weiterhin eine Prüfung durch den Händler.
- Verwenden Sie in Testeingaben keine echten personenbezogenen Kundendaten.
Ergebnis überprüfen
Verwenden Sie diese Checkliste, bevor Sie die Arbeit als abgeschlossen betrachten:
- Jedes Szenario hat ein explizit erwartetes Faktum, Produktverhalten, eine Aktion oder ein Eskalationsergebnis.
- Fehler werden einem Quellbereich zugeordnet, bevor Änderungen vorgenommen werden.
- Kritische Fälle sind in einem wiederholbaren Batch testing-Datensatz vorhanden.
- Ein Smoketest des Shops nach der Bereitstellung besteht auf Desktop und Mobilgerät.
Fehlerbehebung
Playground wird nicht geöffnet
Kehren Sie zum B2B-Arbeitsbereich zurück, bestätigen Sie das aktive Unternehmen und den Zugriff auf die Agent-Konfiguration, und verwenden Sie dann erneut die aktuelle Playground-Aktion. Verlassen Sie sich nicht auf eine zuvor gespeicherte Übergabe-URL.
Eine korrigierte Antwort wirkt immer noch alt
Bestätigen Sie, dass die Quelle im aktiven Unternehmen gespeichert oder veröffentlicht ist, entfernen Sie Konflikte und starten Sie ein neues Playground-Gespräch. Wenn sich Katalogdaten geändert haben, warten Sie auf die Synchronisierung und eine eventuelle Materialisierung von Filtern.
Batch- und interaktive Ergebnisse unterscheiden sich
Vergleichen Sie Unternehmen, Sprache, Produktkontext, Datensatzfrage, Gesprächsverlauf und den Zeitpunkt jedes Durchlaufs. Führen Sie genau die ausgewählte Frage erneut aus, nachdem Sie dieselbe aktuelle Konfiguration bestätigt haben.