Zum Hauptinhalt springen
Betrieb & Qualität

Testen im Playground

Der Playground ist ein eingebautes Test-Chatfenster, in dem Sie Ihren Agenten live ausprobieren — genau so, wie ein Kunde ihn auf Ihrer Website erleben würde, aber ohne Ihre echten Kanäle (WhatsApp, SMS, Telefon, E-Mail) zu benutzen. Nutzen Sie ihn nach jeder Änderung an Persona, Wissensdatenbank, Modell oder Buchungs-Einstellungen, um zu prüfen, ob der Agent so antwortet, wie Sie es erwarten, bevor er auf echte Kunden trifft.

Sie finden den Playground im Agenten-Menü unter dem Reiter "Playground" (Agenten → Ihr Agent → Tab "Playground").

So funktioniert das Testfenster

Der Playground besteht aus drei Teilen: der Kopfzeile mit dem Zurücksetzen-Knopf, dem Chatverlauf in der Mitte und dem Eingabefeld unten. Eine Konfiguration im klassischen Sinn (Formularfelder zum Ausfüllen) gibt es hier nicht — der Playground bedient sich automatisch der aktuell gespeicherten Konfiguration Ihres Agenten. Was Sie testen, ist also immer der jetzige Stand.

Schritt 1: Nachricht eingeben - Schreiben Sie Ihre Testfrage in das Eingabefeld unten. Der Platzhaltertext lautet "Nachricht eingeben… (Enter zum Senden, Shift+Enter für neue Zeile)". - Enter sendet die Nachricht sofort. - Umschalt+Enter (Shift+Enter) fügt einen Zeilenumbruch ein, ohne zu senden — praktisch, um längere, mehrzeilige Kundenanfragen nachzustellen. - Das Feld ist zweizeilig, wächst aber bei längerem Text mit. Solange das Feld leer ist, bleibt der Sende-Knopf (das Papierflieger-Symbol rechts) deaktiviert.

Schritt 2: Antwort abwarten - Nach dem Absenden erscheint Ihre Nachricht rechts (als Sprechblase mit Personen-Symbol). Während der Agent nachdenkt, sehen Sie links eine animierte "Tipp-Anzeige" (drei pulsierende Punkte). - Die Antwort des Agenten erscheint links mit einem Roboter-Symbol. Sie wird mit der echten Konfiguration erzeugt: gewähltes Modell, Temperatur, Persona, Basis-Prompt, Wissensdatenbank (inkl. Recall-Fallback, siehe Tipps) und alle aktivierten Werkzeuge wie Buchung oder Lead-Erfassung.

Schritt 3: Gespräch fortsetzen - Jede weitere Nachricht bleibt Teil derselben Konversation — der Agent erinnert sich also an den bisherigen Verlauf, genau wie im echten Betrieb. So testen Sie auch mehrstufige Dialoge (z. B. eine Terminbuchung über mehrere Nachrichten hinweg). - Sobald die erste Antwort da ist, erscheint oben rechts in der Beschreibung ein kleines graues Kennzeichen wie "conv 1a2b3c4d". Das ist die gekürzte Konversations-ID dieses Testgesprächs — rein zur Orientierung; Sie müssen damit nichts tun.

Schritt 4: Zurücksetzen für einen frischen Test - Der Knopf "Zurücksetzen" oben rechts (mit Kreispfeil-Symbol) leert den Chatverlauf und startet eine komplett neue Konversation. Ein kurzer Hinweis "Konversation zurückgesetzt" bestätigt das. - Nutzen Sie das, wenn Sie ein neues Szenario von vorn beginnen wollen — etwa um zu prüfen, wie der Agent eine Erstanfrage ohne Vorgeschichte behandelt. Der Knopf ist nur aktiv, wenn bereits Nachrichten im Verlauf stehen. - Wichtig: Zurücksetzen leert nur Ihre Ansicht. Die bereits geführte Test-Konversation (und eventuell daraus entstandene Leads/Kosten) bleibt im System bestehen.

Was im Hintergrund passiert (und warum das wichtig ist)

Der Playground ist kein reines "Trockentraining". Er nutzt denselben Agenten-Motor wie der echte Betrieb, über einen internen Kanal namens "portal". Das bedeutet konkret:

  • Es entstehen echte Konversationen. Jede Test-Konversation wird gespeichert und taucht später in Ihrem Posteingang / Ihren Gesprächen auf.
  • Es können echte Leads entstehen. Wenn Sie den CRM-Modus aktiviert haben (Einstellung "Bei Kontakt automatisch anlegen" / auto_create_on_contact), wird aus jedem Kontakt ein Lead — und das gilt für alle Kanäle, also auch für den Playground. Ohne CRM-Modus entsteht ein Lead nur, wenn der Agent selbst entscheidet, die Kontaktdaten zu erfassen (Werkzeug capture_lead). Rechnen Sie also damit, dass Ihre Testchats Lead-Einträge erzeugen können.
  • Es entstehen echte Kosten. Jede Antwort ruft den KI-Anbieter (z. B. OpenAI) auf, und diese Kosten werden vollständig erfasst und auf Ihr Tagesbudget (daily_budget_usd) angerechnet. Intensives Testen kann das Limit also mitverbrauchen.

Tipps & Stolpersteine

  • Tagesbudget greift auch im Playground. Haben Sie ein Tagesbudget gesetzt und ist es bereits ausgeschöpft, antwortet der Agent auch hier nicht mehr, sondern zeigt sinngemäß "Dieser Assistent ist vorübergehend nicht verfügbar. Bitte versuchen Sie es später erneut." Das ist kein Fehler des Playgrounds, sondern Ihr Budget-Stopp. Prüfen Sie in dem Fall das Budget des Agenten.
  • Testchats wandern in Ihre echten Gespräche und Leads. Wenn Sie sauberen "echten" Statistiken/Listen wollen, löschen Sie Testgespräche bzw. Test-Leads hinterher wieder bzw. testen Sie nur, wenn Sie diese Vermischung in Kauf nehmen. Besonders im aktivierten CRM-Modus sammeln sich sonst schnell Karteileichen an.
  • Der Agent muss aktiv sein. Der Playground spricht nur mit einem aktiven, nicht gelöschten Agenten. Ist der Agent deaktiviert, erscheint eine Fehlermeldung im Chat.
  • Sie testen immer den gespeicherten Stand. Änderungen, die Sie an Persona, Prompt oder Wissensdatenbank vornehmen, wirken erst nach dem Speichern. Senden Sie eine Testnachricht, ohne vorher zu speichern, antwortet der Agent noch mit der alten Einstellung.
  • "Recall-Fallback" beim Wissen beachten. Die Wissenssuche arbeitet "recall-first": Findet sich nichts, das die Ähnlichkeitsschwelle (kb_max_distance, Standard 0.5) klar unterschreitet, wird trotzdem der beste Beinahe-Treffer genutzt. Eine im Playground "irgendwie passende, aber nicht ganz richtige" Antwort kann also genau daher kommen. Verschmutzte, automatisch gecrawlte Seiten (Navigations- und Fußzeilen-Text) verschlechtern die Trefferqualität — laden Sie in dem Fall sauberen Text neu hoch.
  • Warum hat er so geantwortet? Der Playground zeigt nur die fertige Antwort, nicht die Begründung. Wollen Sie sehen, welche Wissensbausteine herangezogen wurden, welche Werkzeuge der Agent aufrief und welche Entscheidungen er traf, nutzen Sie den separaten Bereich "KI-Debug" (Übersicht/Wissens-Gesundheit, der Live-"Abruf-Test" mit empfohlener Schwelle und Ein-Klick-Speichern, die "Turn-Traces" pro Nachricht sowie die Entscheidungs-Übersicht mit Daumen hoch/runter).
  • Realistische Tests statt Stichworte. Schreiben Sie ganze Sätze, wie ein Kunde sie tippt — nicht nur Stichworte. So sehen Sie, wie der Agent in der Praxis wirklich reagiert, inklusive Buchungs- und Rückfrage-Logik.
  • Bei einem Fehler erscheint [error] …. Schlägt eine Anfrage fehl, zeigt die Antwortblase eine Fehlermeldung mit vorangestelltem [error] und zusätzlich eine kurze Einblendung. Senden Sie die Nachricht dann einfach erneut; tritt der Fehler wiederholt auf, prüfen Sie Modell-Einstellungen und Budget.