Zum Hauptinhalt springen
Erste Schritte

Agenten anlegen (Grundlagen)

In diesem Bereich legen Sie einen neuen KI-Agenten an und bestimmen sein Grundverhalten: wie er heißt, welches KI-Modell er nutzt, wie kreativ bzw. wie ausführlich er antwortet, in welcher Sprache er spricht und welche Rolle er überhaupt einnimmt. Sie öffnen ihn über "Neuer Agent" in der Agentenübersicht. Alles, was Sie hier einstellen, lässt sich später jederzeit ändern.

Das Anlegen läuft in zwei Schritten ab (Sie sehen oben eine Fortschrittsleiste, den "Stepper"):

  1. Telefonnummer — Sie wählen zuerst eine dedizierte Rufnummer (neu kaufen oder eine bestehende aus Ihrem Konto übernehmen). Diese Nummer versorgt Voice und WhatsApp dieses Agenten. Die Telefon-Einrichtung im Detail wird in einem eigenen Kapitel behandelt; für die Grundlagen genügt es, eine Nummer auszuwählen und auf "Weiter" zu klicken.
  2. Agent-Details — hier wählen Sie eine Vorlage und füllen anschließend das eigentliche Konfigurationsformular aus. Genau darum geht es in diesem Kapitel.

Schritt 1: Vorlage wählen ("Vorlage wählen")

Bevor das Formular erscheint, fragt Prezio: "Wofür ist dieser Agent?" Die gewählte Vorlage stellt automatisch passende Fähigkeiten und einen Start-Prompt ein — Sie können danach im Formular trotzdem alles anpassen.

Zur Auswahl stehen:

  • Restaurant — beantwortet Menü-Fragen aus der Wissensdatenbank und nimmt Bestellungen an (Bestellfunktion vorab aktiviert).
  • Termine — bucht, verschiebt und storniert Termine und beantwortet Service-Fragen (Buchungsfunktion vorab aktiviert).
  • Vertrieb / Leads — qualifiziert und erfasst Interessenten und beantwortet Fragen aus der Wissensdatenbank.
  • Support — beantwortet Fragen strikt aus der Wissensdatenbank und eskaliert sonst an einen Menschen.
  • Individuell ("Custom") — leerer Start, Sie konfigurieren alles selbst. Dies ist die Voreinstellung.

Empfehlung: Wählen Sie die Vorlage, die Ihrem Anwendungsfall am nächsten kommt. Sie liefert einen sinnvoll formulierten System-Prompt als Startpunkt, den Sie dann nur noch anpassen. "Individuell" ist sinnvoll, wenn Ihr Fall keiner der vier Kategorien entspricht.

Nach der Vorlagenwahl erscheint das Konfigurationsformular mit mehreren Reitern (Tabs), gruppiert in "Konfiguration" und "Erweitert". Für die Grundlagen sind nur zwei Bereiche wichtig: der Reiter "Basics" (Karten "Basis-Einstellungen" und "KI-Modell") und — für die Sprache — der Reiter "Persona".

Hinweis: Einige Reiter (z. B. "Wissen", "FAQs", "Leads") sind ausgegraut, bis der Agent einmal gespeichert wurde. Das ist normal: Diese Funktionen brauchen eine gespeicherte Agenten-ID. Legen Sie den Agenten zunächst mit den Basis-Daten an; danach stehen alle Reiter zur Verfügung.

Schritt 2: Basis-Einstellungen (Karte "Basis-Einstellungen")

Hier definieren Sie Name und Kernverhalten des Agenten.

  • Name (Pflichtfeld)
  • Der interne Name des Agenten, z. B. "Acme Customer Service". Er dient Ihnen und Ihrem Team zur Orientierung im Dashboard.
  • Default: leer. Empfehlung: ein kurzer, eindeutiger Name pro Standort/Zweck. Das Feld darf nicht leer sein, sonst lässt sich der Agent nicht speichern.

  • Beschreibung (optional)

  • Eine kurze Notiz für Ihr Team ("Kurze Beschreibung für Ihr Team"). Sie hat keinen Einfluss auf das Verhalten des Agenten.
  • Default: leer. Empfehlung: ausfüllen, sobald Sie mehrere Agenten betreiben.

  • System-Prompt (Pflichtfeld — das Herzstück)

  • Das ist die wichtigste Einstellung überhaupt: die Grundanweisung, die der Agent bei jeder Antwort befolgt. Hier legen Sie Rolle, Aufgabe und Verhaltensregeln in normaler Sprache fest (z. B. "Du bist ein freundlicher Customer-Service-Assistent für …"). Wenn Sie eine Vorlage gewählt haben, ist dieses Feld bereits sinnvoll vorbefüllt.
  • Default: je nach Vorlage ein passender Start-Prompt; bei "Individuell" eine neutrale Grundanweisung ("You are a helpful assistant. Be concise, friendly, and professional.").
  • Muss mindestens 10 Zeichen lang sein, sonst erscheint ein Fehler.
  • Empfehlung für gute Prompts:

    • Beschreiben Sie die Rolle ("Du bist die Assistenz für das Restaurant Sonne").
    • Nennen Sie die Aufgaben ("Beantworte Fragen zur Speisekarte, nimm Bestellungen Schritt für Schritt auf").
    • Setzen Sie klare Grenzen — gerade bei Preisen/Fakten ist die Formel "… nutze AUSSCHLIESSLICH die Wissensdatenbank — erfinde niemals Preise oder Produkte" sehr wirksam, damit der Agent nichts dazudichtet.
    • Halten Sie ihn fokussiert: ein überladener Prompt verwässert die Antworten. Detaillierte Persona-Regeln (Tonfall, verbotene Themen) gehören in den Reiter "Persona", nicht in den Prompt.
  • Begrüßung ("Welcome", optional)

  • Die erste Nachricht, die im Web-Chat-Widget beim Öffnen automatisch angezeigt wird (z. B. "Hallo! Wie kann ich helfen?").
  • Default: "Hello! How can I help you today?"passen Sie das auf Ihre Sprache und Marke an.
  • Wichtig (Stolperstein): SMS und WhatsApp nutzen diese Begrüßung nicht. Dort wird die erste Antwort vom System-Prompt erzeugt. Eine zusätzliche Begrüßung würde dort die Anrede verdoppeln und ein zusätzliches Nachrichten-Segment kosten — die Begrüßung ist also bewusst nur fürs Web-Widget gedacht.

Schritt 3: KI-Modell und Parameter (Karte "KI-Modell")

Hier wählen Sie das Sprachmodell und stellen ein, wie der Agent generiert ("Modell wählen und Generierungs-Parameter anpassen").

  • Modell ("Modell")
  • Bestimmt das zugrunde liegende KI-Modell. Es stehen drei Optionen zur Auswahl:
    • GPT-4o"Recommended" (empfohlen): das stärkste Allround-Modell, beste Antwortqualität.
    • GPT-4o Mini"Fast & affordable" (schnell & günstig): spürbar günstiger und schneller, etwas weniger leistungsfähig.
    • GPT-4 Turbo"High performance" (hohe Leistung): leistungsstarke Alternative.
  • Default: GPT-4o.
  • Empfehlung: Bleiben Sie bei GPT-4o, solange Sie keinen klaren Grund haben zu wechseln. GPT-4o Mini lohnt sich bei hohem Nachrichtenaufkommen und einfachen Aufgaben (z. B. reine FAQ-Beantwortung), um Kosten zu sparen.
  • Hinweis: Für interne Hilfsaufgaben (z. B. kurze Klassifizierungen im Hintergrund) verwendet Prezio ohnehin automatisch ein schnelles, günstiges Modell ("fast model") — dafür müssen Sie nichts einstellen. Die obige Auswahl betrifft nur das Modell, das die eigentlichen Kundenantworten schreibt.

  • Max. Tokens ("Max. Tokens")

  • Begrenzt die maximale Länge einer einzelnen Antwort (Tokens sind grob "Wortbausteine"). Ein höherer Wert erlaubt längere Antworten, kann aber mehr kosten; ein niedriger Wert schneidet lange Antworten ab.
  • Default: 2000. Erlaubter Bereich im Formular: 100 bis 8000.
  • Empfehlung: 2000 ist für die meisten Chat- und Support-Fälle passend. Erhöhen Sie nur, wenn Antworten regelmäßig abgeschnitten wirken; senken Sie (z. B. auf 800–1000) für betont knappe Antworten, etwa per SMS.

  • Temperatur ("Temperatur")

  • Steuert, wie kreativ bzw. wie berechenbar der Agent formuliert. Der Hinweis im Feld lautet: "0 = deterministisch, 1 = kreativ". Niedrige Werte liefern konsistente, faktentreue Antworten; hohe Werte mehr Abwechslung und Varianz.
  • Default: 0,3. Erlaubter Bereich: 0 bis 1 (Schritte von 0,1).
  • Empfehlung: Für Support, Buchung, Bestellungen und alles Faktenbasierte 0,2–0,4 belassen. Werte über 0,7 nur für betont lockere, "kreative" Marketing-Töne — für sachliche Auskünfte ungeeignet, weil das Risiko erfundener Inhalte steigt.

  • Knowledge-Base nutzen (RAG) — Schalter ("kbToggle")

  • Wenn aktiv, schlägt der Agent bei jeder Nachricht relevante Textausschnitte ("Chunks") aus Ihrer Wissensdatenbank nach und nutzt diese für die Antwort. Das ist die Grundlage dafür, dass der Agent Ihre Speisekarte, Preise, Öffnungszeiten usw. wirklich kennt.
  • Default: an (eingeschaltet). Empfehlung: Eingeschaltet lassen, sobald Sie Inhalte hochladen — sonst kann der Agent nur aus dem System-Prompt heraus antworten.
  • Zur Funktionsweise: Der Abruf arbeitet "recall-first". Liegt nichts unter dem internen Ähnlichkeits-Schwellwert (Cosinus-Distanz, Standard 0,5), wird trotzdem der beste Beinahe-Treffer verwendet (im Entscheidungs-Fluss gelb als "Recall-Fallback" markiert). Verschmutzte, automatisch gecrawlte Seiten (Navigations- und Boilerplate-Text) erhöhen die Distanzen und können dazu führen, dass gute Treffer übersehen werden — laden Sie in dem Fall sauberen Text neu hoch. Die Feineinstellung des Schwellwerts erledigen Sie später bequem im Bereich "KI-Debug" über den Abruf-Test mit Ein-Klick-Speichern.

  • Top-K Chunks ("Top-K Chunks")

  • Legt fest, wie viele der relevantesten Textausschnitte in jede Antwort einfließen.
  • Default: 5. Erlaubter Bereich: 1 bis 20. Das Feld ist nur bedienbar, wenn die Knowledge-Base eingeschaltet ist.
  • Empfehlung: 5 ist ein guter Mittelwert. Mehr Chunks liefern mehr Kontext, kosten aber mehr Tokens und können den Fokus verwässern; weniger spart Kosten, riskiert aber fehlende Informationen.

  • Tagesbudget (USD) ("Tagesbudget", nur für Administratoren sichtbar)

  • Eine Kostenobergrenze pro Agent: Sobald die rollierenden 24-Stunden-Kosten diese Marke erreichen, antwortet der öffentliche Chat nicht mehr (er liefert technisch einen "HTTP 429"). Alle Anbieterkosten werden dabei mitgezählt.
  • Default: leer = kein Limit.
  • Empfehlung: Bei öffentlich erreichbaren Agenten ein Limit setzen (z. B. 10,00), um Kostenexplosionen durch Missbrauch oder ungewöhnlichen Andrang zu verhindern. Dieses Feld erscheint nur bei Administrator-Konten.

Schritt 4: Primärsprache festlegen (Reiter "Persona")

Die Sprache des Agenten konfigurieren Sie nicht auf dem "Basics"-Reiter, sondern unter "Persona" in der Karte "Sprachen".

  • Sprache automatisch erkennen ("autoDetect") — Schalter
  • Wenn aktiv, antwortet der Agent in der Sprache, in der der Kunde schreibt. Wenn deaktiviert, antwortet er immer in der Primärsprache.
  • Default: an. Empfehlung: Für gemischtes Publikum eingeschaltet lassen.

  • Primärsprache ("Primärsprache")

  • Auswahl aus: Deutsch, English, Français, Español, Italiano, Nederlands, Português, Türkçe — oder "(keine — Modell entscheidet)".
  • Die Bedeutung hängt vom Schalter oben ab:
    • Bei aktivierter automatischer Erkennung ist die Primärsprache der Rückfall, falls die Kundensprache nicht in Ihrer Liste der unterstützten Sprachen ist.
    • Bei deaktivierter Erkennung antwortet der Agent immer in dieser Sprache.
  • Default: "(keine — Modell entscheidet)".
  • Empfehlung: Setzen Sie die Sprache Ihres Hauptpublikums (z. B. Deutsch) als Primärsprache. Hinweis am Rande: Englische Antworten verwenden standardmäßig britischen Akzent und britische Schreibweise (bei Voice).

  • Unterstützte Sprachen ("Unterstützte Sprachen", nur sichtbar bei aktivierter automatischer Erkennung)

  • Klicken Sie die Sprachen an, zwischen denen der Agent erkennen und wechseln darf. Die Primärsprache ist immer mit ausgewählt (mit ★ markiert) und kann nicht abgewählt werden.
  • Empfehlung: Aktivieren Sie genau die Sprachen, die Ihre Kunden tatsächlich sprechen — nicht mehr.

Speichern

Klicken Sie unten auf "Agent erstellen". Prezio prüft die Pflichtfelder (Name vorhanden, System-Prompt mindestens 10 Zeichen). Bei Fehlern springt das Formular zurück auf den Reiter "Basics" und markiert die betroffenen Felder rot. Nach erfolgreichem Speichern landen Sie auf der Übersichtsseite des neuen Agenten — und alle bisher gesperrten Reiter (Wissen, FAQs, Leads usw.) sind nun freigeschaltet.

Tipps & Stolpersteine

  • Der System-Prompt entscheidet fast alles. Investieren Sie hier die meiste Zeit. Wenn der Agent Dinge erfindet, ergänzen Sie eine klare Regel wie "nutze ausschließlich die Wissensdatenbank, erfinde keine Preise/Produkte".
  • Begrüßung ≠ erste Antwort auf allen Kanälen. Die "Begrüßung" gilt nur fürs Web-Widget. SMS/WhatsApp begrüßen über den System-Prompt — doppelte Begrüßung vermeiden (kostet Segmente).
  • RAG ohne Inhalte bringt nichts. Der Schalter "Knowledge-Base nutzen" ist standardmäßig an, aber der Agent kann nur abrufen, was Sie auch hochgeladen haben. Pflegen Sie die Wissensdatenbank, sonst antwortet der Agent "im Blindflug".
  • Temperatur nicht hochdrehen. Für sachliche Auskünfte 0,2–0,4 lassen. Hohe Temperatur = mehr Phantasie = mehr Risiko falscher Aussagen.
  • Max. Tokens begrenzt die Länge, nicht die Wahrheit. Wirken Antworten abgeschnitten, erhöhen Sie den Wert (Obergrenze 8000); das macht Antworten aber nicht "klüger".
  • Reiter erst nach dem Speichern. "Wissen", "FAQs", "Leads" usw. funktionieren erst nach dem ersten Speichern — kein Fehler, nur die Reihenfolge.
  • Modellwechsel ist jederzeit reversibel. Probieren Sie ruhig GPT-4o Mini für Kostentests; wenn die Qualität nicht reicht, schalten Sie zurück auf GPT-4o.
  • Tagesbudget nur für Admins. Sehen Sie das Feld nicht, fehlt Ihrem Konto die Administrator-Rolle — wenden Sie sich an den Kontoinhaber.
  • Feinjustierung kommt später. Schwellwert für den Wissensabruf und Antwortqualität analysieren Sie nicht hier, sondern im Bereich "KI-Debug" (Abruf-Test mit empfohlenem Schwellwert und Ein-Klick-Speichern, Turn-Traces, Eval und Entscheidungs-Fluss).