Ein KI-Modell zu bitten, etwas nicht zu tun, ist keine Garantie, dass es das auch unterlässt. Bei einem lustigen Bild ist das egal. Bei einem Telefongespräch nicht, denn ein Telefongespräch hat keine Rückgängig-Taste.
Ein Telefongespräch hat keine Rückgängig-Taste
Einen Chatbot können Sie neu antworten lassen. Wer am Telefon gerade etwas gesagt hat, kann es nicht zurücknehmen. Unser KI-Telefonassistent erzeugt seine Antwort außerdem direkt als Sprache: Er überlegt, was er sagt, und sagt es in einem Zug. Dazwischen gibt es keinen Moment, in dem wir den Satz vorher prüfen können.
Was der Assistent sagt, muss also beim ersten Mal stimmen. Und manche Dinge müssen immer klappen.
Anweisungen verlieren gegen Reflexe
In Das Paradox des roten Katers haben wir beschrieben, wie schwierig es ist, einem KI-Modell viele Anweisungen auf einmal mitzugeben. Am Telefon kommt Zeitdruck hinzu. Und unter Zeitdruck setzt sich der Reflex des Modells manchmal gegen die Anweisung durch.
Besonders anfällig sind Anweisungen, die etwas verbieten, etwa „Kündige die Weiterleitung noch nicht an“. Das Modell will hilfsbereit sein, und hilfsbereit bedeutet für ein Modell: sofort handeln.
Ist „Danke, schönen Tag noch“ ein Ja?
Nehmen wir das Weiterverbinden. Der Assistent fragt: „Soll ich Sie weiterverbinden?“ Der Anrufer antwortet: „Danke, schönen Tag noch.“ Oder stellt eine Gegenfrage: „Bieten Sie dafür auch Unterstützung an?“
Ein Mensch hört sofort, dass das kein Ja ist. Für ein Modell, das gern helfen will, konnte es durchaus als Ja zählen. Dann wurde weiterverbunden, obwohl der Anrufer eigentlich auflegen wollte oder noch eine Frage hatte.
Deshalb entscheidet jetzt der Code, ob weiterverbunden wird, und nicht nur die Anweisung:
- nur nach einem klaren Ja wird weiterverbunden
- bei einer Gegenfrage oder einer vagen Antwort fragt der Assistent noch einmal nach
- bei einer Verabschiedung beendet er das Gespräch freundlich
Das Modell sagt es, der Code bestimmt es
Das ist das Prinzip hinter allem, was in einem Gespräch nicht schiefgehen darf. Das Modell bestimmt, wie etwas gesagt wird: freundlich, in der Sprache des Anrufers, im richtigen Ton. Der Code bestimmt, was passieren darf: ob weiterverbunden wird, welche Angaben noch fehlen, was zuerst geprüft werden muss.
Steht eine Regel nur im Prompt, hoffen wir, dass das Modell sich daran hält. Steht sie im Code, kann der Assistent schlicht nicht weiterverbinden, solange der Anrufer nicht Ja gesagt hat.
Englisch für den Assistenten, die eigene Sprache für den Anrufer
Noch eine Lektion. Während eines Gesprächs geben wir dem Assistenten manchmal einen zusätzlichen Hinweis, zum Beispiel nachdem er etwas nachgeschlagen hat. Dieser Hinweis ist immer eine englische Beschreibung dessen, was er tun soll, nie ein fertiger niederländischer Satz.
Der Grund: Das Modell wählt seine Sprache danach, was der Anrufer sagt. Steht dort ein niederländischer Satz, bekommt ein deutscher Anrufer plötzlich Niederländisch zu hören. Beschreibt man nur die Absicht, sagt der Assistent es in der Sprache des Anrufers.
Hilfsbereit und zuverlässig
Entscheidend ist die Balance. Legt man zu viel im Code fest, wirkt der Assistent wie ein Sprachmenü. Überlässt man zu viel dem Prompt, improvisiert er dort, wo er es nicht darf. Wir lassen das Modell tun, was es gut kann, nämlich ein natürliches Gespräch führen, und legen im Code fest, was immer klappen muss.
Neugierig, wie sich das anfühlt? Probieren Sie es selbst auf unserer Website aus.