Ihr Agent gibt etwas Seltsames zurück. War es der Prompt, ein Tool-Aufruf, der abgelaufen ist, oder eine Antwort, die Ihr Code nicht parsen konnte? Ohne Ablaufverfolgungen raten Sie nur.
Ein Kunde fragt den neuen KI-basierten Support-Assistenten eines Unternehmens, ob ein vor 15 Tagen gekauftes Abonnement für eine Rückerstattung in Frage kommt. Der Assistent antwortet, indem er erklärt, dass das Unternehmen ein 30-tägiges Rückerstattungsfenster anbietet, den Kündigungsprozess beschreibt und verspricht, dass das Geld innerhalb von fünf Werktagen eintreffen wird. In Wirklichkeit erlaubt das Unternehmen Rückerstattungen nur innerhalb von 14 Tagen. Der Assistent hat eine falsche Zusage aus dem Nichts erfunden.
Halluzination im Kontext von LLMs sind generierte Informationen, die sachlich falsch, erfunden oder inkonsistent mit dem Material sind, das das Modell verwenden soll. Die gesamte Antwort mag nicht falsch sein, aber ein kleines erfundenes Detail kann der Teil sein, auf den sich der Leser verlässt.
Fehler fallen in drei Kategorien: eine faktische Halluzination widerspricht der Realität; eine Treue-Halluzination betrifft die Beziehung zwischen der Antwort und den bereitgestellten Beweisen; Erfindung beinhaltet das Erfinden von etwas wie einem Richtlinienabschnitt oder einem Forschungspapier. Diese Kategorien überschneiden sich.
Schlüsselentitäten: Unternehmen: ByteByteGo, Sentry | Personen: Serge