Produkt

Gesagt vs. getan: Die Antwort Ihres KI-Agenten ist kein Beweis

Ein Agent kann höflich, selbstsicher und völlig falsch darin sein, was er getan hat. Deshalb liest COLVO nach jeder Aktion das Konto selbst aus.

·2 Min. Lesezeit·COLVO team
Gesagt vs. getan: Die Antwort Ihres KI-Agenten ist kein Beweis

Die Antwort, die gut aussah

Ein Kunde schreibt: „Bitte stoppen Sie meine Verlängerung, aber lassen Sie mir den Zugang bis zum Ablauf.“ Der Agent antwortet, das sei erledigt und der Zugang bleibe bis zum 30. Oktober. Jeder LLM-Judge, den wir ausprobiert haben, bewertete diese Antwort als korrekt.

Die Antwort war richtig. Die Aktion nicht. Das Abonnement war sofort gekündigt worden.

Erwartet vs. beobachtet

COLVO fragt den Agenten nicht, was passiert ist. Es liest Stripe aus – mit dem eigenen eingeschränkten Schlüssel – und vergleicht Feld für Feld:

FeldErwartetBeobachtet
cancel_at_period_endtruefalse
statusactivecanceled
access_enabledtruefalse
In 30 Sekunden sehen, wie es passiertKlicken Sie sich durch ein echtes FAIL eines fehlerhaften Kündigungsagenten – ohne Registrierung.
Demo öffnen →

Vier Arten, wie Antworten von der Realität abweichen

  1. Der falsche Parameter. „Zugang behalten“ wurde zu einer sofortigen Kündigung statt einer zum Periodenende.
  2. Ein verschluckter Fehler. Der Tool-Aufruf schlug fehl; der Agent meldete trotzdem Erfolg.
  3. Eine Ablehnung als erledigt gemeldet. Guard sagte DENY, der Agent sagte „erstattet“.
  4. Eine zweite Aktion, um die niemand gebeten hat. Eine Wiederholung, die dieselbe Erstattung zweimal vorschlug.

Nichts davon ist im Transkript sichtbar. Alles davon ist im Konto sichtbar.

Was dagegen hilft

Testen Sie den Zustand, nicht das Transkript. Lassen Sie deterministische Prüfungen über das Urteil entscheiden und KI-Judges nur beraten: Ein Judge kann eine unhöfliche Antwort markieren, darf aber nie ein FAIL in ein PASS verwandeln. Und setzen Sie in der Produktion eine Schranke zwischen Agent und Geld, damit eine falsche Aktion gestoppt wird, bevor sie passiert, statt hinterher erklärt zu werden.

COLVO team
Wir bauen Tests und Guardrails für KI-Agenten, die mit Geld umgehen.
≠

Verlassen Sie sich nicht auf die Antwort.

Testen Sie Ihren Agenten vor dem Release – und schützen Sie jede echte Aktion, sobald er live ist. Zuerst in einer sicheren Kopie Ihrer Umgebung.