Detto vs fatto: la risposta del tuo agente AI non è una prova
Un agente può essere gentile, sicuro di sé e completamente in errore su ciò che ha fatto. Ecco perché COLVO legge l’account da solo dopo ogni azione.

La risposta che sembrava giusta
Un cliente scrive: “Interrompete il rinnovo, ma lasciatemi l’accesso fino alla scadenza.” L’agente risponde che è fatto e che l’accesso resta fino al 30 ottobre. Ogni giudice LLM che abbiamo provato ha valutato corretta quella risposta.
La risposta era giusta. L’azione no. L’abbonamento era stato annullato subito.
Atteso vs osservato
COLVO non chiede all’agente cosa è successo. Legge Stripe — con la propria chiave limitata — e confronta campo per campo:
| Campo | Atteso | Osservato |
|---|---|---|
| cancel_at_period_end | true | false |
| status | active | canceled |
| access_enabled | true | false |
Quattro modi in cui le risposte si allontanano dalla realtà
- Il parametro sbagliato. “Mantieni l’accesso” tradotto in una disdetta immediata invece che a fine periodo.
- Un errore nascosto. La chiamata allo strumento è fallita; l’agente ha comunque dichiarato successo.
- Un rifiuto spacciato per fatto. Guard ha detto DENY, l’agente ha detto “rimborsato”.
- Una seconda azione che nessuno ha chiesto. Un nuovo tentativo che ha proposto lo stesso rimborso due volte.
Nessuno di questi è visibile nella trascrizione. Tutti sono visibili nell’account.
Cosa fare
Testa lo stato, non la trascrizione. Lascia che siano i controlli deterministici a decidere il verdetto e tieni i giudici AI come consulenti: un giudice può segnalare una risposta sgarbata, ma non deve mai trasformare un FAIL in un PASS. E in produzione metti un cancello tra l’agente e il denaro, così un’azione sbagliata si ferma prima che accada invece di essere spiegata dopo.


