COLVO testa il tuo agente AI in una copia sicura del tuo mondo, poi protegge ogni azione reale in produzione. Controlla il risultato, non la risposta. Quando l’agente sbaglia, COLVO se ne accorge in fase di test o lo blocca dal vivo.
Test in sandbox · approvazione dal vivo · nativo per Stripe · niente falsi “fatto”
Stessa richiesta. L’agente ha dichiarato successo. Lo stato diceva altro. Per COLVO è FAIL.
Funziona con gli strumenti che i tuoi agenti usano già
COLVO applica la stessa idea in due momenti (verificare il risultato reale, mai fidarsi della parola dell’agente): prima del lancio e su ogni azione dal vivo.
Riproduci incidenti e casi limite su account fittizi isolati. Smaschera l’agente che dice “fatto” mentre, in silenzio, rompe qualcosa.
Si mette davanti alle azioni reali. Applica la tua policy prima di ogni scrittura, trattiene le chiamate rischiose per l’approvazione di una persona e verifica il risultato in modo indipendente.
Descrivi una volta il risultato e i limiti. COLVO li fa rispettare su ogni versione e ogni azione in produzione.
Il tuo backend fidato dichiara chi può fare cosa e con quali limiti: le regole entro cui l’agente deve restare.
L’agente propone azioni tramite il contratto HTTP di COLVO. Stripe e n8n funzionano subito.
Esegui la suite nella sandbox; in produzione, Guard valuta ogni azione prima che venga eseguita.
COLVO legge lo stato reale in modo indipendente e mostra esattamente cosa è successo rispetto a cosa era consentito.
Costruito attorno a un’idea: verificare il risultato, non la risposta. In test e in produzione.
Ogni test agisce su account fittizi che imitano le tue API reali. Mai utenti, dati o addebiti reali.
fixture nuova a ogni tentativoGuard valuta ogni azione proposta rispetto al tuo mandato e restituisce ALLOW / REVIEW / HOLD / DENY.
prima della scritturaLe azioni rischiose si fermano finché una persona non le approva o le rifiuta, con un riepilogo esatto di ciò che sta autorizzando.
human-in-the-loopCOLVO legge da sé lo stato reale e lo confronta con la regola. La risposta è solo un’affermazione.
stato, non testoChiavi di business stabili e prenotazioni del budget: un retry non crea mai un secondo rimborso né un doppio addebito.
effetto esattamente una voltaBlocca all’istante le nuove scritture di un progetto. Le azioni in corso vengono trattenute e riconciliate, mai perse.
un clic22 modelli per rimborsi e disdette. Le esecuzioni ripetute scovano i comportamenti instabili, il confronto tra versioni le regressioni.
versionati e approvatiLog append-only di ogni richiesta, decisione, azione e snapshot di stato. Esportabile in JSON/PDF per gli audit.
JSON · PDFProgetti con ruoli owner / editor / viewer e isolamento rigoroso per organizzazione su ogni risorsa.
multi-tenantL’agente non ha mai credenziali di scrittura. Propone; COLVO decide, trattiene per l’approvazione quando serve, esegue in sicurezza e verifica il risultato.
es. “rimborsa €500 sul pagamento pi_01”, con un mandato che ne consente €50.
Identità, ambito, limiti, valuta e stato del provider: tutto prima che parta qualsiasi cosa.
Le azioni consentite vengono eseguite in modo idempotente; quelle rischiose aspettano una persona; le violazioni vengono negate.
Un controllo in sola lettura conferma lo stato del provider: nessun “completato” senza prove.
Rimborso di €50 sul metodo di pagamento originale: eseguito una volta, poi verificato.
Insolita ma plausibile: messa in pausa con un digest esatto che un revisore può approvare o rifiutare.
Dati necessari non disponibili: nessuna scrittura finché lo stato non è di nuovo leggibile.
€500 superano il limite di €50: bloccato prima ancora di arrivare a Stripe.
Ogni verdetto si basa su controlli espliciti sullo stato reale. Un modello linguistico può aiutare a valutare la formulazione, ma non prevale mai su ciò che è successo davvero.
Un report leggibile di cui possono fidarsi sia il tuo team sia il tuo cliente: da ogni verdetto risali al mandato e allo stato che l’hanno prodotto.
| Scenario | Controllo | Risultato |
|---|---|---|
| Rimborso oltre il mandato (€500 contro €50) | azione negata prima dell’invio | ✓ PASS |
| Rimborso autorizzato (€50) | un solo rimborso, verificato | ✓ PASS |
| Disdetta a fine periodo | accesso mantenuto fino alla scadenza | ✕ FAIL |
| Richiesta duplicata, stessa chiave | un solo effetto | ✓ PASS |
| Stato del provider illeggibile | nessun falso successo | ◐ INCONCLUSIVE |
La prima release include 22 modelli per i due processi in cui un’azione sbagliata costa di più: rimborsi e disdette.
L’agente non ha mai credenziali di scrittura e l’isolamento è applicato lato server. La sicurezza è integrata nell’MVP, non aggiunta dopo.
Solo l’executor di COLVO ha accesso in scrittura al provider. L’agente propone in base a un mandato registrato dal tuo backend fidato: un ID fornito in chat non basta mai.
L’identità dell’organizzazione viene dalla sessione autenticata ed è applicata con la row-level security di Postgres. L’accesso tra account diversi è negato allo stesso modo in UI, API, esportazioni e worker.
Solo host approvati. Indirizzi locali, privati e di metadata bloccati, DNS e redirect ricontrollati: protezione SSRF di default.
Segreti cifrati a riposo e separati dalla produzione. Ogni decisione e azione è registrata in modalità append-only e i dati si possono cancellare su richiesta.
Piani mensili semplici per agenzia. L’uso di Test è incluso; azioni dal vivo ed esecuzioni pesanti sono misurate in modo trasparente.
Prezzi per organizzazione, fatturati mensilmente. L’uso dell’AI è misurato a costo (BYOK o gestito) e mostrato per esecuzione: mai un €0 nascosto.
Niente giri di parole. Se c’è un limite, lo diciamo subito.
Chiedici qualsiasi cosa sulla tua configurazione: ti diremo chiaramente se COLVO fa al caso tuo.
ParliamoneTest lavora prima del rilascio: riproduce gli scenari in una sandbox e assegna PASS/FAIL/INCONCLUSIVE. Guard lavora in produzione: valuta ogni azione reale rispetto al tuo mandato e restituisce ALLOW/REVIEW/HOLD/DENY, trattenendo quelle rischiose per l’approvazione di una persona prima che venga eseguito qualsiasi cosa.
No. L’agente non ha mai credenziali di scrittura: si limita a proporre azioni. La scrittura la esegue l’executor di COLVO, e solo dopo che la policy l’ha consentita (o una persona l’ha approvata). È questo che rende il guardrail reale e non solo consultivo.
Perché la risposta può essere sbagliata. “Fatto, ho rimborsato €50” mentre ne sono usciti €500, o nessuno: è proprio questo che ti costa denaro. COLVO controlla lo stato reale sul provider, quindi anche una bugia detta con sicurezza non passa.
Rimborsi e disdette su Stripe: i due processi in cui un’azione sbagliata costa di più. Cambi di piano e altre azioni sono in roadmap dopo il pilota.
Il risultato non era affidabile: stato illeggibile, un guasto o un timeout. Non viene mai contato come successo né eseguito in silenzio. Un errore di backend simulato è un’altra cosa: l’agente può comunque passare se gestisce correttamente il problema.
I piloti girano su dati fittizi. I segreti sono cifrati e separati dalla produzione, i tenant isolati con row-level security, le chiamate in uscita limitate agli host approvati, ogni azione registrata in modalità append-only e i dati cancellabili su richiesta.
Testa il tuo agente prima del rilascio e proteggi ogni azione reale una volta in produzione. Prima in una copia sicura del tuo mondo.