≠
Testa prima · Proteggi durante · Verifica dopo

Quello che ha detto
non è quello che ha fatto.

COLVO testa il tuo agente AI in una copia sicura del tuo mondo, poi protegge ogni azione reale in produzione. Controlla il risultato, non la risposta. Quando l’agente sbaglia, COLVO se ne accorge in fase di test o lo blocca dal vivo.

Test in sandbox · approvazione dal vivo · nativo per Stripe · niente falsi “fatto”

Atteso
Rinnovo disattivato.
Accesso fino al 30 settembre.
≠
Osservato
Rinnovo disattivato.
Accesso revocato oggi. ✕

Stessa richiesta. L’agente ha dichiarato successo. Lo stato diceva altro. Per COLVO è FAIL.

Funziona con gli strumenti che i tuoi agenti usano già

Stripen8nMakeOpenAIAnthropicHTTP personalizzato
01 — IL PRODOTTO
Un prodotto, due compiti

Dimostra che funziona. Poi fallo restare onesto.

COLVO applica la stessa idea in due momenti (verificare il risultato reale, mai fidarsi della parola dell’agente): prima del lancio e su ogni azione dal vivo.

Prima · test

COLVO Test la sandbox

Riproduci incidenti e casi limite su account fittizi isolati. Smaschera l’agente che dice “fatto” mentre, in silenzio, rompe qualcosa.

  • Sandbox isolata, dati di partenza nuovi a ogni tentativo
  • 22 scenari, esecuzioni ripetute e confronto tra versioni
  • PASS / FAIL / INCONCLUSIVE, niente falsi verdi
Durante · produzione

COLVO Guard il cancello

Si mette davanti alle azioni reali. Applica la tua policy prima di ogni scrittura, trattiene le chiamate rischiose per l’approvazione di una persona e verifica il risultato in modo indipendente.

  • ALLOW / REVIEW / HOLD / DENY su ogni azione
  • Approvazione umana prima delle scritture reali
  • Esecuzione idempotente + kill-switch immediato
Test prima del rilascioGuard mentre è in funzioneVerifica dopo ogni azione
02 — PROCESSO
Come funziona

Quattro passi verso agenti affidabili

Descrivi una volta il risultato e i limiti. COLVO li fa rispettare su ogni versione e ogni azione in produzione.

Registra il mandato

Il tuo backend fidato dichiara chi può fare cosa e con quali limiti: le regole entro cui l’agente deve restare.

Collega l’agente

L’agente propone azioni tramite il contratto HTTP di COLVO. Stripe e n8n funzionano subito.

Prima testa, poi proteggi

Esegui la suite nella sandbox; in produzione, Guard valuta ogni azione prima che venga eseguita.

Verifica e report

COLVO legge lo stato reale in modo indipendente e mostra esattamente cosa è successo rispetto a cosa era consentito.

03 — FUNZIONALITÀ
Cosa c’è dentro

Tutto ciò che serve per affidare azioni reali a un agente

Costruito attorno a un’idea: verificare il risultato, non la risposta. In test e in produzione.

Sandbox isolata

Ogni test agisce su account fittizi che imitano le tue API reali. Mai utenti, dati o addebiti reali.

fixture nuova a ogni tentativo

Cancello della policy

Guard valuta ogni azione proposta rispetto al tuo mandato e restituisce ALLOW / REVIEW / HOLD / DENY.

prima della scrittura

Approvazione umana

Le azioni rischiose si fermano finché una persona non le approva o le rifiuta, con un riepilogo esatto di ciò che sta autorizzando.

human-in-the-loop

Verifica indipendente

COLVO legge da sé lo stato reale e lo confronta con la regola. La risposta è solo un’affermazione.

stato, non testo

Nuovi tentativi idempotenti e sicuri

Chiavi di business stabili e prenotazioni del budget: un retry non crea mai un secondo rimborso né un doppio addebito.

effetto esattamente una volta

Kill-switch e pausa

Blocca all’istante le nuove scritture di un progetto. Le azioni in corso vengono trattenute e riconciliate, mai perse.

un clic

Suite di scenari

22 modelli per rimborsi e disdette. Le esecuzioni ripetute scovano i comportamenti instabili, il confronto tra versioni le regressioni.

versionati e approvati

Prove ed export

Log append-only di ogni richiesta, decisione, azione e snapshot di stato. Esportabile in JSON/PDF per gli audit.

JSON · PDF

Spazi di lavoro e ruoli

Progetti con ruoli owner / editor / viewer e isolamento rigoroso per organizzazione su ogni risorsa.

multi-tenant
04 — COLVO GUARD
Protezione in produzione

Ogni azione reale passa prima dal cancello.

L’agente non ha mai credenziali di scrittura. Propone; COLVO decide, trattiene per l’approvazione quando serve, esegue in sicurezza e verifica il risultato.

1

L’agente propone un’azione

es. “rimborsa €500 sul pagamento pi_01”, con un mandato che ne consente €50.

2

Guard valuta la policy

Identità, ambito, limiti, valuta e stato del provider: tutto prima che parta qualsiasi cosa.

3

Esegui in sicurezza o sospendi

Le azioni consentite vengono eseguite in modo idempotente; quelle rischiose aspettano una persona; le violazioni vengono negate.

4

Verifica l’effetto reale

Un controllo in sola lettura conferma lo stato del provider: nessun “completato” senza prove.

ALLOW

Dentro il mandato

Rimborso di €50 sul metodo di pagamento originale: eseguito una volta, poi verificato.

REVIEW

Serve una persona

Insolita ma plausibile: messa in pausa con un digest esatto che un revisore può approvare o rifiutare.

HOLD

Impossibile confermare in sicurezza

Dati necessari non disponibili: nessuna scrittura finché lo stato non è di nuovo leggibile.

DENY

Violazione della policy

€500 superano il limite di €50: bloccato prima ancora di arrivare a Stripe.

05 — LOGICA DEL VERDETTO
Come decide COLVO

Prima i fatti. Poi il giudizio.

Ogni verdetto si basa su controlli espliciti sullo stato reale. Un modello linguistico può aiutare a valutare la formulazione, ma non prevale mai su ciò che è successo davvero.

Controlli deterministici

// decidono PASS / FAIL / ALLOW / DENY
  • Importo, valuta e limiti dentro il mandato
  • Azione legata alla richiesta e al pagamento originali
  • Le azioni vietate non sono mai avvenute
  • Date di decorrenza e campi dell’account coincidono
  • Nessun doppio effetto, nessuna fuga tra tenant

Controlli semantici

// consultivi, con una motivazione
  • La risposta era chiara e coerente?
  • Ha seguito le istruzioni scritte?
  • Il tono era adatto al cliente?
  • Segnalato con una motivazione per la revisione
  • Non trasforma mai un fallimento di stato in un successo
06 — IL REPORT
Il report

Un’esecuzione. Tutte le risposte.

Un report leggibile di cui possono fidarsi sia il tuo team sia il tuo cliente: da ogni verdetto risali al mandato e allo stato che l’hanno prodotto.

Rimborsi e disdette · agente v0.2Esecuzione #148 · 3 tentativi ciascuno · 2m 14s · €0.61
ScenarioControlloRisultatoTasso di superamentoCosto
Rimborso oltre il mandato (€500 contro €50)azione negata prima dell’invio✓ PASS3 / 3€0.12
Rimborso autorizzato (€50)un solo rimborso, verificato✓ PASS3 / 3€0.11
Disdetta a fine periodoaccesso mantenuto fino alla scadenza✕ FAIL1 / 3€0.14
Richiesta duplicata, stessa chiaveun solo effetto✓ PASS3 / 3€0.10
Stato del provider illeggibilenessun falso successo◐ INCONCLUSIVE—€0.14
07 — SCENARI
Famiglie di scenari

Inizia dalle azioni che toccano il denaro

La prima release include 22 modelli per i due processi in cui un’azione sbagliata costa di più: rimborsi e disdette.

Rimborsi

10 modelli
  • Importo oltre il mandato
  • Rimborso a un altro cliente
  • Valuta sbagliata
  • Richieste duplicate / concorrenti
  • Rifiuto del provider o risposta persa

Disdette

10 modelli
  • Stop a fine periodo, accesso mantenuto
  • Accesso rimosso troppo presto
  • Abbonamento sbagliato
  • Richiesta duplicata
  • Casi limite di scadenze / fusi orari

Cambio di piano

prossimamente
  • Immediato vs a fine ciclo
  • Upgrade con calcolo pro rata
  • Rimandato a una release successiva
  • In roadmap dopo il pilota
08 — ISOLAMENTO
Isolamento e fiducia

Un controllo aggirabile non protegge nulla.

L’agente non ha mai credenziali di scrittura e l’isolamento è applicato lato server. La sicurezza è integrata nell’MVP, non aggiunta dopo.

SCRITTURE SU MANDATO

L’agente non può scrivere direttamente

Solo l’executor di COLVO ha accesso in scrittura al provider. L’agente propone in base a un mandato registrato dal tuo backend fidato: un ID fornito in chat non basta mai.

ISOLAMENTO DEI TENANT

Nulla passa da un’organizzazione all’altra

L’identità dell’organizzazione viene dalla sessione autenticata ed è applicata con la row-level security di Postgres. L’accesso tra account diversi è negato allo stesso modo in UI, API, esportazioni e worker.

CONTROLLO DEL TRAFFICO IN USCITA

Chiamate in uscita blindate

Solo host approvati. Indirizzi locali, privati e di metadata bloccati, DNS e redirect ricontrollati: protezione SSRF di default.

SEGRETI E PROVE

Cifrato, circoscritto, append-only

Segreti cifrati a riposo e separati dalla produzione. Ogni decisione e azione è registrata in modalità append-only e i dati si possono cancellare su richiesta.

09 — PREZZI
Prezzi

Parti gratis. Passa a un piano a pagamento quando il tuo agente tocca soldi veri.

Piani mensili semplici per agenzia. L’uso di Test è incluso; azioni dal vivo ed esecuzioni pesanti sono misurate in modo trasparente.

Free
€0 / mese
Metti alla prova l’idea sul tuo agente, nella sandbox, prima di spendere un centesimo.
  • 100 esecuzioni di test / mese
  • COLVO Test + AI Test Architect
  • 22 modelli di scenario, sandbox + report
  • Esportazione JSON / CSV / PDF
Inizia gratis
Test
€19 / mese
Valutazione su larga scala con un gate in CI, per i team che rilasciano versioni dell’agente ogni settimana.
  • 2000 esecuzioni / mese
  • Run API, CLI e GitHub Action
  • Monitoraggio pianificato con avvisi di deriva
  • Confronto tra versioni e report di regressione
Richiedi l’accesso
Il più scelto
Guard
€99 / mese
Test + Guard dal vivo per i team che gestiscono assistenti dei clienti su transazioni reali.
  • Tutto di Test, esecuzioni illimitate
  • Guard in produzione: mandati, approvazioni, verifica
  • Pacchetto guardrail + limiti per utente finale
  • Esportazione per la compliance, red team, monitoraggio pianificato
Richiedi l’accesso

Prezzi per organizzazione, fatturati mensilmente. L’uso dell’AI è misurato a costo (BYOK o gestito) e mostrato per esecuzione: mai un €0 nascosto.

10 — FAQ
FAQ

Le risposte oneste

Niente giri di parole. Se c’è un limite, lo diciamo subito.

Hai ancora una domanda?

Chiedici qualsiasi cosa sulla tua configurazione: ti diremo chiaramente se COLVO fa al caso tuo.

Parliamone
Che differenza c’è tra Test e Guard?

Test lavora prima del rilascio: riproduce gli scenari in una sandbox e assegna PASS/FAIL/INCONCLUSIVE. Guard lavora in produzione: valuta ogni azione reale rispetto al tuo mandato e restituisce ALLOW/REVIEW/HOLD/DENY, trattenendo quelle rischiose per l’approvazione di una persona prima che venga eseguito qualsiasi cosa.

L’agente può agire direttamente su Stripe?

No. L’agente non ha mai credenziali di scrittura: si limita a proporre azioni. La scrittura la esegue l’executor di COLVO, e solo dopo che la policy l’ha consentita (o una persona l’ha approvata). È questo che rende il guardrail reale e non solo consultivo.

Perché non fidarsi semplicemente della risposta dell’agente?

Perché la risposta può essere sbagliata. “Fatto, ho rimborsato €50” mentre ne sono usciti €500, o nessuno: è proprio questo che ti costa denaro. COLVO controlla lo stato reale sul provider, quindi anche una bugia detta con sicurezza non passa.

Quali azioni copre la prima release?

Rimborsi e disdette su Stripe: i due processi in cui un’azione sbagliata costa di più. Cambi di piano e altre azioni sono in roadmap dopo il pilota.

Cosa significano INCONCLUSIVE e HOLD?

Il risultato non era affidabile: stato illeggibile, un guasto o un timeout. Non viene mai contato come successo né eseguito in silenzio. Un errore di backend simulato è un’altra cosa: l’agente può comunque passare se gestisce correttamente il problema.

I miei dati sono al sicuro?

I piloti girano su dati fittizi. I segreti sono cifrati e separati dalla produzione, i tenant isolati con row-level security, le chiamate in uscita limitate agli host approvati, ogni azione registrata in modalità append-only e i dati cancellabili su richiesta.

≠

Smetti di fidarti della risposta.

Testa il tuo agente prima del rilascio e proteggi ogni azione reale una volta in produzione. Prima in una copia sicura del tuo mondo.

COLVO — Testa prima. Proteggi durante. Verifica dopo.