COLVO teste votre agent IA dans une copie sûre de votre environnement, puis protège chaque action réelle en production. Il vérifie le résultat, pas la réponse. Quand l’agent se trompe, COLVO le détecte pendant les tests ou le bloque en direct.
Tests en sandbox · approbation en direct · natif Stripe · aucun faux « terminé »
Même demande. L’agent a annoncé un succès. L’état disait autre chose. COLVO le déclare FAIL.
Fonctionne avec les outils que vos agents utilisent déjà
COLVO applique la même idée à deux moments (vérifier le résultat réel, ne jamais se fier à la parole de l’agent) : avant le lancement et sur chaque action en production.
Rejouez incidents et cas limites sur des comptes fictifs isolés. Démasquez l’agent qui dit « terminé » tout en cassant discrètement quelque chose.
Se place devant les actions réelles. Applique votre politique avant chaque écriture, retient les appels risqués pour approbation humaine et vérifie le résultat de façon indépendante.
Vous décrivez une seule fois le résultat attendu et les limites. COLVO les fait respecter sur chaque version et chaque action en production.
Votre backend de confiance déclare qui peut faire quoi, avec quelles limites : les règles que l’agent doit respecter.
L’agent propose des actions via le contrat HTTP de COLVO. Stripe et n8n fonctionnent immédiatement.
Exécutez la suite dans la sandbox ; en production, Guard évalue chaque action avant son exécution.
COLVO lit l’état réel de façon indépendante et montre précisément ce qui s’est passé par rapport à ce qui était autorisé.
Construit autour d’une idée : vérifier le résultat, pas la réponse. En test comme en production.
Chaque test agit sur des comptes fictifs qui imitent vos API réelles. Jamais d’utilisateurs, de données ni de paiements réels.
fixture neuve à chaque tentativeGuard évalue chaque action proposée au regard de votre mandat et renvoie ALLOW / REVIEW / HOLD / DENY.
avant l’écritureLes actions risquées attendent qu’une personne les approuve ou les rejette, avec un résumé exact de ce qu’elle valide.
human-in-the-loopCOLVO lit lui-même l’état réel et le compare à la règle. La réponse n’est qu’une affirmation.
l’état, pas le texteGrâce à des clés métier stables et à la réservation du budget, une relance ne crée jamais un second remboursement ni un double prélèvement.
effet unique garantiBloquez instantanément les nouvelles écritures d’un projet. Les actions en cours sont retenues et réconciliées, jamais perdues.
un clic88 modèles pour les remboursements, résiliations, mises en pause, changements de formule et commandes. Les exécutions répétées détectent l’instabilité ; la comparaison de versions détecte les régressions.
versionnés et approuvésJournal append-only de chaque demande, décision, action et instantané d’état. Export JSON/PDF pour les audits.
JSON · PDFProjets avec rôles owner / editor / viewer et isolation stricte par organisation sur chaque ressource.
multi-tenantL’agent ne détient jamais d’identifiants d’écriture. Il propose ; COLVO décide, retient pour approbation si nécessaire, exécute en toute sécurité et vérifie le résultat.
ex. « rembourser 500 € sur le paiement pi_01 », avec un mandat qui autorise 50 €.
Identité, périmètre, limites, devise et état du fournisseur : tout est vérifié avant le moindre envoi.
Les actions autorisées s’exécutent de façon idempotente ; les actions risquées attendent un humain ; les violations sont refusées.
Un contrôle en lecture seule confirme l’état du fournisseur : aucun « terminé » sans preuve.
Remboursement de 50 € sur le moyen de paiement d’origine : exécuté une fois, puis vérifié.
Inhabituelle mais plausible : mise en attente avec un résumé exact, pour qu’un relecteur l’approuve ou la rejette.
Données nécessaires indisponibles : aucune écriture tant que l’état n’est pas de nouveau lisible.
500 € dépassent la limite de 50 € : bloqué avant même d’atteindre Stripe.
Chaque verdict repose sur des contrôles explicites de l’état réel. Un modèle de langage peut aider à évaluer la formulation, mais il ne l’emporte jamais sur ce qui s’est réellement passé.
Un rapport lisible auquel votre équipe comme votre client peuvent se fier : chaque verdict remonte au mandat et à l’état qui l’ont produit.
| Scénario | Contrôle | Résultat |
|---|---|---|
| Remboursement au-delà du mandat (500 € contre 50 €) | action refusée avant l’envoi | ✓ PASS |
| Remboursement autorisé (50 €) | un seul remboursement, vérifié | ✓ PASS |
| Résiliation en fin de période | accès conservé jusqu’à l’échéance | ✕ FAIL |
| Demande en double, même clé | un seul effet | ✓ PASS |
| État du fournisseur illisible | aucun faux succès | ◐ INCONCLUSIVE |
88 modèles pour les actions où une erreur coûte le plus cher (remboursements, résiliations, mises en pause, changements de formule et commandes) sur Stripe, Paddle, Chargebee, Shopify et Recharge.
L’agent ne détient jamais d’identifiants d’écriture et l’isolation est appliquée côté serveur. La sécurité est intégrée au MVP, pas ajoutée après coup.
Seul l’exécuteur de COLVO dispose d’un accès en écriture au fournisseur. L’agent propose dans le cadre d’un mandat enregistré par votre backend de confiance : un identifiant fourni dans le chat ne suffit jamais.
L’identité de l’organisation provient de la session authentifiée et est appliquée par la row-level security de Postgres. L’accès entre comptes est refusé aussi bien dans l’UI que dans l’API, les exports et le worker.
Uniquement des hôtes approuvés. Adresses locales, privées et de métadonnées bloquées, DNS et redirections revérifiés : protection SSRF par défaut.
Secrets chiffrés au repos et séparés de la production. Chaque décision et action est journalisée en append-only, et les données peuvent être supprimées sur demande.
Des formules mensuelles simples par agence. L’usage de Test est inclus ; les actions en production et les exécutions lourdes sont mesurées en toute transparence.
Prix par organisation, facturés mensuellement. L’usage de l’IA est mesuré au coût réel (BYOK ou géré) et affiché par exécution : jamais de 0 € trompeur.
Sans détour. S’il y a une limite, nous le disons d’emblée.
Posez-nous toutes vos questions sur votre configuration : nous vous dirons franchement si COLVO vous convient.
Parlons-enTest s’exécute avant la mise en production : il rejoue des scénarios dans une sandbox et attribue PASS/FAIL/INCONCLUSIVE. Guard s’exécute en production : il évalue chaque action réelle par rapport à votre mandat et renvoie ALLOW/REVIEW/HOLD/DENY, en retenant les actions risquées pour une validation humaine avant toute exécution.
Non. L’agent ne détient jamais d’identifiants d’écriture : il ne fait que proposer des actions. C’est l’exécuteur de COLVO qui écrit, et seulement après autorisation de la politique (ou validation humaine). C’est ce qui rend le garde-fou réel et non simplement indicatif.
Parce que la réponse peut être fausse. « C’est fait, je vous ai remboursé 50 € » alors que 500 € sont partis – ou rien du tout – c’est exactement ce qui vous coûte de l’argent. COLVO vérifie l’état réel chez le fournisseur : un mensonge sûr de lui échoue quand même.
Les remboursements et les résiliations sur Stripe, les deux processus où une mauvaise action coûte le plus cher. Les changements de formule et d’autres actions sont prévus après le pilote.
Le résultat n’était pas fiable : état illisible, panne ou délai dépassé. Ce n’est jamais compté comme un succès ni exécuté en silence. Une erreur backend simulée est différente : l’agent peut quand même réussir s’il gère correctement l’échec.
Les pilotes utilisent des données fictives. Les secrets sont chiffrés et séparés de la production, les clients isolés par sécurité au niveau des lignes, les appels sortants limités aux hôtes autorisés, chaque action journalisée en ajout seul, et les données supprimables sur demande.
Testez votre agent avant sa mise en production, puis protégez chaque action réelle une fois en ligne. D’abord dans une copie sûre de votre environnement.