COLVO testet Ihren KI-Agenten in einer sicheren Kopie Ihrer Umgebung – und schützt danach jede echte Aktion in der Produktion. Geprüft wird das Ergebnis, nicht die Antwort. Liegt der Agent falsch, erkennt COLVO das im Test oder blockiert es live.
Tests in der Sandbox · Live-Freigabe · Stripe-nativ · kein falsches „erledigt“
Gleiche Anfrage. Der Agent meldete Erfolg. Der Zustand sagt etwas anderes. COLVO bewertet es als FAIL.
Funktioniert mit den Tools, die Ihre Agenten bereits nutzen
COLVO setzt dieselbe Idee an zwei Stellen um – das echte Ergebnis prüfen, nie dem Wort des Agenten vertrauen: vor dem Launch und bei jeder Live-Aktion.
Spielen Sie Vorfälle und Grenzfälle gegen isolierte Testkonten nach. Entlarven Sie den Agenten, der „erledigt“ sagt, während er still etwas kaputt macht.
Steht vor echten Aktionen. Wendet Ihre Policy vor jedem Schreibvorgang an, hält riskante Aufrufe zur Freigabe durch einen Menschen zurück und prüft das Ergebnis unabhängig.
Sie beschreiben das Ergebnis und die Grenzen einmal. COLVO setzt sie bei jeder Version und jeder Live-Aktion durch.
Ihr vertrauenswürdiges Backend legt fest, wer was mit welchen Limits tun darf – die Regeln, innerhalb derer der Agent bleiben muss.
Der Agent schlägt Aktionen über den HTTP-Vertrag von COLVO vor. Stripe und n8n funktionieren sofort.
Führen Sie die Suite in der Sandbox aus; live bewertet Guard jede Aktion, bevor sie ausgeführt wird.
COLVO liest den echten Zustand unabhängig aus und zeigt genau, was passiert ist und was erlaubt war.
Gebaut um eine Idee: das Ergebnis prüfen, nicht die Antwort – im Test und in der Produktion.
Jeder Test arbeitet mit Testkonten, die Ihre echten APIs nachbilden. Nie echte Nutzer, Daten oder Abbuchungen.
frische Fixture pro VersuchGuard bewertet jede vorgeschlagene Aktion anhand Ihres Mandats und gibt ALLOW / REVIEW / HOLD / DENY zurück.
vor dem SchreibvorgangRiskante Aktionen warten, bis eine Person sie freigibt oder ablehnt – mit einer exakten Zusammenfassung dessen, was freigegeben wird.
Human-in-the-LoopCOLVO liest den tatsächlichen Zustand selbst aus und vergleicht ihn mit der Regel. Die Antwort ist nur eine Behauptung.
Zustand, nicht TextStabile Business-Schlüssel und Budget-Reservierungen sorgen dafür, dass eine Wiederholung nie eine zweite Erstattung oder eine doppelte Abbuchung erzeugt.
Wirkung genau einmalStoppen Sie neue Schreibvorgänge eines Projekts sofort. Laufende Aktionen werden angehalten und abgeglichen, nie verloren.
ein Klick88 Vorlagen für Erstattungen, Kündigungen, Pausierungen, Planwechsel und Bestellungen. Wiederholte Läufe decken instabiles Verhalten auf, Versionsvergleiche Regressionen.
versioniert und freigegebenAppend-only-Log jeder Anfrage, Entscheidung, Aktion und jedes Zustands-Snapshots. Export als JSON/PDF für Audits.
JSON · PDFProjekte mit den Rollen Owner / Editor / Viewer und strikter Isolierung pro Organisation bei jeder Ressource.
mandantenfähigDer Agent hat nie Schreibzugriff. Er schlägt vor; COLVO entscheidet, hält bei Bedarf zur Freigabe zurück, führt sicher aus und prüft das Ergebnis.
z. B. „Erstatte 500 € für Zahlung pi_01“ – bei einem Mandat, das 50 € erlaubt.
Identität, Geltungsbereich, Limits, Währung und Anbieterzustand – alles, bevor etwas gesendet wird.
Erlaubte Aktionen laufen idempotent; riskante warten auf einen Menschen; Verstöße werden abgelehnt.
Eine Prüfung mit reinem Lesezugriff bestätigt den Zustand beim Anbieter – kein „abgeschlossen“ ohne Nachweis.
Erstattung von 50 € auf die ursprüngliche Zahlungsmethode – einmal ausgeführt, dann geprüft.
Ungewöhnlich, aber plausibel – angehalten mit exakter Zusammenfassung, bis ein Prüfer freigibt oder ablehnt.
Benötigte Daten nicht verfügbar – kein Schreibvorgang, bis der Zustand wieder lesbar ist.
500 € überschreiten das Limit von 50 € – blockiert, bevor es Stripe überhaupt erreicht.
Jedes Urteil beruht auf expliziten Prüfungen des echten Zustands. Ein Sprachmodell kann helfen, die Formulierung zu bewerten – es setzt sich nie über das hinweg, was tatsächlich passiert ist.
Ein lesbarer Bericht, dem Ihr Team und Ihr Kunde vertrauen können – von jedem Urteil zurückverfolgbar bis zum Mandat und zum Zustand, die es ergeben haben.
| Szenario | Prüfung | Ergebnis |
|---|---|---|
| Erstattung über dem Mandat (500 € statt 50 €) | Aktion vor dem Senden abgelehnt | ✓ PASS |
| Erstattung autorisiert (50 €) | eine Erstattung, geprüft | ✓ PASS |
| Kündigung zum Periodenende | Zugang bleibt bis zum Ablauf | ✕ FAIL |
| Doppelte Anfrage, gleicher Schlüssel | nur eine Wirkung | ✓ PASS |
| Anbieterzustand nicht lesbar | kein falscher Erfolg | ◐ INCONCLUSIVE |
88 Vorlagen für die Aktionen, bei denen ein Fehler am meisten kostet – Erstattungen, Kündigungen, Pausierungen, Planwechsel und Bestellungen – auf Stripe, Paddle, Chargebee, Shopify und Recharge.
Der Agent hat nie Schreibzugriff, und die Isolierung wird serverseitig durchgesetzt. Sicherheit ist Teil des MVP, nicht nachträglich angebaut.
Nur der Executor von COLVO hat Schreibzugriff beim Anbieter. Der Agent schlägt auf Basis eines Mandats vor, das Ihr vertrauenswürdiges Backend registriert hat – eine im Chat genannte ID reicht nie aus.
Die Identität der Organisation stammt aus der authentifizierten Sitzung und wird mit Row-Level Security in Postgres durchgesetzt. Kontoübergreifender Zugriff wird in UI, API, Export und Worker gleichermaßen verweigert.
Nur freigegebene Hosts. Lokale, private und Metadaten-Adressen gesperrt, DNS und Redirects erneut geprüft – standardmäßig gegen SSRF gehärtet.
Secrets sind im Ruhezustand verschlüsselt und von der Produktion getrennt. Jede Entscheidung und Aktion wird append-only protokolliert, und Daten lassen sich auf Anfrage löschen.
Einfache Monatspläne pro Agentur. Test-Nutzung inklusive; Live-Aktionen und aufwendige Läufe werden transparent abgerechnet.
Preise pro Organisation, monatlich abgerechnet. KI-Nutzung wird zum Selbstkostenpreis abgerechnet (BYOK oder verwaltet) und pro Lauf angezeigt – nie versteckte 0 €.
Keine Schönfärberei. Wenn es eine Grenze gibt, sagen wir es vorab.
Fragen Sie uns alles zu Ihrem Setup – wir sagen Ihnen offen, ob COLVO passt.
Sprechen Sie uns anTest läuft vor dem Release – es spielt Szenarien gegen eine Sandbox ab und bewertet mit PASS/FAIL/INCONCLUSIVE. Guard läuft in Produktion – es prüft jede echte Aktion gegen Ihr Mandat und antwortet mit ALLOW/REVIEW/HOLD/DENY; riskante Aktionen warten auf eine menschliche Freigabe, bevor etwas ausgeführt wird.
Nein. Der Agent hält nie Schreibrechte – er schlägt Aktionen nur vor. Der Executor von COLVO führt den Schreibvorgang aus, und zwar erst, wenn die Richtlinie ihn erlaubt (oder ein Mensch ihn freigibt). Erst das macht die Leitplanke verbindlich statt nur beratend.
Weil die Antwort falsch sein kann. „Erledigt, ich habe 50 € erstattet“, während 500 € rausgingen – oder gar nichts –, genau das kostet Sie Geld. COLVO prüft den echten Zustand beim Anbieter, also fällt auch eine selbstbewusste Lüge durch.
Erstattungen und Kündigungen auf Stripe – die beiden Abläufe, in denen eine falsche Aktion am teuersten ist. Tarifwechsel und weitere Aktionen stehen nach dem Pilot auf der Roadmap.
Dem Ergebnis war nicht zu trauen – unlesbarer Zustand, ein Fehler oder ein Timeout. Das zählt nie als Erfolg und wird nie stillschweigend ausgeführt. Ein simulierter Backend-Fehler ist etwas anderes: Der Agent kann trotzdem bestehen, wenn er den Fehler richtig behandelt.
Pilotprojekte laufen mit Testdaten. Secrets sind verschlüsselt und von der Produktion getrennt, Mandanten per Row-Level-Security isoliert, ausgehende Aufrufe auf freigegebene Hosts beschränkt, jede Aktion wird nur anhängend protokolliert, und Daten werden auf Anfrage gelöscht.
Testen Sie Ihren Agenten vor dem Release – und schützen Sie jede echte Aktion, sobald er live ist. Zuerst in einer sicheren Kopie Ihrer Umgebung.