COLVO prueba tu agente de IA en una copia segura de tu mundo y luego protege cada acción real en producción. Comprueba el resultado, no la respuesta. Cuando el agente se equivoca, COLVO lo detecta en las pruebas o lo bloquea en directo.
Pruebas en sandbox · aprobación en directo · nativo para Stripe · sin falsos “hecho”
Misma solicitud. El agente informó de éxito. El estado decía otra cosa. Para COLVO es FAIL.
Funciona con las herramientas que tus agentes ya usan
COLVO aplica la misma idea en dos momentos (verificar el resultado real, nunca fiarse de la palabra del agente): antes del lanzamiento y en cada acción en directo.
Reproduce incidentes y casos límite sobre cuentas ficticias aisladas. Descubre al agente que dice “hecho” mientras, en silencio, rompe algo.
Se sitúa delante de las acciones reales. Aplica tu política antes de cada escritura, retiene las llamadas arriesgadas para que una persona las apruebe y verifica el resultado de forma independiente.
Describe una sola vez el resultado y los límites. COLVO los hace cumplir en cada versión y en cada acción en directo.
Tu backend de confianza declara quién puede hacer qué y con qué límites: las reglas dentro de las que debe quedarse el agente.
El agente propone acciones a través del contrato HTTP de COLVO. Stripe y n8n funcionan desde el primer momento.
Ejecuta la suite en la sandbox; en producción, Guard evalúa cada acción antes de que se ejecute.
COLVO lee el estado real de forma independiente y muestra exactamente qué ha pasado frente a lo que estaba permitido.
Construido en torno a una idea: verificar el resultado, no la respuesta. En pruebas y en producción.
Cada prueba actúa sobre cuentas ficticias que imitan tus API reales. Nunca usuarios, datos ni cargos reales.
fixture nueva en cada intentoGuard evalúa cada acción propuesta frente a tu mandato y devuelve ALLOW / REVIEW / HOLD / DENY.
antes de la escrituraLas acciones arriesgadas se detienen hasta que una persona las aprueba o las rechaza, con un resumen exacto de lo que está autorizando.
human-in-the-loopCOLVO lee por su cuenta el estado real y lo compara con la regla. La respuesta es solo una afirmación.
estado, no textoClaves de negocio estables y reservas de presupuesto: un reintento nunca crea un segundo reembolso ni un doble cargo.
efecto exactamente una vezDetén al instante las nuevas escrituras de un proyecto. Las acciones en curso se retienen y se concilian; nunca se pierden.
un clic88 plantillas para reembolsos, cancelaciones, pausas, cambios de plan y pedidos. Las ejecuciones repetidas detectan la inestabilidad; la comparación de versiones, las regresiones.
versionados y aprobadosRegistro append-only de cada solicitud, decisión, acción e instantánea de estado. Exportable a JSON/PDF para auditorías.
JSON · PDFProyectos con roles owner / editor / viewer y aislamiento estricto por organización en cada recurso.
multi-tenantEl agente nunca tiene credenciales de escritura. Propone; COLVO decide, retiene para aprobación cuando hace falta, ejecuta de forma segura y verifica el resultado.
p. ej., “reembolsa €500 del pago pi_01”, con un mandato que permite €50.
Identidad, alcance, límites, moneda y estado del proveedor: todo antes de enviar nada.
Las acciones permitidas se ejecutan de forma idempotente; las arriesgadas esperan a una persona; las infracciones se deniegan.
Una comprobación de solo lectura confirma el estado del proveedor: ningún “completado” sin pruebas.
Reembolso de €50 en el método de pago original: ejecutado una vez y luego verificado.
Inusual pero plausible: en pausa con un resumen exacto para que un revisor lo apruebe o lo rechace.
Faltan datos necesarios: no se escribe nada hasta que el estado vuelva a ser legible.
€500 supera el límite de €50: bloqueado antes de llegar a Stripe.
Cada veredicto se basa en comprobaciones explícitas sobre el estado real. Un modelo de lenguaje puede ayudar a valorar la redacción, pero nunca se impone a lo que ocurrió de verdad.
Un informe legible en el que pueden confiar tanto tu equipo como tu cliente: desde cada veredicto llegas al mandato y al estado que lo produjeron.
| Escenario | Comprobación | Resultado |
|---|---|---|
| Reembolso por encima del mandato (€500 frente a €50) | acción denegada antes del envío | ✓ PASS |
| Reembolso autorizado (€50) | un solo reembolso, verificado | ✓ PASS |
| Cancelación al final del periodo | acceso mantenido hasta el vencimiento | ✕ FAIL |
| Solicitud duplicada, misma clave | un solo efecto | ✓ PASS |
| Estado del proveedor ilegible | sin falso éxito | ◐ INCONCLUSIVE |
88 plantillas para las acciones en las que un error cuesta más (reembolsos, cancelaciones, pausas, cambios de plan y pedidos) en Stripe, Paddle, Chargebee, Shopify y Recharge.
El agente nunca tiene credenciales de escritura y el aislamiento se aplica en el servidor. La seguridad está integrada en el MVP, no añadida después.
Solo el executor de COLVO tiene acceso de escritura al proveedor. El agente propone según un mandato registrado por tu backend de confianza: un ID proporcionado en el chat nunca es suficiente.
La identidad de la organización procede de la sesión autenticada y se aplica con la row-level security de Postgres. El acceso entre cuentas se deniega por igual en la UI, la API, las exportaciones y el worker.
Solo hosts aprobados. Direcciones locales, privadas y de metadatos bloqueadas; DNS y redirecciones se vuelven a comprobar: protección SSRF por defecto.
Secretos cifrados en reposo y separados de producción. Cada decisión y acción se registra en modo append-only, y los datos se pueden eliminar bajo petición.
Planes mensuales sencillos por agencia. El uso de Test está incluido; las acciones en directo y las ejecuciones intensivas se miden con transparencia.
Precios por organización, facturados mensualmente. El uso de IA se mide a precio de coste (BYOK o gestionado) y se muestra por ejecución: nunca un €0 oculto.
Sin rodeos. Si hay un límite, lo decimos desde el principio.
Pregúntanos lo que quieras sobre tu configuración: te diremos claramente si COLVO encaja contigo.
Habla con nosotrosTest se ejecuta antes del lanzamiento: reproduce escenarios contra un sandbox y califica con PASS/FAIL/INCONCLUSIVE. Guard se ejecuta en producción: evalúa cada acción real contra tu mandato y responde ALLOW/REVIEW/HOLD/DENY, reteniendo las arriesgadas para aprobación humana antes de que se ejecute nada.
No. El agente nunca tiene credenciales de escritura: solo propone acciones. El ejecutor de COLVO hace la escritura, y solo después de que la política la permita (o una persona la apruebe). Eso es lo que hace que la barrera sea real y no solo un consejo.
Porque la respuesta puede estar mal. «Hecho, te he reembolsado 50 €» mientras salieron 500 € (o nada) es justo lo que te cuesta dinero. COLVO comprueba el estado real en el proveedor, así que una mentira dicha con seguridad también falla.
Reembolsos y cancelaciones en Stripe: los dos procesos donde una acción equivocada sale más cara. Los cambios de plan y otras acciones están en la hoja de ruta después del piloto.
El resultado no era fiable: estado ilegible, un fallo o un tiempo de espera agotado. Nunca cuenta como éxito ni se ejecuta en silencio. Un error de backend simulado es distinto: el agente puede aprobar igualmente si gestiona bien el fallo.
Los pilotos funcionan con datos ficticios. Los secretos están cifrados y separados de producción, los clientes aislados con seguridad a nivel de fila, las llamadas salientes limitadas a hosts aprobados, cada acción registrada en modo solo anexar y los datos se pueden borrar a petición.
Prueba tu agente antes de lanzarlo y protege cada acción real una vez en producción. Primero, en una copia segura de tu mundo.