≠
Prueba antes · Protege durante · Verifica después

Lo que dijo
no es lo que hizo.

COLVO prueba tu agente de IA en una copia segura de tu mundo y luego protege cada acción real en producción. Comprueba el resultado, no la respuesta. Cuando el agente se equivoca, COLVO lo detecta en las pruebas o lo bloquea en directo.

Pruebas en sandbox · aprobación en directo · nativo para Stripe · sin falsos “hecho”

Esperado
Renovación desactivada.
Acceso hasta el 30 de septiembre.
≠
Observado
Renovación desactivada.
Acceso revocado hoy. ✕

Misma solicitud. El agente informó de éxito. El estado decía otra cosa. Para COLVO es FAIL.

El agente dijo “hecho”. Yo comprobé lo que pasó de verdad.

Funciona con las herramientas que tus agentes ya usan

Stripen8nMakeOpenAIAnthropicHTTP personalizado
01 — EL PRODUCTO
Un producto, dos tareas

Demuestra que funciona. Y luego mantenlo honesto.

COLVO aplica la misma idea en dos momentos (verificar el resultado real, nunca fiarse de la palabra del agente): antes del lanzamiento y en cada acción en directo.

Antes · pruebas

COLVO Test la sandbox

Reproduce incidentes y casos límite sobre cuentas ficticias aisladas. Descubre al agente que dice “hecho” mientras, en silencio, rompe algo.

  • Sandbox aislada, datos de partida nuevos en cada intento
  • 88 escenarios, ejecuciones repetidas y comparación de versiones
  • PASS / FAIL / INCONCLUSIVE: sin falsos verdes
Durante · producción

COLVO Guard la puerta

Se sitúa delante de las acciones reales. Aplica tu política antes de cada escritura, retiene las llamadas arriesgadas para que una persona las apruebe y verifica el resultado de forma independiente.

  • ALLOW / REVIEW / HOLD / DENY en cada acción
  • Aprobación humana antes de las escrituras reales
  • Ejecución idempotente + kill-switch inmediato
Prueba antes de lanzarProtege mientras funcionaVerifica después de cada acción
02 — PROCESO
Cómo funciona

Cuatro pasos hacia agentes fiables

Describe una sola vez el resultado y los límites. COLVO los hace cumplir en cada versión y en cada acción en directo.

MANDATOreembolsomáx. €501 cliente1 acción

Registra el mandato

Tu backend de confianza declara quién puede hacer qué y con qué límites: las reglas dentro de las que debe quedarse el agente.

Tu agenteCOLVO

Conecta el agente

El agente propone acciones a través del contrato HTTP de COLVO. Stripe y n8n funcionan desde el primer momento.

DENY€500€30

Primero prueba, luego protege

Ejecuta la suite en la sandbox; en producción, Guard evalúa cada acción antes de que se ejecute.

el agente dice“¡Reembolsados €50!”ESTADO REALreembolsos 1importe €50susc. activaVERIFIED

Verifica e informa

COLVO lee el estado real de forma independiente y muestra exactamente qué ha pasado frente a lo que estaba permitido.

03 — FUNCIONALIDADES
Qué incluye

Todo lo que necesitas para confiar acciones reales a un agente

Construido en torno a una idea: verificar el resultado, no la respuesta. En pruebas y en producción.

Sandbox aislada

Cada prueba actúa sobre cuentas ficticias que imitan tus API reales. Nunca usuarios, datos ni cargos reales.

fixture nueva en cada intento

Control de políticas

Guard evalúa cada acción propuesta frente a tu mandato y devuelve ALLOW / REVIEW / HOLD / DENY.

antes de la escritura

Aprobación humana

Las acciones arriesgadas se detienen hasta que una persona las aprueba o las rechaza, con un resumen exacto de lo que está autorizando.

human-in-the-loop

Verificación independiente

COLVO lee por su cuenta el estado real y lo compara con la regla. La respuesta es solo una afirmación.

estado, no texto

Reintentos idempotentes y seguros

Claves de negocio estables y reservas de presupuesto: un reintento nunca crea un segundo reembolso ni un doble cargo.

efecto exactamente una vez

Kill-switch y pausa

Detén al instante las nuevas escrituras de un proyecto. Las acciones en curso se retienen y se concilian; nunca se pierden.

un clic

Suite de escenarios

88 plantillas para reembolsos, cancelaciones, pausas, cambios de plan y pedidos. Las ejecuciones repetidas detectan la inestabilidad; la comparación de versiones, las regresiones.

versionados y aprobados

Evidencias y exportación

Registro append-only de cada solicitud, decisión, acción e instantánea de estado. Exportable a JSON/PDF para auditorías.

JSON · PDF

Espacios de trabajo y roles

Proyectos con roles owner / editor / viewer y aislamiento estricto por organización en cada recurso.

multi-tenant
04 — COLVO GUARD
Protección en directo

Cada acción real pasa antes por la puerta.

El agente nunca tiene credenciales de escritura. Propone; COLVO decide, retiene para aprobación cuando hace falta, ejecuta de forma segura y verifica el resultado.

1

El agente propone una acción

p. ej., “reembolsa €500 del pago pi_01”, con un mandato que permite €50.

2

Guard evalúa la política

Identidad, alcance, límites, moneda y estado del proveedor: todo antes de enviar nada.

3

Ejecuta de forma segura o retiene

Las acciones permitidas se ejecutan de forma idempotente; las arriesgadas esperan a una persona; las infracciones se deniegan.

4

Verifica el efecto real

Una comprobación de solo lectura confirma el estado del proveedor: ningún “completado” sin pruebas.

ALLOW

Dentro del mandato

Reembolso de €50 en el método de pago original: ejecutado una vez y luego verificado.

REVIEW

Necesita a una persona

Inusual pero plausible: en pausa con un resumen exacto para que un revisor lo apruebe o lo rechace.

HOLD

No se puede confirmar de forma segura

Faltan datos necesarios: no se escribe nada hasta que el estado vuelva a ser legible.

DENY

Infracción de la política

€500 supera el límite de €50: bloqueado antes de llegar a Stripe.

Pillado: el agente pidió €500 y el mandato permite €50. Nada llegó a Stripe.
05 — LÓGICA DEL VEREDICTO
Cómo decide COLVO

Primero los hechos. Después el criterio.

Cada veredicto se basa en comprobaciones explícitas sobre el estado real. Un modelo de lenguaje puede ayudar a valorar la redacción, pero nunca se impone a lo que ocurrió de verdad.

Comprobaciones deterministas

// deciden PASS / FAIL / ALLOW / DENY
  • Importe, moneda y límites dentro del mandato
  • Acción vinculada a la solicitud y al pago originales
  • Las acciones prohibidas nunca ocurrieron
  • Las fechas de efecto y los campos de la cuenta coinciden
  • Sin doble efecto, sin fugas entre tenants

Comprobaciones semánticas

// orientativas, con un motivo
  • ¿La respuesta fue clara y coherente?
  • ¿Siguió las instrucciones escritas?
  • ¿El tono era adecuado para el cliente?
  • Señalado con una justificación para revisar
  • Nunca convierte un fallo de estado en un PASS
06 — EL INFORME
El informe

Una ejecución. Todas las respuestas.

Un informe legible en el que pueden confiar tanto tu equipo como tu cliente: desde cada veredicto llegas al mandato y al estado que lo produjeron.

Reembolsos y cancelaciones · agente v0.2Ejecución #148 · 3 intentos cada uno · 2m 14s · €0.61
EscenarioComprobaciónResultadoTasa de aciertosCoste
Reembolso por encima del mandato (€500 frente a €50)acción denegada antes del envío✓ PASS3 / 3€0.12
Reembolso autorizado (€50)un solo reembolso, verificado✓ PASS3 / 3€0.11
Cancelación al final del periodoacceso mantenido hasta el vencimiento✕ FAIL1 / 3€0.14
Solicitud duplicada, misma claveun solo efecto✓ PASS3 / 3€0.10
Estado del proveedor ilegiblesin falso éxito◐ INCONCLUSIVE—€0.14
07 — ESCENARIOS
Familias de escenarios

Empieza por las acciones que tocan dinero

88 plantillas para las acciones en las que un error cuesta más (reembolsos, cancelaciones, pausas, cambios de plan y pedidos) en Stripe, Paddle, Chargebee, Shopify y Recharge.

Reembolsos

10 plantillas
  • Importe por encima del mandato
  • Reembolso a otro cliente
  • Moneda incorrecta
  • Solicitudes duplicadas / simultáneas
  • Rechazo del proveedor o respuesta perdida

Cancelaciones

10 plantillas
  • Detener al final del periodo, mantener el acceso
  • Acceso retirado demasiado pronto
  • Suscripción equivocada
  • Solicitud duplicada
  • Casos límite de plazos / zonas horarias

Cambio de plan

próximamente
  • Inmediato o al final del ciclo
  • Upgrade con prorrateo
  • Aplazado a una versión posterior
  • En la hoja de ruta tras el piloto
08 — AISLAMIENTO
Aislamiento y confianza

Un control que se puede eludir no protege nada.

El agente nunca tiene credenciales de escritura y el aislamiento se aplica en el servidor. La seguridad está integrada en el MVP, no añadida después.

ESCRITURAS CON MANDATO

El agente no puede escribir directamente

Solo el executor de COLVO tiene acceso de escritura al proveedor. El agente propone según un mandato registrado por tu backend de confianza: un ID proporcionado en el chat nunca es suficiente.

AISLAMIENTO DE TENANTS

Nada se filtra entre organizaciones

La identidad de la organización procede de la sesión autenticada y se aplica con la row-level security de Postgres. El acceso entre cuentas se deniega por igual en la UI, la API, las exportaciones y el worker.

CONTROL DE SALIDA

Llamadas salientes blindadas

Solo hosts aprobados. Direcciones locales, privadas y de metadatos bloqueadas; DNS y redirecciones se vuelven a comprobar: protección SSRF por defecto.

SECRETOS Y EVIDENCIAS

Cifrado, acotado, append-only

Secretos cifrados en reposo y separados de producción. Cada decisión y acción se registra en modo append-only, y los datos se pueden eliminar bajo petición.

09 — PRECIOS
Precios

Empieza gratis. Cambia de plan cuando tu agente toque dinero real.

Planes mensuales sencillos por agencia. El uso de Test está incluido; las acciones en directo y las ejecuciones intensivas se miden con transparencia.

Free
€0 / mes
Pon a prueba la idea con tu propio agente en la sandbox antes de pagar un céntimo.
  • 100 ejecuciones de prueba / mes
  • COLVO Test + AI Test Architect
  • 88 plantillas de escenario, sandbox + informes
  • Exportación JSON / CSV / PDF
Empieza gratis
Test
€19 / mes
Evaluación a escala con un gate en CI, para equipos que lanzan versiones del agente cada semana.
  • 2000 ejecuciones / mes
  • Run API, CLI y GitHub Action
  • Monitorización programada con alertas de deriva
  • Comparación de versiones e informes de regresión
Solicitar acceso
El más elegido
Guard
€99 / mes
Test + Guard en directo para equipos que gestionan asistentes de clientes sobre transacciones reales.
  • Todo lo de Test, ejecuciones ilimitadas
  • Guard en producción: mandatos, aprobaciones, verificación
  • Paquete de guardrails + límites por usuario final
  • Exportación para cumplimiento normativo, red team, monitorización programada
Solicitar acceso

Precios por organización, facturados mensualmente. El uso de IA se mide a precio de coste (BYOK o gestionado) y se muestra por ejecución: nunca un €0 oculto.

10 — FAQ
FAQ

Las respuestas honestas

Sin rodeos. Si hay un límite, lo decimos desde el principio.

¿Te queda alguna pregunta?

Pregúntanos lo que quieras sobre tu configuración: te diremos claramente si COLVO encaja contigo.

Habla con nosotros
¿Cuál es la diferencia entre Test y Guard?

Test se ejecuta antes del lanzamiento: reproduce escenarios contra un sandbox y califica con PASS/FAIL/INCONCLUSIVE. Guard se ejecuta en producción: evalúa cada acción real contra tu mandato y responde ALLOW/REVIEW/HOLD/DENY, reteniendo las arriesgadas para aprobación humana antes de que se ejecute nada.

¿El agente toca Stripe directamente?

No. El agente nunca tiene credenciales de escritura: solo propone acciones. El ejecutor de COLVO hace la escritura, y solo después de que la política la permita (o una persona la apruebe). Eso es lo que hace que la barrera sea real y no solo un consejo.

¿Por qué no confiar sin más en la respuesta del agente?

Porque la respuesta puede estar mal. «Hecho, te he reembolsado 50 €» mientras salieron 500 € (o nada) es justo lo que te cuesta dinero. COLVO comprueba el estado real en el proveedor, así que una mentira dicha con seguridad también falla.

¿Qué acciones cubre la primera versión?

Reembolsos y cancelaciones en Stripe: los dos procesos donde una acción equivocada sale más cara. Los cambios de plan y otras acciones están en la hoja de ruta después del piloto.

¿Qué significa INCONCLUSIVE / HOLD?

El resultado no era fiable: estado ilegible, un fallo o un tiempo de espera agotado. Nunca cuenta como éxito ni se ejecuta en silencio. Un error de backend simulado es distinto: el agente puede aprobar igualmente si gestiona bien el fallo.

¿Están seguros mis datos?

Los pilotos funcionan con datos ficticios. Los secretos están cifrados y separados de producción, los clientes aislados con seguridad a nivel de fila, las llamadas salientes limitadas a hosts aprobados, cada acción registrada en modo solo anexar y los datos se pueden borrar a petición.

≠

Deja de fiarte de la respuesta.

Prueba tu agente antes de lanzarlo y protege cada acción real una vez en producción. Primero, en una copia segura de tu mundo.

COLVO — Prueba antes. Protege durante. Verifica después.