Qué incluye

Todo lo que necesitas para confiar acciones reales a un agente.

Construido en torno a una idea: verificar el resultado, no la respuesta, en pruebas y en producción. Aquí tienes la lista completa, agrupada según cuándo trabaja para ti.

01 — PRUEBAS
Pruebas

Pon a prueba el agente antes de lanzarlo

Sandbox aislada

Cada intento actúa sobre cuentas ficticias nuevas que imitan a Stripe. Sin usuarios, datos ni cargos reales. Nunca.

fixture nueva en cada intento

Suite de escenarios

88 plantillas para reembolsos, cancelaciones, pausas, cambios de plan y pedidos; las ejecuciones repetidas detectan la inestabilidad y la comparación de versiones, las regresiones.

versionados y aprobados

AI Test Architect

Describe tu agente; COLVO redacta los escenarios: solicitud, regla aprobada, datos de partida. Una persona los aprueba antes de que se ejecute nada.

con medición, orientativo

Red team

Genera entradas hostiles y casos límite (intentos de inyección, importes en el límite, cancelaciones ambiguas) e informa de lo que se coló.

bloqueadas vs. coladas

Veredictos deterministas

PASS / FAIL / INCONCLUSIVE a partir de comprobaciones explícitas sobre el estado. Un juez semántico puede comentar; nunca anula un FAIL.

sin falsos verdes

Gate en CI y programaciones

Ejecuta la suite desde la CI o de forma programada; haz fallar la build ante un FAIL; recibe alertas de regresiones.

cli · cron
02 — PRODUCCIÓN
Producción

Protege cada acción real

Control de políticas

Cada acción propuesta se evalúa frente al mandato y devuelve ALLOW / REVIEW / HOLD / DENY con sus motivos.

antes de la escritura

Aprobación humana

Las acciones arriesgadas se detienen a la espera de una persona, que firma un resumen exacto de lo que va a ocurrir.

human-in-the-loop

Verificación independiente

COLVO lee por su cuenta el estado real y lo compara con la regla. La respuesta es solo una afirmación.

estado, no texto

Reintentos idempotentes y seguros

Claves de negocio estables, reservas y un outbox: un reintento nunca crea un segundo reembolso.

efecto exactamente una vez

Guardrails

Detección de prompt injection y de datos personales con ocultación en la entrada; fidelidad a los hechos y toxicidad en la salida; bloqueante u orientativo en cada guardrail.

entrada · salida

Topes por cliente final

Acciones y gasto por cliente en ventanas móviles: HOLD o DENY cuando un solo usuario final los supera.

por sujeto

Kill-switch y pausa

Detén al instante las nuevas escrituras de un proyecto; las acciones en curso se retienen y se concilian, nunca se pierden.

un clic

Incidentes y alertas

MISMATCH, UNVERIFIABLE y TEST_FAIL abren incidentes con evidencias; alertas por Slack, email y webhook.

abierto → resuelto
03 — CONFIANZA Y OPERACIONES
Confianza y operaciones

Evidencias, análisis y control

Evidencias y exportación

Registro append-only de cada solicitud, decisión, acción e instantánea de estado. JSON, CSV y PDF por ejecución.

JSON · CSV · PDF

Informe de cumplimiento

Por organización y rango de fechas: decisiones, aprobaciones, activaciones de guardrails, verificaciones. Encadenado con SHA-256 y recalculable.

a prueba de manipulaciones

Analítica

Tasa de aprobación en el tiempo, inestabilidad, tasa de bloqueo, coste por ejecución y dónde sigue fallando el agente.

tendencias

Coste de IA medido

Cada llamada a la IA se mide: coste conocido por el gateway o estimado según el catálogo, nunca un €0 oculto. Límites a nivel de organización y de plataforma.

BYOK o gestionado

Espacios de trabajo y roles

Proyectos con roles owner / editor / viewer y aislamiento estricto por organización en cada recurso.

multi-tenant

Registro de actividad

Quién hizo qué y cuándo (inicios de sesión, cambios de claves, cambios de plan, decisiones), para tu equipo y para las revisiones de seguridad.

auditoría
Planes

La misma honestidad en todos los planes

Free incluye solo Test con 100 ejecuciones al mes. Test añade el gate en CI y las programaciones. Guard añade la protección en directo, los guardrails, los límites, la exportación de cumplimiento y el red team. Compara los planes →

≠

Deja de fiarte de la respuesta.

Prueba tu agente antes de lanzarlo y protege cada acción real una vez en producción. Primero, en una copia segura de tu mundo.

Funcionalidades — todo lo que necesitas para confiar acciones reales a un agente · COLVO