Guard

Guard dice que no: qué es un mandato y por qué tu agente no puede convencerlo

Un reembolso de 120 € pedido con amabilidad sigue estando 70 € por encima del límite. Cómo COLVO convierte “el cliente estaba molesto” en ALLOW, REVIEW o DENY, sin IA en la decisión.

·2 min de lectura·COLVO team
Guard dice que no: qué es un mandato y por qué tu agente no puede convencerlo

Un agente que puede reembolsar recibirá tarde o temprano una solicitud de reembolso que no debería conceder. El cliente está molesto, la historia es convincente, el modelo quiere ayudar. La pregunta no es si se puede convencer al modelo, sino qué pasa después.

Un mandato es una autorización, declarada una vez

Cuando llega la solicitud de un cliente, es tu backend —no el agente— quien registra un mandato en COLVO: qué cliente, qué pagos y suscripciones, qué acciones, qué límites, hasta cuándo. El agente recibe una clave que solo puede proponer acciones dentro de ese mandato.

La barrera

Cada propuesta pasa por los mismos controles deterministas, en orden: identidad, alcance, límites, disponibilidad. La respuesta es una de cuatro:

  • ALLOW — dentro del mandato y por debajo del límite de aprobación automática; COLVO la ejecuta una sola vez con su propia clave restringida.
  • REVIEW — permitida, pero por encima del límite de aprobación automática; decide una persona y hasta entonces no se envía nada.
  • HOLD — el proveedor tiene problemas o la solicitud no se puede comprobar ahora mismo.
  • DENY — fuera del mandato. No pasa nada.

Por qué las palabras no importan

El motor de políticas nunca lee el razonamiento del agente. “El cliente está molesto, quiere su dinero” y “reembolsa 120” producen la misma decisión con el mismo mandato. No hay prompt en el que inyectar nada, porque no hay ningún modelo en el circuito.

Pruébalo en el playground de GuardMueve un límite del mandato y mira cómo cambia entre ALLOW, REVIEW, HOLD o DENY, sin registrarte.
Abrir la demo →

Qué debe hacer el agente con un DENY

Decirlo. Un DENY significa que no ha pasado nada: la respuesta honesta es “No puedo hacerlo, un compañero te contactará”, no “hecho”. COLVO Test comprueba exactamente eso: la respuesta tiene que coincidir con la decisión.

COLVO team
Creamos pruebas y guardrails para agentes de IA que tocan dinero.
≠

Deja de fiarte de la respuesta.

Prueba tu agente antes de lanzarlo y protege cada acción real una vez en producción. Primero, en una copia segura de tu mundo.