Agente supervisor
gobiernoguardian agent · agente guardián · agente verificador · segunda línea automática
Agente de IA cuyo único trabajo es revisar lo que hace otro agente antes de que la acción salga: comprueba la salida contra la política de la empresa, marca lo que falta y decide si pasa, se bloquea o escala a una persona.
Un agente supervisor es una segunda línea de control automática. No hace el trabajo: lo revisa. Corre en paralelo al agente que produce (o entre este y el sistema de destino) y evalúa cada salida o acción contra tres cosas: la política escrita de la empresa, las fuentes aprobadas de información y los límites de autoridad que se le han fijado al agente supervisado. El resultado es siempre una de tres decisiones —dejar pasar, bloquear o escalar a una persona— y un registro de por qué. Su valor no está en detectar errores de calidad (para eso están las evaluaciones offline) sino en impedir que una acción incorrecta llegue a un cliente, a un regulador o a un sistema de registro. En sectores regulados se usa para verificar disclosures obligatorios, conflictos con la política interna y afirmaciones que no se sostienen en una fuente aprobada. Requisito de diseño: el agente supervisor no puede depender del mismo contexto ni del mismo prompt que el supervisado, o repite su error; y no sustituye a la persona en las decisiones donde la responsabilidad es legalmente indelegable.
En qué se diferencia de
- Humano en el bucle
- El humano en el bucle es una persona que aprueba; el agente supervisor es software que filtra antes de que llegue a esa persona. Se combinan, no se sustituyen.
- Guardarraíles de agente
- Los guardarraíles son reglas fijas en la configuración del agente. El supervisor es un agente aparte que razona sobre la salida con contexto y puede escalar.
- Observabilidad de agentes
- La observabilidad te cuenta qué pasó después. El supervisor decide antes de que pase.
- Evaluaciones de agente
- Las evaluaciones miden calidad sobre un banco de pruebas, fuera de producción. El supervisor actúa en producción sobre tráfico real.
Ejemplos
- Un agente revisa cada email comercial que redacta otro agente y bloquea los que no llevan la advertencia legal obligatoria.
- Antes de que un agente de soporte prometa un reembolso, un supervisor comprueba el importe contra la política de devoluciones y escala si excede el límite.
- Un supervisor contrasta las cifras que cita un agente de marketing contra la única fuente de datos aprobada y devuelve la pieza si no cuadran.
Preguntas frecuentes
- ¿No basta con poner un humano a revisar?
- Basta hasta que el volumen crece. Cuando un agente produce cientos de salidas al día, la revisión humana total deja de ser viable y se convierte en un sello sin lectura. El supervisor filtra el 90% obvio para que la persona vea solo lo que de verdad requiere criterio.
- ¿Puede el mismo modelo supervisarse a sí mismo?
- Mal. Si comparte prompt, contexto y datos con el agente supervisado, tiende a validar sus propios errores. La supervisión útil usa criterios explícitos, fuentes distintas y, cuando el riesgo lo justifica, otro modelo.
- ¿En qué casos sigue haciendo falta una persona?
- En tres: cuando la decisión compromete dinero por encima de un umbral, cuando la responsabilidad es legalmente indelegable, y cuando el caso no se parece a nada que estuviera previsto en la política.
Términos relacionados
Gartner Market Guide for Guardian Agents (vía distribución de vendor) · 2026-09-07 · E3