Supervisión humana

Ajusta la autonomía de cada agente — con un mínimo de riesgo que nunca puede cruzar.

Define hasta dónde puede actuar cada agente por su cuenta, desde suggest-only hasta autonomous. La política de riesgo de la propia acción es siempre un mínimo: la supervisión solo puede endurecer una decisión, nunca relajarla — y cada anulación es un break-glass auditado.

supervisión ▸ agente → predeterminado del tenant → predeterminado de la plataforma (execute_low_risk)

Modos de supervisión
mínimo de riesgosuggest_onlydraftexecute_low_riskexecute_with_reviewautonomous
oversight ▸ la puerta de riesgo es un mínimo: la autonomía solo puede endurecerla
El problema

“Autonomous” y “desatendido” no son el mismo ajuste.

La mayoría de los equipos trata la autonomía de los agentes como un único interruptor: o un humano aprueba todo (y el agente es inútil) o el agente actúa libremente (y nadie responde). Cortex convierte la autonomía en un dial explícito, por agente y auditable, resuelto agente → predeterminado del tenant → predeterminado de la plataforma, con la política de riesgo de la acción como mínimo infranqueable por debajo.

decideApproval(action, mode) matriz de decisión pura y probada
Los cinco Oversight Modes

Un dial, cinco posiciones — de solo proponer a plena autonomía.

Cada modo se define por agente (o como predeterminado de tenant o de plataforma). La ejecución del agente que gobierna es el actor máquina; la cola de aprobación humana a la que dirige es la superficie de la app y de la persona.

suggest_only
  • El agente solo puede proponer acciones
  • Toda acción queda pendiente de un humano
  • Cero ejecución autónoma
draft
  • El agente redacta la acción y sus evidencias
  • Todas las propuestas siguen pendientes
  • El revisor aprueba el trabajo ya preparado
execute_low_risk
  • Las acciones de riesgo bajo se ejecutan solas
  • El riesgo medio y alto queda pendiente
  • Predeterminado de la plataforma si no configuras nada
execute_with_review
  • Riesgo bajo y medio se ejecutan (marcados reviewRequired)
  • El riesgo alto sigue pendiente
  • Revisión posterior, no un bloqueo
autonomous
  • Ejecuta todo lo que la política permita
  • Solo el mínimo de la propia acción queda pendiente
  • Nunca anula requiresApproval
Orden de resolución
  • Primero manda el modo específico del agente
  • Si no, se aplica el predeterminado del tenant
  • Si no, el predeterminado de la plataforma: execute_low_risk
El control de riesgo marca el mínimo

La supervisión puede endurecer una decisión — nunca puede relajarla.

Cada acción lleva su propio nivel de riesgo y un control requiresApproval. Ese control es el mínimo. Por mucho que se gire el dial de autonomía, una acción de alto riesgo o que requiera aprobación siempre acaba en la bandeja de aprobación humana. Poner un agente en autonomous elimina las comprobaciones humanas opcionales — nunca elimina la obligatoria.

  • El control requiresApproval de la acción siempre deja pendiente, en todos los modos
  • La supervisión se aplica en el momento de propose(), dentro del Action Fabric
  • Las decisiones emiten una marca reviewRequired para la revisión posterior
Action Fabric
Simulación
Reembolso de $240
riesgo: bajo · evidencia
Propuesta
Cerrar el caso #4471
riesgo: medio · evidencia
Pendiente de aprobación
Pago de $5.000
riesgo: alto · evidencia
Ejecutada
Enviar correo al cliente
riesgo: bajo · evidencia
actions ▸ simulación → propuesta → aprobación → ejecución → compensación
Cómo se decide una propuesta

De una acción propuesta a ejecutada — o retenida.

Cuando un agente propone una acción, Cortex resuelve el modo de supervisión del agente que la propone y aplica la función pura decideApproval(action, mode), por encima del mínimo de riesgo de la propia acción.

  1. 01

    El agente propone

    Un actor máquina propone una acción a través del Action Fabric, con su nivel de riesgo y su flag requiresApproval.

  2. 02

    Resolver el modo

    Cortex resuelve el Oversight Mode del agente: específico del agente → predeterminado del tenant → predeterminado de la plataforma (execute_low_risk).

  3. 03

    Decidir

    decideApproval aplica el modo frente al mínimo — ejecución automática, ejecución con reviewRequired o pending_approval.

  4. 04

    Enrutar y registrar

    Las acciones retenidas van a la bandeja de aprobación humana; cada decisión (y decidedBy) queda registrada en el ledger de auditoría.

Break-glass auditado

Una anulación de emergencia que deja constancia permanente.

A veces una acción pendiente debe ejecutarse ya — un incidente, un plazo, un caso atascado. El break-glass fuerza la ejecución de una invocación pending_approval, pero solo para un administrador de plataforma y solo con un motivo escrito obligatorio que pasa a formar parte de la traza de auditoría.

Solo administradores
  • POST /v1/actions/:id/break-glass
  • Requiere una sesión de administrador de plataforma (AdminGuard)
  • Definir los modos también es solo para administradores; las lecturas siguen acotadas al tenant
Motivo obligatorio
  • Se exige un motivo escrito — sin anulaciones silenciosas
  • Registra decisionReason="break-glass: …"
  • Registra decidedBy — quién accionó la palanca
Demostrable
  • Emite un evento ActionBreakGlass
  • Fluye hacia el Trust Ledger a prueba de manipulaciones
  • Cada anulación se puede reproducir ante un auditor
pending_approvalbreak-glass · ejecutado
Seguridad y cumplimiento

Una supervisión que tus auditores pueden aprobar.

Cambios de modo restringidos a administradores, motivos obligatorios para el break-glass y un registro inmutable de cada decisión — alineado con las expectativas de supervisión humana de los marcos que tus revisores ya utilizan.

EU AI ActNIST AI RMFISO 42001SOC 2FINRAGDPR

Da a cada agente exactamente el margen que tú quieras darle.

Fija el dial por agente, mantén el mínimo innegociable y demuestra cada anulación — sin frenar a tu equipo.

Supervisión humana de los agentes de IA | Cortex AI OS