La aprobación humana funciona cuando la política crea un punto de decisión duradero vinculado a una única acción propuesta, un revisor autenticado, una fecha de expiración y una rama de reanudación.
Una automatización doméstica de varios pasos puede recopilar pruebas, redactar un mensaje, mover archivos y después cambiar un dispositivo o ponerse en contacto con alguien fuera del hogar. Solo debe pausarse en el límite con consecuencias. El entorno de ejecución debe conservar todo el estado anterior, mostrar al revisor lo que ocurrirá, esperar sin mantener recursos de cómputo ocupados y continuar únicamente con una decisión que coincida con la solicitud aún vigente.
La política de riesgos decide dónde debe ubicarse la aprobación
Un motor de políticas clasifica las acciones según su efecto, objetivo, sensibilidad de los datos, reversibilidad, importe y alcance para el usuario. Las lecturas de bajo riesgo pueden continuar automáticamente, mientras que las comunicaciones externas, eliminaciones, compras, cambios de seguridad u objetivos ambiguos crean nodos de aprobación antes de la ejecución.
Un control del flujo de aprobación práctico define los flujos de aprobación como controles del entorno de ejecución que interrumpen a un agente antes de que cause un impacto en el mundo real. Esto aclara que la aprobación es un estado de cumplimiento obligatorio, no una solicitud cortés que el modelo pueda decidir omitir.
Demasiadas barreras provocan fatiga de revisión y aprobaciones automáticas; muy pocas dejan sin examinar el paso peligroso. Coloca la barrera después de resolver el objetivo y los parámetros, pero antes de liberar las credenciales o iniciar un efecto secundario.
La solicitud de aprobación debe ser específica y resistente a manipulaciones
La solicitud registra el ID del flujo de trabajo, el tipo de acción, el objetivo resuelto, los parámetros, las pruebas, el efecto esperado, el motivo del riesgo, el solicitante, la política de aprobación, la fecha de expiración y un resumen criptográfico. El revisor puede aprobar, rechazar, editar dentro de la política o solicitar una nueva planificación. Esta distinción sigue siendo visible durante las pruebas posteriores en el hogar.
Un patrón detallado de decisión de revisión duradera muestra a un agente proponiendo una acción, esperando la revisión y reanudándose después de una aprobación, edición, rechazo o revisión. Su principal desafío de ingeniería es mantener esa decisión de forma duradera. El resultado intermedio debe seguir siendo inspeccionable antes de que la automatización continúe.
La autenticación demuestra quién decidió, mientras que la vinculación de la solicitud demuestra qué decidió. Cualquier cambio sustancial en los parámetros después de la aprobación crea un nuevo resumen y requiere una nueva decisión; aprobar «mover fotos» no puede autorizar posteriormente otro destino ni un conjunto más amplio de archivos.
La espera y la ramificación duraderas preservan la decisión
El motor de orquestación guarda un punto de control del flujo de trabajo, registra un ID de correlación, libera al trabajador y espera una señal autenticada. La señal selecciona una rama y se consume una sola vez, aunque el canal vuelva a intentar entregarla o el servidor doméstico se reinicie.
El tutorial sobre señales de aprobación duraderas muestra consultas para la inspección y señales para aprobar o editar, mientras el estado del flujo de trabajo sobrevive a los fallos. Demuestra por qué una simple notificación de chat no es un sistema de aprobación. Ese límite debe medirse por separado en condiciones operativas realistas.
El límite de fallo es la aprobación obsoleta. Si el estado del objetivo, los permisos, el precio, la versión del archivo o el contenido propuesto cambian mientras se espera, el entorno de ejecución debe invalidar la decisión y volver a generar la vista previa. Los tiempos de espera deben dar lugar por defecto a una denegación o una escalada, nunca a una ejecución silenciosa.
Prueba aprobar, rechazar, editar, expirar y reiniciar
Crea un flujo de trabajo con una lectura inocua, una escritura reversible y una acción irreversible. Prueba la aprobación, el rechazo, la edición permitida, la edición prohibida, la respuesta duplicada, el revisor incorrecto, la solicitud expirada, el objetivo modificado, el fallo de notificación y el reinicio del servidor durante la espera.
Compara la barrera con los permisos explícitos de herramientas, que explican por qué los permisos explícitos deben mantenerse fuera de la discreción del modelo. Verifica que cada decisión haga referencia al resumen exacto de la acción, conserve las pruebas, seleccione una sola rama y aparezca en el registro de auditoría.
Aprueba el sistema solo cuando ninguna herramienta con consecuencias reciba credenciales antes de una aprobación válida y ninguna decisión obsoleta pueda autorizar parámetros modificados. Mide por separado la carga del revisor para que la política pueda reducir las barreras innecesarias sin debilitar los controles de alto riesgo. La consecuencia práctica aparece cuando varias fuentes compiten por un contexto limitado.
Centro de Tecnología e IA
Más para leer

¿Qué componentes permiten realizar búsquedas híbridas en archivos NAS?
Aprende cómo los identificadores exactos y el significado semántico conducen a un único resultado clasificado de búsqueda de NAS sin eludir los permisos ni...

¿Qué características permiten seleccionar de forma fiable la versión de los documentos en RAG?
Descubre cómo RAG selecciona la revisión aplicable en lugar de la copia obsoleta más similar y cómo probar actualizaciones explícitas, implícitas y superpuestas.

¿Qué factores hacen que los planes de los agentes diverjan de los permisos de herramientas disponibles?
Descubre cómo el descubrimiento, la delegación, la retroalimentación de políticas y la replanificación mantienen los pasos propuestos por un agente de IA alineados con...

