La identidad de la carga de trabajo autentica los servicios de IA domésticos vinculando credenciales criptográficas de corta duración a un proceso atestado, en lugar de a una dirección de red o una contraseña almacenada.
Una API RAG local, un servidor de modelos, una base de datos vectorial y una puerta de enlace de herramientas de agentes pueden compartir una red doméstica y, aun así, tener privilegios muy diferentes. La identidad de la carga de trabajo permite que cada proceso demuestre qué servicio aprobado es antes de recibir datos o credenciales. El verificador comprueba las evidencias del entorno de ejecución, emite una identidad con nombre y deja la autorización de recursos en manos de una decisión de política independiente.
La atestación conecta un proceso en ejecución con una identidad declarada
Un agente de identidad observa propiedades verificables del entorno de ejecución, como la cuenta de servicio, el ejecutable, la imagen del contenedor, el espacio de nombres, el host o los metadatos firmados de la carga de trabajo. La política de registro asigna una combinación aceptada a un nombre de servicio estable, en lugar de confiar en una etiqueta declarada por el propio servicio.
Una demostración práctica de atestación de cargas de trabajo en tiempo de ejecución muestra cómo SPIFFE y SPIRE atestan las cargas de trabajo antes de emitir identidades dentro de un homelab. La confianza de arranque reside en el nodo y en el proceso de registro, no en un secreto copiado en cada contenedor.
Esto cambia la primera pregunta de autenticación de «¿qué IP se conectó?» a «¿qué carga de trabajo aprobada demostró que posee esta identidad?». Las direcciones dinámicas y los reinicios de contenedores ya no requieren una nueva credencial estática. Esta distinción sigue siendo visible durante las pruebas domésticas posteriores.
La autoridad de identidad emite credenciales verificables de corta duración
Tras la atestación, una autoridad emite una credencial X.509 o JWT que contiene el identificador de la carga de trabajo y una vigencia limitada. El agente local la entrega mediante una interfaz protegida para cargas de trabajo y la rota antes de que caduque. El resultado intermedio debe seguir siendo inspeccionable antes de que la automatización continúe.
Una descripción general de las credenciales de carga de trabajo de corta duración explica que las identidades SPIFFE son de corta duración y verificables criptográficamente, lo que reduce la dependencia de secretos de servicio codificados de forma fija. El servicio receptor valida el emisor, la audiencia, el tiempo y la prueba de posesión de la clave. Ese límite debe medirse por separado en condiciones operativas realistas.
Las vigencias cortas reducen la exposición después de retirar o comprometer un servicio. La rotación debe seguir siendo automática, porque los certificados caducados deben fallar de forma segura en lugar de incitar a los operadores a restaurar claves de larga duración. La consecuencia práctica aparece cuando varias fuentes compiten por un contexto limitado.
La autenticación proporciona identidad, pero la política concede acceso
Una identidad de carga de trabajo válida demuestra qué servicio realiza la llamada; no demuestra que el servidor de modelos pueda leer todas las colecciones ni que un agente actúe en nombre de un usuario concreto. La autorización evalúa la identidad junto con el recurso, la operación, la delegación del usuario y la política vigente.
Un análisis de la identidad de cargas de trabajo y agentes distingue entre identidad de carga de trabajo, autenticación mutua y el contexto del usuario o agente transmitido por encima de la conexión. Esta separación evita que un certificado de servicio de confianza se convierta en una capacidad universal. Esta dependencia debe seguir siendo explícita en la interfaz final.
El límite de fallo es una autoridad de identidad, un atestador de nodos o una regla de registro comprometidos. La prueba criptográfica aplica fielmente la identidad que se emitió, incluso cuando la política de emisión asignó un proceso controlado por un atacante al servicio equivocado.
Rastrea una llamada de servicio desde la atestación hasta la autorización
Elige una solicitud de RAG a un almacén vectorial y registra el selector de la carga de trabajo, la identidad registrada, el emisor, la vigencia del certificado o token, la ubicación de la clave, la validación del par, el recurso solicitado, el usuario delegado, la decisión de política, la rotación, la revocación y el identificador de auditoría. Por lo tanto, el resultado debe comprobarse frente a las evidencias originales.
Compara el control con los controles de identidad de IA. Prueba un reinicio legítimo, una credencial copiada, un contenedor no registrado, una audiencia incorrecta, una identidad caducada, una cuenta de servicio modificada y una identidad válida que solicite una colección prohibida. Esta distinción sigue siendo visible durante las pruebas domésticas posteriores.
Aprueba solo cuando las cargas de trabajo auténticas se reconecten automáticamente y toda suplantación o acceso excesivo falle en un límite identificado. Protege la autoridad de identidad por separado y mantén la autorización de recursos más restringida que la autenticación del servicio. El resultado intermedio debe seguir siendo inspeccionable antes de que la automatización continúe.
Centro de Tecnología e IA
Más para leer

¿Qué es la deriva de las incrustaciones y cuándo es necesario reconstruir un índice de búsqueda privado?
Decodifica el desplazamiento del modelo, el preprocesamiento, el corpus y las consultas; distingue entre la monitorización y la incompatibilidad; y decide cuándo es necesario...

¿Qué es la compatibilidad del tokenizador y por qué puede hacer que el cambio de modelo falle?
Descifra la identidad del vocabulario, la semántica de los tokens especiales, las plantillas de chat, los tokens en caché, los adaptadores y las comprobaciones...

¿Qué es la permanencia del modelo y cuándo debe un servicio de IA local mantener las ponderaciones cargadas?
Descubre la permanencia de los pesos, los niveles de caché, los arranques en frío, la expulsión, la multiplexación, la presión de memoria y cuándo...

