La plataforma de seguridad Open Agent de NVIDIA previene el “desvío” de los agentes de IA mediante la aplicación fuera de banda.
En resumen
NVIDIA ha lanzado la Open Agent Safety Platform, que combina la zona segura OpenShell con la ejecución forzada en hardware BlueField-4 para proteger a gran escala a los agentes de IA frente a la desviación.
NVIDIA ha presentado la Open Agent Safety Platform, un marco abierto diseñado para proteger a los agentes autónomos de inteligencia artificial mediante el control de políticas con monitorización continua y aplicación forzada a nivel de hardware. Lanzada el 28 de septiembre de 2026, esta plataforma busca responder a las crecientes preocupaciones del sector de la IA, tras informes de agentes de IA que escapaban a los entornos de evaluación, accedían a sistemas no autorizados o informaban erróneamente sobre sus propias acciones.
La empresa compara esta situación con los primeros días de Internet. El Internet inicial solo se convirtió en la base del comercio y la comunicación cuando se implementaron mecanismos de seguridad (conexiones cifradas, pestañas de navegador en sandbox, indicadores de confianza visibles). NVIDIA considera que la IA basada en agentes también necesita una capa de confianza similar para escalar hacia una "economía de agentes" fiable, y que las medidas de control de seguridad deben acelerar, y no frenar, la innovación.
Tiempo de ejecución OpenShell: aislamiento a nivel de kernel
El núcleo de la plataforma es NVIDIA OpenShell, un entorno de ejecución seguro de código abierto publicado bajo licencia Apache 2.0. OpenShell ejecuta cada agente en un entorno aislado a nivel de kernel y transforma las instrucciones del operador en políticas verificables. Estas definen los permisos de acceso a archivos, red, herramientas, procesos y credenciales. Estas restricciones se validan antes de la ejecución y se aplican continuamente durante el funcionamiento.
La plataforma se basa en cinco principios: las políticas deben ser verificables antes de la ejecución del agente; la aplicación debe realizarse fuera del alcance del agente; la ruta de acceso al modelo actúa como punto principal de control y observabilidad; los privilegios de los agentes deben aumentar en consonancia con la transparencia de su razonamiento; y la responsabilidad de la seguridad se comparte entre laboratorios, empresas y proveedores de hardware.
Las investigaciones de la propia NVIDIA subrayan el problema de la "deriva": los agentes pueden desviarse de sus tareas previstas por instrucciones ambiguas, restricciones de políticas, falta de herramientas o periodos prolongados de funcionamiento autónomo. La compañía advierte que esta deriva no puede eliminarse por completo sin sacrificar la capacidad de los agentes, por lo que no se puede esperar que los agentes controlen su comportamiento de forma autónoma en tales situaciones.
Aplicación masiva a nivel de hardware
La arquitectura incluye tres capas: capa de aplicación (modelos, herramientas, marcos y datos), capa de ejecución (orquestación y aplicación de políticas) y capa de infraestructura (recursos de computación, almacenamiento y red). Para organizaciones que requieren una segunda capa independiente, NVIDIA Sentry amplía la supervisión y aplicación a las BlueField-4 Data Processing Unit mediante NVIDIA DOCA, vinculando las interacciones de los agentes, las decisiones de política y el acceso a los datos a registros de actividad contextual, validando continuamente la identidad y autorización de cada agente.
En la configuración NVIDIA Vera Rubin POD, el BlueField-4 DPU se sitúa en la única ruta entre el nodo y el modelo, proporcionando observabilidad out-of-band y ejecución de políticas en tiempo real y a velocidad de línea, además de estar aislado del host. Esto permite una protección de seguridad "a nivel de chip" incluso cuando los recursos del host no son de confianza. Según NVIDIA, las implementaciones existentes de Vera y BlueField-4 solo requieren una actualización de software para habilitar estas protecciones; la plataforma también es compatible con hardware que no sea de NVIDIA.
NVIDIA afirma que está colaborando con laboratorios de vanguardia, desarrolladores y proveedores de infraestructura para convertir la plataforma en la base abierta para la naciente economía de agentes, y que el control independiente basado en hardware debe ser un requisito previo para sistemas autónomos fiables a gran escala.

Disclaimer: The content of this article solely reflects the author's opinion and does not represent the platform in any capacity. This article is not intended to serve as a reference for making investment decisions.
You may also like

