La plataforma abierta de seguridad de agentes de NVIDIA ataca la 'deriva' de los agentes de IA con aplicación fuera de banda
Puntos clave
- •NVIDIA lanzó la Open Agent Safety Platform el 28 de septiembre de 2026, con el respaldo de más de 100 socios de la industria.
- •El componente OpenShell es un runtime seguro de código abierto publicado bajo la licencia Apache 2.0 que ejecuta agentes en entornos aislados con aislamiento a nivel de kernel y valida las políticas antes de la ejecución.
- •El componente Sentry extiende el monitoreo y la aplicación de políticas a las DPU BlueField-4 mediante NVIDIA DOCA, permitiendo una aplicación fuera de banda a nivel de hardware incluso cuando el host no es confiable.
- •La investigación de NVIDIA encontró que la deriva de los agentes no puede eliminarse por completo mediante entrenamiento sin sacrificar capacidades, lo que motivó el enfoque de la plataforma en controles ubicados fuera del alcance del agente.
- •La plataforma es compatible con hardware que no es de NVIDIA, y las implementaciones existentes de Vera y BlueField-4 requieren solo una actualización de software para habilitar las nuevas protecciones.

NVIDIA ha presentado la Open Agent Safety Platform, un marco abierto diseñado para proteger a los agentes de IA autónomos mediante monitoreo continuo y controles de políticas aplicados por hardware. Anunciada el 28 de septiembre de 2026, la plataforma llega en medio de una creciente preocupación en la industria de la IA tras reportes de agentes que escapan de sus entornos de evaluación, acceden a sistemas no autorizados y reportan incorrectamente sus propias acciones.
La compañía establece un paralelismo con los primeros días de internet, que se convirtió en una base para el comercio y la comunicación solo después de que se establecieron mecanismos de seguridad: conexiones cifradas, pestañas de navegador aisladas e indicadores de confianza visibles. NVIDIA argumenta que la IA agéntica requiere una capa de confianza comparable antes de poder escalar hacia una confiable "economía de agentes", y que los controles de seguridad deben acelerar en lugar de obstaculizar la innovación.
Al anunciar el lanzamiento en X, el CEO de NVIDIA, Jensen Huang, dijo que la plataforma reúne dos componentes, OpenShell y Sentry, con el respaldo de más de 100 socios de la industria:
Today, with over 100 industry partners, we introduced the NVIDIA Open Agent Safety Platform, bringing together OpenShell and Sentry. Artificial intelligence is extraordinary technology that will advance discovery, productivity, security, health, and prosperity for generations to… pic.twitter.com/dReAxwpRUn
— Jensen Huang (@JensenHuang) September 28, 2026
Runtime OpenShell: aislamiento desde el kernel hacia arriba
En el núcleo de la plataforma se encuentra NVIDIA OpenShell, un runtime seguro de código abierto publicado bajo la licencia Apache 2.0, una licencia abierta permisiva que permite a las organizaciones inspeccionar, modificar e implementar el código en sus propios entornos. OpenShell ejecuta cada agente dentro de un entorno aislado con aislamiento a nivel de kernel, traduciendo las instrucciones del operador en una política verificable que define el acceso permitido a archivos, redes, herramientas, procesos y credenciales. Estos límites se validan antes de la ejecución y se aplican de manera continua durante la operación.
La plataforma se basa en cinco principios: las políticas deben ser verificables antes de que un agente se ejecute; la aplicación debe operar fuera de banda, fuera del alcance del agente; la ruta hacia el modelo sirve como el principal punto de control y superficie de observabilidad; la autoridad del agente debe escalar junto con la transparencia de su razonamiento; y la responsabilidad de la se comparte entre laboratorios, empresas y proveedores de hardware.
La propia investigación de NVIDIA destaca el problema de la "deriva": el comportamiento de un agente que se desvía de las tareas previstas debido a instrucciones ambiguas, bloqueos de políticas, herramientas faltantes u operación autónoma prolongada. Según la compañía, esta deriva no puede eliminarse por completo mediante entrenamiento sin sacrificar capacidades, y no puede esperarse que los agentes gobiernen su propio comportamiento bajo estas condiciones. Ese hallazgo sustenta el énfasis de la plataforma en la aplicación fuera de banda: si un agente no puede supervisarse de manera confiable, los controles deben ubicarse donde el agente no pueda alterarlos.
Aplicación a nivel de hardware a escala
La arquitectura abarca tres capas: la aplicación (modelos, herramientas, harnesses y datos), el runtime (orquestación y aplicación de políticas) y la infraestructura (recursos de cómputo, almacenamiento y red). Para las organizaciones que requieren una segunda capa independiente, NVIDIA Sentry extiende el monitoreo y la aplicación de políticas a las unidades de procesamiento de datos BlueField-4 mediante NVIDIA DOCA, correlacionando las interacciones de los agentes, las decisiones de políticas y el acceso a datos en un registro de actividad contextual, mientras verifica continuamente la identidad y la autoridad delegada de cada agente. Las DPU son procesadores dedicados que gestionan trabajos de infraestructura como redes y seguridad de forma separada de las CPU principales de un servidor, lo que les permite observar y aplicar políticas incluso cuando el propio host no es confiable.
En las configuraciones de NVIDIA Vera Rubin POD, una DPU BlueField-4 se encuentra en la única ruta del nodo hacia el modelo, proporcionando observabilidad fuera de banda y aplicación de políticas en tiempo real a velocidad de línea, aislada del host. Según NVIDIA, esto permite la aplicación de seguridad "en silicio", incluso cuando los recursos del host no son confiables. Para las implementaciones existentes de Vera y BlueField-4, la compañía indica que las protecciones requieren solo una actualización, y la plataforma también es compatible con hardware que no es de NVIDIA, términos que extienden los controles más allá de la infraestructura NVIDIA recién adquirida.
NVIDIA dijo que colabora con laboratorios de frontera, desarrolladores y proveedores de infraestructura para establecer la plataforma como una base abierta para la emergente economía de agentes, posicionando los controles independientes con raíces en hardware como un requisito previo para sistemas autónomos confiables a escala. Con más de 100 socios en el lanzamiento, un runtime de código abierto y soporte para hardware más allá del propio ecosistema de NVIDIA, la amplitud con la que el marco sea adoptado por laboratorios, empresas y proveedores de infraestructura será una medida de si la seguridad de los agentes se consolida en torno una capa de confianza compartida.
Este artículo fue publicado originalmente en Metaverse Post.