Nvidia lanza Open Agent Safety para contener agentes de IA

Nvidia lanza Open Agent Safety para contener agentes de IA

Nvidia presenta una plataforma para limitar agentes de IA; Sentry promete aislarlos en milisegundos.

Por Humberto Toledo el 28 de septiembre del 2026 a las 11:12 am PDT

✨︎ Resumen (TL;DR):

  • Nvidia presentó el 28 de septiembre de 2026 Open Agent Safety Platform para limitar las acciones de los agentes de IA.
  • OpenShell ya está disponible como software de código abierto; Sentry forma parte de un diseño de referencia para chips BlueField-4.
  • Nvidia afirma que Sentry podría detener y aislar un agente en milisegundos, pero aún no hay evidencia independiente de esa capacidad en una intrusión real.

Nvidia presentó el 28 de septiembre de 2026 Open Agent Safety Platform, una propuesta para limitar las acciones de los agentes de inteligencia artificial y vigilarlos desde una capa separada del sistema donde trabajan. La plataforma combina OpenShell, software de código abierto disponible para desarrolladores, con Sentry, un diseño de referencia para chips BlueField-4. Nvidia sostiene que esa segunda capa podría aislar en milisegundos a un agente que intente rebasar los permisos asignados.

Jensen Huang acusa a líderes de IA de buscar exenciones
Te podría interesar:
Jensen Huang acusa a líderes de IA de buscar exenciones
Primer plano de una consola de juegos iluminada con un aura de luz roja y azul.
Foto: Corentin Detry / Pexels

OpenShell pone límites fuera del modelo

OpenShell es un software de código abierto que ejecuta cada agente en un entorno aislado y aplica una política sobre los recursos que puede usar. Esa política abarca archivos, conexiones de red y credenciales.

La documentación técnica de Nvidia indica que el sistema comprueba los límites antes de la ejecución y los hace cumplir mientras el agente trabaja. Las restricciones quedan fuera del proceso del agente, por lo que no dependen de que el modelo siga una instrucción de seguridad.

Nvidia anunció OpenShell en marzo y ahora lo ofrece de forma general como software de código abierto. La compañía lo vincula con sus CPU Vera, aunque afirma que la capa de software puede adaptarse a plataformas de otros fabricantes, incluidos Arm e Intel.

Esa compatibilidad se refiere a OpenShell. No significa que cualquier computadora cuente ya con la vigilancia de Sentry.

Sentry vigila desde un DPU BlueField-4

Sentry es un diseño de referencia que supervisaría la actividad de un agente desde un entorno separado, dentro de los DPU BlueField-4, procesadores dedicados a tareas de infraestructura del servidor.

Desde esa separación, Sentry aplicaría las reglas aunque el sistema principal falle o quede comprometido. Nvidia sostiene que podría detener y aislar al agente en milisegundos si intenta rebasar sus permisos.

La afirmación sobre esa velocidad proviene de Nvidia. El material consultado no aporta una prueba independiente de su eficacia durante una intrusión real, así que la capacidad anunciada todavía no tiene una validación pública en ese escenario.

Qué está disponible para desarrolladores

El comunicado identifica a OpenShell y otros recursos de software como disponibles para desarrolladores. En cambio, presenta a Sentry como parte de un diseño de referencia basado en BlueField-4, sin anunciar por separado su disponibilidad general.

La diferencia importa para quien evalúa adoptar la plataforma: hoy puede examinar el software abierto, mientras que la capa de vigilancia por hardware depende de esa infraestructura específica con DPU de Nvidia.

Más de 100 organizaciones, sin cifra de adopción completa

Nvidia afirma que más de 100 organizaciones trabajan con tecnologías de Open Agent Safety Platform y menciona a Anthropic, Microsoft y SAP. La lista incluye colaboraciones de distinto tipo.

No está claro cuántas adoptaron OpenShell. Por eso, el número no equivale a más de 100 instalaciones completas de OpenShell y Sentry.

La prueba citada por Nvidia fue hipotética

En una presentación a periodistas, el vicepresidente de IA empresarial de Nvidia, Justin Boitano, dijo que la plataforma podría haber evitado el incidente en el que agentes de OpenAI vulneraron sistemas de Hugging Face.

La declaración fue una evaluación hipotética de Nvidia sobre un episodio pasado, no una prueba realizada durante ese incidente.

El lanzamiento deja disponible una forma de restringir permisos fuera del modelo y plantea un segundo control en los DPU de Nvidia. La promesa de aislar agentes en milisegundos todavía necesita evidencia de funcionamiento en despliegues reales para medir su alcance.

Fuentes: 1, 2, 3, 4, 5

+ Temas Relacionados

Más de AI

Feed