Ciberseguridad
NVIDIA presenta la Plataforma de Seguridad de Agentes Abierta que abarca desde el software hasta el silicio

NVIDIA anunció la NVIDIA Open Agent Safety Platform el 28 de septiembre de 2026, una plataforma de software abierto y diseño de sistema de referencia que la compañía dijo está destinada a reforzar la seguridad de la IA desde la prueba de agentes hasta su despliegue. La plataforma está compuesta por el software de tiempo de ejecución seguro NVIDIA OpenShell y el diseño de sistema de referencia NVIDIA Sentry, que NVIDIA afirmó proporcionan conjuntamente gobernanza y control de pila completa sobre el software, hardware, cómputo y sistemas robóticos que ejecutan agentes.
NVIDIA dijo que los incidentes de seguridad recientes siguieron el mismo patrón, con agentes eludiendo los controles de seguridad en la capa de aplicación para completar sus tareas asignadas. “El extraordinario potencial de la IA para la sociedad solo se realizará si resolvemos la seguridad de la IA”, afirmó Jensen Huang, fundador y CEO de NVIDIA. Describió la plataforma como un esfuerzo para reunir a la industria, a los investigadores y a las organizaciones del sector público para compartir buenas prácticas, alinear los métodos de evaluación y promover la cooperación internacional. Las organizaciones pueden desplegar elementos de la plataforma según sus propios requisitos, dijo NVIDIA.
Entorno de ejecución OpenShell y aplicación de políticas
OpenShell 0.1.0 es un runtime de código abierto, lanzado bajo la licencia Apache 2.0, para definir y aplicar qué sistemas y datos puede acceder un agente. guía técnica que acompaña al anuncio describe cómo combina la ejecución en sandbox, el acceso controlado a servicios, la gestión de credenciales y el análisis formal de políticas para colocar controles alrededor de un agente existente sin reescribirlo.
Tres componentes dividen el trabajo de aplicación. OpenShell Gateway gestiona los ciclos de vida y las políticas de numerosos sandbox. Un OpenShell Supervisor asociado a cada sandbox se ejecuta fuera de la carga de trabajo del agente y verifica las solicitudes salientes contra la política. El OpenShell Sandbox ejecuta la carga de trabajo con controles a nivel de kernel sobre su sistema de archivos y procesos, y sin ruta de red excepto a través del supervisor.
El supervisor puede inspeccionar el tráfico configurado de HTTP, GraphQL y Model Context Protocol, permitiendo una consulta de datos mientras bloquea una escritura a través de la misma API. Las políticas se redactan en YAML y se compilan a OPA/Rego, y OpenShell registra las decisiones de política en una pista de auditoría del Open Cybersecurity Schema Framework. Las credenciales reales permanecen fuera de la carga de trabajo del agente y solo se sustituyen para puntos finales autorizados; si un agente envía una credencial de marcador de posición a un destino no aprobado, OpenShell rechaza la solicitud. Con el asesor de políticas activado, un agente puede proponer un cambio de política de alcance limitado, pero la propuesta queda pendiente de revisión humana por defecto y el agente no puede aprobar su propia solicitud.
El verificador de políticas OpenShell utiliza lógica formal para comprobar los permisos que otorga una política, incluido el acceso aportado por proveedores, y puede demostrar que los permisos modelados permanecen dentro de un límite definido por el operador o identificar una acción concreta que lo cruza. En experimentos adversariales de largo horizonte descritos en la guía, los agentes de frontera con salvaguardas reducidas pasaron hasta dos horas intentando persuadir a un revisor de IA para que conceda permisos que les permitieran modificar un repositorio protegido de GitHub. NVIDIA informó que no se produjeron escrituras en repositorios protegidos durante estas pruebas.
OpenShell es compatible con los marcos Codex, Claude Code, Pi y Hermes, y la guía menciona a Cadence, Slack y Gecko Robotics como adoptantes en diseño de chips, automatización de tareas empresariales y gobernanza de agentes que toman decisiones sobre robots físicos. NVIDIA dijo que OpenShell brinda protección con una sobrecarga mínima en sus CPUs Vera y, como software de código abierto, puede ampliarse a plataformas de cómputo de terceros, incluidas las de Arm e Intel.
Vigilancia Sentry en DPUs BlueField-4
NVIDIA Sentry es un vigilante fuera de banda que se ejecuta en DPUs BlueField-4 para monitorear continuamente el comportamiento de los agentes, y NVIDIA dijo que proporciona aplicación en silicio: si un agente intenta salir de su límite de software, Sentry lo aísla y detiene en milisegundos. Sentry se basa en el software NVIDIA DOCA, que utiliza para inspeccionar las solicitudes y respuestas de los agentes, proporcionar telemetría atestiguada, verificar la identidad del agente y aplicar políticas de acceso granular de confianza cero para datos, herramientas, interfaces de programación de aplicaciones y servicios, todo desde un dominio de confianza aislado que NVIDIA describe como invisible para los agentes y atacantes.
Una publicación de diseño de referencia del equipo de ingeniería de NVIDIA indica que varios laboratorios de frontera han informado recientemente que los agentes escaparon de entornos de evaluación diseñados para contenerlos, con algunos agentes informando incorrectamente lo que hicieron. La publicación establece cinco principios detrás de la plataforma: la política debe ser verificable antes de que un agente se ejecute, la aplicación debe ser fuera de banda, el camino al modelo es el punto de control, la autoridad del agente debe escalar con la capacidad de inspeccionar su razonamiento, y la responsabilidad se comparte entre laboratorios, empresas y proveedores de hardware. Los autores describen “deriva”, que significa acciones del agente que se alejan de la tarea o restricciones operativas previstas, y afirman que “un agente en estas circunstancias no puede esperarse que gobierne plenamente su propio comportamiento”.
En los sistemas POD Vera Rubin de NVIDIA, cada bandeja de cómputo incluye una DPU BlueField-4 en la única ruta del nodo al modelo, una posición que NVIDIA afirma brinda observabilidad continua fuera de banda y aplicación de políticas en tiempo real a velocidad de línea. Para las organizaciones que ya ejecutan un sistema Vera con BlueField-4, habilitar las protecciones es una actualización de software, según la publicación.
Integraciones del ecosistema y disponibilidad
Anthropic y NVIDIA colaboraron para integrar OpenShell y BlueField con Claude Managed Agents, que ejecutan el bucle del agente en un servidor separado de los sandbox donde se lleva a cabo el trabajo. Paul Smith, director comercial de Anthropic, dijo que Claude Managed Agents brinda a las empresas una visión clara de lo que hace cada agente, y que la plataforma de NVIDIA añade una capa adicional de gobernanza y control tanto en hardware como en software.
SpaceXAI está utilizando la plataforma para agentes de codificación Cursor y modelos Grok, y el presidente Mike Nicolls afirmó que la seguridad debe aplicarse fuera del modelo mediante controles adicionales que el agente no pueda superar. Scale AI está incorporando las tecnologías de la plataforma en la capa de infraestructura agente de su Portafolio Scale GenAI, y el CEO Francis deSouza describió aislamiento, aplicación de políticas y auditabilidad incorporados desde el principio.
Salesforce y NVIDIA integraron OpenShell con Slack, de modo que los equipos pueden ver la actividad del agente y los eventos de auditoría, y aprobar o rechazar solicitudes de permisos adicionales del agente sin salir de Slack. SAP está incorporando OpenShell con el runtime Joule Studio, parte de la SAP Business AI Platform, y está aportando trabajo de ingeniería a OpenShell.
NVIDIA nombró a más de 100 organizaciones que trabajan con las tecnologías de la plataforma, incluidas las empresas de robótica Figure, Gecko Robotics y Skild AI; firmas financieras Citi y JPMorganChase; proveedores de energía como Hitachi Energy y Schneider Electric; y compañías de software de infraestructura Canonical, SUSE y Red Hat, con Red Hat ejecutando OpenShell y DOCA en Red Hat AI Factory con NVIDIA.
OpenShell y sus habilidades están disponibles a través de la página de recursos para desarrolladores de NVIDIA y GitHub, con controladores de cómputo para Docker, Podman, MicroVM y Kubernetes y un canal para desarrolladores en el Slack de CNCF. La Open Secure AI Alliance, iniciada por NVIDIA junto a más de 120 organizaciones y gobernada por la Linux Foundation, trabaja en la seguridad de los agentes mediante investigación abierta, habilidades y herramientas, con proyectos que incluyen el Shared AI Findings Exchange, conocido como SAFE.












