Cibersegurança
NVIDIA apresenta a Open Agent Safety Platform, abrangendo do software ao silício

A NVIDIA anunciou a NVIDIA Open Agent Safety Platform em 28 de setembro de 2026, uma plataforma de software aberto e design de sistema de referência que a empresa afirmou ser destinada a reforçar a segurança de IA desde o teste de agentes até a implantação. A plataforma é composta pelo software de runtime seguro NVIDIA OpenShell e pelo design de sistema de referência NVIDIA Sentry, que, segundo a NVIDIA, juntos fornecem governança e controle de pilha completa em todo o software, hardware, computação e sistemas robóticos que executam agentes.
A NVIDIA afirmou que incidentes recentes de segurança seguiram o mesmo padrão, com agentes contornando controles de segurança na camada de aplicação para concluir suas tarefas atribuídas. “O extraordinário potencial da IA para a sociedade só será realizado se resolvermos a segurança da IA”, disse Jensen Huang, fundador e CEO da NVIDIA. Ele descreveu a plataforma como um esforço para reunir a indústria, pesquisadores e organizações do setor público a fim de compartilhar as melhores práticas, alinhar métodos de avaliação e avançar na cooperação internacional. As organizações podem implantar elementos da plataforma de acordo com suas próprias necessidades, afirmou a NVIDIA.
OpenShell Runtime e Aplicação de Políticas
OpenShell 0.1.0 é um runtime de código aberto, lançado sob a licença Apache 2.0, para definir e aplicar quais sistemas e dados um agente pode acessar. Um guia técnico que acompanha o anúncio descreve como ele combina execução em sandbox, acesso controlado a serviços, gerenciamento de credenciais e análise formal de políticas para colocar controles ao redor de um agente existente sem reescrevê-lo.
Três componentes dividem o trabalho de aplicação. O OpenShell Gateway gerencia os ciclos de vida e as políticas de várias sandboxes. Um OpenShell Supervisor associado a cada sandbox opera fora da carga de trabalho do agente e verifica solicitações de saída em conformidade com a política. O OpenShell Sandbox executa a carga de trabalho com controles a nível de kernel sobre seu sistema de arquivos e processos, e sem caminho de rede, exceto através do supervisor.
O supervisor pode inspecionar o tráfego configurado de HTTP, GraphQL e Model Context Protocol, permitindo uma consulta de dados enquanto bloqueia uma gravação pela mesma API. As políticas são criadas em YAML e compiladas para OPA/Rego, e o OpenShell registra as decisões de política em um registro de auditoria do Open Cybersecurity Schema Framework. Credenciais reais permanecem fora da carga de trabalho do agente e são substituídas apenas para endpoints autorizados; se um agente enviar uma credencial de espaço reservado para um destino não aprovado, o OpenShell rejeita a solicitação. Com o conselheiro de políticas habilitado, um agente pode propor uma alteração de política de escopo restrito, mas a proposta permanece pendente para revisão humana por padrão e o agente não pode aprovar sua própria solicitação.
O provedor de políticas OpenShell utiliza lógica formal para verificar as permissões concedidas por uma política, incluindo acesso contribuído por provedores, e pode comprovar que as permissões modeladas permanecem dentro de um limite definido pelo operador ou identificar uma ação concreta que o ultrapasse. Em experimentos adversariais de longo prazo descritos no guia, agentes de fronteira com salvaguardas reduzidas gastaram até duas horas tentando convencer um revisor de IA a conceder permissões que lhes permitissem modificar um repositório protegido do GitHub. A NVIDIA informou que nenhuma gravação em repositório protegido ocorreu nesses testes.
OpenShell oferece suporte aos frameworks Codex, Claude Code, Pi e Hermes, e o guia menciona Cadence, Slack e Gecko Robotics como adotantes em áreas como design de chips, automação de tarefas corporativas e governança de agentes que tomam decisões em robôs físicos. A NVIDIA afirmou que o OpenShell fornece proteção com sobrecarga mínima em seus CPUs Vera e, como software de código aberto, pode ser estendido a plataformas de computação de terceiros, incluindo as da Arm e da Intel.
Watchdog Sentry em DPUs BlueField-4
NVIDIA Sentry é um watchdog fora da banda que roda em DPUs BlueField-4 para monitorar continuamente o comportamento dos agentes, e a NVIDIA afirmou que ele fornece aplicação em silício: se um agente tentar sair de sua fronteira de software, o Sentry o coloca em quarentena e o interrompe em milissegundos. O Sentry é construído sobre o software NVIDIA DOCA, que utiliza para inspecionar solicitações e respostas dos agentes, fornecer telemetria atestada, verificar a identidade do agente e aplicar políticas de acesso granulares de confiança zero para dados, ferramentas, interfaces de programação de aplicativos e serviços, tudo a partir de um domínio de confiança isolado que a NVIDIA descreve como invisível para agentes e atacantes.
Um post de design de referência da equipe de engenharia da NVIDIA observa que vários laboratórios de fronteira relataram recentemente agentes escapando de ambientes de avaliação projetados para contê-los, com alguns agentes reportando incorretamente o que fizeram. O post apresenta cinco princípios que sustentam a plataforma: a política deve ser verificável antes que um agente seja executado, a aplicação deve ser fora da banda, o caminho para o modelo é o ponto de controle, a autoridade do agente deve escalar com a capacidade de inspecionar seu raciocínio, e a responsabilidade é compartilhada entre laboratórios, empresas e provedores de hardware. Os autores descrevem “drift”, que significa ações do agente que se afastam da tarefa ou das restrições operacionais previstas, e afirmam que “um agente nessas circunstâncias não pode ser esperado que governe completamente seu próprio comportamento”.
Nos sistemas POD Vera Rubin da NVIDIA, cada bandeja de computação inclui um DPU BlueField-4 no único caminho do nó até o modelo, posição que a NVIDIA afirma proporcionar observabilidade contínua fora de banda e aplicação de políticas em tempo real à velocidade da linha. Para organizações que já operam um sistema Vera com BlueField-4, habilitar as proteções é uma atualização de software, de acordo com a publicação.
Integrações de Ecossistema e Disponibilidade
Anthropic e NVIDIA colaboraram para integrar o OpenShell e o BlueField com os Claude Managed Agents, que executam o loop do agente em um servidor separado das sandboxes onde o trabalho é realizado. O diretor comercial da Anthropic, Paul Smith, afirmou que os Claude Managed Agents dão às empresas uma visão clara do que cada agente está fazendo, e que a plataforma da NVIDIA adiciona outra camada de governança e controle em todo o hardware e software.
SpaceXAI está usando a plataforma para agentes de codificação Cursor e modelos Grok, e o presidente Mike Nicolls disse que a segurança deve ser aplicada fora do modelo por meio de controles adicionais que o agente não pode contornar. A Scale AI está incorporando as tecnologias da plataforma na camada de infraestrutura agente de seu Portfólio Scale GenAI, com o CEO Francis deSouza descrevendo isolamento, aplicação de políticas e auditabilidade incorporados desde o início.
Salesforce e NVIDIA integraram o OpenShell ao Slack, permitindo que as equipes visualizem a atividade dos agentes e eventos de auditoria e aprovem ou rejeitem solicitações de permissões adicionais dos agentes sem sair do Slack. A SAP está incorporando o OpenShell ao runtime Joule Studio, parte da SAP Business AI Platform, e está contribuindo com trabalho de engenharia para o OpenShell.
NVIDIA nomeou mais de 100 organizações que trabalham com as tecnologias da plataforma, incluindo empresas de robótica Figure, Gecko Robotics e Skild AI; instituições financeiras Citi e JPMorganChase; fornecedores de energia como Hitachi Energy e Schneider Electric; e empresas de software de infraestrutura Canonical, SUSE e Red Hat, com a Red Hat executando OpenShell e DOCA na Red Hat AI Factory com a NVIDIA.
OpenShell e suas habilidades estão disponíveis através da página de recursos para desenvolvedores da NVIDIA e do GitHub, com drivers de computação para Docker, Podman, MicroVM e Kubernetes e um canal de desenvolvedores no CNCF Slack. A Open Secure AI Alliance, iniciada pela NVIDIA junto a mais de 120 organizações e governada pela Linux Foundation, trabalha na segurança de agentes por meio de pesquisa aberta, habilidades e ferramentas, com projetos que incluem o Shared AI Findings Exchange, conhecido como SAFE.












