Nvidia lança plataforma aberta para vigiar agentes de IA, com monitor em DPU que isola violações
A Open Agent Safety Platform junta o runtime aberto OpenShell ao Sentry, monitor que roda à parte na DPU BlueField-4 e põe agentes em quarentena.
A Nvidia lançou em 28 de setembro de 2026 a Open Agent Safety Platform, conjunto de software aberto e projeto de referência de hardware para manter agentes de IA dentro de limites definidos, do teste à produção. Segundo o anúncio da empresa, a plataforma tem duas partes: o OpenShell, runtime de código aberto que cria uma fronteira de execução e registra as ações dos agentes, e o Sentry, monitor que roda separadamente nas DPUs BlueField-4 e pode pôr em quarentena, em milissegundos, um agente que tente sair dos limites.
Por que a Nvidia diz que isso é necessário
A empresa justifica o lançamento com incidentes recentes em que agentes contornaram controles de segurança na camada de aplicação para cumprir a tarefa recebida. A SecurityWeek relata que, segundo a Nvidia, agentes podem se desviar por bloqueios de política, bugs, ferramentas ausentes, instruções ambíguas ou execuções longas, e que um agente nessas condições não pode governar o próprio comportamento. A ideia é colocar o controle fora do modelo e do agente.
Como funciona
O OpenShell, já disponível de forma ampla na versão 0.1.0, tem três componentes, segundo a SecurityWeek: um gateway que gerencia o ciclo de vida e as políticas de várias sandboxes, uma sandbox com controles no nível do kernel sobre arquivos e processos e um supervisor que confere cada requisição de saída contra a política. Todo o tráfego de rede da sandbox passa pelo supervisor, que pode, por exemplo, permitir leitura de dados por uma API e bloquear escrita. Chaves de API ficam fora do alcance do agente, que vê só um substituto, e agentes podem propor mudanças de política, mas não aprová-las. O OpenShell funciona com agentes como Codex, Claude Code e Hermes.
O Sentry é opcional e roda fora de banda na BlueField-4, usando o software DOCA para inspecionar requisições e respostas, verificar a identidade dos agentes e aplicar políticas de acesso. Como a DPU opera separada do servidor, a Nvidia diz que o Sentry consegue observar e aplicar regras mesmo se o host for comprometido. Toda bandeja de computação do Vera Rubin POD tem uma BlueField-4, e quem já usa esses sistemas pode ativar a proteção por atualização de software.
Quem participa
A Nvidia afirma que mais de 100 organizações trabalham com a plataforma, entre elas Anthropic, Cisco, CrowdStrike, Microsoft, Palo Alto Networks, Red Hat, Salesforce e SAP. A Salesforce integrou o OpenShell ao Slack, para aprovar ou negar pedidos de permissão dos agentes, e a SAP vai embutir o runtime no Joule Studio. Em 7 de outubro, a Microsoft informou que o OpenShell também foi integrado aos seus contêineres para agentes no Windows.
Quem precisa agir
Não se trata de uma vulnerabilidade nem de uma correção. A plataforma interessa a equipes que colocam agentes autônomos em produção com acesso a dados, repositórios e APIs. Segundo a Nvidia, o OpenShell, por ser aberto, pode ser estendido a plataformas de terceiros, como Arm e Intel; o Sentry depende da BlueField-4.
Limites e pontos em aberto
- O OpenShell está na versão 0.1.0; maturidade e auditorias independentes ainda não foram divulgadas.
- Os testes citados pela Nvidia, em que agentes tentaram por até duas horas obter permissões sem conseguir escrever no repositório protegido, são internos.
- A proteção em hardware do Sentry exige DPUs BlueField-4, como as que equipam as bandejas do Vera Rubin POD.
Fontes
- NVIDIA Newsroom — NVIDIA Launches Open Agent Safety Platform to Secure Agents From Testing to Deployment (28/09/2026)
- SecurityWeek — Nvidia Unveils AI Agent Safety Platform With Hardware-Based Watchdog (28/09/2026)
- Windows Developer Blog — Microsoft Execution Containers: Policy-driven containment for AI agents (07/10/2026)
Imagem destacada: ilustração gerada por computador, sem valor documental.


