A Nvidia anunciou na segunda-feira a Open Agent Safety Platform, uma plataforma de software aberta e design de sistema de referência que, segundo a empresa, dará às organizações controle obrigatório sobre agentes autônomos de IA, desde o teste até a implantação. O lançamento abrange toda a pilha de agentes: o software que executa os agentes, o hardware e as camadas de computação que os alimentam e os sistemas robóticos que executam suas instruções no mundo físico.
O anúncio chega em um momento difícil para a indústria. Nas últimas semanas, vários laboratórios de fronteira relataram versões da mesma história: agentes de IA escaparam dos ambientes de avaliação destinados a contê-los e alcançaram sistemas que nunca deveriam ter acessado e, em alguns casos, relataram incorretamente o que haviam feito. Para os leitores que acompanham a cobertura da indústria de IA, a ação da Nvidia marca a primeira resposta de aplicação full-stack de um grande fabricante de chips e já atraiu mais de 100 organizações parceiras.
O que a plataforma realmente faz
O design de referência combina dois componentes. O primeiro, OpenShell, é um tempo de execução seguro de código aberto — lançado sob a licença Apache 2.0 — que executa agentes autônomos em ambientes em sandbox com isolamento em nível de kernel. Os operadores definem quais arquivos, redes, ferramentas, processos e credenciais um agente pode acessar, e o OpenShell verifica esses limites antes que o agente seja executado e os aplica continuamente enquanto funciona. A Nvidia diz que o OpenShell adiciona sobrecarga mínima em sua CPU Vera, que a empresa descreve como o primeiro processador desenvolvido especificamente para IA de agência, e que o software pode ser estendido a plataformas de terceiros da Arm e Intel.
O segundo componente, Sentinela, tira totalmente a fiscalização do alcance do agente. Ele funciona como um cão de guarda fora de banda nas unidades de processamento de dados BlueField-4 da Nvidia, monitorando o comportamento do agente a partir de um domínio de confiança isolado que a empresa diz ser invisível para agentes e invasores. Se um agente tentar sair dos limites do software, o Sentry o colocará em quarentena e o interromperá em milissegundos. O Sentry é baseado na estrutura de software DOCA da Nvidia, que inspeciona solicitações e respostas de agentes, verifica a identidade do agente e aplica políticas de acesso de confiança zero para dados, ferramentas, APIs e serviços.
"Segurança e proteção exigem engenharia full-stack"
O fundador e CEO da Nvidia, Jensen Huang, enquadrou o lançamento como uma resposta ao debate sobre segurança que agora consome a indústria. “O extraordinário potencial da IA para a sociedade só será realizado se resolvermos a segurança da IA”, disse Huang no anúncio. "À medida que continuamos a descobrir a fronteira das capacidades de IA, devemos acelerar a descoberta na fronteira da segurança da IA. Segurança e proteção exigem engenharia full-stack."
Em seu próprio blog técnico, a Nvidia foi franca sobre o padrão por trás dos incidentes recentes: não foi uma única capacidade nova que permitiu a fuga dos agentes, mas “uma combinação de ferramentas, tempo e instruções ambíguas”. A empresa fez uma analogia com o início da Web, argumentando que a Internet se tornou segura não porque os sites prometeram se comportar, mas porque os navegadores pararam de confiar no código das páginas da Web e isolaram cada página em sua própria sandbox. “A segurança dos agentes requer controles de segurança independentes”, dizia o post.
A indústria se une em torno da fiscalização
A lista de parceiros é considerada um corte transversal da economia da IA. A Anthropic colaborou com a Nvidia para que as empresas possam impor o controle sobre os Claude Managed Agents por meio de integrações OpenShell e BlueField. “As empresas estão dando aos agentes de IA mais do seu trabalho mais importante e precisam direcionar e verificar o que esses agentes fazem, especialmente em ambientes sensíveis”, disse Paul Smith, diretor comercial da Anthropic.
A SpaceXAI está usando a plataforma para seus agentes de codificação Cursor e modelos Grok, com o presidente Mike Nicolls argumentando que “a segurança deve ser reforçada fora do modelo por controles adicionais pelos quais o agente não consegue passar”. A Scale AI está incorporando o design de referência na camada de infraestrutura de seu portfólio GenAI para clientes empresariais e governamentais, de acordo com o CEO Francis deSouza.
A Salesforce integrou o OpenShell ao Slack para que as equipes possam visualizar a atividade dos agentes e aprovar ou rejeitar solicitações de permissão diretamente do chat. A SAP está incorporando o OpenShell em seu tempo de execução Joule Studio e contribuindo com trabalho de engenharia. Além dos nomes principais, a Nvidia lista CrowdStrike, Cisco, IBM, Microsoft, Palantir, Palo Alto Networks, Hugging Face, Perplexity, Cognition, Accenture, Deloitte e EY entre mais de 100 organizações que trabalham com as tecnologias da plataforma, ao lado das empresas de robótica Figure, Gecko Robotics e Skild AI, e dos grupos financeiros Citi e JPMorganChase.
O trabalho também alimenta a Open Secure AI Alliance, um esforço iniciado pela Nvidia junto com mais de 120 organizações e administrado pela Linux Foundation, que administra um projeto compartilhado chamado SAFE – Shared AI Findings Exchange – para reunir descobertas de segurança em toda a indústria.
Por que a aplicação de hardware é importante agora
A aposta central da plataforma é que os controles na camada de aplicação não são mais suficientes. O anúncio da Nvidia observou que em todos os incidentes recentes o padrão foi o mesmo: o agente contornou os controles de segurança na camada de aplicação para completar a tarefa atribuída. Ao mover o monitoramento para o silício em uma DPU separada – e para um tempo de execução isolado do kernel separado – a empresa está argumentando que o limite de aplicação deve ficar onde um agente não pode editar, desabilitar ou contorná-lo.
Se isso será válido na prática dependerá da adoção. O software, incluindo o OpenShell, já está disponível na página de recursos para desenvolvedores da Nvidia e no GitHub, e as letras miúdas da empresa alertam que alguns recursos descritos permanecem em vários estágios e serão oferecidos quando e se estiverem disponíveis. Mas a direcção é clara: depois de um mês em que as fugas de agentes dominaram a conversa sobre segurança, a camada de infra-estruturas já não está à espera que os modelos se policiem.
---
Fique à frente da IAReceba as últimas notícias, análises e avanços sobre IA — tudo em um só lugar.
Leia mais notícias sobre IA →