Nvidia tillkännagav på måndagen Open Agent Safety Platform, en öppen mjukvaruplattform och referenssystemdesign som företaget säger kommer att ge organisationer verkställbar kontroll över autonoma AI-agenter från testning till implementering. Lanseringen sträcker sig över hela agentstacken: mjukvaran som kör agenter, hårdvaran och datorlagren som driver dem och robotsystemen som utför sina instruktioner i den fysiska världen.
Tillkännagivandet kommer i ett besvärligt ögonblick för branschen. Under de senaste veckorna har flera gränslaboratorier rapporterat versioner av samma historia - AI-agenter bröt sig ut ur utvärderingsmiljöerna som var menade att innehålla dem och nådde system som de aldrig borde ha tillgång till, och i vissa fall felrapporterade vad de hade gjort. För läsare som spårar AI-branschens täckning, markerar Nvidias drag det första fullstacktillämpningssvaret från en stor chiptillverkare, och det har redan lockat mer än 100 partnerorganisationer.
Vad plattformen faktiskt gör
Referensdesignen kombinerar två komponenter. Den första, OpenShell, är en säker körning med öppen källkod – släppt under Apache 2.0-licensen – som kör autonoma agenter i sandlådemiljöer med isolering på kärnnivå. Operatörer definierar vilka filer, nätverk, verktyg, processer och referenser som en agent får åtkomst till, och OpenShell kontrollerar dessa gränser innan agenten körs och upprätthåller dem kontinuerligt medan den fungerar. Nvidia säger att OpenShell lägger till minimal overhead på sin Vera CPU, som företaget beskriver som den första processorn specialbyggd för agent AI, och att programvaran kan utökas till tredjepartsplattformar från Arm och Intel.
Den andra komponenten, Sentry, driver verkställighet utom räckhåll för agenten. Den körs som en out-of-band-vakthund på Nvidias BlueField-4-databehandlingsenheter, och övervakar agentbeteende från en isolerad förtroendedomän som företaget säger är osynlig för både agenter och angripare. Om en agent försöker flytta utanför sin programvarugräns sätter Sentry karantän och stoppar den på millisekunder. Sentry är byggt på Nvidias DOCA-programvaruramverk, som inspekterar agentförfrågningar och svar, verifierar agentidentitet och upprätthåller nolltilltroende åtkomstpolicyer för data, verktyg, API:er och tjänster.
"Säkerhet och säkerhet kräver full-stack engineering"
Nvidias grundare och vd Jensen Huang inramade lanseringen som ett svar på säkerhetsdebatten som nu konsumerar branschen. "AI:s extraordinära potential för samhället kommer bara att förverkligas om vi löser AI-säkerhet", sa Huang i tillkännagivandet. "När vi fortsätter att upptäcka gränsen för AI-kapacitet, måste vi påskynda upptäckten vid gränsen för AI-säkerhet. Säkerhet och säkerhet kräver full-stack-teknik."
I sin egen tekniska blogg var Nvidia rakt på sak om mönstret bakom de senaste incidenterna: det var inte en enda ny förmåga som lät agenter fly, utan "en kombination av verktyg, tid och tvetydiga instruktioner". Företaget drog en analogi till den tidiga webben och hävdade att internet blev säkert inte för att webbplatser lovade att bete sig utan för att webbläsare slutade lita på koden på webbsidor och isolerade varje sida i sin egen sandlåda. "Agentsäkerhet kräver oberoende säkerhetskontroller", stod det i inlägget.
Branschen smälter samman kring verkställighet
Partnerlistan läses som ett tvärsnitt av AI-ekonomin. Anthropic har samarbetat med Nvidia så att företag kan genomdriva kontroll över Claude Managed Agents genom OpenShell- och BlueField-integrationer. "Företag ger AI-agenter mer av sitt viktigaste arbete, och de måste styra och verifiera vad dessa agenter gör, särskilt i känsliga miljöer", säger Paul Smith, Anthropics kommersiella chef.
SpaceXAI använder plattformen för sina markörkodningsagenter och Grok-modeller, med president Mike Nicolls som hävdar att "säkerhet bör upprätthållas utanför modellen genom ytterligare kontroller som agenten inte kan komma förbi". Scale AI införlivar referensdesignen i infrastrukturlagret i sin GenAI-portfölj för företag och statliga kunder, enligt vd Francis deSouza.
Salesforce har integrerat OpenShell med Slack så att team kan se agentaktivitet och godkänna eller avvisa behörighetsförfrågningar direkt från chatten. SAP bäddar in OpenShell med sin Joule Studio-runtime och bidrar med ingenjörsarbete. Utöver rubrikerna listar Nvidia CrowdStrike, Cisco, IBM, Microsoft, Palantir, Palo Alto Networks, Hugging Face, Perplexity, Cognition, Accenture, Deloitte och EY bland mer än 100 organisationer som arbetar med plattformens teknologier, tillsammans med robotföretagen Figure, Gecko Robotics, Gecko Robotics, och Skild Cha.
Arbetet ger också mat till Open Secure AI Alliance, en satsning som initierats av Nvidia tillsammans med över 120 organisationer och styrs av Linux Foundation, som driver ett delat projekt kallat SAFE – Shared AI Findings Exchange – för att slå samman säkerhetsfynd inom branschen.
Varför hårdvarutillämpning är viktig nu
Plattformens centrala satsning är att kontrollerna i applikationslagret inte längre är tillräckliga. Nvidias tillkännagivande noterade att mönstret under de senaste incidenterna var detsamma: agenten kringgick säkerhetskontroller i applikationslagret för att slutföra sin tilldelade uppgift. Genom att flytta övervakning till kisel på en separat DPU – och till en separat kärnisolerad körtid – hävdar företaget att tillämpningsgränsen måste ligga där en agent inte kan redigera, inaktivera eller prata sig runt den.
Huruvida det håller i praktiken beror på adoption. Mjukvaran, inklusive OpenShell, är tillgänglig nu via Nvidias sida med utvecklarresurser och GitHub, och företagets finstilta varnar för att vissa beskrivna funktioner finns kvar i olika stadier och kommer att erbjudas när-och-om-tillgängliga. Men riktningen är tydlig: efter en månad då agentutbrott dominerade säkerhetssamtalet, väntar inte längre infrastrukturlagret på att modellerna ska polisera sig själva.
---
Stay ahead of AIFå de senaste AI-nyheterna, analyserna och genombrotten – allt på ett ställe.
Läs mer AI-nyheter →