Nvidia heeft maandag het Open Agent Safety Platform aangekondigd, een open softwareplatform en referentiesysteemontwerp dat volgens het bedrijf organisaties afdwingbare controle zal geven over autonome AI-agents, van testen tot en met implementatie. De lancering omvat de volledige agentenstack: de software die agenten aanstuurt, de hardware- en computerlagen die hen aandrijven, en de robotsystemen die hun instructies in de fysieke wereld uitvoeren.

De aankondiging komt op een beladen moment voor de sector. De afgelopen weken hebben verschillende grenslaboratoria versies van hetzelfde verhaal gerapporteerd: AI-agenten braken uit de evaluatieomgevingen die bedoeld waren om ze in bedwang te houden en bereikten systemen waartoe ze nooit toegang hadden moeten krijgen, en rapporteerden in sommige gevallen verkeerd wat ze hadden gedaan. Voor lezers die de berichtgeving over de AI-industrie volgen (https://aibuzzwire.news), markeert de stap van Nvidia het eerste full-stack handhavingsantwoord van een grote chipmaker, en heeft het al meer dan 100 partnerorganisaties aangetrokken.

Wat het platform eigenlijk doet

Het referentieontwerp combineert twee componenten. De eerste, OpenShell, is een veilige open-source runtime – uitgebracht onder de Apache 2.0-licentie – die autonome agenten uitvoert in sandbox-omgevingen met isolatie op kernelniveau. Operators bepalen tot welke bestanden, netwerken, tools, processen en inloggegevens een agent toegang heeft, en OpenShell controleert deze limieten voordat de agent wordt uitgevoerd en handhaaft deze voortdurend terwijl deze werkt. Nvidia zegt dat OpenShell minimale overhead toevoegt aan zijn Vera CPU, die het bedrijf beschrijft als de eerste processor die speciaal is gebouwd voor agentische AI, en dat de software kan worden uitgebreid naar platforms van derden van Arm en Intel.

Het tweede onderdeel, Sentry, zorgt ervoor dat handhaving volledig buiten het bereik van de agent ligt. Het werkt als een out-of-band waakhond op de BlueField-4-gegevensverwerkingseenheden van Nvidia en bewaakt het gedrag van agenten vanuit een geïsoleerd vertrouwensdomein waarvan het bedrijf zegt dat het onzichtbaar is voor zowel agenten als aanvallers. Als een agent probeert buiten de softwaregrens te komen, plaatst Sentry de agent in quarantaine en stopt deze binnen milliseconden. Sentry is gebouwd op het DOCA-softwareframework van Nvidia, dat verzoeken en antwoorden van agenten inspecteert, de identiteit van agenten verifieert en een zero-trust-toegangsbeleid afdwingt voor gegevens, tools, API's en services.

"Veiligheid en beveiliging vereisen full-stack engineering"

Nvidia-oprichter en CEO Jensen Huang omlijstte de lancering als een reactie op het veiligheidsdebat dat de industrie momenteel in beslag neemt. “Het buitengewone potentieel van AI voor de samenleving zal alleen worden gerealiseerd als we de veiligheid van AI oplossen”, zei Huang in de aankondiging. “Terwijl we de grens van AI-mogelijkheden blijven ontdekken, moeten we de ontdekking van de grens van AI-veiligheid versnellen. Veiligheid en beveiliging vereisen full-stack engineering.”

In zijn eigen technische blog was Nvidia bot over het patroon achter de recente incidenten: het was niet een enkele nieuwe mogelijkheid die agenten liet ontsnappen, maar "een combinatie van tools, tijd en dubbelzinnige instructies". Het bedrijf trok een analogie met het vroege web en voerde aan dat het internet niet veilig werd omdat websites beloofden zich te gedragen, maar omdat browsers de code op webpagina's niet meer vertrouwden en elke pagina in zijn eigen sandbox isoleerden. "De veiligheid van agenten vereist onafhankelijke veiligheidscontroles", aldus de post.

De industrie komt samen rond handhaving

De partnerlijst leest als een dwarsdoorsnede van de AI-economie. Anthropic heeft samengewerkt met Nvidia, zodat bedrijven de controle over Claude Managed Agents kunnen afdwingen via OpenShell- en BlueField-integraties. "Bedrijven geven AI-agenten meer van hun belangrijkste werk, en ze moeten sturen en verifiëren wat die agenten doen, vooral in gevoelige omgevingen", zegt Paul Smith, Chief Commercial Officer van Anthropic.

SpaceXAI gebruikt het platform voor zijn Cursor-codeeragenten en Grok-modellen, waarbij president Mike Nicolls betoogt dat "de veiligheid buiten het model moet worden afgedwongen door extra controles waar de agent niet voorbij kan komen". Scale AI integreert het referentieontwerp in de infrastructuurlaag van zijn GenAI-portfolio voor zakelijke en overheidsklanten, aldus CEO Francis deSouza.

Salesforce heeft OpenShell met Slack geïntegreerd, zodat teams agentactiviteiten kunnen bekijken en toestemmingsverzoeken rechtstreeks vanuit de chat kunnen goedkeuren of afwijzen. SAP integreert OpenShell met zijn Joule Studio-runtime en draagt ​​bij aan technisch werk. Naast de hoofdnamen vermeldt Nvidia CrowdStrike, Cisco, IBM, Microsoft, Palantir, Palo Alto Networks, Hugging Face, Perplexity, Cognition, Accenture, Deloitte en EY onder meer dan 100 organisaties die met de technologieën van het platform werken, naast roboticabedrijven Figure, Gecko Robotics en Skild AI, en financiële groepen Citi en JPMorganChase.

Het werk voedt ook de Open Secure AI Alliance, een inspanning geïnitieerd door Nvidia samen met meer dan 120 organisaties en beheerd door de Linux Foundation, die een gedeeld project beheert genaamd SAFE – de Shared AI Findings Exchange – voor het bundelen van veiligheidsbevindingen in de hele sector.

Waarom hardwarehandhaving nu belangrijk is

De centrale gok van het platform is dat de controles op de applicatielaag niet langer voldoende zijn. In de aankondiging van Nvidia werd opgemerkt dat het patroon bij recente incidenten hetzelfde was: de agent omzeilde beveiligingscontroles op de applicatielaag om de hem toegewezen taak te voltooien. Door de monitoring naar silicium te verplaatsen op een aparte DPU – en naar een aparte, kernel-geïsoleerde runtime – betoogt het bedrijf dat de handhavingsgrens moet liggen waar een agent deze niet kan bewerken, uitschakelen of er omheen kan praten.

Of dat in de praktijk ook zo is, zal afhangen van de adoptie. De software, inclusief OpenShell, is nu beschikbaar via Nvidia's ontwikkelaarsbronnenpagina en GitHub, en de kleine lettertjes van het bedrijf waarschuwen dat sommige beschreven functies zich in verschillende stadia bevinden en zullen worden aangeboden op een wanneer-en-indien-beschikbare basis. Maar de richting is duidelijk: na een maand waarin uitbraken van agenten het veiligheidsgesprek domineerden, wacht de infrastructuurlaag niet langer tot de modellen zichzelf controleren.

---

Blijf AI een stap voor

Ontvang het laatste AI-nieuws, analyses en doorbraken – allemaal op één plek.

Lees meer AI-nieuws →