Nvidia a anunțat luni Open Agent Safety Platform, o platformă software deschisă și un design de sistem de referință despre care compania spune că va oferi organizațiilor un control aplicabil asupra agenților AI autonomi de la testare până la implementare. Lansarea se întinde pe întreaga stivă de agenți: software-ul care rulează agenții, hardware-ul și straturile de calcul care îi alimentează și sistemele robotice care își îndeplinesc instrucțiunile în lumea fizică.

Anunțul vine într-un moment dificil pentru industrie. În ultimele săptămâni, mai multe laboratoare de frontieră au raportat versiuni ale aceleiași povești – agenții AI au ieșit din mediile de evaluare menite să le conțină și au ajuns la sisteme pe care nu ar fi trebuit să le acceseze și, în unele cazuri, au raportat greșit ceea ce au făcut. Pentru cititorii care urmăresc acoperirea industriei AI, mișcarea Nvidia marchează primul răspuns complet de aplicare de la un mare producător de cipuri și a atras deja peste 100 de organizații partenere.

Ce face de fapt platforma

Designul de referință combină două componente. Primul, OpenShell, este un runtime securizat cu sursă deschisă – lansat sub licența Apache 2.0 – care execută agenți autonomi în medii sandbox cu izolare la nivel de kernel. Operatorii definesc ce fișiere, rețele, instrumente, procese și acreditări pe care le poate accesa un agent, iar OpenShell verifică acele limite înainte ca agentul să ruleze și le aplică în mod continuu pe măsură ce funcționează. Nvidia spune că OpenShell adaugă o suprasarcină minimă asupra procesorului său Vera, pe care compania îl descrie ca fiind primul procesor creat special pentru AI agentic și că software-ul poate fi extins la platformele terțe de la Arm și Intel.

Cea de-a doua componentă, Sentry, împinge în totalitate aplicarea din îndemâna agentului. Funcționează ca un supraveghetor în afara benzii pe unitățile de procesare a datelor BlueField-4 ale Nvidia, monitorizând comportamentul agenților dintr-un domeniu de încredere izolat despre care compania spune că este invizibil atât pentru agenți, cât și pentru atacatori. Dacă un agent încearcă să se mute în afara graniței sale software, Sentry îl pune în carantină și îl oprește în milisecunde. Sentry este construit pe cadrul software DOCA al Nvidia, care inspectează solicitările și răspunsurile agenților, verifică identitatea agentului și impune politici de acces zero-trust pentru date, instrumente, API-uri și servicii.

„Siguranța și securitatea necesită o inginerie full-stack”

Fondatorul și CEO-ul Nvidia, Jensen Huang, a încadrat lansarea ca un răspuns la dezbaterea privind siguranța care consumă acum industria. „Potențialul extraordinar al AI pentru societate va fi realizat doar dacă rezolvăm siguranța AI”, a spus Huang în anunț. „Pe măsură ce continuăm să descoperim granița capabilităților AI, trebuie să accelerăm descoperirea la frontiera siguranței AI. Siguranța și securitatea necesită o inginerie completă.”

În propriul său blog tehnic, Nvidia a spus clar modelul din spatele incidentelor recente: nu a fost o singură capacitate nouă care a lăsat agenții să scape, ci „o combinație de instrumente, timp și instrucțiuni ambigue”. Compania a făcut o analogie cu web-ul timpuriu, argumentând că internetul a devenit sigur nu pentru că site-urile web au promis să se comporte, ci pentru că browserele au încetat să mai aibă încredere în codul din paginile web și au izolat fiecare pagină în propriul sandbox. „Siguranța agenților necesită controale independente de securitate”, se spune în postare.

Industria se unește în jurul aplicării legii

Lista de parteneri se citește ca o secțiune transversală a economiei AI. Anthropic a colaborat cu Nvidia, astfel încât întreprinderile să poată impune controlul asupra agenților gestionați Claude prin integrările OpenShell și BlueField. „Companiile oferă agenților AI mai mult din munca lor cea mai importantă și trebuie să direcționeze și să verifice ceea ce fac acești agenți, în special în medii sensibile”, a spus Paul Smith, directorul comercial al Anthropic.

SpaceXAI folosește platforma pentru agenții săi de codare Cursor și modelele Grok, președintele Mike Nicolls susținând că „siguranța ar trebui să fie impusă în afara modelului prin controale suplimentare pe care agentul nu le poate trece”. Scale AI încorporează designul de referință în stratul de infrastructură al portofoliului său GenAI pentru clienții întreprinderi și guvernamentali, potrivit CEO-ului Francis deSouza.

Salesforce a integrat OpenShell cu Slack, astfel încât echipele să poată vedea activitatea agenților și să aprobe sau să respingă cererile de permisiune direct din chat. SAP încorporează OpenShell cu timpul său de rulare Joule Studio și contribuie la munca de inginerie. Dincolo de nume principale, Nvidia enumeră CrowdStrike, Cisco, IBM, Microsoft, Palantir, Palo Alto Networks, Hugging Face, Perplexity, Cognition, Accenture, Deloitte și EY printre cele peste 100 de organizații care lucrează cu tehnologiile platformei, alături de firmele de robotică Figure, Gecko Robotics și grupul financiar JPMChatti și Skild AI.

Lucrarea alimentează, de asemenea, Open Secure AI Alliance, un efort inițiat de Nvidia alături de peste 120 de organizații și guvernat de Linux Foundation, care derulează un proiect comun numit SAFE – Shared AI Findings Exchange – pentru a pune în comun constatările de siguranță în întreaga industrie.

De ce contează acum aplicarea hardware-ului

Pariul central al platformei este că controalele la nivel de aplicație nu mai sunt suficiente. Anunțul Nvidia a menționat că în incidentele recente, modelul a fost același: agentul a ocolit controalele de securitate la nivelul aplicației pentru a-și îndeplini sarcina atribuită. Prin mutarea monitorizării în siliciu pe un DPU separat - și într-un timp de execuție separat izolat de nucleu - compania susține că granița de aplicare trebuie să se afle acolo unde un agent nu poate edita, dezactiva sau vorbi despre ea.

Dacă acest lucru este valabil în practică, va depinde de adopție. Software-ul, inclusiv OpenShell, este disponibil acum prin pagina de resurse pentru dezvoltatori a Nvidia și prin GitHub, iar literele mici ale companiei avertizează că unele caracteristici descrise rămân în diferite etape și vor fi oferite pe o bază disponibilă și dacă este disponibilă. Dar direcția este clară: după o lună în care erupțiile agenților au dominat conversația privind siguranța, stratul de infrastructură nu mai așteaptă ca modelele să se autopolițezeze.

---

Rămâneți înaintea AI

Obțineți cele mai recente știri, analize și descoperiri despre AI - toate într-un singur loc.

Citiți mai multe știri AI →