Anthropic a anunțat marți o extindere majoră a eforturilor sale de acces model centrate pe securitate, restructurarea inițiativei sale de acces verificat într-un program formal de verificare cibernetică (CVP) cu trei niveluri distincte pentru profesioniștii în securitate cibernetică. Mișcarea vine în momentul în care compania a dezvăluit că inițiativa sa Project Glasswing a descoperit cel puțin 129.000 de vulnerabilități software verificate din aprilie.

Programul restructurat permite echipelor de securitate verificate să ruleze cele mai capabile modele Anthropic – inclusiv Claude Opus 5.5, Claude Sonnet 5.5 și Claude Mythos 5.1 – cu măsuri de protecție reduse și blocarea clasificatoarelor, permisiuni care în mod normal nu sunt disponibile pentru utilizatorii generali. Potrivit Anthropic, scopul este de a pune capabilitățile AI de frontieră în mâinile apărătorilor înainte ca actorii rău intenționați să armeze aceleași instrumente. For more context on this story, see our ongoing breaking AI news.

Trei niveluri de acces, trei scenarii de amenințare

Noul program este organizat în jurul a trei niveluri de acces, fiecare adaptat unui tip diferit de lucru de securitate:

  • Defense Access acoperă operațiuni defensive, cum ar fi răspunsul la incident, inginerie inversă a malware-ului și analiza și validarea vulnerabilităților.
  • Red Team Access adaugă teste de penetrare autorizate și red-teaming la cazurile de utilizare defensive, permițând atacuri simulate împotriva sistemelor pe care organizațiile au permisiunea de a le testa.
  • Accesul specializat are cele mai puține garanții și este rezervat unui set limitat de organizații verificate care sunt autorizate să testeze ele însele sistemele de siguranță AI.

Organizațiile și echipele individuale de securitate solicită nivelul care se potrivește cu munca lor, iar Anthropic examinează fiecare aplicație înainte de a acorda acces. Compania a spus că toate cele trei niveluri includ acces la modelele sale emblematice actuale, precum și la modelele noi lansate în viitor.

Măsuri de siguranță Still Bite — Selectiv

Anthropic a asociat anunțul cu date de evaluare menite să arate că sistemul de niveluri separă munca defensivă benignă de capacitatea cu adevărat periculoasă. Într-o evaluare CyScenarioBench pe Claude Opus 5.5, compania a raportat că măsurile de protecție au blocat 46 din 50 de sarcini din nivelul Defense Access. În nivelul Red Team Access pe același model, niciuna dintre sarcini nu a fost blocată, iar modelul a finalizat 34 din 50 - aceeași rată de finalizare înregistrată atunci când nu s-au aplicat măsuri de siguranță.

În schimb, fără acces CVP, fiecare sarcină a fost blocată la primul prompt, potrivit Anthropic.

„Aceste evaluări ne oferă încredere că putem pune la dispoziție capabilități cibernetice avansate în siguranță unui set mai larg de apărători, extinzând eforturile defensive pe care le-am început cu Proiectul Glasswing”, a spus compania în anunțul său, care a fost raportat pe scară largă de The Hacker News, Reuters și SecurityWeek.

Designul reflectă pariul că majoritatea lucrărilor de securitate defensivă - corecție, analiză de jurnal, triaj malware - pot continua sub balustrade stricte, în timp ce testarea ofensivă legitimă necesită un coridor mai larg. De asemenea, reflectă modul în care industria de securitate a gestionat de mult uneltele cu dublă utilizare: examinați medicul, nu doar instrumentul.

Amprenta în expansiune a lui Glasswing

Extinderea programului este strâns legată de Project Glasswing, inițiativa Anthropic de a-și aplica modelele la consolidarea software-ului critic. Compania a spus că Glasswing a descoperit cel puțin 129.000 de vulnerabilități software verificate între aprilie și iulie 2026 și alte 5.500 de vulnerabilități verificate între aprilie și octombrie, prin eforturi de scanare open-source.

Dintre vulnerabilitățile verificate, mai mult de 33.000 au fost până acum evaluate ca fiind critice sau de severitate ridicată - o cifră Anthropic descrie ca fiind probabil o subnumărare semnificativă, deoarece se bazează pe datele sondajului doar de la un subset de parteneri Glasswing. Compania estimează că impactul real ar putea fi de cel puțin cinci ori mai mare.

O viziune măsurată a descoperirii vulnerabilităților bazate pe inteligență artificială

Analiza independentă sugerează că valul de defecte găsite de AI nu se traduce direct într-un val de încălcări exploatate. Într-o analiză publicată la sfârșitul lunii trecute, cercetătorul VulnCheck Patrick Garrity a descoperit că doar 2 din cele 300 de vulnerabilități descoperite de Anthropic sau Project Glasswing – aproximativ 0,67 la sută – au fost exploatate în sălbăticie.

Cele două defecte exploatate sunt CVE-2026-26980, o vulnerabilitate de injectare SQL în Ghost CMS și CVE-2026-61500, o defecțiune de falsificare a sesiunii în Rejetto HTTP File Server. Datele susțin o nuanță pe care cercetătorii în domeniul securității au subliniat-o: AI reduce bariera în calea descoperirii vulnerabilităților, dar majoritatea defectelor pe care le prezintă nu au fost niciodată pe radarele atacatorilor.

Anunțul ajunge, de asemenea, pe fondul dezbaterii mai ample despre munca de securitate generată de AI. Cercetările de la 1Password și Veracode au arătat că patch-urile de vulnerabilitate scrise de AI pot introduce noi defecte, subliniind că automatizarea ajută, dar nu înlocuiește verificarea umană.

Ce înseamnă pentru industria de securitate

Pentru echipele de securitate, CVP scade energia de activare pentru utilizarea modelelor de frontieră în munca defensivă reală. Răspunsurile la incident obțin o cale sancționată către asistență pentru analiza malware; testerii de penetrare obțin un mediu guvernat pentru atacurile asistate de AI; iar grupul mic de organizații care auditează sistemele de siguranță AI primesc cel mai puțin acces restricționat.

Pentru Anthropic, programul este atât o strategie de siguranță, cât și una comercială. Acesta concretizează poziția companiei conform căreia capabilitățile cibernetice puternice ar trebui să fie eliberate în mod deliberat, pentru apărătorii verificați, mai degrabă decât suprimate în întregime - un contrast cu rivalii care s-au confruntat cu controlul asupra modelelor cu controale cibernetice mai slabe. De asemenea, adâncește relațiile Anthropic cu întreprinderile cel mai probabil să plătească pentru accesul la modele de frontieră: guverne, operatori de infrastructură critică și furnizori mari de securitate.

Compania nu a anunțat modificări ale prețurilor legate de program, iar cererile sunt procesate prin canalele de acces verificate existente ale Anthropic. Având în vedere amploarea a ceea ce Glasswing a ieșit deja la suprafață – și recunoașterea propriei companii că cifrele probabil subestimează realitatea – industria de securitate va urmări câte dintre aceste 129.000 de constatări vor fi remediate înainte ca atacatorii să le găsească primii.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →