Anthropic a publicat joi raportul său de informații despre amenințări din septembrie 2026, „Detectarea și combaterea utilizării abuzive a IA”, descriind modul în care echipa sa Threat Intelligence a identificat și perturbat actorii amenințărilor care l-au folosit în mod abuziv pe Claude între decembrie 2025 și august 2026. dezvoltare și distilarea modelelor ilicite. Potrivit companiei, fiecare campanie pe care o descrie a fost perturbată, iar informațiile au fost împărtășite autorităților și partenerilor din industrie, acolo unde a fost cazul.
Raportul ajunge într-un moment de control intens pentru industria AI și, în special, pentru Anthropic, deoarece știrile de ultimă oră AI săptămâna aceasta a fost dominată de dezvăluiri privind siguranța, conturile avertizorilor și presiunea crescândă din partea legislatorilor. De asemenea, vine alături de reportaje de la The New York Times și Politico care evidențiază încercările de a arma modelele de frontieră - inclusiv eforturile blocate legate de dezvoltarea armelor biologice.
Cum Anthropic urmărește actorii de amenințări activați de AI
Anthropic urmărește actorii în raportul său sub desemnatorii interni cunoscuți sub numele de Grupuri de amenințări generative sau GTG. Fiecare studiu de caz măsoară ceea ce compania numește uplift – creșterea capacității pe care AI o oferă unei operațiuni în trei dimensiuni: viteză, scară și adâncime. Cazurile de utilizare greșită au implicat modelele Claude Haiku, Sonnet și Opus. Niciunul nu a implicat modelele companiei Fable sau Mythos, cu excepția unui caz ilicit de distilare.
Anthropic își încadrează disponibilitatea de a publica mai degrabă ca pe o datorie decât ca un exercițiu de marketing, afirmând în raport că „credem că avem responsabilitatea de a dezvălui utilizarea abuzivă rău intenționată a serviciilor noastre”.
O operațiune legată de Midnight Blizzard care și-a reconstruit propriul program malware
Cel mai amplu caz cibernetic al raportului, urmărit ca GTG-20006, descrie un actor a cărui atribuire Anthropic spune că este în concordanță cu raportarea publică care îl leagă de Midnight Blizzard, grupul rus de hacking aliniat la stat cunoscut anterior ca Nobelium sau APT29. Unul dintre operatorii săi, o persoană care folosește mânerul „JackPoterz”, este vorbitor de rusă.
Potrivit raportului, grupul a vizat mai mult de 20 de organizații, concentrate între organisme guvernamentale, militare și diplomatice ucrainene. A compromis cel puțin trei furnizori de WiFi de hoteluri pentru a deturna înregistrările DNS, a preluat conturile WhatsApp a cel puțin doi foști oficiali ucraineni de nivel înalt și a furat peste 300.000 de înregistrări naționale de identitate, împreună cu datele din registrul comercial care acoperă mai mult de jumătate de milion de companii de la o autoritate tehnologică guvernamentală nord-africană.
Cel mai izbitor detaliu este adaptarea autonomă: Anthropic raportează că agenții AI ai actorului au modificat și reconstruit malware-ul grupului ori de câte ori produsele de securitate îl detectau - o buclă care anterior ar fi necesitat dezvoltatori calificați la cerere.
Recoltarea acreditărilor la scară și vânătoarea autonomă de zile zero
Un al doilea caz, GTG-50014, acoperă operatorii suspectați de afiliere la colectivul ShinyHunters. Conductele lor de colectare a acreditărilor au descărcat în masă 1,8 milioane de APK-uri Android și le-au scanat pentru secrete codificate. Într-un compromis al unui furnizor de tehnologie, a fost exfiltrat mai mult de un terabyte de date, inclusiv milioane de înregistrări ale cardurilor de plată. Un alt afiliat a extras date de la aproximativ 200 de clienți din aval ai unui furnizor de software ca serviciu încălcat și a aruncat peste 2.100 de seturi de jetoane Azure AD din peste 40 de chiriași corporativi în aproximativ 34 de ore - agenții AI efectuând aproape toată munca, conform raportului.
GTG-10007 este și mai serios pentru apărători. Anthropic atribuie acest cluster operatorilor vorbitori de limbă chineză probabil cu sediul în Changsha, Hunan – dintre care doi i-a identificat drept studenți de licență – care au vizat aproximativ cincizeci de organizații și au condus un program autonom de cercetare a vulnerabilității. Un singur flux de lucru, care se repetă pe dispozitivele de rețea, a dat peste o duzină de descoperiri posibile de zero-day într-o singură lună.
Extorcare, un hacktivist singuratic și un raid eșuat în AI Labs
Utilizarea abuzivă motivată din punct de vedere financiar are un loc proeminent. GTG-50020, un actor vorbitor de limbă rusă, a exfiltrat aproximativ 26 de gigaocteți de la o victimă și a căutat între 1,5 și 2,5 milioane de dolari pentru extorcare. Același grup a atacat apoi aproximativ treizeci de companii AI în aproximativ patru zile, cu scopul declarat de a accesa un model Claude pre-lansare. Anthropic spune că fiecare încercare de cale a eșuat și propriile sisteme nu au fost niciodată compromise.
La celălalt capăt al spectrului, GTG-50029 a fost un singur hacktivist vorbitor de limbă franceză care a exploatat o condiție de cursă de reinstalare a WordPress nedocumentată anterior împotriva a cel puțin patru site-uri, a obținut acces intern la cel puțin 14 din 42 de ținte urmărite și a exfiltrat aproximativ 140.000 de înregistrări - inclusiv opiniile politice ale utilizatorilor dintr-o platformă de campanie. Actorul a construit apoi o platformă de doxxing, fafsearch, încărcată cu zeci de milioane de rânduri.
Influențați operațiunile din Republica Centrafricană până în Malaezia
Nouă cazuri de operațiuni de influență din raport au provenit din Rusia, Iran, Turcia, Golful, Asia de Sud, Africa și Europa, acoperirea fiind măsurată pe scara Breakout a Brookings Institution. Într-un caz, GTG-04001, un actor vorbitor de limbă rusă cu sediul în Bangui, a produs conținut zilnic pentru Radio Lengo Songo, un post Anthropic legat de Politologie — filiala Africa Corps și Wagner, despre care ea a intrat sub controlul Serviciului de Informații Externe al Rusiei, la sfârșitul anului 2023. Operațiunea a produs falsuri pentru președintele Republicii Centrafricane, documente și contracte de loialitate guvernamentale și de fidelitate a Rusiei. evaluat ca Categoria a Patra pe scară.
O altă rețea, GTG-54002, a fost urmărită până la LKM Company, o agenție de publicitate digitală cu sediul în Franța, care operează aproximativ 70 de site-uri web de știri fabricate, 70 de conturi X potrivite și peste 250 de conturi de comentarii neautentice. Rețeaua a publicat cel puțin 8.913 articole în aproximativ 20 de limbi, dintre care 318 s-au concentrat pe Republica Democrată Congo.
Alegerile au fost și ele o țintă. GTG-84005, o platformă comercială de manipulare a alegerilor care vizează Malaezia pe care Anthropic a legat-o de BBS Bilisim Teknolojileri cu sediul la Istanbul, a gestionat aproximativ 1.000 de conturi X false în toate cele 222 de circumscripții parlamentare din Malaezia și a fabricat dosare împotriva unui politician din opoziție. Un grup separat, GTG-24015, a folosit patru conturi ca birou editorial asistat de inteligență artificială, care alimenta mass-media de stat rusă.
De ce este importantă divulgarea
Anthropic spune că a întrerupt activitatea în fiecare caz, a folosit rezultatele pentru a-și consolida garanțiile și a împărtășit informații cu autoritățile și partenerii din industrie, acolo unde este cazul. Publicarea unor studii de caz detaliate – complete cu analize de eșec ale propriilor detectări – rămâne rară în laboratoarele de frontieră, iar compania susține că transparența ridică nivelul de referință pentru întreaga industrie.
Raportul subliniază, de asemenea, o schimbare pe care echipele de securitate nu o mai pot ignora: cele mai periculoase operațiuni activate de AI descrise aici nu au fost demonstrații ipotetice, ci campanii în direct împotriva guvernelor, companiilor și alegerilor. Pe măsură ce modelele devin mai capabile, datele Anthropic sugerează că creșterea pe care o oferă adversarilor hotărâți se agravează – iar cel mai bun răspuns disponibil al apărătorilor, deocamdată, este vizibilitatea, dezvăluirea și o iterație mai rapidă a garanțiilor.
---
Rămâneți înaintea AIObțineți cele mai recente știri, analize și descoperiri despre AI - toate într-un singur loc.
Citiți mai multe știri AI →