Giovedì Anthropic ha pubblicato il suo rapporto di intelligence sulle minacce del settembre 2026, "Rilevamento e contrasto dell'uso improprio dell'intelligenza artificiale", che descrive come il suo team di Threat Intelligence ha identificato e interrotto gli autori delle minacce che hanno abusato di Claude tra dicembre 2025 e agosto 2026. I casi abbracciano sette distinte aree di danno: operazioni informatiche, operazioni di influenza, sorveglianza, truffe e frodi, uso improprio biologico, sviluppo di armi convenzionali e distillazione di modelli illeciti. Secondo la società, ogni campagna descritta è stata interrotta e le informazioni sono state condivise con le autorità e i partner del settore, ove appropriato.
Il rapporto arriva in un momento di intenso esame per il settore dell’intelligenza artificiale, e per Anthropic in particolare, poiché le ultime notizie sull’intelligenza artificiale questa settimana sono state dominate da divulgazioni sulla sicurezza, resoconti di informatori e crescente pressione da parte dei legislatori. Arriva anche insieme ai resoconti del New York Times e di Politico che evidenziano i tentativi di trasformare in armi i modelli di frontiera, compresi gli sforzi bloccati relativi allo sviluppo di armi biologiche.
Come Anthropic tiene traccia degli attori delle minacce abilitati all'intelligenza artificiale
Anthropic tiene traccia degli attori nel suo rapporto secondo designatori interni noti come Generative Threat Groups o GTG. Ogni caso di studio misura ciò che l'azienda chiama uplift: l'incremento di capacità che l'intelligenza artificiale fornisce a un'operazione su tre dimensioni: velocità, scala e profondità. I casi di abuso riguardavano i modelli Claude Haiku, Sonnet e Opus. Nessuno riguardava i modelli di classe Fable o Mythos dell'azienda, ad eccezione di un caso di distillazione illecita.
Anthropic definisce la propria volontà di pubblicare come un dovere piuttosto che come un esercizio di marketing, affermando nel rapporto che "crediamo di avere la responsabilità di rivelare abusi dannosi dei nostri servizi".
Un'operazione legata a Midnight Blizzard che ha ricostruito il proprio malware
Il caso informatico più ampio del rapporto, segnalato come GTG-20006, descrive un attore la cui attribuzione secondo Anthropic è coerente con le segnalazioni pubbliche che lo collegano a Midnight Blizzard, il gruppo di hacking russo allineato allo stato precedentemente noto come Nobelium o APT29. Uno dei suoi operatori, un individuo che utilizza lo pseudonimo "JackPoterz", è di lingua russa.
Secondo il rapporto, il gruppo ha preso di mira più di 20 organizzazioni, concentrate tra gli organi governativi, militari e diplomatici ucraini. Ha compromesso almeno tre fornitori di WiFi di hotel per dirottare i record DNS, ha preso il controllo degli account WhatsApp di almeno due ex funzionari ucraini di alto livello e ha rubato più di 300.000 record di identità nazionale insieme ai dati del registro commerciale che coprono più di mezzo milione di aziende da un’autorità tecnologica del governo nordafricano.
Il dettaglio più sorprendente è l'adattamento autonomo: Anthropic riferisce che gli agenti di intelligenza artificiale dell'attore hanno modificato e ricostruito il malware del gruppo ogni volta che i prodotti di sicurezza lo hanno rilevato, un ciclo che in precedenza avrebbe richiesto sviluppatori esperti su richiesta.
Raccolta di credenziali su larga scala e caccia zero-day autonoma
Un secondo caso, GTG-50014, riguarda operatori sospettati di affiliazione al collettivo ShinyHunters. Le loro pipeline di raccolta delle credenziali hanno scaricato in massa 1,8 milioni di APK Android e li hanno scansionati alla ricerca di segreti codificati. In un caso di compromissione di un fornitore di tecnologia, è stato esfiltrato più di un terabyte di dati, inclusi milioni di record di carte di pagamento. Un altro affiliato ha estratto dati da circa 200 clienti a valle di un fornitore di software come servizio violato e ha scaricato più di 2.100 set di token Azure AD che coprono oltre 40 tenant aziendali in circa 34 ore, con agenti IA che svolgono quasi tutto il lavoro, secondo il rapporto.
GTG-10007 fa ancora più riflettere i difensori. Anthropic attribuisce questo cluster a operatori di lingua cinese probabilmente con sede a Changsha, Hunan - due dei quali identificati come studenti universitari - che hanno preso di mira circa cinquanta organizzazioni e hanno condotto un programma autonomo di ricerca sulle vulnerabilità. Un flusso di lavoro, eseguito su dispositivi di rete, ha prodotto più di una dozzina di possibili risultati zero-day in un solo mese.
Estorsione, un hacktivista solitario e un raid fallito ai laboratori di intelligenza artificiale
L’abuso motivato dal punto di vista finanziario è predominante. GTG-50020, un attore di lingua russa, ha esfiltrato circa 26 gigabyte da una vittima e ha chiesto un'estorsione tra 1,5 e 2,5 milioni di dollari. Lo stesso gruppo ha poi attaccato una trentina di aziende di intelligenza artificiale in circa quattro giorni con l’obiettivo dichiarato di accedere a un modello Claude pre-rilascio. Anthropic afferma che ogni tentativo di percorso è fallito e che i suoi sistemi non sono mai stati compromessi.
All'estremità opposta dello spettro, GTG-50029 era un singolo hacktivista di lingua francese che ha sfruttato una race condition di reinstallazione di WordPress precedentemente non documentata contro almeno quattro siti, ottenuto l'accesso interno ad almeno 14 dei 42 obiettivi monitorati ed esfiltrato circa 140.000 record, comprese le opinioni politiche degli utenti da una piattaforma di campagna. L'attore ha quindi costruito una piattaforma di doxxing, fafsearch, carica di decine di milioni di righe.
Operazioni di influenza dalla Repubblica Centrafricana alla Malesia
Nove casi di operazioni di influenza menzionati nel rapporto hanno avuto origine in Russia, Iran, Turchia, Golfo, Asia meridionale, Africa ed Europa, con portata misurata sulla scala di breakout della Brookings Institution. In un caso, GTG-04001, un attore di lingua russa con sede a Bangui, ha prodotto contenuti giornalieri per Radio Lengo Songo, una stazione Anthropic collegata a Politology: l'Africa Corps e il ramo di influenza di Wagner che, secondo le stime, sono passati sotto il controllo dei servizi segreti esteri russi alla fine del 2023. L'operazione ha prodotto documenti governativi e contratti di lavoro falsificati del governo della Repubblica Centrafricana che imponevano lealtà al presidente del paese e alla Russia, ed è stata valutata come categoria quattro sulla scala.
Un'altra rete, GTG-54002, è stata ricondotta a LKM Company, un'agenzia di pubblicità digitale con sede in Francia che gestisce circa 70 siti Web di notizie fabbricati, 70 account X corrispondenti e più di 250 account di commenti non autentici. La rete ha pubblicato almeno 8.913 articoli in circa 20 lingue, 318 dei quali incentrati sulla Repubblica Democratica del Congo.
Anche le elezioni erano un obiettivo. GTG-84005, una piattaforma commerciale di manipolazione elettorale rivolta alla Malesia che Anthropic ha collegato a BBS Bilisim Teknolojileri con sede a Istanbul, ha gestito circa 1.000 account X falsi in tutte le 222 circoscrizioni parlamentari malesi e ha fabbricato dossier contro un politico dell'opposizione. Un cluster separato, GTG-24015, utilizzava quattro account come redazione assistita dall’intelligenza artificiale per alimentare i media statali russi.
Perché la divulgazione è importante
Anthropic afferma di aver interrotto l’attività in ogni caso, di aver utilizzato i risultati per rafforzare le proprie misure di salvaguardia e di aver condiviso informazioni con le autorità e i partner industriali, ove appropriato. La pubblicazione di casi di studio dettagliati, completi di analisi dei fallimenti dei propri rilevamenti, rimane rara tra i laboratori di frontiera e l’azienda sostiene che la trasparenza aumenta la base di riferimento per l’intero settore.
Il rapporto sottolinea anche un cambiamento che i team di sicurezza non possono più ignorare: le operazioni più pericolose basate sull’intelligenza artificiale qui descritte non erano dimostrazioni ipotetiche ma campagne dal vivo contro governi, aziende ed elezioni. Man mano che i modelli diventano più capaci, i dati di Anthropic suggeriscono che il miglioramento che forniscono ad avversari determinati si sta aggravando – e la migliore risposta disponibile per i difensori, per ora, è visibilità, divulgazione e iterazione più rapida delle misure di salvaguardia.
---
Stai al passo con l'intelligenza artificialeRicevi le ultime notizie, analisi e scoperte sull'intelligenza artificiale, tutto in un unico posto.
Leggi altre notizie sull'AI →