Anthropic ha annunciato martedì un’importante espansione dei suoi sforzi di accesso ai modelli incentrati sulla sicurezza, ristrutturando la sua iniziativa di accesso controllato in un programma formale di verifica informatica (CVP) con tre livelli distinti per i professionisti della sicurezza informatica. La mossa arriva quando la società ha rivelato che la sua iniziativa Project Glasswing ha scoperto almeno 129.000 vulnerabilità software verificate da aprile.

Il programma ristrutturato consente ai team di sicurezza selezionati di eseguire i modelli più potenti di Anthropic - tra cui Claude Opus 5.5, Claude Sonnet 5.5 e Claude Mythos 5.1 - con protezioni ridotte e classificatori di blocco, autorizzazioni che normalmente non sono disponibili per gli utenti generali. Secondo Anthropic, l’obiettivo è mettere le capacità di intelligenza artificiale di frontiera nelle mani dei difensori prima che i malintenzionati utilizzino gli stessi strumenti come armi. Per maggiori informazioni su questa storia, consulta la nostra copertura dell'industria IA.

Tre livelli di accesso, tre scenari di minaccia

Il nuovo programma è organizzato attorno a tre livelli di accesso, ciascuno adattato a un diverso tipo di lavoro di sicurezza:

  • Defense Access copre operazioni difensive come la risposta agli incidenti, il reverse engineering del malware e l'analisi e la convalida delle vulnerabilità.
  • Red Team Access aggiunge test di penetrazione autorizzati e red-teaming ai casi d'uso difensivi, consentendo attacchi simulati contro i sistemi che le organizzazioni sono autorizzate a testare.
  • L'Accesso specializzato comporta il minor numero di garanzie ed è riservato a un insieme limitato di organizzazioni verificate autorizzate a testare autonomamente i sistemi di sicurezza dell'IA.

Le organizzazioni e i singoli team di sicurezza fanno domanda per il livello corrispondente al loro lavoro e Anthropic esamina ciascuna richiesta prima di concedere l'accesso. La società ha affermato che tutti e tre i livelli includono l’accesso ai suoi attuali modelli di punta e ai nuovi modelli rilasciati in futuro.

Le protezioni continuano a mordere: in modo selettivo

Anthropic ha abbinato l'annuncio a dati di valutazione intesi a dimostrare che il sistema di livelli separa il lavoro difensivo benigno dalle capacità veramente pericolose. In una valutazione CyScenarioBench su Claude Opus 5.5, la società ha riferito che le protezioni hanno bloccato 46 delle 50 attività nel livello di accesso alla difesa. Nel livello di accesso della squadra rossa sullo stesso modello, nessuna attività è stata bloccata e il modello ne ha completate 34 su 50: lo stesso tasso di completamento registrato quando non veniva applicata alcuna protezione.

Al contrario, secondo Anthropic, senza accesso CVP, ogni attività veniva bloccata al primo prompt.

"Queste valutazioni ci danno fiducia che possiamo rendere le capacità informatiche avanzate disponibili in modo sicuro a un insieme più ampio di difensori, ampliando gli sforzi difensivi che abbiamo iniziato con Project Glasswing", ha affermato la società nel suo annuncio, che è stato ampiamente riportato da The Hacker News, Reuters e SecurityWeek.

Il progetto riflette la scommessa secondo cui la maggior parte del lavoro difensivo sulla sicurezza – patch, analisi dei log, triage del malware – può procedere sotto rigidi guardrail, mentre i test offensivi legittimi necessitano di un corridoio più ampio. Rispecchia anche il modo in cui il settore della sicurezza gestisce da tempo gli strumenti a duplice uso: controllare il professionista, non solo lo strumento.

L'impronta in espansione di Glasswing

L'espansione del programma è strettamente collegata al Project Glasswing, l'iniziativa di Anthropic volta ad applicare i suoi modelli al rafforzamento del software critico. La società ha affermato che Glasswing ha scoperto almeno 129.000 vulnerabilità software verificate tra aprile e luglio 2026 e altre 5.500 vulnerabilità verificate tra aprile e ottobre attraverso sforzi di scansione open source.

Delle vulnerabilità verificate, più di 33.000 sono state finora classificate come critiche o di gravità elevata: una cifra che Anthropic descrive come probabilmente una significativa sottostima, poiché si basa sui dati del sondaggio di solo un sottoinsieme di partner di Glasswing. L’azienda stima che l’impatto reale potrebbe essere almeno cinque volte superiore.

Una visione misurata del rilevamento delle vulnerabilità basato sull'intelligenza artificiale

Analisi indipendenti suggeriscono che l’ondata di difetti rilevati dall’intelligenza artificiale non si traduce direttamente in un’ondata corrispondente di violazioni sfruttate. In un’analisi pubblicata alla fine del mese scorso, il ricercatore di VulnCheck Patrick Garrity ha scoperto che solo 2 delle 300 vulnerabilità scoperte da Anthropic o Project Glasswing – circa lo 0,67% – sono state sfruttate in natura.

I due difetti sfruttati sono CVE-2026-26980, una vulnerabilità di SQL injection in Ghost CMS, e CVE-2026-61500, un difetto di falsificazione di sessione in Rejetto HTTP File Server. I dati supportano una sfumatura che i ricercatori di sicurezza hanno enfatizzato: l’intelligenza artificiale sta abbassando la barriera alla scoperta delle vulnerabilità, ma la maggior parte dei difetti che emerge non sono mai stati rilevati dai radar degli aggressori.

L’annuncio rientra anche nel contesto di un dibattito più ampio sul lavoro di sicurezza generato dall’intelligenza artificiale. La ricerca di 1Password e Veracode ha dimostrato che le patch di vulnerabilità scritte dall’intelligenza artificiale possono esse stesse introdurre nuovi difetti, sottolineando che l’automazione assiste ma non sostituisce la verifica umana.

Cosa significa per il settore della sicurezza

Per i team di sicurezza, il CVP riduce l’energia di attivazione per l’utilizzo di modelli di frontiera sul lavoro difensivo reale. Gli addetti alla risposta agli incidenti ottengono un percorso sanzionato per ricevere assistenza nell'analisi del malware; i penetration tester ottengono un ambiente governato per gli attacchi assistiti dall’intelligenza artificiale; e il piccolo gruppo di organizzazioni che controllano i sistemi di sicurezza dell’IA ricevono l’accesso meno limitato.

Per Anthropic, il programma è sia una strategia di sicurezza che commerciale. Concretizza la posizione dell'azienda secondo cui le potenti capacità informatiche dovrebbero essere rilasciate deliberatamente, a difensori controllati, piuttosto che soppresse del tutto: un contrasto con i rivali che hanno dovuto affrontare un esame accurato su modelli con controlli informatici più deboli. Inoltre, approfondisce i rapporti di Anthropic con le imprese che più probabilmente pagheranno per l'accesso al modello di frontiera: governi, operatori di infrastrutture critiche e grandi fornitori di sicurezza.

La società non ha annunciato modifiche ai prezzi legate al programma e le richieste vengono elaborate attraverso i canali di accesso controllati esistenti di Anthropic. Data la portata di ciò che Glasswing è già emerso – e l’ammissione della stessa azienda che i numeri probabilmente sottostimano la realtà – il settore della sicurezza osserverà quanti di questi 129.000 risultati verranno risolti prima che gli aggressori li trovino per primi.

---

Rimani Aggiornato sull'IA

Le ultime notizie, analisi e scoperte sull'intelligenza artificiale — tutto in un posto.

Leggi altre notizie sull'IA →