OpenAI ha aumentato la ricompensa per la scoperta di "jailbreak universali" nei suoi modelli di intelligenza artificiale a $ 50.000, più che raddoppiando la taglia precedente e segnalando che l'azienda considera alcune classi di bypass di sicurezza abbastanza gravi da giustificare un pagamento premium.

Il programma aggiornato Bio Bug Bounty, annunciato da OpenAI il 9 luglio 2026, chiede ai ricercatori di sicurezza di trovare suggerimenti che possano sfondare universalmente le barriere di sicurezza del modello: bypass che funzionano su più conversazioni e contesti piuttosto che su casi limite isolati. Il programma si rivolge specificamente ai jailbreak legati a minacce biologiche, in cui un modello di intelligenza artificiale potrebbe essere costretto a fornire indicazioni attuabili sulla creazione di agenti patogeni o armi pericolosi.

Per ulteriori notizie dell'ultima ora e analisi approfondite, visita AI Buzz Wire.

Perché $ 50.000?

L’aumento della ricompensa riflette la crescente preoccupazione per il divario tra ciò che ai modelli di intelligenza artificiale di frontiera viene detto di non fare e ciò che gli utenti determinati possono effettivamente ricavarne. Un jailbreak universale è particolarmente pericoloso perché, a differenza di un trucco di pronta iniezione, rappresenta una debolezza sistematica che può essere replicata e condivisa.

TechRepublic ha riferito il 10 luglio che l'aumento della ricompensa avviene nel contesto di un controllo approfondito dei modelli più potenti di OpenAI. Secondo National Technology News, l’amministrazione Trump aveva precedentemente chiesto a OpenAI di limitare il rilascio del suo nuovo modello cyber-capace a un gruppo selezionato di utenti selezionati, riflettendo la preoccupazione del governo riguardo al potenziale offensivo dei sistemi IA di frontiera.

Un'agenzia del Regno Unito ritiene che le capacità informatiche dell'IA stiano accelerando

L’annuncio della taglia coincide con un duro avvertimento da parte dell’AI Security Institute (AISI) del Regno Unito, che valuta in modo indipendente le capacità informatiche dei modelli di frontiera dal 2024.

In una valutazione dell'aprile 2026 del GPT-5.5 di OpenAI, l'AISI ha rilevato che il modello ha raggiunto un tasso di superamento del 71,4% nelle attività di sicurezza informatica a livello di esperto: il più alto di qualsiasi modello testato, superando Claude Mythos Preview di Anthropic al 68,6%, GPT-5.4 al 52,4% e Opus 4.7 al 48,6%.

Un punto di riferimento è stato particolarmente sorprendente. AISI ha progettato una sfida di reverse engineering personalizzata per una macchina virtuale: un'attività in più fasi che richiede a un utente malintenzionato di creare un decodificatore di istruzioni personalizzato, eseguire il reverse engineering di un autenticatore e recuperare una password valida. L'esperto playtester umano di Crystal Peak Security ha risolto la sfida in circa 12 ore utilizzando strumenti professionali. GPT-5.5 ha risolto il problema in 10 minuti e 22 secondi al costo di 1,73 dollari di utilizzo dell'API, senza assistenza umana.

Raddoppia ogni pochi mesi

In un’analisi separata pubblicata nel maggio 2026, l’AISI ha rilevato che la durata delle attività informatiche di frontiera che i modelli di intelligenza artificiale possono completare autonomamente è raddoppiata ogni 4,7 mesi dalla fine del 2024, un’accelerazione rispetto alla stima di 8 mesi di novembre 2025.

“L’attuale tasso di cambiamento indica un crescente potenziale per le capacità informatiche dell’IA di tradursi in rischi tangibili – rischi che le organizzazioni del Regno Unito dovranno affrontare nei prossimi mesi”, ha scritto l’AISI.

Claude Mythos Preview e GPT-5.5 hanno entrambi sostanzialmente superato la precedente tendenza al raddoppio, sollevando la questione se il ritmo stia diventando ancora più veloce.

Jailbreak universali: la posta in gioco più alta

La distinzione tra jailbreak ristretto e universale è fondamentale. Un jailbreak ristretto potrebbe indurre un modello a produrre un'unica risposta non consentita in condizioni specifiche. Un jailbreak universale, al contrario, rappresenta una crepa fondamentale nell’architettura di sicurezza del modello, un metodo che aggira in modo affidabile i guardrail attraverso un’ampia gamma di input.

La decisione di OpenAI di offrire 50.000 dollari per tali scoperte suggerisce che la società ritiene che i jailbreak universali siano abbastanza rari da giustificare una grande taglia e abbastanza pericolosi da giustificare l'investimento. Se un jailbreak universale per query relative a minacce biologiche venisse scoperto da un utente malintenzionato prima che venisse applicata la patch, le conseguenze potrebbero essere gravi.

Il programma svolge anche una funzione di trasparenza. Invitando ricercatori esterni a sondare i suoi modelli, OpenAI può identificare e correggere le vulnerabilità prima che vengano sfruttate in natura, a condizione che la ricompensa sia abbastanza grande da attirare il calibro di talenti necessari.

Una corsa tra attacco e difesa

Gli sviluppi paralleli – l’aumento della taglia di OpenAI e le valutazioni delle capacità dell’AISI – illustrano la tensione centrale nella sicurezza dell’IA oggi. I modelli stanno diventando notevolmente più capaci nelle attività informatiche, con l’orizzonte temporale delle attività che possono completare che raddoppia ogni pochi mesi. Allo stesso tempo, le aziende stanno correndo per correggere le vulnerabilità che rendono pericolosi i loro modelli.

Rimane una questione aperta se i premi e le squadre rosse possano tenere il passo con la curva di capacità in accelerazione. Ma la cifra di 50.000 dollari invia un segnale chiaro: OpenAI ritiene che la minaccia sia abbastanza grave da pagare cifre elevate a chiunque possa dimostrare che le crepe esistono.

Stai al passo con l'intelligenza artificiale

Man mano che i modelli di frontiera diventano più potenti, la battaglia tra i guardrail di sicurezza e coloro che cercano di infrangerli non farà altro che intensificarsi. Tieni traccia degli ultimi sviluppi su AI Buzz Wire.

Scopri di più sulla copertura del settore dell'intelligenza artificiale su AI Buzz Wire.