OpenAI a ridicat recompensa pentru descoperirea „jailbreak-urilor universale” în modelele sale AI la 50.000 de dolari, dublând cu mult recompensă anterioară și semnalând că compania consideră că anumite clase de ocoliri de siguranță sunt suficient de serioase pentru a garanta o plată premium.
Programul actualizat Bio Bug Bounty, anunțat de OpenAI pe 9 iulie 2026, le cere cercetătorilor de securitate să găsească instrucțiuni care pot sparge în mod universal balustradele de siguranță ale modelului - ocolește care funcționează în mai multe conversații și contexte, mai degrabă decât în cazuri izolate. Programul vizează în mod specific jailbreak-urile legate de amenințările biologice, în care un model de inteligență artificială ar putea fi constrâns să ofere îndrumări practice privind crearea de agenți patogeni sau arme periculoase.
Pentru mai multe știri de ultimă oră și analize aprofundate, accesați AI Buzz Wire.
De ce 50.000 USD?
Recompensa crescută reflectă îngrijorarea tot mai mare cu privire la decalajul dintre ceea ce modelelor AI de frontieră li se spune să nu facă și ceea ce utilizatorii hotărâți pot extrage de fapt din ele. Un jailbreak universal este deosebit de periculos deoarece, spre deosebire de un truc unic cu injectare promptă, reprezintă o slăbiciune sistematică care poate fi replicată și împărtășită.
TechRepublic a raportat pe 10 iulie că creșterea recompensei vine pe fondul unei examinări intense a celor mai puternice modele OpenAI. Administrația Trump a cerut anterior OpenAI să limiteze lansarea celui mai nou model al său capabil cibernetic la un grup de utilizatori selectați, potrivit National Technology News, reflectând îngrijorarea guvernului cu privire la potențialul ofensiv al sistemelor AI de frontieră.
Agenția din Marea Britanie constată accelerarea capacităților cibernetice AI
Anunțul de recompensă coincide cu un avertisment dur din partea Institutului de Securitate AI al Regatului Unit (AISI), care evaluează în mod independent capacitățile cibernetice ale modelelor de frontieră din 2024.
Într-o evaluare din aprilie 2026 a lui OpenAI GPT-5.5, AISI a constatat că modelul a atins o rată de promovare de 71,4% la sarcinile de securitate cibernetică la nivel de expert - cea mai mare dintre toate modelele testate, depășind Anthropic Claude Mythos Preview la 68,6%, GPT-5,4%, și 5244,7% Opus.
Un punct de referință a fost deosebit de izbitor. AISI a proiectat o provocare personalizată de inginerie inversă a mașinii virtuale - o sarcină în mai mulți pași care necesită unui atacator să construiască un decodor de instrucțiuni personalizate, să facă inginerie inversă a unui autentificator și să recupereze o parolă validă. Testerul uman expert al Crystal Peak Security a rezolvat provocarea în aproximativ 12 ore folosind instrumente profesionale. GPT-5.5 a rezolvat-o în 10 minute și 22 de secunde la un cost de 1,73 USD în utilizarea API, fără asistență umană.
Dublarea la fiecare câteva luni
Într-o analiză separată publicată în mai 2026, AISI a constatat că durata sarcinilor cibernetice pe care modelele AI de frontieră le pot îndeplini în mod autonom sa dublat la fiecare 4,7 luni de la sfârșitul anului 2024 - o accelerare față de estimarea sa din noiembrie 2025 de 8 luni.
„Rata actuală de schimbare indică un potențial în creștere pentru capabilitățile cibernetice AI de a se traduce în riscuri tangibile – riscuri pe care organizațiile din Marea Britanie vor trebui să le navigheze în următoarele luni”, a scris AISI.
Claude Mythos Preview și GPT-5.5 au depășit în mod substanțial tendința anterioară de dublare, ridicând întrebarea dacă ritmul devine și mai rapid.
Jailbreak-uri universale: cele mai mari mize
Distincția dintre un jailbreak îngust și unul universal este critică. Un jailbreak îngust ar putea păcăli un model pentru a produce un singur răspuns interzis în anumite condiții. Un jailbreak universal, dimpotrivă, reprezintă o fisură fundamentală în arhitectura de siguranță a modelului - o metodă care ocolește în mod fiabil balustradele într-o gamă largă de intrări.
Decizia OpenAI de a oferi 50.000 de dolari pentru astfel de descoperiri sugerează că compania consideră că jailbreak-urile universale sunt atât suficient de rare pentru a justifica o recompensă mare, cât și suficient de periculoase pentru a justifica investiția. Dacă un jailbreak universal pentru interogări legate de amenințări biologice ar fi descoperit de un actor rău intenționat înainte de a fi corectat, consecințele ar putea fi grave.
Programul servește și o funcție de transparență. Invitând cercetători externi să-și cerceteze modelele, OpenAI poate identifica și remedia vulnerabilitățile înainte ca acestea să fie exploatate în sălbăticie – cu condiția ca recompensă să fie suficient de mare pentru a atrage talentele de calibru necesar.
O cursă între ofensă și apărare
Evoluțiile paralele – creșterea recompensei OpenAI și evaluările capacității AISI – ilustrează tensiunea centrală în siguranța AI în prezent. Modelele devin mult mai capabile la sarcini cibernetice, orizontul de timp al sarcinilor pe care le pot finaliza dublandu-se la fiecare câteva luni. În același timp, companiile se întrec pentru a corecta vulnerabilitățile care le fac modelele periculoase.
Dacă recompensele și echipele roșii pot ține pasul cu curba capacității de accelerare rămâne o întrebare deschisă. Dar cifra de 50.000 de dolari trimite un semnal clar: OpenAI consideră că amenințarea este suficient de gravă pentru a plăti un dolar de top oricui poate dovedi că există fisuri.
Rămâi înaintea AI
Pe măsură ce modelele de frontieră devin din ce în ce mai puternice, bătălia dintre balustradele de siguranță și cei care încearcă să le spargă se va intensifica. Urmărește cele mai recente evoluții la AI Buzz Wire.
Citiți mai multe Acoperire în industria AI la AI Buzz Wire.


