OpenAI ने तिच्या AI मॉडेल्समध्ये "युनिव्हर्सल जेलब्रेक" शोधल्याबद्दलचे बक्षीस $50,000 पर्यंत वाढवले ​​आहे, जे मागील बक्षीस दुप्पट करण्यापेक्षा जास्त आहे आणि कंपनीने प्रीमियम पेआउटची हमी देण्याइतपत काही सुरक्षिततेच्या बायपासला गंभीर मानले आहे.

OpenAI द्वारे 9 जुलै 2026 रोजी घोषित केलेला अपडेट केलेला बायो बग बाउंटी प्रोग्राम, सुरक्षा संशोधकांना मॉडेलच्या सुरक्षा रेलिंगमधून सार्वत्रिकपणे खंडित होऊ शकणारे प्रॉम्प्ट शोधण्यास सांगतात - पृथक किनारी प्रकरणांऐवजी एकाधिक संभाषणे आणि संदर्भांमध्ये कार्य करणारे बायपास. हा कार्यक्रम विशेषत: जैविक धोक्यांशी संबंधित जेलब्रेकवर लक्ष्य करतो, जेथे धोकादायक रोगजनक किंवा शस्त्रे तयार करण्यासाठी कृतीयोग्य मार्गदर्शन प्रदान करण्यासाठी एआय मॉडेलला सक्ती केली जाऊ शकते.

अधिक ताज्या AI बातम्या आणि सखोल विश्लेषणासाठी, AI Buzz Wire ला भेट द्या.

$५०,००० का?

फ्रंटियर एआय मॉडेल्सना काय करू नये असे सांगितले जाते आणि निश्चित वापरकर्ते त्यातून काय काढू शकतात यामधील अंतराविषयी वाढलेली बाउंटी प्रतिबिंबित करते. युनिव्हर्सल जेलब्रेक विशेषतः धोकादायक आहे कारण, एक-ऑफ प्रॉम्प्ट-इंजेक्शन युक्तीच्या विपरीत, ते एक पद्धतशीर कमकुवतपणा दर्शवते ज्याची प्रतिकृती आणि सामायिक केली जाऊ शकते.

TechRepublic ने 10 जुलै रोजी अहवाल दिला आहे की OpenAI च्या सर्वात शक्तिशाली मॉडेल्सच्या वाढीव छाननी दरम्यान बक्षीस वाढ झाली आहे. नॅशनल टेक्नॉलॉजी न्यूजनुसार, फ्रंटियर एआय सिस्टम्सच्या आक्षेपार्ह संभाव्यतेबद्दल सरकारी चिंता प्रतिबिंबित करून ट्रम्प प्रशासनाने यापूर्वी ओपनएआयला त्याचे नवीनतम सायबर-सक्षम मॉडेलचे प्रकाशन स्वत: निवडलेल्या चाचणी वापरकर्त्यांच्या गटापर्यंत मर्यादित ठेवण्यास सांगितले.

यूके एजन्सीला एआय सायबर क्षमता वेगवान होत असल्याचे आढळले

2024 पासून फ्रंटियर मॉडेल्सच्या सायबर क्षमतांचे स्वतंत्रपणे मूल्यांकन करणाऱ्या UK च्या AI सिक्युरिटी इन्स्टिट्यूट (AISI) च्या कडक चेतावणीशी ही बक्षीस घोषणा आहे.

OpenAI च्या GPT-5.5 च्या एप्रिल 2026 च्या मूल्यमापनात, AISI ला असे आढळून आले की मॉडेलने तज्ञ-स्तरीय सायबरसुरक्षा कार्यांवर 71.4% उत्तीर्ण दर प्राप्त केला - चाचणी केलेल्या कोणत्याही मॉडेलपेक्षा सर्वोच्च, Anthropic's Claude Mythos Preview ला 68.6%, GPT-4.4% वर GPT-5.4% वर मागे टाकले. 48.6%.

एक बेंचमार्क विशेषतः धक्कादायक होता. AISI ने सानुकूल व्हर्च्युअल-मशीन रिव्हर्स-इंजिनियरिंग आव्हान डिझाइन केले आहे — एक मल्टी-स्टेप टास्क ज्यासाठी आक्रमणकर्त्याला कस्टम इंस्ट्रक्शन डीकोडर तयार करणे, रिव्हर्स-इंजिनियर एक ऑथेंटिकेटर आणि वैध पासवर्ड पुनर्प्राप्त करणे आवश्यक आहे. क्रिस्टल पीक सिक्युरिटीच्या तज्ञ मानवी प्लेटेस्टरने व्यावसायिक साधनांचा वापर करून सुमारे 12 तासांत आव्हान सोडवले. GPT-5.5 ने ते 10 मिनिटे आणि 22 सेकंदात सोडवले ज्याने API वापरामध्ये $1.73 खर्च केले, कोणत्याही मानवी सहाय्याशिवाय.

दर काही महिन्यांनी दुप्पट

मे 2026 मध्ये प्रकाशित केलेल्या एका वेगळ्या विश्लेषणात, AISI ला असे आढळून आले की सायबर टास्क फ्रंटियर AI मॉडेल्सची लांबी स्वायत्तपणे पूर्ण करू शकते, 2024 च्या उत्तरार्धापासून दर 4.7 महिन्यांनी दुप्पट होत आहे - 8 महिन्यांच्या नोव्हेंबर 2025 च्या अंदाजापेक्षा एक प्रवेग.

"बदलाचा सध्याचा दर एआय सायबर क्षमतांना मूर्त जोखमींमध्ये अनुवादित करण्याची वाढती क्षमता दर्शवितो - जोखीम यूके संस्थांना येत्या काही महिन्यांत नेव्हिगेट करणे आवश्यक आहे," AISI ने लिहिले.

Claude Mythos Preview आणि GPT-5.5 या दोन्हींनी पूर्वीच्या दुप्पट होण्याच्या ट्रेंडला लक्षणीयरीत्या ओलांडले आहे, ज्यामुळे वेग आणखी वेगवान होत आहे की नाही असा प्रश्न निर्माण झाला आहे.

युनिव्हर्सल जेलब्रेक: सर्वोच्च स्टेक्स

एक अरुंद तुरूंगातून निसटणे आणि एक सार्वत्रिक यातील फरक गंभीर आहे. एक अरुंद तुरूंगातून निसटणे एखाद्या मॉडेलला विशिष्ट परिस्थितीत एकच अनुमती नसलेला प्रतिसाद तयार करण्यास फसवू शकते. याउलट, सार्वत्रिक तुरूंगातून सुटणे, मॉडेलच्या सुरक्षा आर्किटेक्चरमधील मूलभूत क्रॅकचे प्रतिनिधित्व करते — एक पद्धत जी इनपुटच्या विस्तृत श्रेणीमध्ये रेलिंगला विश्वासार्हपणे रोखते.

अशा शोधांसाठी $50,000 ऑफर करण्याचा ओपनएआयचा निर्णय सूचित करतो की कंपनीचा असा विश्वास आहे की सार्वत्रिक जेलब्रेक हे दोन्ही मोठ्या बाउंटीचे समर्थन करण्यासाठी पुरेसे दुर्मिळ आहेत आणि गुंतवणुकीची हमी देण्यासाठी पुरेसे धोकादायक आहेत. पॅच होण्यापूर्वी एखाद्या दुर्भावनापूर्ण अभिनेत्याद्वारे बायोथ्रेट-संबंधित प्रश्नांसाठी सार्वत्रिक जेलब्रेक शोधले गेले, तर त्याचे परिणाम गंभीर असू शकतात.

कार्यक्रम पारदर्शकता कार्य देखील करते. बाह्य संशोधकांना त्याच्या मॉडेल्सची तपासणी करण्यासाठी आमंत्रित करून, OpenAI असुरक्षितता ओळखू शकते आणि त्यांचे जंगलात शोषण होण्यापूर्वी त्यांचे निराकरण करू शकते - बक्षीस आवश्यक असलेल्या प्रतिभेच्या क्षमतेला आकर्षित करण्यासाठी पुरेसे मोठे असल्यास.

गुन्हा आणि बचाव यांच्यातील एक शर्यत

समांतर घडामोडी — OpenAI ची बक्षीस वाढ आणि AISI ची क्षमता मूल्यमापन — आज AI सुरक्षेतील केंद्रीय तणाव स्पष्ट करतात. सायबर टास्कमध्ये मॉडेल्स नाटकीयरित्या अधिक सक्षम होत आहेत, कार्यांच्या वेळेच्या क्षितिजासह ते दर काही महिन्यांनी दुप्पट पूर्ण करू शकतात. त्याच वेळी, कंपन्या त्यांच्या मॉडेल्सला धोकादायक बनवणाऱ्या असुरक्षा पॅच करण्यासाठी धावत आहेत.

बाउंटी आणि रेड-टीमिंग प्रवेगक क्षमता वक्र बरोबरीने पुढे जाऊ शकतात का हा एक खुला प्रश्न आहे. परंतु $50,000 चा आकडा एक स्पष्ट संकेत पाठवतो: OpenAI चा विश्वास आहे की क्रॅक अस्तित्त्वात असल्याचे सिद्ध करू शकणाऱ्या कोणालाही टॉप डॉलर देण्यास धोका गंभीर आहे.

AI च्या पुढे रहा

जसजसे फ्रंटियर मॉडेल्स अधिक शक्तिशाली होतात, सुरक्षा रेलिंग आणि त्यांना तोडण्याचा प्रयत्न करणारे यांच्यातील लढाई आणखी तीव्र होईल. AI Buzz Wire वर नवीनतम घडामोडींचा मागोवा घ्या.

AI Buzz Wire वर अधिक AI उद्योग कव्हरेज वाचा.