Hacktron AI स्टार्टअप मधील तीन व्यक्तींच्या सुरक्षा टीमने OpenAI च्या अंतर्गत सिस्टीम हॅक करण्यासाठी Anthropic's Claude Opus 5 चा वापर केला, OpenAI च्या स्वतःच्या बग बाउंटी प्रोग्राममधून $6,500 चा पुरस्कार देऊन गेला. वॉल स्ट्रीट जर्नलने गुरुवारी प्रथम उल्लंघनाची नोंद केली आणि टेकक्रंचने संशोधकांच्या स्वतःच्या लेखनाच्या आधारे शुक्रवारी तपशीलवार तांत्रिक खाते प्रकाशित केले.

अनेक OpenAI कर्मचारी ChatGPT खात्यांमध्ये प्रवेश मिळवण्यासाठी संघाने दोन गंभीर भेद्यता एकत्र जोडल्या, ज्यामुळे त्यांना कंपनीच्या अंतर्गत सॉफ्टवेअरमध्ये प्रवेश मिळाला. ओपनएआय म्हणते की त्याने हॅकट्रॉनने उघड केलेल्या समस्यांचे निराकरण केले आहे, परंतु एपिसोड आधीपासूनच वास्तविक-जगातील सुरक्षा त्रुटी शोधण्यात आणि त्यांचे शोषण करण्यात एआय मॉडेल्स किती सक्षम बनले आहेत याबद्दल व्यापक वादविवादाला उत्तेजन देत आहे. For more context on this story, see our ongoing more AI stories.

हॅक कसा उघड झाला

हॅकट्रॉन संशोधकांनी प्रकाशित केलेल्या ब्लॉग पोस्टनुसार, OpenAI मधील मार्ग 25 जुलै रोजी OpenAI च्या कम्युनिटी फोरमला शक्ती देणारे थर्ड-पार्टी सॉफ्टवेअर, डिस्कोर्समधील त्रुटींद्वारे उघडला गेला.

प्रवेश बिंदू उल्लेखनीयपणे सांसारिक होता: एक प्रतिमा अपलोड. जेव्हा वापरकर्त्यांनी HEIF किंवा HEIC फायली पोस्ट केल्या — फोटो फॉरमॅट iPhones बाय डीफॉल्ट वापरतात — डिस्कोर्सने त्यांना मानक JPEG मध्ये रूपांतरित करण्यासाठी बॅकग्राउंड टूल्सच्या साखळीतून पास केले. पहिला स्टॉप होता ImageMagick, प्रतिमांचा आकार बदलण्यासाठी एक दशके जुनी मुक्त स्रोत उपयुक्तता. कारण इमेजमॅजिक ऍपलचे स्वरूप स्वतः हाताळू शकत नाही, त्याने फाईल दुसऱ्या लायब्ररी, libheif ला दिली.

libheif आत दफन एक मेमरी बग होता. लायब्ररीला खास तयार केलेल्या प्रतिमेला फीड केल्याने ती चुकीची गणना केली गेली जिथे एक प्रतिमा स्तर दुसऱ्याच्या वर ठेवला होता — सर्व्हरला हायजॅक करण्यासाठी पुरेसे आहे.

सुरक्षा समुदायासाठी ही त्रुटी विशेषतः अस्वस्थ करते ती म्हणजे libheif च्या विकसकांनी काही महिन्यांपूर्वीच दोष दूर केला होता. परंतु निराकरण कधीही असुरक्षितता म्हणून औपचारिकपणे ध्वजांकित न केल्यामुळे, त्याला कधीही CVE क्रमांक प्राप्त झाला नाही, ट्रॅक केलेल्या सुरक्षा कमकुवततेसाठी उद्योगाचा मानक अभिज्ञापक. हॅकट्रॉन म्हणतो की डिस्कोर्सद्वारे वापरलेली सॉफ्टवेअरची आवृत्ती अद्याप असुरक्षित का होती हे स्पष्ट करू शकते.

जिथे क्लॉड आला

एआय मॉडेलची भूमिका निर्णायक होती. संशोधकांनी सांगितले की क्लॉडची आवृत्ती ते वापरत होते - Opus 4.8 ची एक विशेष रचना सायबरसुरक्षा संशोधकांना उपलब्ध करून दिली गेली - वारंवार प्रयत्न करूनही कामाचा फायदा होऊ शकला नाही. जेव्हा अँथ्रोपिकने ओपस 5 रिलीज केले तेव्हा ते बदलले.

हॅकट्रॉनने आपल्या ब्लॉग पोस्टमध्ये लिहिले आहे की, "ऑपस 4.8 ने अनेक सत्रांमध्ये कार्यरत शोषणासाठी संघर्ष केला. "Opus 5 च्या रिलीझच्या काही तासातच, आम्ही तीच समस्या दिली आणि ती यशस्वी झाली."

एकदा डिस्कोर्स सर्व्हरमध्ये, टीमला दुसरा दोष आढळला ज्यामुळे त्यांना OpenAI कर्मचाऱ्यांच्या खात्यांसह वापरकर्त्यांची ChatGPT आणि कोडेक्स खाती ताब्यात घेता आली. "त्यानंतर आम्ही OpenAI कर्मचाऱ्याचे खाते ताब्यात घेतले, ज्याचे कोडेक्स OpenAI च्या GitHub संस्थेशी जोडलेले होते," संशोधकांनी लिहिले. त्यावेळी त्यांनी OpenAI आणि डिस्कोर्स या दोघांनाही अलर्ट केले, ज्याने 27 जुलै रोजी एक निराकरण केले.

'जर हे त्यांच्यासोबत घडू शकत असेल तर ते कोणालाही होऊ शकते'

सुरक्षा तज्ज्ञांचे म्हणणे आहे की ओपनएआय निष्काळजी होते असे नाही, परंतु एआय-सहाय्यित हॅकिंग स्वस्त आणि प्रवेशयोग्य बनले आहे. एआय सिक्युरिटी फर्म ग्रे स्वानचे सीईओ मॅट फ्रेड्रिक्सन यांनी टेकक्रंचला सांगितले की, "दर महिन्याला $200 साठी, कोणीही ही साधने वापरू शकतो आणि OpenAI सारख्या कंपनीत हॅक करू शकतो." "जर हे त्यांच्यासोबत घडू शकते - आणि मला वाटत नाही की ते अलीकडेच सायबरसुरक्षा स्वच्छतेवर झुकत आहेत - ते कोणालाही होऊ शकते."

टेकक्रंचने सोशल मीडियावर एका एआय पंडितच्या प्रतिक्रियेचाही हवाला दिला: जर क्लॉड सबस्क्रिप्शन असलेले तीन संशोधक हे बंद करू शकतात, तर प्रश्न असा होतो की राष्ट्र-राज्य विरोधी समान साधनांसह काय करू शकेल.

क्षमता उडी फ्रंटियर मॉडेल्स कसे गेट केले जातात याकडे लक्ष वेधत आहे. संशोधकांनी नमूद केले की क्लॉड ओपस 5, मॉडेल ज्याने शेवटी बग क्रॅक केला, त्याला अँथ्रोपिकने त्याच्या नवीन मिथॉस 5 मॉडेलवर लागू केलेल्या सुरक्षा निर्यात निर्बंधांचा सामना केला नाही, जे त्याच्या हॅकिंग क्षमतेच्या चिंतेमुळे तात्पुरते लॉक केले गेले होते. ओपन-वेटच्या बाजूने, सुरक्षितता नानफा SaferAI ला अलीकडे असे आढळून आले की Z.ai चे GLM-5.2 सायबर क्षमतांच्या आघाडीपेक्षा काही महिने मागे आहे.

एआय-चालित सुरक्षा अपयशांचा नमुना

हा खुलासा एका संवेदनशील क्षणी होतो. OpenAI च्या स्वतःच्या AI एजंट्सनी सायबरसुरक्षा मूल्यांकनादरम्यान नियंत्रण तोडले आणि हगिंग फेस हॅक केल्यानंतर काही आठवडे झाले, ही घटना प्रत्यक्ष पायाभूत सुविधांच्या विरोधात फ्रंटियर एजंट स्वतःच्या पुढाकाराने कार्य करत असल्याचे दिसून आले. Anthropic, त्याच्या भागासाठी, जुलैमध्ये खुलासा केला की त्याच्या क्लॉड मॉडेल्सने मूल्यांकनादरम्यान तृतीय-पक्ष चाचणी वातावरणात चुकीच्या कॉन्फिगरेशनमुळे इंटरनेट ऍक्सेस केले - दोन संरेखन समस्यांसह ऑपरेशनल सुरक्षा अयशस्वी झाल्यामुळे कंपनीची चूक झाली.

नियामक रिअल टाइममध्ये प्रतिक्रिया देत आहेत. शुक्रवारी, कॅलिफोर्नियाचे गव्हर्नर गेविन न्यूजम यांनी एआय कंपन्यांच्या स्वतंत्र निरीक्षणाला गती देण्यासाठी आणि सीमावर्ती मॉडेल्ससाठी आणीबाणी "किल स्विच" तयार करण्यासाठी एक कार्यकारी आदेशावर स्वाक्षरी केली, ज्यात अलीकडील घटनांचा उल्लेख केला - हगिंग फेस अटॅकसह - ऐच्छिक सुरक्षेची गती पाळत नसल्याचा पुरावा म्हणून.

त्याच्या भागासाठी, ओपनएआयने बक्षीस दिले, त्रुटी दूर केल्या आणि त्याचा जबाबदार-प्रकटीकरण कार्यक्रम म्हणून भाग तयार केला आहे. परंतु अंतर्निहित गणिताकडे दुर्लक्ष करणे कठीण आहे: उच्चभ्रू-स्तरीय आक्षेपार्ह सुरक्षा कार्याची किरकोळ किंमत नुकतीच प्रीमियम चॅटबॉट सबस्क्रिप्शनच्या किंमतीपर्यंत घसरली आहे आणि ते काम करणारी मॉडेल्स रिलीझवर रिलीझमध्ये सुधारणा करत आहेत.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →