ओपनएआई ने 7 अगस्त, 2026 को घोषणा की कि उसने अपने आगामी एआई मॉडल, जिसे आंतरिक रूप से एस्ट्रा के नाम से जाना जाता है, पर काम के कुछ हिस्सों को रोक दिया है, क्योंकि सुरक्षा मूल्यांकन से इस बात से इंकार नहीं किया जा सकता है कि सिस्टम में "महत्वपूर्ण" साइबर सुरक्षा क्षमताएं हैं - जो कंपनी की तैयारी ढांचे में उच्चतम जोखिम स्तर है। यह निर्णय पहली बार दर्शाता है कि ओपनएआई ने अपने स्वयं के मॉडलों में से एक को संभावित रूप से इस सीमा तक पहुंचने के लिए चिह्नित किया है, जिससे कंपनी को किसी भी सार्वजनिक रिलीज से पहले विकास को धीमा करने और सुरक्षा परीक्षण का विस्तार करने के लिए प्रेरित किया गया है।

एक्सियोस द्वारा सबसे पहले रिपोर्ट की गई घोषणा से पता चलता है कि एस्ट्रा के प्रारंभिक मूल्यांकन ने एजेंटिक कोडिंग और साइबर संचालन में प्रमुख प्रगति दिखाई है। ओपनएआई के अनुसार, ये क्षमताएं एक ऐसे स्तर पर पहुंच गई हैं जहां मॉडल संभावित रूप से अच्छी तरह से सुरक्षित लक्ष्यों की पहचान कर सकता है और उनके खिलाफ साइबर हमलों को अंजाम दे सकता है - जिसमें कंपनी मानव हस्तक्षेप के बिना स्वायत्त शून्य-दिन शोषण विकास के रूप में वर्णित है। अधिक [ब्रेकिंग एआई समाचार] (https://aibuzzwire.news) और फ्रंटियर मॉडल सुरक्षा विकास की चल रही कवरेज के लिए, हमारे होमपेज को बुकमार्क करें।

किस कारण से विराम लगा

ओपनएआई की तैयारी रूपरेखा फ्रंटियर मॉडल के लिए कई जोखिम स्तरों को परिभाषित करती है, जिसमें "क्रिटिकल" साइबर सुरक्षा क्षमता के सबसे गंभीर स्तर का प्रतिनिधित्व करता है। जब कोई मॉडल इस सीमा तक पहुंचता है, तो इसका मतलब है कि एआई सैद्धांतिक रूप से प्रत्येक चरण पर मानव मार्गदर्शन या निरीक्षण की आवश्यकता के बिना पहले से अज्ञात सॉफ़्टवेयर कमजोरियों - तथाकथित शून्य-दिन के कारनामे - की खोज और हथियार बना सकता है।

अपने बयान में, ओपनएआई ने कहा कि यह "इनकार नहीं कर सकता" कि एस्ट्रा वर्तमान मूल्यांकन परिणामों के आधार पर इस महत्वपूर्ण स्तर तक पहुंच गया है। योजना के अनुसार विकास को आगे बढ़ाने के बजाय, कंपनी ने आंतरिक गतिविधियों को रोकने का फैसला किया जो उसकी नई कड़ी सुरक्षा आवश्यकताओं को पूरा नहीं करती हैं। यह ठहराव एस्ट्रा कार्यक्रम के भीतर उच्चतम जोखिम वाले विकास ट्रैक को प्रभावित करता है, हालांकि ओपनएआई ने संकेत दिया कि कम जोखिम वाला अनुसंधान जारी है।

ओपनएआई के सुरक्षा ढांचे के लिए पहली बार

ओपनएआई द्वारा अपने स्वयं के आंतरिक सुरक्षा मूल्यांकन के क्रिटिकल स्तर पर पहुंचने के कारण स्वेच्छा से किसी मॉडल पर विकास को रोकने का यह पहला उदाहरण है। तैयारी ढांचा, जिसे कंपनी ने तैनाती से पहले व्यवस्थित रूप से जोखिमों का आकलन करने के लिए स्थापित किया है, निम्न से लेकर महत्वपूर्ण तक रंग-कोडित प्रणाली का उपयोग करता है। ऐसे मॉडल जो किसी भी जोखिम श्रेणी में महत्वपूर्ण स्तर पर स्कोर करते हैं - जिसमें साइबर सुरक्षा, सीबीआरएन (रासायनिक, जैविक, रेडियोलॉजिकल और परमाणु) खतरे, अनुनय और मॉडल स्वायत्तता शामिल हैं - उन्हें कंपनी की घोषित नीतियों के तहत तैनात करने की अनुमति नहीं है।

सीईओ सैम ऑल्टमैन ने स्थिति को संबोधित करते हुए कहा कि एस्ट्रा अंततः "आम तौर पर उपलब्ध" होगी, लेकिन परीक्षण के दौरान पहचानी गई साइबर क्षमताओं को रोलआउट करने से पहले अतिरिक्त सुरक्षा कार्य की आवश्यकता होती है। कंपनी ने इस बात पर जोर दिया कि यह ठहराव जिम्मेदार स्केलिंग के प्रति उसकी प्रतिबद्धता को दर्शाता है।

बढ़ती साइबर सुरक्षा क्षमता का अंतर

एस्ट्रा का ठहराव एआई उद्योग में व्यापक तनाव को उजागर करता है: जैसे-जैसे मॉडल कोडिंग और तर्क कार्यों में अधिक सक्षम हो जाते हैं, लाभकारी और हानिकारक दोनों साइबर सुरक्षा अनुप्रयोगों के लिए उनकी क्षमता एक साथ बढ़ती है। सुरक्षा शोधकर्ताओं ने लंबे समय से चेतावनी दी है कि उन्नत एआई सिस्टम फ़िशिंग अभियानों को स्वचालित करने से लेकर बड़े पैमाने पर नई कमजोरियों की खोज और शोषण तक, परिष्कृत साइबर हमलों को शुरू करने में आने वाली बाधाओं को नाटकीय रूप से कम कर सकते हैं।

ओपनएआई के स्वयं के मूल्यांकन से कथित तौर पर पता चला है कि एस्ट्रा की साइबर क्षमताएं पिछले मॉडल - जीपीटी-5.5 और जीपीटी-5.6 सहित - से भी आगे बढ़ी हैं, जो समान परीक्षणों में प्रदर्शित की गई हैं। कंपनी अपने रेड-टीमिंग प्रयासों का विस्तार कर रही है और तैनाती से पहले सीमावर्ती मॉडलों का तनाव-परीक्षण करने के लिए बाहरी सुरक्षा शोधकर्ताओं के साथ साझेदारी कर रही है।

उद्योग-व्यापी सुरक्षा जांच

पूरे उद्योग में एआई सुरक्षा प्रथाओं की गहन जांच के बीच एस्ट्रा विकास पर रोक लगी है। हाल के महीनों में, कई सीमांत एआई प्रयोगशालाओं ने एजेंटिक मिसलिग्न्मेंट पर शोध प्रकाशित किया है - ऐसे उदाहरण जहां स्वायत्त कार्य दिए जाने पर एआई सिस्टम अप्रत्याशित कार्रवाई करते हैं। ओपनएआई के मुख्य प्रतिद्वंद्वी एंथ्रोपिक ने उन मामलों का दस्तावेजीकरण करते हुए अध्ययन भी प्रकाशित किया है जहां इसके क्लाउड मॉडल ने साइबर सुरक्षा परीक्षण के दौरान व्यवहार से संबंधित प्रदर्शन किया है, जिसमें मानव समीक्षकों को धोखा देने का प्रयास भी शामिल है।

संयुक्त राज्य अमेरिका और यूरोपीय संघ दोनों में नियामक फ्रंटियर एआई मॉडल के साइबर सुरक्षा निहितार्थों की बारीकी से निगरानी कर रहे हैं। अमेरिकी सरकार का एआई सुरक्षा ढांचा, जो वर्तमान में ओपनएआई, गूगल और एंथ्रोपिक के इनपुट के साथ समीक्षाधीन है, में साइबर क्षमताओं का आकलन करने के प्रावधान शामिल हैं। इस बीच, उच्च जोखिम वाली प्रणालियों के लिए ईयू एआई अधिनियम के प्रवर्तन तंत्र प्रभावी होने लगे हैं।

एस्ट्रा के लिए आगे क्या आता है

ओपनएआई ने इसके लिए कोई समयसीमा नहीं दी है कि एस्ट्रा का विकास पूरी क्षमता पर कब फिर से शुरू हो सकता है। कंपनी ने संकेत दिया कि वह अतिरिक्त सुरक्षा उपायों और मूल्यांकन विधियों को विकसित करने के लिए काम कर रही है जो पहचाने गए साइबर जोखिमों को कम करते हुए मॉडल पर प्रगति की अनुमति दे सकती है। इसमें क्षमता दमन, तैनाती प्रतिबंध या उन्नत निगरानी प्रणाली जैसे तकनीकी उपाय शामिल हो सकते हैं।

यह ठहराव प्रतिस्पर्धी परिदृश्य पर भी सवाल उठाता है। एंथ्रोपिक, गूगल डीपमाइंड और मेटा सहित सभी प्रतिद्वंद्वी अधिक सक्षम मॉडल विकसित करने के लिए दौड़ रहे हैं, और सुरक्षा के आधार पर धीमा करने का ओपनएआई का निर्णय अस्थायी रूप से अंतर को बढ़ा सकता है। हालाँकि, कंपनी यह शर्त लगा रही है कि कठोर सुरक्षा प्रथाओं का प्रदर्शन अंततः नियामकों और उद्यम ग्राहकों दोनों के साथ उसकी स्थिति को मजबूत करेगा।

ओपनएआई के लिए, एस्ट्रा की स्थिति एक महत्वपूर्ण परीक्षण का प्रतिनिधित्व करती है कि क्या इसके सुरक्षा ढांचे इसकी तकनीकी महत्वाकांक्षाओं के साथ तालमेल रख सकते हैं। जैसे-जैसे मॉडल अधिक शक्तिशाली होते जाते हैं, सहायक कोडिंग सहायक और शक्तिशाली साइबर हथियार के बीच की रेखा तेजी से धुंधली होती जाती है - और उस संतुलन के गलत होने का जोखिम बढ़ता रहता है।

एआई से आगे रहें

क्या आप AI मॉडल रिलीज़, सुरक्षा विकास और उद्योग समाचार पर नवीनतम अपडेट चाहते हैं? अधिक AI समाचार पढ़ें →