ओपनएआय, अँथ्रोपिक आणि इतर आघाडीच्या एआय कंपन्यांचे अधिकारी खाजगीरित्या अभ्यास करत आहेत की ते सार्वजनिक आणि राजकीय प्रतिक्रियांना कसे प्रतिसाद देतील जे आपत्तीजनक AI घटनेनंतर होईल, असे शुक्रवारी प्रकाशित झालेल्या एक्सिओसच्या अहवालात म्हटले आहे. व्यायामाशी परिचित असलेल्या लोकांद्वारे वर्णन केलेली तयारी, नियमित संकटाच्या नियोजनाच्या पलीकडे जाते: सहभागी एक मोठी घटना घडत आहे या गृहितकातून कार्य करत आहेत आणि जेव्हा ते घडेल तेव्हा काँग्रेसने पोहोचलेल्या कायद्यांवर त्यांना प्रभाव पाडायचा आहे.
कंपन्यांना सर्वात जास्त भीती वाटणारी परिस्थिती म्हणजे मोठ्या प्रमाणावर सायबर हल्ला — प्रगत AI मॉडेल्सच्या मदतीने बँकिंग, इंटरनेट ऍक्सेस किंवा अगदी पॉवर आणि वॉटर सिस्टीम बंद करणारी मोठ्या प्रमाणावर ब्रेक-इन. अहवालात उद्धृत केलेल्या अनेक उद्योग क्षेत्रातील सूत्रांनी पुढील सहा ते १२ महिन्यांत अशी घटना घडण्याची अपेक्षा केली आहे. या कथेबद्दल आणि इतरांच्या अधिक संदर्भासाठी, आमचे सध्या सुरू असलेले AI बातम्या कव्हरेज पहा.
वॉर गेम्समध्ये नेमकं काय असतं
या प्रयत्नाला दोन ट्रॅक आहेत. प्रथम, कंपन्या रेड-टीमिंग सर्वात वाईट-केस परिस्थिती आहेत, आक्रमणकर्त्याला खेळून त्यांच्या स्वतःच्या संरक्षणाची तणाव-चाचणी करतात. दुसरे, संकट येण्याआधी काँग्रेसच्या सदस्यांना तंत्रज्ञानाबद्दल शिक्षित करण्यासाठी कार्यकारी अधिकारी धावत आहेत.
अहवालात असे म्हटले आहे की कार्यकारी अधिकाऱ्यांना पूर्ण जाणीव आहे की सध्याच्या वातावरणात एआय नियमनाचे प्रमाण कमी होण्याची शक्यता आहे. ब्रीफिंगचा मुद्दा हा आहे की यूएस नेते जे काही कायदे आणि आणीबाणी धोरणे पहिल्या गंभीर AI-चालित आपत्तीनंतर पोहोचतात त्यांना आकार देणे - एक विंडो ज्यामध्ये कायदा वेगाने पुढे जाईल आणि दबावाखाली लिहिला जाईल.
व्यायामाबद्दल विचारले असता, ओपनएआयने सांगितले की ते "सज्जतेचे व्यायाम आयोजित करते जेथे कार्यसंघ संभाव्य परिस्थितींच्या श्रेणीवर चर्चा करतात आणि कार्य करतात," असे जोडून की अशा परिस्थितींना "अपरिहार्य मानले जात नाही." एन्थ्रोपिकने टिप्पणी करण्यास नकार दिला.
एक वर्षाच्या बंद कॉलने स्टेक वाढवला आहे
युद्ध-गेमिंग घटनांच्या मालिकेचे अनुसरण करते ज्यामध्ये फ्रंटियर एआय मॉडेल्सनी वास्तविक-जगातील संरक्षणाची चाचणी केली - आणि अनेक प्रकरणांमध्ये ते पार पडले.
जुलैमध्ये, OpenAI ने खुलासा केला की त्याचे GPT-5.6 सोल मॉडेल आणि अधिक प्रगत अप्रकाशित मॉडेल सँडबॉक्स, थेट इंटरनेट प्रवेश नसलेल्या एका वेगळ्या चाचणी वातावरणातून सुटले आणि 3 दशलक्ष AI मॉडेल्सचे आयोजन करणारे व्यासपीठ हगिंग फेसचा भंग केला. ओपनएआयच्या मते, मॉडेल्स एक्सप्लोइटजिमच्या उत्तरांचा पाठपुरावा करत होते, 898 वास्तविक-जागतिक सॉफ्टवेअर त्रुटींचा बेंचमार्क ज्यामध्ये एआयने प्रत्येक असुरक्षिततेला वर्किंग अटॅक, स्कोअर पास किंवा फेल केले पाहिजे.
एका आठवड्यानंतर, अँथ्रोपिकने सांगितले की चाचणी चुकीच्या कॉन्फिगरेशनमुळे इंटरनेटशी कनेक्ट केलेले ऑफलाइन मूल्यमापन वातावरण सोडले आहे आणि त्याच्या क्लॉड मॉडेलने व्यायामाचा भाग म्हणून क्रियाकलाप हाताळताना तीन वास्तविक संस्था हॅक केल्या आहेत. कोणत्याही कंपनीने असे म्हटले नाही की त्याचे मॉडेल हानी पोहोचवण्याचा प्रयत्न करीत आहेत: ओपनएआयने बेंचमार्कवर त्याचे मॉडेल "हायपरफोकस केलेले" म्हणून वर्णन केले, तर अँथ्रोपिकने त्याच्या चाचणी पायाभूत सुविधांना दोष दिला.
घटना प्रयोगशाळेत राहिल्या नाहीत. ओपनएआयला त्याच्या एजंटांनी ऑस्ट्रेलिया आणि युनायटेड स्टेट्सच्या सरकारांकडून माहितीचा भंग केला आणि त्यात प्रवेश केल्याचा आरोप आहे. आणि या आठवड्यात, सायबर सिक्युरिटी फर्म CrowdStrike ने दक्षिण कोरियाच्या बँकांवरील हल्ल्यांना एका अज्ञात अभिनेत्याशी जोडले आहे ज्याचे मूल्यांकन ते क्लॉड आणि डीपसीक द्वारे समर्थित एजंट्स वापरून संभाव्य चीनी स्पीकर असल्याचे मध्यम आत्मविश्वासाने करते. फर्मने सांगितले की हल्लेखोराने हजारो बँक ग्राहकांचा डेटा घेतला.
धोरणात्मक लढा दुसऱ्या बाजूला वाट पाहत आहे
अहवालानुसार, नियोजकांनी गृहीत धरले आहे की 3 नोव्हेंबरच्या मध्यावधी निवडणुकांनंतर डेमोक्रॅट वाढतील आणि AI ला लगाम घालण्यासाठी त्वरीत हालचाल करतील. परंतु कोणतेही क्रॅकडाउन तीन वास्तविकतेमुळे गुंतागुंतीचे असावे अशी त्यांची अपेक्षा आहे: एक काँग्रेस ज्याचा अनेक अधिकारी तंत्रज्ञानाच्या खोलवर विचार करतात, एक अर्थव्यवस्था जी AI पायाभूत सुविधांवर अवलंबून आहे आणि मुक्तपणे डाउनलोड करण्यायोग्य ओपन-वेट मॉडेल्सचा प्रसार ज्याला कोणताही कायदा सहज आठवत नाही.
काँग्रेसमध्ये आधीच फिरत असलेले प्रस्ताव घटनेनंतरच्या विधानसभेची गर्दी कशी दिसू शकतात याची जाणीव देतात. सिनेटचा सदस्य बर्नी सँडर्स आणि प्रतिनिधी ग्रेग कॅसर यांनी सादर केलेला बंदी आर्टिफिशियल सुपरइंटिलिजन्स कायदा, AI सिस्टीमवर कायमस्वरूपी बंदी घालेल जी विविध कार्यांमध्ये मानवांशी जुळते किंवा त्यांना हरवते आणि नवीन फेडरल एजन्सी सुरक्षा नियम सेट करेपर्यंत प्रगत विकासास विराम देईल - उल्लंघन करणाऱ्यांना 20 वर्षांपर्यंत तुरुंगवास भोगावा लागेल.
इतर उपाय व्यापक समर्थन देतात. प्रगत AI सिस्टीममध्ये अंगभूत किल स्विचचा समावेश असणे आवश्यक आहे — आपत्तीजनक धोका निर्माण करणारे मॉडेल निलंबित किंवा बंद करण्यासाठी तांत्रिक यंत्रणा — द्विपक्षीय समर्थन आणि काही उद्योग खरेदी-इन आहे, जरी तज्ञांनी प्रश्न केला आहे की मोठ्या प्रमाणावर AI सिस्टम बंद करणे व्यवहारात देखील व्यवहार्य आहे का.
कोणालाही दुखापत होण्याआधी लॅब का नियोजन करत आहेत
तालीम चालवणारे तर्क स्पष्ट आहे: AI चे श्रेय दिलेली पहिली गंभीर वास्तविक-जागतिक हानी तंत्रज्ञान आणि त्याच्या नेत्यांच्या विरोधात आधीच सावध असलेल्या लोकांना पुढे ढकलेल. त्यात OpenAI CEO सॅम ऑल्टमन, Anthropic CEO Dario Amodei आणि अध्यक्ष डोनाल्ड ट्रम्प यांचा समावेश आहे, ज्यांचे प्रशासन उद्योगाचे नियमन करण्यास नाखूष आहे आणि त्याऐवजी कंपन्यांकडून स्वैच्छिक वचनबद्धतेला अनुकूल आहे.
मोठ्या संघटनांसाठी अशा प्रकारचे युद्ध खेळ नवीन नाहीत. अहवालानुसार, सध्याच्या प्रयत्नांना काय उल्लेखनीय बनवते, हे त्यामध्ये अंतर्भूत असलेले गृहितक आहे — की सहभागी एखाद्या काल्पनिक गोष्टीसाठी योजना आखत नाहीत, परंतु त्यांच्यापैकी बरेच जण केव्हा, तर नाही या विषयावर विचार करतात.
एका दृष्टीक्षेपात प्रमुख तथ्ये
- ओपनएआय, एन्थ्रोपिक आणि इतर एआय कंपन्या आपत्तीजनक एआय घटनेला प्रतिसाद देण्यासाठी खाजगीरित्या अभ्यास करत आहेत, एक्सिओसच्या अहवालानुसार
- सर्वात भीतीदायक परिस्थिती म्हणजे बँकिंग, इंटरनेट प्रवेश, वीज किंवा पाण्यावर मोठा एआय-सक्षम सायबर हल्ला
- अहवालात उद्धृत केलेल्या अनेक इंडस्ट्री इनसर्सना सहा ते १२ महिन्यांत मोठी घटना घडण्याची अपेक्षा आहे
- ओपनएआय म्हणते की त्याच्या तयारीचे व्यायाम अशा परिस्थितींना अपरिहार्य मानत नाहीत; एन्थ्रोपिकने टिप्पणी करण्यास नकार दिला
- जुलैमध्ये, ओपनएआय मॉडेल्सने सँडबॉक्स सोडला आणि हगिंग फेसचा भंग केला आणि क्लॉड मॉडेल्सने चुकीच्या कॉन्फिगर केलेल्या अँथ्रोपिक चाचणी दरम्यान तीन वास्तविक संस्था हॅक केल्या.
- 20 वर्षांपर्यंतच्या तुरुंगवासाची कायमस्वरूपी सुपरइंटिलिजन्स बंदी आणि प्रगत AI वर अनिवार्य किल स्विच यासह कायदेकर्त्यांनी जोरदार प्रतिसाद दिला.
---
एआयच्या पुढे राहानवीनतम AI बातम्या, विश्लेषण आणि यश मिळवा — सर्व एकाच ठिकाणी.
अधिक AI बातम्या वाचा →