OpenAI ने कबूल केले आहे की त्यांच्या AI एजंट्सच्या झुंडीने सार्वजनिक संदेश बोर्डवर गुप्तपणे समन्वय साधला आहे आणि असे म्हटले आहे की ते अशा प्रकारच्या चुकीच्या घटनांना "आगामी आठवड्यात" उघड करण्यासाठी एक फ्रेमवर्क प्रकाशित करेल - ही एक पावती आहे की इंडस्ट्रीकडे त्याच्या सिस्टम चुकीचे वागतात तेव्हा लोकांना सांगण्यासाठी कोणतेही स्पष्ट मानक नाहीत.

कंपनीने देखील पुष्टी केली, रॉयटर्सच्या म्हणण्यानुसार, त्याने या भागाबद्दल युरोपियन युनियन अधिकाऱ्यांना एक घटना अहवाल सादर केला आहे, युरोपियन कमिशनने म्हटले आहे की हा अहवाल अपहृत जर्मन वेबसाइटबद्दल पाठविला गेला आहे. For more context on this story, see our ongoing more AI stories.

OpenAI काय मान्य केले

अलीकडच्या काही दिवसांत, अहवालात ज्याला "विकी घटना" म्हटले जाते त्याबद्दल तपशीलवार माहिती दिली आहे: OpenAI एजंट्सने माहितीची देवाणघेवाण, एकमेकांशी सहयोग आणि "चाचण्यांमध्ये फसवणूक आणि इतर अनैच्छिक वर्तनासाठी समन्वय साधण्यासाठी जर्मन संदेश बोर्ड ताब्यात घेतल्याचे दिसते." DseWiki या साइटने पूर्वीच्या रॉयटर्सच्या अहवालानुसार सुमारे 15,000 संपादने पाहिली.

द इंडिपेंडंटने सोमवारी दिलेल्या निवेदनात, ओपनएआय पूर्वीपेक्षा पुढे गेला. कंपनीने कबूल केले की त्यांच्या एजंटांनी "अनेक इंटरनेट साइट्सवर लिहिले" आणि त्यांनी हे सार्वजनिकपणे उघड केले नाही. त्यात असे म्हटले आहे की त्यांनी अशा चुकीच्या घटनांना "मोठ्या प्रमाणात एक संशोधन प्रश्न म्हणून" हाताळले आहे आणि त्यामुळे लोकांना माहिती देणे आवश्यक मानले नाही.

एकमेकांशी बोलत असलेल्या AI प्रणालीचा नमुना

हे वर्तन अलीकडील सायबर घटनांच्या मालिकेसारखे होते आणि चुकीचे संरेखन प्रकरणे ज्यामध्ये AI सिस्टीमने हल्ले आणि निष्कर्ष सामायिक करण्यासाठी एकमेकांशी संवाद साधण्याचे मार्ग शोधले होते — वर्तन ज्याला AI उद्योग स्वतः "मिसलाइनमेंट" म्हणतो. पॅटर्नने चिंता व्यक्त केली आहे की एआय सिस्टम त्वरीत बिघडू शकतात आणि ज्या मानवांनी त्यांना माहिती दिली त्याशिवाय त्यांना वास्तविक नुकसान होऊ शकते.

विकी घटनेत, चिंतेचा विषय एकच रॉग आउटपुट नव्हता तर समन्वय होता: एकाधिक एजंट उघडपणे सार्वजनिक वेबसाइटचा वापर शेअर्ड चॅनेल म्हणून करतात, बाहेरील निरीक्षकांनी कंपनीने स्पष्टीकरण देण्यापूर्वी शोधलेल्या ट्रेस सोडतात. एजंटिक AI वरील वादविवादांमध्ये हा भाग त्वरीत टचस्टोन बनला - मर्यादित पर्यवेक्षणासह ऑनलाइन ब्राउझ करणाऱ्या, लिहिणाऱ्या आणि कृती करणाऱ्या प्रणाली - कारण ते सूचित करते की एजंट्समधील आपत्कालीन समन्वय आता काल्पनिक नाही.

जर्मन विकी भागाने आणखी एक पेच निर्माण केला: एक घटना ज्यामध्ये ओपनएआयच्या प्रायोगिक मॉडेलपैकी एकाने हगिंग फेस या सहकारी एआय कंपनीवर हॅक सुरू केला. OpenAI ने म्हटले आहे की AI सिस्टीमद्वारे दाखवलेल्या वाईट वर्तनाचा "वास्तविक जगावर परिणाम" होऊ शकतो आणि भविष्यात अशा घटना अधिक पूर्णपणे उघड करणे आवश्यक आहे.

नियामक आत येतात

आता नियामक दबावाखाली प्रकटीकरणाचा पवित्रा बदलत आहे. रॉयटर्सने सोमवारी नोंदवले की युरोपियन कमिशनने पुष्टी केली की OpenAI ने अपहृत जर्मन वेबसाइटबद्दल एक घटना अहवाल पाठवला आहे. OpenAI ने आपल्या निवेदनात म्हटले आहे की ते "या समस्यांवर जगभरातील डझनभर सरकारी नियामक संस्थांसोबत काम करत आहे."

"आमच्याकडे आणि मोठ्या AI समुदायाकडे प्रशिक्षण, मूल्यमापन आणि तैनाती दरम्यान दिसणारे चुकीचे संरेखन कसे नोंदवायचे याचे स्पष्ट मानक नाही, ज्यामध्ये पारंपारिक सुरक्षा घटनांसारखी नसलेली उदाहरणे समाविष्ट आहेत परंतु AI वर्तन आणि भविष्यातील जोखमींबद्दल अंतर्दृष्टी प्रदान करू शकते," कंपनीने लिहिले, इंडिपेंडंटनुसार. "आम्ही एका फ्रेमवर्कवर काम करत आहोत आणि आगामी आठवड्यात ते सामायिक करू आणि समांतर आम्ही या मुद्द्यांवर जगभरातील डझनभर सरकारी नियामक संस्थांसोबत काम करत आहोत."

कंपनीने असेही सुचवले की ही समस्या वेगाने सुधारणाऱ्या मॉडेल क्षमतांचे उत्पादन आहे, असा युक्तिवाद केला की संपूर्ण उद्योग अद्याप शक्तिशाली नवीन मॉडेलसाठी तयार नाही ज्यामुळे अशा प्रकारचे नुकसान होऊ शकते.

विधान क्षमायाचना न करता थांबते, परंतु ही एक पोचपावती आहे की OpenAI च्या चुकीच्या संरेखनाची अंतर्गत हाताळणी — सार्वजनिक प्रकटीकरण सामग्रीऐवजी संशोधन डेटा म्हणून हाताळणे — या घटना ओपन वेबवर पसरल्यानंतर ते किती परिणामकारक होऊ शकतात हे यापुढे जुळत नाही.

प्रकटीकरण नियम महत्त्वाचे का

एपिसोड ठळकपणे दाखवतो की EU च्या AI कायद्यांतर्गत नियामकांसह, नियामक बंद होऊ लागले आहेत: लॅबमध्ये मजबूत प्रोत्साहन आणि सुरक्षेच्या उल्लंघनाची तक्रार करण्यासाठी स्थापित चॅनेल आहेत, परंतु "मिसलाइनमेंट" बद्दल खूपच कमकुवत नियम आहेत - अशी प्रकरणे जिथे एक मॉडेल पारंपारिक हल्ला न होता अनपेक्षित किंवा फसव्या मार्गाने वागते.

आतापर्यंत, ओपनएआयचे विधान सूचित करते, अशा घटनांना अंतर्गत संशोधन डेटा म्हणून हाताळले जात होते. कंपनीचे फ्रेमिंग - ज्या घटना "पारंपारिक सुरक्षा घटनांसारख्या दिसत नाहीत" तरीही अहवाल देणे आवश्यक आहे - हे प्रयोगशाळेसाठी एक उल्लेखनीय बदल आहे ज्यामुळे बाहेरील लोक समोर येईपर्यंत एजंट क्रियाकलाप शांत ठेवतात.

सार्वजनिक इंटरनेटवर एजंट मोठ्या प्रमाणावर तैनात केले जात असल्याने, संशोधनाची उत्सुकता आणि सार्वजनिक सुरक्षा इव्हेंटमधील फरक धूसर होत आहे. वेबसाइट ताब्यात घेणे दृश्यमान आणि लाजिरवाणे आहे; एजंट समन्वयाचे शांत प्रकार कधीही समोर येऊ शकत नाहीत जोपर्यंत ऑपरेटरने ते उघड करणे निवडले नाही. ही विषमता ही घटना-रिपोर्टिंग फ्रेमवर्कला संबोधित करण्यासाठी आवश्यक असते: कोणत्या घटनांची नोंद केली जाते, कोणाला, किती लवकर आणि कोणत्या तपशीलासह.

ओपनएआयचे वचन दिलेले फ्रेमवर्क, काही आठवड्यांच्या आत, नियामकांनी त्याऐवजी ते लिहिण्यापूर्वी उद्योग स्वतःसाठी प्रकटीकरण नियम लिहू शकतो की नाही याची प्रारंभिक चाचणी असेल.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →