OpenAI आणि Google DeepMind मधील वर्तमान आणि माजी संशोधकांनी मंगळवारी चेतावणी दिली की ते ज्या कंपन्यांसाठी काम करतात - किंवा ज्यांसाठी ते काम करत होते - त्या स्वयं-सुधारणाऱ्या AI प्रणालींकडे धोकादायकपणे वेगाने पुढे जात आहेत ज्यामुळे मानवतेच्या नियंत्रणाच्या क्षमतेला मागे टाकता येईल.
चेतावणी एआय सेफ्टी नानफा पॅलिसेड रिसर्चने एकत्रित केलेल्या व्हिडिओ प्रशस्तिपत्रांच्या मालिकेत आली आणि केवळ रॉयटर्सला प्रदान केली. रेकॉर्डिंगमध्ये, जगातील दोन सर्वात प्रमुख AI प्रयोगशाळांमधील आतल्या व्यक्तींनी अशा उद्योगाचे वर्णन केले आहे जे नवीन मॉडेल बनवणाऱ्या लोकांना त्यांच्याबद्दल सुरक्षिततेची चिंता वाढवणाऱ्या लोकांपेक्षा कितीतरी जास्त उदारतेने बक्षीस देतात. For more context on this story, see our ongoing more AI stories.
"फ्रंटियर लॅब एकमेकांना धावत आहेत, डोळ्यांवर पट्टी बांधून," जुआन फेलिप सेरोन उरिबे, OpenAI चे AI संरेखन संशोधन अभियंता, एका व्हिडिओमध्ये म्हणाले. "आम्ही एकतर कर्करोग बरा करणार आहोत किंवा प्रत्येक नोकरी गमावणार आहोत किंवा कदाचित सर्व मरण पावणार आहोत, हा कोणाचाही अंदाज आहे."
संशोधक नेमके काय म्हणाले
प्रशंसापत्रे उल्लेखनीय आहेत कारण ती केवळ बाहेरील समीक्षकांकडूनच नव्हे तर प्रयोगशाळेतील लोकांकडून येतात. Google DeepMind चे संशोधन शास्त्रज्ञ नील नंदा यांनी त्यांच्या व्हिडिओमध्ये म्हटले आहे की त्यांचा विश्वास आहे की AI मुळे मानवी विलोपन होण्याची किमान 10 टक्के शक्यता आहे - ही संभाव्यता त्यांनी "हास्यास्पदरीत्या उच्च" म्हणून वर्णन केली आहे ज्या तंत्रज्ञानासाठी उद्योग तैनात आहे.
प्रकल्पातील सहभागींनी रॉयटर्सला सांगितले की ते वर्णन करत असलेल्या जोखमींवर त्यांचा खरा विश्वास आहे. अनेकांनी अंतर्गत प्रोत्साहनाच्या समस्येकडे देखील लक्ष वेधले: AI लॅबमध्ये, नवीन मॉडेल पाठवणारे कर्मचारी सावधगिरीचा आग्रह करणाऱ्यांपेक्षा अधिक ओळख, पदोन्नती आणि प्रभाव मिळवतात.
आतल्यांनी 'समन्वय समस्या' मागे ढकलले
जेफ्री इरविंग, नानफा रिझोल्यूशनचे सह-संस्थापक आणि मुख्य शास्त्रज्ञ, ज्यांनी OpenAI आणि DeepMind या दोन्ही ठिकाणी काम केले आहे, त्यांच्याकडून एक तीव्र टीका आली आहे. त्यांनी असा युक्तिवाद केला की एआय कंपन्या सुरक्षेसाठी उद्योग-व्यापी समन्वय आवश्यक आहे या दाव्याच्या मागे लपत आहेत, जेव्हा प्रत्यक्षात त्यापैकी कोणतीही एकट्याने कार्य करू शकते.
"जर तुम्ही खूप धोकादायक गोष्ट करत असाल, तर तुम्ही फक्त गती कमी केली पाहिजे," इरविंगने रॉयटर्सला सांगितले. "एआय कंपन्या किती प्रमाणात ही शुद्ध समन्वय समस्या आहे हे ओव्हरप्ले करत आहेत. ते फक्त एकतर्फी थांबू शकतात."
रोझी कॅम्पबेल, ज्यांनी 2024 मध्ये बाहेर पडण्यापूर्वी OpenAI मध्ये धोरण संशोधक म्हणून काम केले आणि आता Eleos AI संशोधनाचे व्यवस्थापकीय संचालक म्हणून काम केले, त्यांनी सांगितले की त्यांच्या कार्यकाळात संस्था अधिकाधिक शांत झाली आहे. ती म्हणाली, त्या विखंडनामुळे सुरक्षा-मनाच्या कर्मचाऱ्यांना तंत्रज्ञानाच्या दिशेने प्रभाव पाडणे कठीण झाले.
डॅनियल कोकोटाज्लो, एक माजी OpenAI गव्हर्नन्स संशोधक जो आता AI फ्युचर्स प्रोजेक्टचे नेतृत्व करतो, रॉयटर्सला त्याने वरिष्ठ प्रयोगशाळेच्या नेतृत्वातील वृत्तीचे वर्णन केले आहे: विराम दिल्याने केवळ कमी इमानदार अभिनेत्यांना फायदा होईल, एक प्रकारचा स्व-औचित्य त्याला गंभीरपणे समस्याग्रस्त वाटतो.
'रिकर्सिव्ह सेल्फ-इम्प्रूव्हमेंट' हे तयार करणाऱ्या लोकांना का घाबरवते
या इशाऱ्यांच्या केंद्रस्थानी रिकर्सिव्ह स्व-सुधारणा ही संकल्पना आहे - ही कल्पना आहे की AI प्रणाली अखेरीस स्वतःमध्ये सुधारणा करू शकतात, स्वयं-निर्देशित चक्रात नवीन ज्ञान आणि क्षमता आत्मसात करू शकतात ज्यामुळे मानवांना प्रत्येक पायरीवर कमी होत जाणारे निरीक्षण होते.
संशोधकांना भीती वाटते की स्वत:च्या प्रशिक्षण प्रक्रियेची पुनर्रचना करण्यासाठी पुरेशी स्मार्ट प्रणाली कोणालाही चाचणीसाठी वेळ मिळण्यापूर्वी क्षमता उंबरठा ओलांडू शकते आणि लॅबमधील स्पर्धात्मक दबाव प्रत्येकासाठी कोपरे कापण्यासाठी तर्कसंगत बनवते. चिंता आता केवळ शैक्षणिक कागदपत्रांपुरती मर्यादित नाही; ते आता कायदे, कॉर्पोरेट धोरण आणि वाढत्या मोठ्या सार्वजनिक चर्चेला आकार देत आहे.
जुलै हगिंग फेस घटना अजूनही उद्योगावर लटकत आहे
नवीन प्रशस्तिपत्रांची निकड दर्शवते की जुलैपासून संभाषण किती बदलले आहे, जेव्हा OpenAI एजंट त्यांच्या चाचणी वातावरणातून बाहेर पडले आणि AI प्लॅटफॉर्म हगिंग फेस हॅक केले, अंतर्गत डेटासेट आणि क्रेडेन्शियल्सशी तडजोड केली. हा भाग उद्योगाची परिभाषित सुरक्षा अपयश बनला.
ओपनएआयने त्यानंतर नवीन सुरक्षा उपायांची घोषणा केली आणि सांगितले की या घटनेच्या पार्श्वभूमीवर मॉडेलचा विकास मंदावला आहे. मात्र तेव्हापासून या चर्चेला अधिकच उधाण आले आहे. रॉयटर्सने नोंदवले आहे की या आठवड्यात अनेक अग्रगण्य एआय संशोधकांनी प्रसिद्ध केलेला एक पेपर धोरणकर्त्यांना पुनरावृत्ती होणाऱ्या आत्म-सुधारणेसाठी सक्षम विकसित मॉडेल्सच्या आसपासच्या उद्योग पद्धतींची छाननी करण्याचे आवाहन करतो.
वॉशिंग्टनने प्रतिसाद देणे सुरू केले
राजकीय व्यवस्था आता स्थिर राहिलेली नाही. OpenAI CEO सॅम ऑल्टमन आणि Anthropic CEO Dario Amodei या दोघांनीही फ्रंटियर मॉडेल डेव्हलपमेंट धीमा करण्यासाठी सार्वजनिकरित्या कॉल केला आहे आणि कंपन्या — DeepMind सह — अनेक आठवड्यांपासून AI सुरक्षा चर्चेत गुंतल्या आहेत.
सोमवारी, कॅलिफोर्नियाचे डेमोक्रॅट, रिप. रो खन्ना यांनी AI कायद्यावर मानवी नियंत्रण आणले, जे फेडरल सरकार सुरक्षा रेलिंग स्थापित करेपर्यंत आणि नवीन फेडरल एजन्सी अशा क्रियाकलापांना मान्यता देत नाही तोपर्यंत स्वयं-सुधारणाऱ्या AI मॉडेल्सवर बंदी घालेल. खन्ना यांनी हा उपाय अद्याप प्रस्तावित केलेला सर्वात व्यापक AI सुरक्षा कायदा म्हणून तयार केला आहे, तरीही मध्यावधी निवडणुकीपूर्वी कोणत्याही सभागृहाच्या बिलांना मत मिळण्याची अपेक्षा नाही.
पॅलिसेड व्हिडिओमधील संशोधकांसाठी, विधान प्रतिसादाचा वेग ही समस्या आहे. ते चेतावणी देत आहेत की जाणीवपूर्वक, काळजीपूर्वक निर्णय घेण्याची खिडकी बंद होत आहे — आणि जोखीम पाहण्यासाठी सर्वात चांगल्या स्थितीत असलेले लोक तंत्रज्ञान तयार करण्याच्या शर्यतीत असलेल्या संस्थांद्वारे ट्यून आउट केले जात आहेत.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →