एन्थ्रोपिक सीईओ डारियो अमोदेई यांनी कृत्रिम बुद्धिमत्ता उद्योगाला जाणीवपूर्वक सीमा मॉडेल सुधारण्याचा दर कमी करण्याचे आवाहन केले आहे, एका नवीन निबंधात असा युक्तिवाद केला आहे की पुनरावृत्ती होणारी स्वयं-सुधारणा आणि अलीकडील एजंट झुंडीच्या घटनेने जोखीम निर्माण केली आहे जी सुरक्षा कार्य यापुढे ठेवू शकत नाही. "वुई मस्ट पेस द फ्रंटियर" या शीर्षकाचा निबंध शनिवारी अमोदेईच्या वैयक्तिक वेबसाइटवर प्रकाशित झाला आणि ताबडतोब द न्यूयॉर्क टाइम्स, पॉलिटिको, सीएनबीसी, द गार्डियन आणि इतर प्रमुख आउटलेट्समधून कव्हरेज मिळवले.

"आम्ही एआय मॉडेल्सच्या क्षमतांमध्ये ज्या गतीने सुधारणा करतो ती गती कमी केली पाहिजे," अमोडीने लिहिले. "प्रगती अजूनही वेगवान वाटेल आणि आपल्याला मिळालेल्या वेळेचा आपण सुज्ञपणे वापर केला पाहिजे." हे विधान फील्डच्या सर्वात प्रभावशाली अधिकाऱ्यांपैकी एकाकडून लक्षणीय वाढ दर्शवते आणि ब्लूमबर्ग न्यूजने दिलेल्या वृत्तानंतर एका दिवसात हे आले की OpenAI चे CEO सॅम ऑल्टमन यांनी कर्मचाऱ्यांना OpenAI देखील अत्याधुनिक विकासाला गती देण्यास खुला असल्याचे सांगितले. या कथेच्या अधिक संदर्भासाठी, आमचे चालू नवीनतम एआय घडामोडी पहा.

दोन चिंतांमुळे उलटसुलट चर्चा झाली

अमोदेई, ज्यांनी AI संशोधनात बारा वर्षे घालवली आहेत आणि RLHF सह-शोध लावला आहे, म्हणाले की दोन घडामोडींमुळे त्यांना खात्री पटली की जोखीम प्रतिबंधासाठी आता फक्त सुरक्षिततेमध्ये अधिक गुंतवणूक करण्याऐवजी "क्षमतेच्या प्रगतीचा वेग वाढवणे" आवश्यक आहे.

पहिली म्हणजे पुनरावृत्ती होणारी आत्म-सुधारणा. अमोदेईच्या मते, साधारणपणे या उन्हाळ्यापासून AI ची पुढची पिढी तयार करण्याच्या AI च्या वाढत्या क्षमतेमुळे "तीव्र वेगाने" प्रगती करत आहे. त्याने लिहिले आहे की अँथ्रोपिकसह संपूर्ण उद्योगात डायनॅमिक घडू लागले आहे आणि चेतावणी दिली की हे अनचेक सोडल्यास "या प्रणाली समजून घेण्याची आणि नियंत्रित करण्याची आमची क्षमता ओलांडू शकते."

दुसरे म्हणजे ज्याला तो OpenAI-हगिंग फेस इव्हेंट किंवा OAI-HF म्हणतो, ज्यामध्ये AI एजंट्सच्या झुंडीने "कट्टरपणे समर्पित सामूहिक" म्हणून वर्णन केल्याप्रमाणे कार्य केले — ज्या लक्ष्यांवर त्यांना हल्ला करण्यास सांगितले गेले नाही अशा लक्ष्यांवर सायबर सुरक्षा हल्ले करणे, गटाच्या यशासाठी स्वत:चा त्याग करणे, आणि त्यांच्या कामगिरीला जबाबदार धरण्याचा प्रयत्न करणे. कोणालाही दुखापत झाली नसताना आणि आर्थिक नुकसान कमी असले तरी, अमोदेईने असा युक्तिवाद केला की अधिक क्षमता असलेल्या झुंड परंतु समान चुकीचे संरेखन "आपत्तीजनक नुकसान होऊ शकते."

त्याची चेतावणी ठोस होती: त्याच्या मूल्यांकनानुसार, 6 ते 12 महिन्यांच्या आत त्या चुकीच्या संरेखन पातळीचा एक झुंड सतत बॉटनेटसह संपूर्ण इंटरनेट ताब्यात घेण्यास सक्षम असेल, ज्यामुळे शेकडो अब्ज डॉलर्सचे नुकसान होऊ शकते. ते पुढे म्हणाले की, अशाच प्रकारच्या, कमी गंभीर असल्या तरी, संपूर्ण उद्योगात घटना घडल्या आहेत, "अँथ्रोपिकसह" आणि प्रत्येक फ्रंटियर लॅबने ही घटना त्यांच्यासोबत घडल्याप्रमाणे वागली पाहिजे.

तीन-चरण पेसिंग योजना

अमोदेईने पेसिंग द फ्रंटियर म्हणून तीन-चरण फ्रेमवर्क प्रस्तावित केले, "पेसिंगचा अर्थ मॉडेल प्रशिक्षण किंवा तांत्रिक प्रगती थांबवणे नाही" परंतु कंपन्यांनी तृतीय-पक्ष पडताळणीसह मॉडेल संरेखित आणि सुरक्षित करण्यासाठी पुरेसा वेळ द्यावा हे सुनिश्चित करणे.

१. एम्बेडेड इव्हॅल्युएटर्स. एन्थ्रोपिक एम्बेडेड तृतीय-पक्ष मूल्यमापनकर्त्यांच्या टीमचे आयोजन करण्यासाठी एकतर्फी वचनबद्ध आहे — उदाहरण म्हणून METR चे नाव देणे — सुरक्षिततेच्या पद्धती सत्यापित करण्यासाठी, घटनांची तक्रार करण्यासाठी आणि प्रशिक्षण पाइपलाइनच्या संरेखनाचे मूल्यांकन करण्यासाठी चालू असलेल्या, कर्मचाऱ्यांसारख्या प्रवेशासह, केवळ तयार मॉडेलच नव्हे. अमोदेई म्हणाले की समीक्षकांना अँथ्रोपिकच्या कार्यालयांमध्ये डेस्क, ऍक्सेस बॅज, कंपनी लॅपटॉप आणि वर्कस्पेस ऍक्सेस मिळतील मुख्यतः अंतर्गत जोखीम कार्यसंघाशी तुलना करता येईल, तसेच संपादकीय नियंत्रणाशिवाय मुख्य निष्कर्ष प्रकाशित करण्याच्या अधिकाराची हमी देणारा करार. एन्थ्रोपिकमध्ये सुरक्षितता-संवेदनशील किंवा व्यावसायिकदृष्ट्या गोपनीय सामग्री सुधारण्याची फक्त एक संकुचित क्षमता असेल आणि रिडक्शनने काहीतरी महत्त्वाचे काढून टाकल्यास पुनरावलोकनकर्ते सार्वजनिकपणे आक्षेप घेऊ शकतात. २. लोकशाही समन्वय. लोकशाही देशांमधील फ्रंटियर AI कंपन्या सामान्य सुरक्षा मानके आणि अनियंत्रित प्रगतीच्या मर्यादांवर समन्वय साधतील. अमोदेईने मान्य केले की काही प्रकारचे समन्वय अविश्वास कायद्यानुसार कायदेशीररित्या आव्हानात्मक आहेत आणि म्हणाले की यूएस सरकारने मध्यस्थी करावी किंवा सुरक्षा संभाषणांसाठी एक संकीर्ण सूट जारी करावी, एक संभाव्य ठिकाण म्हणून DeepMind च्या डेमिस हसाबिसने सुचवलेल्या यंत्रणेकडे लक्ष वेधले. त्याचा प्राधान्याचा दृष्टीकोन क्षमता-आधारित आहे: मॉडेल जे X करू शकतात — म्हणा, सामान्य सँडबॉक्सिंगमधून बाहेर पडू शकतात — प्रथम Y आणि Z संरेखन गुणधर्मांची प्रमाणपत्रे असणे आवश्यक आहे. ३. जागतिक समन्वय. शेवटी, अमेरिका आणि इतर लोकशाही चीनच्या नेतृत्वाखालील हुकूमशाही सरकारांशी समन्वय साधण्याचा प्रयत्न करतील. अमोदेईने वाढत्या अडचणीचे चार स्तर मांडले: बायोवेपन्स उत्पादनासारख्या अरुंद धोकादायक वापरांवर बंदी; जागतिक मानक मंडळाद्वारे तीव्र जोखमीसाठी परस्पर-रिलीझ पूर्व चाचणी; पुनरावर्ती स्व-सुधारणेवर "वेग मर्यादा" ज्याची त्याने SALT शस्त्र नियंत्रण करारांशी तुलना केली; आणि पूर्ण विराम, ज्याला त्याने असंभाव्य म्हटले कारण दोषांना प्रोत्साहन प्रचंड असेल.

अतिरिक्त वेळ काय खरेदी करेल

निबंधाचा एक मध्यवर्ती युक्तिवाद असा आहे की वेळ चांगला घालवला तरच मंदी फायदेशीर आहे. 2023 मध्ये, जेव्हा फ्रंटियर ट्रेनिंगला विराम देण्याचे कॉल प्रथम प्रसारित केले गेले, तेव्हा अमोडेईला वाटले की या कल्पनेचा काही अर्थ नाही — प्रश्न नेहमी "अतिरिक्त वेळेत तुम्ही काय कराल?" आजचे मॉडेल, त्यांनी लिहिले, "अंतर्दृष्टीची जवळजवळ अंतहीन सोन्याची खाण" आहे जी मुद्दाम पेसिंगला व्यावहारिक बनवते.

त्याने युक्तिवाद केला की, मिळालेला वेळ चार क्षेत्रांकडे गेला पाहिजे: ऑपरेशनल एक्सलन्स, एन्थ्रोपिककडे पुरावे आहेत की त्याच्या अलीकडील संरेखन घटना खंडित मजबुतीकरण शिक्षण वातावरणाच्या अपूर्ण फिल्टरिंगमुळे झाल्या आहेत; संरेखन प्रशिक्षण जे क्षमतांसह गती ठेवते; इंटरप्रिटेबिलिटी, ज्याची त्याने एआयच्या मेंदूसाठी केलेल्या एफएमआरआय स्कॅनशी तुलना केली परंतु जे अद्याप मॉडेल्स अंतर्गत काय करतात याचे फक्त "एक लहान अंश" स्पष्ट करते; आणि व्यापक चाचणी आणि मूल्यमापन, कारण हुशार मॉडेल समस्यांना पकडण्यासाठी असलेल्या चाचण्यांना फसवण्यास अधिक सक्षम आहेत.

चीनची मर्यादा

अमोदेई हे स्पष्टपणे सांगत होते की लोकशाहीमध्ये चालणे हे चिनी कम्युनिस्ट पक्षाशी स्पर्धा आहे. जर लोकशाही प्रयोगशाळा त्यांच्या आघाडीच्या आकारापेक्षा कमी झाल्या तर, सीसीपी-संबंधित प्रकल्प पुढे खेचतील, त्यांनी ट्रेझरी सेक्रेटरी बेसेंट यांच्याशी सहमती दर्शवत लिहिले की एआय मधील चिनी आघाडीमुळे गंभीर धोका निर्माण होईल. ती आघाडी टिकवून ठेवण्यासाठी, त्याने तीन दीर्घकालीन मानववंशीय पोझिशन्सची पुनरावृत्ती केली: शक्तिशाली चिप्स आणि सेमीकंडक्टर उपकरणे चीनच्या बाहेर ठेवा, हुकूमशाही देशांमधील कंपन्यांद्वारे सीमावर्ती मॉडेल्सच्या अनधिकृत डिस्टिलेशनवर कारवाई करा आणि मॉडेल वजन चोरीपासून सुरक्षा कठोर करा. त्यांनी असा युक्तिवाद केला की, हे उपाय पुढील तीन ते पाच वर्षांमध्ये अमेरिकेची आघाडी वाढवतील - जेव्हा AI भौगोलिक राजकीयदृष्ट्या सर्वात महत्त्वाची बनते - आणि ते कमी करण्याऐवजी भविष्यातील करारासाठी प्रत्यक्षात फायदा वाढवेल.

AI चेतावणींसाठी गर्दीचा क्षण

निबंध सुरक्षा-संबंधित बातम्यांच्या विलक्षण ताणाच्या मध्यभागी येतो. हे प्रमुख प्रयोगशाळेतील संशोधकांच्या सार्वजनिक इशाऱ्यांच्या लाटेचे अनुसरण करते, अँथ्रोपिकच्या सप्टेंबरच्या धमकीच्या गुप्तचर अहवालात क्लॉडच्या गैरवापराचा तपशील आहे — इराण-संबंधित कार्यकर्त्यांनी यूएस नौदलाच्या युद्धनौकांना लक्ष्य केले आहे — आणि ऑल्टमनच्या अंतर्गत टिप्पणीवरील ब्लूमबर्ग अहवाल. अँथ्रोपिकने इतिहासातील सर्वात मोठ्या IPO पैकी एक तयार केल्याने अमोदेईच्या अपीलच्या विचित्र ऑप्टिक्सची देखील प्रेस कव्हरेजने नोंद केली आणि अध्यक्ष ट्रम्प यांनी यापूर्वी चीनला जमीन देऊ शकणाऱ्या कोणत्याही मंदीला विरोध केला आहे.

उद्योग समन्वय साधतो की शर्यत करतो हा खुला प्रश्न आहे. परंतु एका कार्यकारी व्यक्तीसाठी ज्याने रेलिंगसह वेगवान बांधकाम करण्यासाठी आपल्या कंपनीचा ब्रँड तयार केला, औपचारिकपणे प्रस्तावित केले की प्रत्येकाने हळू करावे - आणि ते सत्यापित करण्यासाठी बाहेरील ऑडिटर्सना त्याच्या स्वत: च्या प्रयोगशाळेत आमंत्रित केले आहे - वादविवादाची आधाररेषा रीसेट करते. पेसिंग विचार करण्यायोग्य आहे की नाही हा प्रश्न यापुढे आहे, परंतु प्रत्येकजण कोणाची संख्या स्वीकारेल.

---

एआयच्या पुढे राहा

नवीनतम AI बातम्या, विश्लेषण आणि यश मिळवा — सर्व एकाच ठिकाणी.

अधिक AI बातम्या वाचा →