Anthropic ने या आठवड्यात स्वतःच्या विकासाच्या पाइपलाइनमध्ये स्वतःच्या प्रकारचा पहिला-वहिला देखावा प्रकाशित केला, ज्याने खुलासा केला की त्याचे क्लॉड मॉडेल आता कंपनीतील AI संशोधन आणि विकास कार्यात 26% "नेतृत्व" करत आहे - जे फेब्रुवारी 2026 मध्ये 1% पेक्षा कमी आहे. हे आकडे "मेजरमेंट्स फॉर रीडिंग समजण्यासाठी कंपनी ब्लॉग पोस्ट" मध्ये दिसले. रॉयटर्स, द वॉशिंग्टन पोस्ट आणि इतर आउटलेट.
पोस्ट अंशतः पारदर्शकतेचा व्यायाम आहे आणि अंशतः एक युक्तिवाद आहे: मानववंशीय इतर फ्रंटियर लॅबने समान प्रकारचे आकडे प्रकाशित करावेत, जेणेकरुन जनता आणि सरकार AI तयार करण्याच्या चाव्या किती लवकर AI ला दिल्या जात आहेत याचा मागोवा घेऊ शकतील. For more context on this story, see our ongoing artificial intelligence updates.
AI विकासाचा मागोवा घेण्यासाठी तीन क्रमांक
कंपनीने तीन मोजमाप प्रस्तावित केले आहेत ज्यात असे म्हटले आहे की फ्रंटियर लॅबमधील विकासाचा वेग प्रकाशित करा: एआय स्वतः किती AI R&D करते, AI एजंट्सच्या कृतींवर किती चांगल्या प्रकारे देखरेख केली जाते आणि क्षमता कार्य आणि सुरक्षा कार्य यांच्यात गणना कशी केली जाते.
हेडलाइन नंबर ज्याला अँथ्रोपिक त्याच्या R&D ऑटोमेशन इंडेक्स म्हणतो त्यावरून येतो. कंपनीने कंपनीमध्ये केलेल्या प्रत्येक प्रकारच्या AI R&D कामांचे कॅटलॉग केले, सध्या प्रत्येक कार्य किती स्वयंचलित आहे याचे मूल्यांकन केले आणि Epoch AI संशोधन गटाने विकसित केलेल्या स्केलचा वापर करून परिणाम एकत्रित केले. स्केल AL0 (कोणतेही AI सहभाग नाही) पासून AL5 पर्यंत चालते (AI पूर्णपणे स्वायत्तपणे चालते, लूपमध्ये कोणताही मनुष्य नसतो), AL3 म्हणजे AI "सहयोग करते" मोठ्या भागांवर काम करते जवळच्या मानवी मार्गदर्शनाखाली आणि AL4 म्हणजे AI "नेतृत्व करते," उच्च-स्तरीय सूचनांमधून बहुतेक कार्य शेवटपासून शेवटपर्यंत पूर्ण करते.
ऑगस्ट 2026 पर्यंत, अँथ्रोपिकने अहवाल दिला, क्लॉड कंपनीच्या AI R&D कामात 26% नेतृत्व करतात. "AI collaborates" स्तरावरील किंवा त्यावरील कामाचा वाटा 90% पेक्षा जास्त आहे. AI R&D कामाच्या कोणत्याही मोजलेल्या उपसंचासाठी क्लॉड पूर्णपणे स्वायत्तपणे कार्य करत नाही.
30,000 एजंट, एक मॉनिटर
दुसरे मापन निरीक्षणाशी संबंधित आहे. Anthropic ने खुलासा केला की ऑगस्ट 2026 पर्यंत कंपनीमध्ये जवळपास 30,000 एजंट संशोधन आणि अभियांत्रिकी कार्य करत होते.
ते एजंट करतात ती प्रत्येक कृती अंमलात येण्यापूर्वी ऑनलाइन मॉनिटरमधून पास होते, सामान्यत: काही सेकंदात, पोस्टनुसार. Anthropic म्हणते की त्यांनी ऑगस्टमध्ये त्याच्या संशोधन आणि अभियांत्रिकी एजंट्सच्या एक अब्जाहून अधिक निर्णयांचे विश्लेषण केले आणि असे आढळले की मॉनिटर्सद्वारे अवरोधित केलेल्या किंवा वाढवलेल्या क्रियाकलापांचा वाटा 0.002% होता.
गणना वाटपावर, तिसरे मोजमाप, कंपनीने सांगितले की तपासलेल्या आठवड्यात AI R&D मध्ये गेलेल्या अंदाजे 6% सुरक्षेसाठी वाटप केले गेले.
स्वतःचा उत्तराधिकारी तयार करणे — मानवांच्या देखरेखीसह
आकृत्यांइतकीच फ्रेमिंग महत्त्वाची आहे. एंथ्रोपिकचे मॉडेल त्याच मॉडेलची पुढची पिढी तयार करण्यात वाढत्या प्रमाणात सहभागी होत आहेत — ज्याला संशोधक पुनरावर्ती स्व-सुधारणा म्हणतात आणि वॉशिंग्टन पोस्टच्या मथळ्याने चॅटबॉट "स्वतःचा उत्तराधिकारी तयार करण्याचे काम हाती घेणे" असे स्पष्टपणे वर्णन केले आहे.
"एआय लीड्स" आणि "एआय रिप्लेस" मधील रेषा काढण्यासाठी मानववंशवादी सावधगिरी बाळगतात. AL4 वर, माणूस अजूनही देखरेख करतो आणि हस्तक्षेप करू शकतो; कंपनीने स्पष्टपणे नोंदवले की त्यांच्या R&D कार्याचा कोणताही मोजलेला उपसंच AL5 वर चालत नाही. परंतु मार्ग खूप मोठा आहे: अंदाजे सात महिन्यांत 1% वरून 26% पर्यंत जाणे सूचित करते की एआय-नेतृत्वाखालील कामाचा वाटा सध्याच्या ट्रेंडला धरून राहिल्यास दशकाच्या समाप्तीपूर्वी निम्म्याने पुढे जाऊ शकेल.
कार्यपद्धतीला वास्तविक मर्यादा आहेत आणि मानववंशीय असे म्हणतात. स्लॅक मेसेज आणि अंतर्गत दस्तऐवजांसह - कंपनीच्या स्वतःच्या कामाच्या नोंदींचे नमुने घेऊन त्याचे ऑटोमेशन रेटिंग तयार केले गेले आणि प्रत्येक कार्य किती स्वयंचलित आहे हे मानव आणि न्यायाधीश मॉडेल रेट करून तयार केले गेले. एका अंध चाचणीमध्ये, कर्मचाऱ्यांनी मॉडेल्सने कोणते पुरावे गोळा केले हे जाणून घेतल्याशिवाय कार्यांचे मूल्यांकन केले. कंपनीने नोंदवले की त्याचे मॉडेल जज मानवांनी एकमेकांशी जितक्या वेळा सहमत होते तितक्या वेळा मानवांशी सहमत होते: अचूक मॉडेल-टू-मानवी करार 59% होता, तर मानव-ते-मानव करार केवळ 35% होता आणि मॉडेल आणि मानवी रेटिंग 97% वेळेत एकमेकांच्या एका पातळीवर आले होते.
कंपनीने स्वतःच्या कार्यपद्धतीमध्ये स्वयं-संदर्भ जोखीम देखील मान्य केली: अँथ्रोपिकने त्याच्या सिस्टमचे मूल्यमापन करण्यात मदत करण्यासाठी स्वतःचे मॉडेल वापरले, याचा अर्थ असा होऊ शकतो की न्यायाधीश मॉडेल ज्या मॉडेलची तपासणी करत आहे त्याच प्रकारच्या त्रुटी करतात. तृतीय-पक्ष पडताळणी हेच खरे उत्तर आहे, असा तर्क आहे.
बाहेरचे डोळे येत आहेत
त्यासाठी, Anthropic म्हणते की कंपनीच्या अंतर्गत अनेक संस्थांमधून स्वतंत्र तृतीय-पक्ष मूल्यमापनकर्त्यांना एम्बेड करण्याची योजना आहे, ज्यामुळे त्यांना अंतर्गत प्रक्रिया, प्रणाली आणि अंतर्गत जोखीम मूल्यांकन संघांकडे असलेल्या डेटाशी तुलना करता येईल. बाह्य AI संशोधन नानफा METR ने यापूर्वी अँथ्रोपिकचे ऑफलाइन मॉनिटरिंग प्लॅटफॉर्म रेड-टीम केले आहे.
पेसिंगबद्दल वाढलेल्या वादाच्या दरम्यान हे प्रकटीकरण आले आहे. एन्थ्रोपिकचे सीईओ डारियो अमोदेई यांनी सीमारेषा कमी करण्यासाठी समन्वयाचे आवाहन केले आहे आणि कंपनीने असे नमूद केले आहे की जर असा समन्वय अस्तित्त्वात असेल तर त्यांची स्वतःची संख्या बदलण्याची अपेक्षा केली जाईल. या आठवड्यात, एन्थ्रोपिक आणि ओपनएआय हे देखील सुरक्षितता तज्ञांच्या सार्वजनिक पत्राचा विषय होते ज्यात लॅबला खरोखर स्वतंत्र सुरक्षा मूल्यांकनकर्त्यांची आवश्यकता आहे.
प्रतिस्पर्धी अँथ्रोपिकच्या आघाडीचे अनुसरण करतात की नाही हा खुला प्रश्न आहे. कंपनीचे म्हणणे आहे की कोणताही फ्रंटियर डेव्हलपर सार्वजनिक पद्धती वापरून हे उपाय नियमितपणे प्रकाशित करू शकतो. ते असे करेपर्यंत, AI किती वेगाने AI तयार करत आहे याचे फक्त सार्वजनिक आकडे स्वतः लॅबमधून येतात.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →