एंथ्रोपिक ने इस सप्ताह अपने स्वयं के विकास पाइपलाइन के अंदर अपनी तरह का पहला लुक प्रकाशित किया, जिसमें खुलासा किया गया कि इसका क्लाउड मॉडल अब कंपनी में 26% एआई अनुसंधान और विकास कार्यों का "नेतृत्व" करता है - फरवरी 2026 में 1% से कम। एंथ्रोपिक द्वारा 17 सितंबर को प्रकाशित और रॉयटर्स, द वाशिंगटन पोस्ट और अन्य आउटलेट्स द्वारा रिपोर्ट किए गए "फ्रंटियर लैब्स के अंदर एआई विकास की गति को समझने के लिए माप" शीर्षक से कंपनी के ब्लॉग पोस्ट में आंकड़े दिखाई दिए।
पोस्ट आंशिक रूप से एक पारदर्शिता अभ्यास और आंशिक रूप से एक तर्क है: एंथ्रोपिक चाहता है कि अन्य सीमांत प्रयोगशालाएं उसी प्रकार के नंबर प्रकाशित करें, ताकि जनता और सरकारें यह ट्रैक कर सकें कि एआई के निर्माण के लिए कितनी जल्दी एआई को चाबियाँ सौंपी जा रही हैं। For more context on this story, see our ongoing latest AI developments.
एआई विकास को ट्रैक करने के लिए तीन नंबर
कंपनी ने तीन मापों का प्रस्ताव दिया है, जिसके बारे में उसका कहना है कि यह सीमांत प्रयोगशालाओं के अंदर विकास की गति को उजागर करता है: एआई आर एंड डी का कितना हिस्सा एआई द्वारा ही किया जाता है, एआई एजेंटों के कार्यों की कितनी अच्छी तरह से निगरानी की जाती है, और क्षमता कार्य और सुरक्षा कार्य के बीच गणना कैसे आवंटित की जाती है।
हेडलाइन नंबर एंथ्रोपिक द्वारा अपने आर एंड डी ऑटोमेशन इंडेक्स के नाम से आता है। कंपनी ने कंपनी में किए गए हर प्रकार के एआई आरएंडडी कार्यों को सूचीबद्ध किया, मूल्यांकन किया कि वर्तमान में प्रत्येक कार्य कितना स्वचालित है, और अनुसंधान समूह एपोच एआई द्वारा विकसित पैमाने का उपयोग करके परिणामों को एकत्रित किया। पैमाना AL0 (कोई AI भागीदारी नहीं) से AL5 (AI पूरी तरह से स्वायत्त रूप से संचालित होता है, लूप में कोई मानव नहीं) तक चलता है, AL3 का अर्थ है AI करीबी मानव निर्देशन के तहत काम के बड़े हिस्से पर "सहयोग करता है" और AL4 का अर्थ है AI "नेतृत्व करता है", एक उच्च-स्तरीय संकेत से अधिकांश कार्य को शुरू से अंत तक पूरा करता है जबकि एक मानव पर्यवेक्षण करता है।
एंथ्रोपिक की रिपोर्ट के अनुसार, अगस्त 2026 तक, क्लाउड कंपनी के 26% AI R&D कार्य का नेतृत्व करता है। "एआई सहयोग" स्तर पर या उससे ऊपर काम का हिस्सा 90% से ऊपर है। एआई अनुसंधान एवं विकास कार्य के किसी भी मापा उपसमूह के लिए क्लाउड पूरी तरह से स्वायत्त रूप से काम नहीं कर रहा है।
30,000 एजेंट, एक मॉनिटर
दूसरा माप निरीक्षण से संबंधित है। एंथ्रोपिक ने खुलासा किया कि अगस्त 2026 तक कंपनी के सबसे अधिक उपयोग किए जाने वाले आंतरिक प्लेटफॉर्म पर किसी भी समय लगभग 30,000 एजेंट अनुसंधान और इंजीनियरिंग कार्य कर रहे थे।
पोस्ट के अनुसार, एजेंट जो भी कार्रवाई करते हैं, उसे अंजाम देने से पहले वह आमतौर पर कुछ सेकंड के भीतर ऑनलाइन मॉनिटर से होकर गुजरता है। एंथ्रोपिक का कहना है कि उसने अगस्त में अपने अनुसंधान और इंजीनियरिंग एजेंटों के एक अरब से अधिक निर्णयों का विश्लेषण किया और पाया कि मॉनिटरों द्वारा अवरुद्ध या बढ़ाई गई गतिविधियों का हिस्सा 0.002% था।
गणना आवंटन पर, तीसरा माप, कंपनी ने कहा कि जांच किए गए सप्ताह के दौरान एआई आरएंडडी को गई गणना का लगभग 6% सुरक्षा के लिए आवंटित किया गया था।
अपने स्वयं के उत्तराधिकारी का निर्माण - मनुष्यों की देखरेख में
फ़्रेमिंग उतनी ही मायने रखती है जितनी आंकड़े। एंथ्रोपिक के मॉडल उन्हीं मॉडलों की अगली पीढ़ी के निर्माण में तेजी से भाग ले रहे हैं - जिसे शोधकर्ता पुनरावर्ती आत्म-सुधार कहते हैं, और जिसे वाशिंगटन पोस्ट की हेडलाइन ने अधिक स्पष्ट रूप से एक चैटबॉट के रूप में वर्णित किया है "अपने उत्तराधिकारी के निर्माण का काम संभाल रहा है।"
एंथ्रोपिक "एआई लीड्स" और "एआई रिप्लेस" के बीच एक रेखा खींचने में सावधानी बरतता है। AL4 पर, एक मानव अभी भी पर्यवेक्षण करता है और हस्तक्षेप कर सकता है; कंपनी ने स्पष्ट रूप से बताया कि उसके अनुसंधान एवं विकास कार्य का कोई भी मापा उपसमुच्चय AL5 पर नहीं चलता है। लेकिन प्रक्षेपवक्र कठिन है: लगभग सात महीनों में 1% से 26% तक जाने से पता चलता है कि यदि मौजूदा रुझान जारी रहा तो दशक के अंत से पहले एआई के नेतृत्व वाले काम का हिस्सा आधा हो सकता है।
कार्यप्रणाली की वास्तविक सीमाएँ हैं, और एंथ्रोपिक ऐसा कहता है। इसकी स्वचालन रेटिंग कंपनी के स्वयं के कार्य रिकॉर्ड का नमूना लेकर तैयार की गई थी - जिसमें स्लैक संदेश और आंतरिक दस्तावेज़ शामिल थे - और मानव और एक न्यायाधीश मॉडल दोनों ने मूल्यांकन किया कि प्रत्येक कार्य कितना स्वचालित है। एक अंधे परीक्षण में, कर्मचारियों ने यह जाने बिना कि मॉडलों ने क्या साक्ष्य एकत्र किए थे, कार्यों का मूल्यांकन किया। कंपनी ने बताया कि उसके मॉडल जज मनुष्यों के साथ उतनी ही बार सहमत थे जितनी बार मनुष्य एक-दूसरे के साथ सहमत होते थे: सटीक मॉडल-से-मानव समझौता 59% था, जबकि मानव-से-मानव समझौता केवल 35% था, और मॉडल और मानव रेटिंग 97% समय एक दूसरे के एक स्तर के भीतर उतरे।
कंपनी ने अपनी कार्यप्रणाली में स्व-संदर्भित जोखिम को भी स्वीकार किया: एंथ्रोपिक ने अपने सिस्टम का मूल्यांकन करने में सहायता के लिए अपने स्वयं के मॉडल का उपयोग किया, जिसका अर्थ यह हो सकता है कि जज मॉडल उसी प्रकार की त्रुटियां करता है जिस मॉडल की वह जांच कर रहा है। उसका तर्क है कि तृतीय-पक्ष सत्यापन ही वास्तविक उत्तर है।
बाहरी आँखें आना
उस अंत तक, एंथ्रोपिक का कहना है कि वह कंपनी के अंदर कई संगठनों से स्वतंत्र तृतीय-पक्ष मूल्यांकनकर्ताओं को शामिल करने की योजना बना रहा है, जिससे उन्हें आंतरिक जोखिम मूल्यांकन टीमों के बराबर आंतरिक प्रक्रियाओं, प्रणालियों और डेटा तक पहुंच मिल सके। बाहरी एआई अनुसंधान गैर-लाभकारी एमईटीआर ने पहले एंथ्रोपिक के ऑफ़लाइन निगरानी प्लेटफ़ॉर्म को रेड-टीम किया है।
यह खुलासा गति को लेकर बढ़ती बहस के बीच हुआ है। एंथ्रोपिक के सीईओ डारियो अमोदेई ने सीमा को धीमा करने के लिए समन्वय का आह्वान किया है, और कंपनी का कहना है कि यदि ऐसा समन्वय मौजूद रहा तो उसकी अपनी संख्या में बदलाव की उम्मीद होगी। इस सप्ताह, एंथ्रोपिक और ओपनएआई भी सुरक्षा विशेषज्ञों के एक सार्वजनिक पत्र का विषय थे, जिसमें तर्क दिया गया था कि प्रयोगशालाओं को वास्तव में स्वतंत्र सुरक्षा मूल्यांकनकर्ताओं की आवश्यकता है।
क्या प्रतिद्वंद्वी एंथ्रोपिक के नेतृत्व का अनुसरण करते हैं, यह खुला प्रश्न है। कंपनी का तर्क है कि कोई भी फ्रंटियर डेवलपर सार्वजनिक पद्धति का उपयोग करके इन उपायों को नियमित रूप से प्रकाशित कर सकता है। जब तक वे ऐसा नहीं करते, एआई कितनी तेजी से एआई का निर्माण कर रहा है, इस पर एकमात्र सार्वजनिक आंकड़े प्रयोगशालाओं से ही आते हैं।
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →