2026 பிப்ரவரியில் 1% க்கும் குறைவான AI ஆராய்ச்சி மற்றும் மேம்பாட்டுப் பணிகளில் அதன் Claude மாடல் இப்போது 26% "முன்னணி" செய்கிறது என்பதை வெளிப்படுத்தும் வகையில், இந்த வாரம் அதன் சொந்த மேம்பாட்டுக் குழாய்க்குள் ஆந்த்ரோபிக் அதன் முதல்-வகையான தோற்றத்தை வெளியிட்டது. ராய்ட்டர்ஸ், தி வாஷிங்டன் போஸ்ட் மற்றும் பிற விற்பனை நிலையங்கள் மூலம்.
இந்த இடுகை ஓரளவு வெளிப்படைத்தன்மை மற்றும் ஒரு வாதமாக உள்ளது: AI ஐ உருவாக்குவதற்கான சாவிகளை பொதுமக்களும் அரசாங்கங்களும் எவ்வளவு விரைவாக வழங்குகிறார்கள் என்பதைக் கண்காணிக்கும் வகையில், மற்ற எல்லைப்புற ஆய்வகங்கள் அதே வகையான எண்களை வெளியிட வேண்டும் என்று ஆந்த்ரோபிக் விரும்புகிறது. For more context on this story, see our ongoing AI news.
AI வளர்ச்சியைக் கண்காணிக்க மூன்று எண்கள்
எல்லைப்புற ஆய்வகங்களுக்குள் வளர்ச்சியின் வேகத்தை விளக்கும் என்று நிறுவனம் மூன்று அளவீடுகளை முன்மொழிந்தது: AI ஆல் AI R&D எவ்வளவு செய்யப்படுகிறது, AI முகவர்களின் நடவடிக்கைகள் எவ்வளவு சிறப்பாகக் கண்காணிக்கப்படுகின்றன, மற்றும் திறன் வேலை மற்றும் பாதுகாப்புப் பணிகளுக்கு இடையே எவ்வாறு கணக்கிடப்படுகிறது.
ஆந்த்ரோபிக் அதன் R&D ஆட்டோமேஷன் இண்டெக்ஸ் என்று அழைக்கும் தலைப்பு எண். நிறுவனம் நிறுவனத்தில் செய்யப்படும் ஒவ்வொரு வகையான AI R&D வேலைகளையும் பட்டியலிட்டது, தற்போது ஒவ்வொரு பணியும் எவ்வளவு தானியங்கு நிலையில் உள்ளது என்பதை மதிப்பிட்டது மற்றும் Epoch AI என்ற ஆராய்ச்சி குழுவால் உருவாக்கப்பட்ட அளவைப் பயன்படுத்தி முடிவுகளை ஒருங்கிணைத்தது. இந்த அளவுகோல் AL0 (AI ஈடுபாடு இல்லை) இலிருந்து AL5 வரை இயங்குகிறது (AI முழு தன்னாட்சி முறையில் இயங்குகிறது, மனிதர்கள் யாரும் இல்லாமல்), AL3 என்றால் AI என்பது நெருங்கிய மனித வழிகாட்டுதலின் கீழ் பெரிய அளவிலான வேலைகளில் "ஒத்துழைக்கிறது" மற்றும் AL4 என்றால் AI "முன்னணிக்கிறது", உயர்மட்ட மேற்பார்வையின் போது பெரும்பாலான பணிகளை முடிவடைகிறது.
ஆகஸ்ட் 2026 நிலவரப்படி, நிறுவனத்தின் AI R&D பணிகளில் கிளாட் 26% முன்னணியில் இருப்பதாக ஆந்த்ரோபிக் தெரிவித்துள்ளது. "AI collaborates" மட்டத்தில் அல்லது அதற்கு மேல் உள்ள பணியின் பங்கு 90%க்கு மேல் உள்ளது. AI R&D பணியின் அளவிடப்பட்ட எந்த துணைக்குழுவிற்கும் Claude முழுமையாக தன்னாட்சி முறையில் செயல்படவில்லை.
30,000 முகவர்கள், ஒரு மானிட்டர்
இரண்டாவது அளவீடு மேற்பார்வை பற்றியது. ஆகஸ்ட் 2026 நிலவரப்படி, நிறுவனத்தில் எந்த நேரத்திலும் ஆராய்ச்சி மற்றும் பொறியியல் பணிகளைச் செய்யும் சுமார் 30,000 முகவர்கள் அதன் மிக அதிகமாகப் பயன்படுத்தப்படும் உள் தளத்தில் இருப்பதாக Anthropic வெளிப்படுத்தியது.
அந்த ஏஜெண்டுகள் எடுக்கும் ஒவ்வொரு செயலும் ஆன்லைன் மானிட்டர் மூலம் செயல்படுத்தப்படுவதற்கு முன்பு அனுப்பப்படும், பொதுவாக சில நொடிகளில், இடுகையின் படி. ஆகஸ்ட் மாதத்தில் அதன் ஆராய்ச்சி மற்றும் பொறியியல் முகவர்களிடமிருந்து ஒரு பில்லியனுக்கும் அதிகமான முடிவுகளை ஆய்வு செய்ததாகவும், கண்காணிப்பாளர்களால் தடுக்கப்பட்ட அல்லது அதிகரித்த நடவடிக்கைகளின் பங்கு 0.002% என்று கண்டறியப்பட்டதாகவும் ஆந்த்ரோபிக் கூறுகிறது.
கம்ப்யூட் ஒதுக்கீட்டில், மூன்றாவது அளவீடு, ஆய்வு செய்யப்பட்ட வாரத்தில் AI R&D க்கு சென்ற கணக்கீட்டில் சுமார் 6% பாதுகாப்பிற்காக ஒதுக்கப்பட்டதாக நிறுவனம் கூறியது.
அதன் சொந்த வாரிசை உருவாக்குதல் — மனிதர்கள் மேற்பார்வையுடன்
புள்ளிவிவரங்களைப் போலவே ஃப்ரேமிங்கும் முக்கியமானது. அதே மாதிரிகளின் அடுத்த தலைமுறையை உருவாக்குவதில் ஆந்த்ரோபிக்கின் மாதிரிகள் பெருகிய முறையில் பங்கேற்கின்றன - ஆராய்ச்சியாளர்கள் சுழல்நிலை சுய-முன்னேற்றம் என்று அழைக்கிறார்கள், மேலும் தி வாஷிங்டன் போஸ்டின் தலைப்பு ஒரு சாட்போட் "தனது சொந்த வாரிசை உருவாக்கும் வேலையை எடுத்துக்கொள்கிறது" என்று அப்பட்டமாக விவரித்தது.
"AI லீட்ஸ்" மற்றும் "AI ரீப்ளேஸ்ஸ்" இடையே ஒரு கோட்டை வரைவதில் ஆந்த்ரோபிக் கவனமாக உள்ளது. AL4 இல், ஒரு மனிதன் இன்னும் மேற்பார்வை செய்கிறான் மற்றும் தலையிட முடியும்; நிறுவனம் அதன் R&D பணியின் அளவிடப்பட்ட துணைக்குழு AL5 இல் இயங்கவில்லை என்று வெளிப்படையாகத் தெரிவிக்கிறது. ஆனால் பாதை செங்குத்தானது: ஏறக்குறைய ஏழு மாதங்களில் 1% இலிருந்து 26% வரை செல்வது, தற்போதைய போக்குகள் தொடர்ந்தால், AI- தலைமையிலான பணியின் பங்கு பத்தாண்டுகளின் இறுதிக்குள் பாதியாக இருக்கும் என்று அறிவுறுத்துகிறது.
முறைக்கு உண்மையான வரம்புகள் உள்ளன, மேலும் மானுடவியல் அவ்வாறு கூறுகிறது. ஸ்லாக் மெசேஜ்கள் மற்றும் உள் ஆவணங்கள் உட்பட - நிறுவனத்தின் சொந்த பணிப் பதிவுகளை மாதிரியாக எடுத்து அதன் தன்னியக்க மதிப்பீடுகள் உருவாக்கப்பட்டன, மேலும் மனிதர்கள் மற்றும் ஒரு நீதிபதி மாதிரி ஒவ்வொரு பணியும் எவ்வளவு தானியக்கமாக உள்ளது என்பதை மதிப்பிடுகிறது. குருட்டு சோதனையில், மாதிரிகள் என்ன ஆதாரங்களை சேகரித்தன என்பதை அறியாமல் ஊழியர்கள் பணிகளை மதிப்பிட்டனர். மனிதர்கள் ஒருவருக்கொருவர் உடன்படும் போது அதன் மாதிரி நீதிபதி மனிதர்களுடன் ஒத்துப் போவதாக நிறுவனம் தெரிவித்துள்ளது: சரியான மாதிரி-மனித ஒப்பந்தம் 59%, அதே சமயம் மனிதனுக்கு-மனிதன் ஒப்பந்தம் வெறும் 35%, மற்றும் மாதிரி மற்றும் மனித மதிப்பீடுகள் 97% நேரம் ஒருவருக்கொருவர் ஒரு மட்டத்தில் இறங்கியது.
நிறுவனம் அதன் சொந்த வழிமுறையில் சுய-குறிப்பு ஆபத்தையும் ஒப்புக்கொண்டது: ஆந்த்ரோபிக் அதன் அமைப்புகளை மதிப்பிடுவதற்கு அதன் சொந்த மாதிரிகளைப் பயன்படுத்தியது, அதாவது நீதிபதி மாதிரி அது சரிபார்க்கும் மாதிரியின் அதே வகையான பிழைகளை ஏற்படுத்தும். மூன்றாம் தரப்பு சரிபார்ப்பு, உண்மையான பதில் என்று அது வாதிடுகிறது.
வெளி கண்கள் வரும்
அந்த முடிவுக்கு, ஆந்த்ரோபிக் நிறுவனம் பல நிறுவனங்களில் இருந்து சுயாதீனமான மூன்றாம் தரப்பு மதிப்பீட்டாளர்களை உட்பொதிக்க திட்டமிட்டுள்ளதாகக் கூறுகிறது, உள் செயல்முறைகள், அமைப்புகள் மற்றும் உள் இடர் மதிப்பீட்டுக் குழுக்களுடன் ஒப்பிடக்கூடிய தரவுகளுக்கான அணுகலை அவர்களுக்கு வழங்குகிறது. வெளிப்புற AI ஆராய்ச்சி இலாப நோக்கற்ற METR ஆனது முன்பு Anthropic இன் ஆஃப்லைன் கண்காணிப்பு தளத்தை சிவப்பு-குழுவாக மாற்றியுள்ளது.
வேகக்கட்டுப்பாடு பற்றிய தீவிரமான விவாதத்தின் மத்தியில் இந்த வெளிப்பாடு வருகிறது. Anthropic CEO Dario Amodei, எல்லையை மெதுவாக்குவதற்கான ஒருங்கிணைப்புக்கு அழைப்பு விடுத்துள்ளார், மேலும் அத்தகைய ஒருங்கிணைப்பு இருந்தால் அதன் சொந்த எண்கள் மாறும் என்று எதிர்பார்க்கப்படுகிறது என்று நிறுவனம் குறிப்பிடுகிறது. இந்த வாரம், ஆந்த்ரோபிக் மற்றும் ஓபன்ஏஐ ஆகியவை, ஆய்வகங்களுக்கு உண்மையிலேயே சுயாதீனமான பாதுகாப்பு மதிப்பீட்டாளர்கள் தேவை என்று வாதிடும் பாதுகாப்பு நிபுணர்களின் பொதுக் கடிதத்திற்கு உட்பட்டது.
போட்டியாளர்கள் ஆந்த்ரோபிக்கின் வழியைப் பின்பற்றுகிறார்களா என்பது திறந்த கேள்வி. எந்தவொரு எல்லை டெவலப்பரும் பொது முறையைப் பயன்படுத்தி இந்த நடவடிக்கைகளைத் தொடர்ந்து வெளியிடலாம் என்று நிறுவனம் வாதிடுகிறது. அவர்கள் செய்யும் வரை, AI எவ்வளவு வேகமாக AI ஐ உருவாக்குகிறது என்பதற்கான ஒரே பொது எண்கள் ஆய்வகங்களிலிருந்தே வருகின்றன.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →