ஆந்த்ரோபிக் சனிக்கிழமையன்று விரிவான சுய அளவீடுகளின் தொகுப்பை வெளியிட்டது, பொதுமக்கள், பத்திரிகையாளர்கள் மற்றும் அரசாங்கங்கள் எல்லைப்புற AI உண்மையில் எவ்வளவு வேகமாக உருவாக்கப்படுகிறது என்பதைக் கண்காணிக்கும் நோக்கம் கொண்டது - நிறுவனத்தின் சொந்த ஆராய்ச்சியில் இப்போது AI எவ்வளவு செய்யப்படுகிறது என்பதற்கான முதல்-வகையான குறியீடு மற்றும் நிறுவனத்தில் 30,000 AI முகவர்கள் ஆராய்ச்சி செய்து வருகின்றனர்.

"எல்லைப்புற ஆய்வகங்களுக்குள் AI வளர்ச்சியின் வேகத்தைப் புரிந்துகொள்வதற்கான அளவீடுகள்" என்ற தலைப்பில் உள்ள இடுகை, தொழில்துறையின் மிகவும் பின்விளைவு வாதத்தின் மையத்திற்கு வருகிறது: எல்லை மேம்பாடு வேண்டுமென்றே மெதுவாக்கப்பட வேண்டுமா. டாரியோ அமோடி "எல்லையை வேகப்படுத்த" ஒருங்கிணைப்பிற்கு அழைப்பு விடுத்துள்ளார், இது சந்தைகளை உலுக்கிய ஒரு முன்மொழிவு, முக்கிய ஆய்வகங்களுக்கிடையில் வேகக்கட்டுப்பாடு கூட்டு என்று ஒரு நுகர்வோர் வழக்கை வரைந்தது, மேலும் எந்தவொரு மந்தநிலையையும் தடுக்க அர்ப்பணிக்கப்பட்ட "AI படையை" அறிவிக்க ஜனாதிபதி டிரம்ப்பைத் தூண்டியது. அந்தச் சூழலைப் பற்றி ஆந்த்ரோபிக்கின் ஃப்ரேமிங் வெளிப்படையாக உள்ளது: "எல்லை AI வளர்ச்சியின் வேகத்தைக் குறைப்பதாக உலகம் கருதுவதால், பொதுமக்களுக்கு கூடுதல் தகவல் தேவை."

AI முன்னேற்றத்தைக் கண்காணிப்பதற்கான மூன்று அளவீடுகள்

நிறுவனம் மூன்று அளவீட்டு பகுதிகளை வகுத்துள்ளது, எந்த எல்லை ஆய்வகமும் தொடர்ந்து வெளியிடலாம் என்று வாதிடுகிறது:

1. AI ஆல் தானே எவ்வளவு AI R&D செய்யப்படுகிறது. நிறுவனத்தில் செய்யப்படும் ஒவ்வொரு வகையான AI ஆராய்ச்சி மற்றும் மேம்பாட்டுப் பணிகளையும் பட்டியலிடுவதன் மூலம், ஒவ்வொரு பணியும் தற்போது எவ்வளவு தானியக்கமாக உள்ளது என்பதை மதிப்பீடு செய்து, முடிவுகளை ஒருங்கிணைத்து, "Anthropic R&D Automation Index" என்ற முன்மாதிரியை ஆந்த்ரோபிக் உருவாக்கியது. மதிப்பீடுகள் Epoch AI இன் பொது "ஆட்டோமேஷன் லெவல்" அளவைப் பயன்படுத்துகின்றன, இது AL0 (AI ஈடுபாடு இல்லை) இலிருந்து AL5 வரை இயங்குகிறது (ஏஐ லூப்பில் மனிதர்கள் இல்லாமல் முழு தன்னாட்சி முறையில் இயங்குகிறது). இந்த அளவில், AL3 என்பது AI "ஒத்துழைக்கிறது" - மனிதனின் நெருக்கமான வழிகாட்டுதலின் கீழ் பெரிய அளவிலான வேலைகளைச் செய்கிறது - AL4 என்பது AI "முன்னணி" என்று பொருள்படும், ஒரு மனிதன் மேற்பார்வையிடும் போது ஒரு உயர்மட்ட வரியில் இருந்து இறுதி முதல் இறுதி வரை பணியை முடிக்கிறது.

எந்த ஆய்வகமும் சுழல்நிலை சுய-முன்னேற்றத்திற்கு எவ்வளவு நெருக்கமாக இருக்கிறது என்பதை அளவிடுவதே குறியீட்டின் புள்ளி - ஒரு மாதிரியானது அதன் சொந்த வாரிசை முழுமையாக தன்னாட்சி முறையில் உருவாக்குகிறது. AI வளர்ச்சியை துரிதப்படுத்தும் மாதிரிகள் "இந்த அமைப்புகளைப் புரிந்துகொள்வது அல்லது கட்டுப்படுத்துவது மனிதர்களுக்கு மிகவும் சவாலானதாக இருக்கும்" என்று ஆந்த்ரோபிக் குறிப்பிடுகிறது.

2. AI முகவர்களின் நடவடிக்கைகள் எவ்வளவு சிறப்பாக கண்காணிக்கப்படுகின்றன. இங்குதான் 30,000 எண்ணிக்கை தோன்றுகிறது. ஆகஸ்ட் 2026 வரை, ஏறத்தாழ 30,000 முகவர்கள் எந்த நேரத்திலும் ஆராய்ச்சி மற்றும் பொறியியல் பணிகளை ஆந்த்ரோபிக்கின் அதிகம் பயன்படுத்தப்படும் உள் தளத்திற்குள் செய்து, பணிகளை ஒருவருக்கொருவர் ஒப்படைத்து, நீண்ட காலத்திற்கு அரை தன்னாட்சி முறையில் வேலை செய்தனர். நிறுவனம் அந்த முகவர்களின் மேற்பார்வையில் மூன்று விஷயங்களை அளவிடுகிறது: கவரேஜ் (செயல்படுத்துவதற்கு முன் அல்லது பின் ஒரு மானிட்டர் வழியாக செல்லும் முகவர் செயல்களின் பங்கு), தாமதத்தை மதிப்பாய்வு செய்தல் (எவ்வளவு விரைவாக கொடியிடப்பட்ட செயல்கள் மதிப்பாய்வு செய்யப்படுகின்றன, முதலில் ஒரு தானியங்கி மானிட்டரால் மதிப்பாய்வு செய்யப்படுகிறது, பின்னர் ஒரு மனிதனால்), மற்றும் அதிகரிப்பு விகிதம் (தடுக்கப்பட்ட, திருப்பிவிடப்பட்ட அல்லது மதிப்பாய்வுக்காக கொடியிடப்பட்ட செயல்பாடுகளின் பங்கு).

ஆந்த்ரோபிக்கின் கண்காணிப்புத் தரவு இதுவரை தனிப்பட்ட முகவர்கள் தவறாக நடந்துகொள்வதைக் கூறுகிறது - ஆனால் நிறுவனம் எச்சரிக்கிறது, "பொருளாதாரத்தில் மில்லியன் கணக்கான அல்லது பில்லியன் கணக்கான முகவர்கள் செயல்படும் போது, ​​அரிதான நிகழ்வுகள் கூட தொடர்ந்து நிகழலாம்."

3. கணக்கீடு எவ்வாறு ஒதுக்கப்படுகிறது. ஆய்வகத்தின் கணினி வளங்கள் எவ்வாறு விநியோகிக்கப்படுகின்றன என்பதை மூன்றாவது அளவீடு கண்காணிக்கிறது - இது மாதிரி திறன்களுடன் தொடர்புபடுத்தும் மூல உள்ளீடு. மற்ற இரண்டு அளவீடுகளுடன் சேர்ந்து, இது வெளியாட்களுக்கு மாடல் வெளியீடுகளுடன் மாடல் உள்ளீடுகளை தொடர்புபடுத்துவதற்கான வழியை வழங்குகிறது என்று ஆந்த்ரோபிக் வாதிடுகிறது, நிறுவனம் ஏற்கனவே அதன் பொறுப்பான அளவிடுதல் கொள்கை ஆபத்து அறிக்கைகள் மூலம் வெளியிடும் திறன் மதிப்பீடுகளை நிறைவு செய்கிறது.

எண்கள் ஒரு மந்தநிலையின் கீழ் நகரும்

இடுகையில் மிகவும் அரசியல் ரீதியாக சுட்டிக்காட்டப்பட்ட வரி, வேகமான விவாதத்தை நேரடியாக இலக்காகக் கொண்டது: ஆந்த்ரோபிக் கூறுகிறது, இது "எல்லையை வேகப்படுத்துவதில் ஒருங்கிணைப்பு இருந்தால், மானுடவியல் தலைமை நிர்வாக அதிகாரி டாரியோ அமோடியால் அழைப்பு விடுக்கப்பட்டால், இந்த எண்கள் மாறும் என்று எதிர்பார்க்கலாம்." வேறு வார்த்தைகளில் கூறுவதானால், தொழில் உண்மையில் மெதுவாக இருந்தால், இந்த அளவீடுகள் பொதுமக்கள் அதை எவ்வாறு சரிபார்க்கலாம் - மேலும் நிறுவனங்கள் தங்கள் எண்ணிக்கை அதிகரித்துக்கொண்டே இருக்கும் போது வேகம் காட்டுவதாகக் கூறினால், அளவீடுகள் அதையும் வெளிப்படுத்தும்.

சுயாதீன சரிபார்ப்பு என்பது காணாமல் போன துண்டு

ஆந்த்ரோபிக் சுய-அறிக்கை அளவீடுகளின் மைய பலவீனத்தை ஒப்புக்கொள்கிறது: அதன் சொந்த அமைப்புகளை மதிப்பிடுவதற்கு அதன் சொந்த மாதிரிகளைப் பயன்படுத்துகிறது, அதாவது "நீதிபதி" மாதிரியானது சரிபார்க்கப்படும் மாதிரியின் குருட்டுப் புள்ளிகளைப் பகிர்ந்து கொள்ளலாம். ஆய்வகங்கள் முழுவதும் பொதுவான வழிமுறை இல்லாததையும் நிறுவனம் குறிப்பிடுகிறது, இது ஒப்பீடுகளை கடினமாக்குகிறது.

அதன் முன்மொழியப்பட்ட தீர்வு, ஆந்த்ரோபிக் உள்ளே பல நிறுவனங்களில் இருந்து சுயாதீனமான மூன்றாம் தரப்பு மதிப்பீட்டாளர்களை உட்பொதிப்பதாகும், உள் செயல்முறைகள், அமைப்புகள் மற்றும் உள் இடர் மதிப்பீட்டுக் குழுக்கள் பார்ப்பதற்கு ஒப்பிடக்கூடிய தரவுகளுக்கான அணுகலை அவர்களுக்கு வழங்குகிறது. அந்த மூன்றாம் தரப்பினர் பாதுகாப்பு நடைமுறைகளைச் சரிபார்த்து, சம்பவங்களைப் புகாரளித்து, புதிய அளவீடுகளைக் கண்காணிப்பார்கள். METR, லாப நோக்கமற்ற மதிப்பீட்டு நிறுவனமானது, அதன் ஆஃப்லைன் கண்காணிப்பு தளத்தை முன்பு சுயாதீனமாக சிவப்பு குழுவாக இணைத்துள்ளது, மேலும் இந்த அளவீடுகளை மற்றவர்கள் சரிபார்க்கக்கூடிய வடிவத்தில் தொடர்ந்து வெளியிட திட்டமிட்டுள்ளதாக நிறுவனம் கூறுகிறது.

அளவீடுகள் ஆந்த்ரோபிக்கின் பரந்த மேம்பட்ட AI கட்டமைப்பின் முன்மொழிவுடன் இணைக்கப்பட்டுள்ளன, இது எல்லை மாதிரி வெளியீடுகளுக்கான "சாலையின் விதிகளை" அமைக்கிறது, அரசாங்கங்கள் தேவைப்படக்கூடிய வெளிப்படைத்தன்மைக் கடமைகள் - தரப்படுத்தப்பட்ட இடர் அறிக்கைகள் போன்றவை.

முழு தொழில்துறைக்கும் ஒரு சோதனை

பதவியின் ஆழமான முக்கியத்துவம் போட்டியாக இருக்கலாம். மானுடவியல் திறம்பட ஒவ்வொரு எல்லை ஆய்வகத்தையும் அதே எண்களை வெளியிடுவதற்கு சவாலாக உள்ளது, "எந்த எல்லை டெவலப்பர்களும் இந்த நடவடிக்கைகளை பொது முறையைப் பயன்படுத்தி தொடர்ந்து வெளியிடலாம்" என்று வாதிடுகின்றனர். போட்டியாளர்கள் குறைந்துவிட்டால், பாதுகாப்பு விவாதத்தில் மாறுபாடு அதன் சொந்த தரவு புள்ளியாக மாறும்; அவர்கள் ஒப்புக்கொண்டால், AI உண்மையில் எவ்வளவு வேகமாக முன்னேறுகிறது என்பதற்கான முதல் பொதுவான அளவுகோலை தொழில்துறை பெறுகிறது.

இப்போதைக்கு, வேகமான உரையாடலில் வெளிப்படையான ஆர்வமுள்ள ஒரு நிறுவனத்தால் எண்கள் சுயமாக அறிவிக்கப்படுகின்றன. ஆனால் அவை விவாதத்தில் இல்லாத ஒன்றைப் பிரதிநிதித்துவப்படுத்துகின்றன: உறுதியான, மீண்டும் மீண்டும் செய்யக்கூடிய அளவீடுகள், எல்லை முடுக்கிவிடுகிறதா, நிலையாக இருக்கிறதா அல்லது உண்மையில் மெதுவாக இருக்கிறதா என்பதைக் காட்டும்.

AIக்கு முன்னால் இருங்கள்

வாரந்தோறும் இது போன்ற எல்லைப்புற ஆய்வக வெளிப்பாடுகள். மேலும் பிரேக்கிங் AI ஆராய்ச்சி மற்றும் தொழில் கவரேஜுக்கு, AI Buzz Wire ஐப் பின்தொடரவும்.

சமீபத்திய AI செய்திகளைப் படிக்கவும் →