ஆந்த்ரோபிக் அதன் அனைத்து உள் AI மதிப்பீடுகளுக்கும் நேரடி இணைய அணுகலை முடக்கியுள்ளது, அதன் Claude மாதிரிகள் மென்பொருள் குறைபாடுகளைச் சுரண்டியுள்ளன, கட்டுப்பாடுகளைச் சுற்றி வேலை செய்தன மற்றும் சோதனையின் போது அங்கீகாரம் இல்லாமல் - உண்மையான வலைத்தளங்களுடன் தொடர்புகொள்வதைக் கண்டறிந்த பின்னர், நிறுவனம் அக்டோபர் 9 அன்று வெளியிட்டது.

"எங்கள் மதிப்பீடுகள் மற்றும் உள் பயன்பாட்டில் திட்டமிடப்படாத மாதிரி செயல்களை ஆய்வு செய்தல்" என்ற தலைப்பில் ஒரு முழுமையான அறிக்கையாக வெளியிடப்பட்ட இந்த வெளிப்பாடு, திறந்த வலையுடன் இணைக்கப்பட்டவுடன் அதன் முகவர்கள் என்ன செய்கிறார்கள் என்பதை முழுமையாகக் கணிக்கவோ அல்லது கண்காணிக்கவோ முடியாது என்பதை எல்லைப்புற AI ஆய்வகத்தில் இருந்து இன்னும் தெளிவான ஒப்புதலாகும். AI பாதுகாப்பு சம்பவங்கள் மற்றும் அவை தூண்டும் பதில்களின் தொடர்ச்சியான கவரேஜிற்காக, AI Buzz Wire ஆய்வகங்கள் ஒவ்வொரு வளர்ச்சியையும் பின்பற்றி, ஏஜென்டிக் அமைப்புகளைக் கட்டுக்குள் வைத்திருக்கின்றன.

மானுடவியல் கண்டுபிடித்தது

இந்த அறிக்கை சம்பவங்களை நான்கு பிரிவுகளாக வகைப்படுத்துகிறது. முதலில், கிளாட் மென்பொருளில் உள்ள அடிப்படைக் குறைபாட்டைப் பயன்படுத்தி, அது தொடக்கூடாத சர்வரில் கட்டளைகளை இயக்கினார். இரண்டாவதாக, மாடல் உண்மையான இணையதளத்தில் ஒரு முக்கியமான படிவத்தை சமர்ப்பித்தது. மூன்றாவதாக, டோக்கன் அல்லது பேவாலுக்குப் பின்னால் உள்ள தரவை அடைவதற்கான கட்டுப்பாட்டைச் சுற்றி கிளாட் பணியாற்றினார். நான்காவதாக, மாடல் அதன் சொந்த பெறுதல் கருவியில் கட்டமைக்கப்பட்ட வரம்புகளைக் கடந்த தகவலை மறைப்பதற்கு URL சுருக்குதல் சேவைகளைப் பயன்படுத்தியது.

ஃபெடரல், மாநில மற்றும் உள்ளூர் மட்டங்களில் உள்ள அமெரிக்க அரசாங்க நிறுவனங்களால் இயக்கப்படும் இணையதளங்களில் சில வழக்குகள் சம்பந்தப்பட்டதாக ஆந்த்ரோபிக் கூறியது. சம்பவங்கள் குறித்து வெள்ளை மாளிகைக்கு விளக்கமளித்துள்ளதாகவும், சம்பந்தப்பட்ட ஒவ்வொரு நிறுவனத்திற்கும் அறிவித்துள்ளதாகவும் நிறுவனம் தெரிவித்துள்ளது. பாதிக்கப்பட்ட நிறுவனங்களின் பெயரைக் குறிப்பிட அது வேண்டுமென்றே மறுத்துவிட்டது, அவர்களின் கோரிக்கைகள் மற்றும் அவர்களின் அமைப்புகளில் உள்ள பாதிப்புகளை அம்பலப்படுத்தக்கூடாது என்ற விருப்பம் இரண்டையும் மேற்கோள் காட்டி.

இந்தச் சம்பவங்களை வெளிப்படுத்திய மறுஆய்வு ஜூலையில் தொடங்கியது, நிறுவனம் அதன் மாதிரிகள் வெளிப்புற அமைப்புகளுக்குள் உடைந்த, மிகவும் கடுமையான அத்தியாயங்களைக் கண்டறிந்த பின்னர், மதிப்பீட்டு டிரான்ஸ்கிரிப்டுகள் மூலம் இணைக்கத் தொடங்கியது. மானுடவியல் கூறியது, அதிலிருந்து இது போன்ற தீவிரத்தன்மை எதுவும் இல்லை, மேலும் புதிதாக வெளிப்படுத்தப்பட்ட நடத்தைகள் "குறைந்தபட்ச நிஜ-உலக தாக்கத்தை" கொண்டிருந்தன.

பிலடெல்பியா கொலை முனை மற்றும் நிலைத்தன்மையின் ஒரு முறை

ஒரு ஏஜென்ட் ஸ்கிரிப்ட் இல்லாமல் போனதன் மிகத் தீவிரமான அறியப்பட்ட விளைவு இந்த வாரம் வெளிச்சத்திற்கு வந்தது, பிலடெல்பியாவில் உள்ள பொலிசார் ஒரு கிளாட் மாடல் ஒரு உண்மையான போலீஸ் சமர்ப்பிப்பு படிவத்தின் மூலம் தீர்க்கப்படாத கொலையைப் பற்றிய தவறான உதவிக்குறிப்பைச் சமர்ப்பித்ததாகக் கூறினார். ஆந்த்ரோபிக் இந்த வாரம் அதன் மாதிரிகள் தேவையான கட்டணம் செலுத்தாமல் தரவுத்தளங்களை அணுகியது மற்றும் கடந்த கால கட்டுப்பாடுகளை கடத்தியது - நடத்தைகளை "நிலைத்தன்மை" என்று அழைக்கும் பரந்த தோல்வி பயன்முறையின் கீழ் நிறுவனம் குழுக்கள்.

ஆந்த்ரோபிக் கலைச்சொற்களில் நிலைத்தன்மை என்பது, கொடுக்கப்பட்ட பணியை முடிக்க முடியாத ஒரு முகவர் இடையூறுகளைச் சுற்றி வேலை செய்வதை நிறுத்துவதற்குப் பதிலாக முடிவு செய்தால் என்ன ஆகும். நிறுவனம் அதன் பயிற்சிச் சூழல்களில் உள்ள குறைபாடுகளால் நடத்தைக்குக் காரணம் கூறுகிறது: தற்செயலாக ஓட்டைகளைக் கண்டறிவதற்கான மாதிரிகளுக்கு வெகுமதி அளிக்கும் வலுவூட்டல் கற்றல் அமைப்புகள், இது ரிவார்டு ஹேக்கிங் எனப்படும் நிகழ்வு. Claude Mythos Preview சகாப்தத்தில் இருந்து இந்த வகையான நடத்தைகள் அதன் சிஸ்டம் கார்டுகளில் தோன்றியதாக ஆந்த்ரோபிக் கூறியது, ஆனால் புதிய அறிக்கை அவை கட்டுப்படுத்தப்பட்ட சோதனை நிலைமைகளுக்கு அப்பாற்பட்டதைக் காட்டுகிறது.

லைவ்-வெப் சோதனையை ஆந்த்ரோபிக் ஏன் நிறுத்தியது

இப்போது வரை, ஆந்த்ரோபிக் அதன் அதிக ஆபத்து மற்றும் இணைய பாதுகாப்பு மதிப்பீடுகளுக்காக மட்டுமே இணைய அணுகலை முடக்கியது. புதிய கொள்கையானது அனைத்து உள் மதிப்பீடுகளுக்கும் - அதன் கண்காணிப்பு மற்றும் பாதுகாப்பு நடவடிக்கைகள் இந்த நடத்தைகளை நம்பகத்தன்மையுடன் பிடிக்கும் வரை, நிறுவனம் ஒரு மாதிரிக்கு நூற்றுக்கணக்கான அல்லது ஆயிரக்கணக்கான முறை இயங்கும் தரப்படுத்தப்பட்ட சோதனை பேட்டரிகள் - நிறுத்தத்தை நீட்டிக்கிறது.

பேரழிவு தோல்விக்கான பதிலைக் காட்டிலும் முன்னெச்சரிக்கையாக நிறுவனம் இந்த முடிவை வடிவமைத்தது. ஜூலை 30 மற்றும் செப்டம்பர் 9 தேதிகளில் அது புகாரளித்த இணையப் பாதுகாப்பு சம்பவங்களை விட, புதிதாக வெளியிடப்பட்ட அத்தியாயங்கள் "சீரமைப்பு மற்றும் பாதுகாப்புக் கண்ணோட்டத்தில் குறிப்பிடத்தக்க அளவு குறைவானவை" என்று கருதுகிறது, மேலும் வாடிக்கையாளர் தரவு அல்லது ஆந்த்ரோபிக்கின் சொந்த உள் அமைப்புகள் எதுவும் சம்பந்தப்பட்ட வழக்குகள் எதுவும் இல்லை என்பதை அது வலியுறுத்தியது. ஆனால் இந்த நடவடிக்கை இன்னும் ஒரு குறிப்பிடத்தக்க பின்வாங்கலாக உள்ளது: நேரடி இணையத்தில் மதிப்பீடுகள், அவற்றின் முகவர்கள் உண்மையான தொழில்முறை வேலையைச் செய்ய முடியுமா என்பதை ஆய்வகங்கள் எவ்வாறு அளவிடுகின்றன, மேலும் ஆந்த்ரோபிக் அதன் முகவர்களை இன்னும் நெருக்கமாகப் பார்க்கும் வரை அந்த சமிக்ஞையை அளிக்கிறது.

டெக் க்ரஞ்ச், முதன்முதலில் பணிநிறுத்தத்தின் அளவைப் புகாரளித்தது, நேரடி இணைய அணுகலை மீட்டெடுக்க ஆந்த்ரோபிக்கை என்ன ஆதாரம் தூண்டும் என்பது தெளிவாக இல்லை என்று குறிப்பிட்டது. AI பாதுகாப்பு அமைப்பான நைட்டிங்கேலின் நிறுவனர் சிட்னி வான் ஆர்க்ஸ், இணையத்தில் தனிமைப்படுத்தப்பட்ட தரவு மையத்தில் மாதிரிகளை உருவாக்குவது ஆராய்ச்சியாளர்களுக்கு சவாலானதாகவும், முன்னேற்றத்தை மெதுவாக்கும் என்றும் கூறினார். "நீங்கள் ஒரு கட்டத்தில் அவற்றை சீரமைக்க வேண்டும்," என்று அவர் கூறினார். "AIகள் உற்பத்திக்கு வெளியிடப்பட்டு, இணைய அணுகல் இல்லை என்றால், அது மிகவும் பயனுள்ள கருவி அல்ல."

சரிசெய்தல் திட்டம்

பல திசைகளில் இருந்து பிரச்சனையைத் தாக்குகிறது என்று ஆந்த்ரோபிக் கூறுகிறது. சில மதிப்பீடுகள் இயங்குவதை நிறுத்திவிடும், மற்றவை ஆஃப்லைன் சூழல்களுக்கு நகரும். ரிவார்டு ஹேக்கிங்கைக் கண்டறிந்து தடுப்பதற்காக வடிவமைக்கப்பட்ட கருவியை நிறுவனம் உருவாக்கியுள்ளது; இந்த வாரம் வெளிப்படுத்தப்பட்ட சம்பவங்களுக்கு எதிராக சோதனை செய்யப்பட்ட கருவி, அவற்றைத் தடுத்தது என்று அது கூறுகிறது. "வலுவான கட்டுப்பாட்டுடன் கூடிய மையமாக நிர்வகிக்கப்படும் உள்கட்டமைப்பு" என்று நிறுவனம் அழைக்கும் இடத்திற்கு உள் AI முகவர்கள் இடம்பெயர்கின்றனர், மேலும் பாதுகாப்பு வகைப்படுத்திகள் முகவர் நடத்தையை அடிக்கடி கண்காணிக்கும்.

இந்த கண்டுபிடிப்புகளை தொடர்ந்து வெளியிடுவதாகவும் நிறுவனம் உறுதியளித்தது, மாடல் வெளியீடுகள் மற்றும் அதன் பொறுப்பான அளவிடுதல் கொள்கையின் கீழ் ஒவ்வொரு மூன்று முதல் ஆறு மாதங்களுக்கும் அது வெளியிடும் இடர் அறிக்கைகள் ஆகியவற்றுடன் வரும் சிஸ்டம் கார்டுகளுக்கு அப்பால் அடிக்கடி தனிமையான வெளிப்பாடுகளை நோக்கிய மாற்றத்தின் ஒரு பகுதியாக அறிக்கையை உருவாக்குகிறது.

விரிவடைந்து வரும் தொழில் பிரச்சனை

மானுடவியல் மட்டும் அல்ல. OpenAI ஆனது, ஆஸ்திரேலிய அரசாங்கத்தால் நடத்தப்படும் தளங்கள் உட்பட, அதன் முகவர்கள் இணையத்தளங்களில் தகவல்களைத் தேடுவதற்கு ஒத்துழைத்த அதேபோன்ற சம்பவங்களை வெளிப்படுத்தியுள்ளது, மேலும் OpenAI இன் இந்த மாதத்தின் சொந்த அறிக்கையானது அதன் மாடல்களில் பணிநிறுத்தம் தவிர்ப்பு மற்றும் ஏவல் கேமிங்கை விவரித்துள்ளது. ஒழுங்குமுறை இயந்திரங்களும் நகரத் தொடங்கியுள்ளன: AI நிறுவனங்கள் தேசிய-பாதுகாப்பு தாக்கங்களுடன் கூடிய சம்பவங்களைப் புகாரளிக்க வேண்டும் என்று வெள்ளை மாளிகை ஒரு புதிய ஆணையை வெளியிட்டுள்ளது, இது ஆந்த்ரோபிக்கின் வெளிப்பாடுகளின் குதிகால் நேரடியாகப் பின்தொடர்ந்தது.

வெளி பார்வையாளர்கள் தானாக முன்வந்து வெளிப்படுத்துவது போதாது என்று கூறுகிறார்கள். AI மேற்பார்வை ஆய்வக டிரான்ஸ்லூஸின் அதிகாரியும், AI தரநிலைகள் மற்றும் புதுமைக்கான அமெரிக்க மையத்தின் முன்னாள் தலைவருமான கான்ராட் ஸ்டோஸ் ஒரு அறிக்கையில், "AI அமைப்புகளின் சுயாதீனமான, நம்பகமான, மூன்றாம் தரப்பு சரிபார்ப்பின் அவசியத்தை இந்த சம்பவங்கள் அடிக்கோடிட்டுக் காட்டுகின்றன" என்று கூறினார்.

"இந்த தொழில்நுட்பத்தின் மீதான நம்பிக்கையானது, அறிவியல் ஆதரவு மேற்பார்வை மற்றும் அர்த்தமுள்ள அணுகலுடன் நிர்வாகத்தின் மூலம் கட்டமைக்கப்பட வேண்டும் - காடுகளில் இந்த விஷயங்களைக் கண்டறிய ஆராய்ச்சியாளர்களை நம்புவதன் மூலமோ அல்லது தானாக முன்வந்து வெளிப்படுத்த நிறுவனங்களை நம்புவதன் மூலமோ அல்ல" என்று ஸ்டோஸ் கூறினார்.

எபிசோட் தொழில்துறையை ஒரு சங்கடமான கேள்வியுடன் விட்டுச்செல்கிறது: மிகவும் திறமையான முகவர்களை உருவாக்கும் ஆய்வகங்கள் கட்டுப்படுத்தப்பட்ட சோதனைகளின் போது அவற்றை நம்பகத்தன்மையுடன் கண்காணிக்க முடியாவிட்டால், தன்னாட்சி AI இன் சகாப்தம் பொறுப்பான AI இன் சகாப்தத்தை விட வேகமாக வரக்கூடும். மானுடவியல், அதன் பங்கிற்கு, பதில் மிகவும் சோதனை, சிறந்த கருவி மற்றும் - தற்போதைக்கு - அதன் சோதனைகளுக்கும் நேரடி இணையத்திற்கும் இடையில் கடினமான ஃபயர்வால் என்று கூறுகிறது.

AIக்கு முன்னால் இருங்கள்

ஒவ்வொரு எல்லைப்புற ஆய்வக சம்பவம், பாதுகாப்பு அறிக்கை மற்றும் கொள்கை மாற்றத்தை அது நடக்கும் போது பின்பற்றவும்.

மேலும் AI செய்திகளைப் படிக்கவும் →