Google DeepMind ஆகஸ்ட் 27 அன்று, தனியுரிம, எல்லைப்புற-வகுப்பு AI மாதிரியின் உலகின் முதல் இரட்டை-குருட்டு மதிப்பீடு என்று அழைக்கிறது - இது வெளி நிபுணர்கள் கூகுளின் மாடல்களை இருதரப்பு ரகசியங்களையும் பார்க்காமல் அழுத்த-சோதனை செய்ய வடிவமைக்கப்பட்ட கிரிப்டோகிராஃபிக் அமைப்பு.
வில்லியம் ஐசக், சோல் மெஸ்ஸிங் மற்றும் கிறிஸ்டியன் லம் ஆகியோரின் DeepMind வலைப்பதிவு இடுகையில் விவரிக்கப்பட்டுள்ள பைலட், கிரிப்டோகிராஃபிக் ரீதியாக பாதுகாப்பான சூழலில் ரகசிய வரையறைகள் மூலம் ஜெமினி ஃப்ளாஷ் லைட் மாதிரியை இயக்குகிறார். Google DeepMind சிங்கப்பூர் AI பாதுகாப்பு நிறுவனம், OpenMined, AVERI மற்றும் MLCcommons ஆகியவற்றுடன் கூட்டு முயற்சியில் ஈடுபட்டுள்ளது, மேலும் இந்த முறையை விவரிக்கும் தொழில்நுட்ப அறிக்கையை வெளியிட்டுள்ளது.
இந்த அறிவிப்பு AI மதிப்பீட்டில் உள்ள மிகவும் தொடர்ச்சியான பலவீனங்களில் ஒன்றைக் குறிக்கிறது: முக்கிய மாசுபாடு. [AI ஆராய்ச்சிச் செய்திகள்] (https://aibuzzwire.news)ஐக் கண்காணிக்கும் வாசகர்களுக்கு, மூன்றாம் தரப்பு மாதிரிச் சோதனையைச் சரிபார்க்கும் வகையில் சுத்தமாக்குவதற்கான உறுதியான முயற்சிகளில் இதுவும் ஒன்றாகும்.
மாசுபடுதல் பிரச்சனை, விளக்கப்பட்டது
DeepMind அதன் அறிவிப்பை வகுப்பறை ஒப்புமையுடன் திறக்கிறது. ஒரு மாணவர் தற்செயலாக தேர்வு கேள்விகளை முன்கூட்டியே பார்த்தால், சரியான மதிப்பெண் என்பது ஒன்றுமில்லை. அதே தர்க்கம் எல்லைப்புற மாடல்களுக்கும் பொருந்தும்: ஒரு மாதிரி ஏற்கனவே ஒரு அளவுகோலில் உள்ள கேள்விகளுக்கு வெளிப்பட்டிருந்தால் - பயிற்சி தரவு, கசிந்த ஏவல் செட் அல்லது முன் தேர்வுமுறை - இதன் விளைவாக வரும் மதிப்பெண்கள் உண்மையான திறனை பெருமளவில் மிகைப்படுத்தலாம்.
இது ஒரு கற்பனையான கவலை அல்ல. பெஞ்ச்மார்க் மாசுபாடு பல ஆண்டுகளாக களத்தில் உள்ளது, பிரபலமான சோதனைத் தொகுப்புகள் இணைய அளவிலான பயிற்சி நிறுவனத்தில் கசிந்து விடுகின்றன என்பதை ஆராய்ச்சியாளர்கள் மீண்டும் மீண்டும் காட்டுகின்றனர், மேலும் அறியப்பட்ட மதிப்பீடுகளில் சிறப்பாக செயல்பட மாதிரிகள் அமைதியாக வடிவமைக்கப்படலாம். அரசாங்கங்களும் நிறுவனங்களும் கொள்முதல் மற்றும் கொள்கை முடிவுகளை எடுக்க பெஞ்ச்மார்க் மதிப்பெண்களைப் பயன்படுத்தும் போது, உயர்த்தப்பட்ட எண்கள் உண்மையான விளைவுகளை ஏற்படுத்துகின்றன.
மாதிரிகள் அதிக திறன் கொண்டதாக வளரும் போது, DeepMind வாதிடுகிறது, முக்கியமான மதிப்பீட்டு வகைகளுக்கு - இணைய பாதுகாப்பு சோதனை மற்றும் அரசாங்க மதிப்பீடுகள் முதன்மையானவை - இதில் அசுத்தமான மதிப்பெண் தவறானது மட்டுமல்ல, ஆபத்தானது.
பழைய வர்த்தகம்: உங்கள் தூண்டுதல்கள் அல்லது எங்கள் எடைகள்
வரலாற்று ரீதியாக, உயர்-பங்குகள் வெளிப்புற மதிப்பீடுகள் ஒரு சங்கடமான தேர்வை கட்டாயப்படுத்தியது. மதிப்பீட்டாளர் அதன் சோதனைத் தூண்டுதல்களை மாதிரி வழங்குநரிடம் ஒப்படைத்தார் - வழங்குநர் சோதனைக் கேள்விகளை முன்கூட்டியே பார்ப்பார் என்ற ஆபத்து - அல்லது வழங்குநர் மாதிரி எடைகளை மதிப்பீட்டாளரிடம் ஒப்படைத்தார் - அதன் மதிப்புமிக்க அறிவுசார் சொத்துக்களை இழக்க நேரிடும்.
ஜீரோ-லாக்கிங் நெறிமுறைகள் மற்றும் கடுமையான ஒப்பந்தப் பாதுகாப்புகள் நீண்ட காலமாக வெளிப்புற சோதனைத் தூண்டுதல்களை ரகசியமாக வைத்துள்ளன, டீப் மைண்ட் எழுதுகிறது, ஆனால் அவை கணிதத்தால் அல்லாமல் கொள்கையால் செயல்படுத்தப்படும் வாக்குறுதிகள். இரட்டை குருட்டு மதிப்பீடுகள் அந்த நம்பிக்கையை கிரிப்டோகிராஃபிக் ஆதாரத்துடன் மாற்றுகின்றன.
கிரிப்டோகிராஃபிக் பாக்ஸ் எப்படி வேலை செய்கிறது
கிரிப்டோகிராஃபிக் "பாக்ஸ்" என DeepMind விவரிக்கும் ஒன்றை உருவாக்க, பைலட், Google Cloud இன் கான்ஃபிடன்ஷியல் கம்ப்யூட்டிங் போர்ட்ஃபோலியோவின் ஒரு பகுதியான Confidential Space ஐப் பயன்படுத்துகிறார். அதன் உள்ளே, மதிப்பீட்டின் இரண்டு பகுதிகளும் - ரகசிய அளவுகோல் மற்றும் தனியுரிம மாதிரி - அந்தந்த உரிமையாளர்களுக்கு தனிப்பட்டதாக இருக்கும், மேலும் சூழல் குறியாக்கவியல் ரீதியாக அந்த உண்மையைச் சரிபார்க்கிறது.
இதன் விளைவாக உண்மையிலேயே இரட்டைக் குருட்டுத்தன்மை உள்ளது: வெளிப்புற மதிப்பீட்டாளரால் ஜெமினி மாடல் எடையைப் பார்க்க முடியாது, மேலும் மதிப்பீட்டாளரின் சோதனைத் தூண்டுதல்களை Google பார்க்க முடியாது. எந்தவொரு தரப்பினரும் மற்றவரின் வாக்குறுதிகளை நம்ப வேண்டியதில்லை, ஏனென்றால் கட்டிடக்கலையானது கொள்கையளவில் கசிவை சாத்தியமற்றதாக்குகிறது. விமர்சன ரீதியாக, இந்த அமைப்பு எதிர்கால சோதனைக்கு முன்னதாக மாதிரி செயல்திறனை மேம்படுத்துவதற்கு மதிப்பீட்டுத் தரவைப் பயன்படுத்துவதைத் தடுக்கிறது - மாசு பொதுவாக மீண்டும் ஊடுருவிச் செல்லும் வளையத்தை மூடுகிறது.
AI மேற்பார்வைக்கு இது ஏன் முக்கியமானது
பரந்த முக்கியத்துவம் ஒரு ஜெமினி மாதிரிக்கு அப்பாற்பட்டது. சுயாதீன நிறுவனங்கள் - AI பாதுகாப்பு நிறுவனங்கள், கல்வி ஆய்வகங்கள், கட்டுப்பாட்டாளர்கள் - மூடிய எல்லை மாதிரிகளை கடுமையாக மதிப்பீடு செய்ய பல ஆண்டுகளாக போராடி வருகின்றனர். ஒவ்வொரு பெரிய AI பாதுகாப்பு நிறுவனமும், எல்லைப்புற ஆய்வகங்களுடன் மதிப்பீட்டு ஒப்பந்தங்களில் கையெழுத்திடும் போது, இந்தச் சிக்கலின் பதிப்புகளைப் புரிந்துகொள்கின்றன.
பைலட் பொறுமையாக இருந்தால், அது ஒரு டெம்ப்ளேட்டை வழங்குகிறது, அதன் கீழ் தரவு இறையாண்மை மற்றும் அறிவுசார் சொத்து ஆகியவை சுதந்திரமான ஆய்வுடன் தொடர்பைத் தக்கவைக்கும். டீப் மைண்ட், பைலட் "மாடல் மேற்பார்வைக்கான புதிய எல்லையை நிறுவி, பரந்த தொழில்துறைக்கு பாதுகாப்பான, அதிக நம்பகமான மற்றும் பரவலாக நம்பப்படும் AI அமைப்புகளை உருவாக்க உதவுகிறது" என்று நம்புகிறது.
கூட்டாளர் பட்டியல் அதில் குறிப்பிடத்தக்கது. சிங்கப்பூர் AI பாதுகாப்பு நிறுவனம் மிகவும் செயலில் உள்ள தேசிய மதிப்பீட்டு அமைப்புகளில் ஒன்றாகும்; OpenMined தனியுரிமையைப் பாதுகாக்கும் கணக்கீட்டு கருவியை உருவாக்குகிறது; MLCommons தொழில் தரப்படுத்தலை தரப்படுத்துகிறது. AVERI ஆனது அரசாங்கம், கல்வித்துறை மற்றும் தொழில்துறை தரநிலை அமைப்புகளை உள்ளடக்கிய ஒரு கூட்டமைப்பைச் சுற்றி வளைக்கிறது - இது ஒரு ஆர்ப்பாட்டமாக இல்லாமல் ஒரு விதிமுறையாக மாறுவதற்கு இரட்டை குருட்டு மதிப்பீட்டைக் கடைப்பிடிக்க வேண்டிய தொகுதிகள்.
மதிப்பீட்டு நேர்மைக்கு மேல் ஒரு ஆயுதப் போட்டி
AI நிறுவனங்கள் தங்களை எவ்வாறு தரப்படுத்துகின்றன என்ற உயரும் ஆய்வுக்கு மத்தியில் இந்த அறிவிப்பு வந்துள்ளது. ஆய்வகங்கள் செர்ரி-தேர்வு சாதகமான வரையறைகளை வளர்ந்து வரும் குற்றச்சாட்டுகளை எதிர்கொள்கின்றன, மேலும் சுயாதீன லீடர்போர்டுகள் துல்லியமாக செல்வாக்கு பெற்றுள்ளன, ஏனெனில் அவை விற்பனையாளர்களின் கட்டுப்பாட்டிற்கு வெளியே அமர்ந்துள்ளன. இரட்டை குருட்டு மதிப்பீடு விற்பனையாளரின் சொந்த உள்கட்டமைப்பிற்குள் சுதந்திர இயக்கத்தை விரிவுபடுத்துகிறது - வரலாற்று ரீதியாக தங்கள் மாதிரிகள் எவ்வாறு சோதிக்கப்படுகின்றன என்பதைப் பற்றிய ஒவ்வொரு விவரத்தையும் கட்டுப்படுத்த வலியுறுத்திய நிறுவனங்களுக்கு இது ஒரு குறிப்பிடத்தக்க மாற்றம்.
இப்போதைக்கு, பைலட் ஒரு மாதிரி மற்றும் ரகசிய வரையறைகளின் தொகுப்பை உள்ளடக்கியது. ஆனால் கிரிப்டோகிராஃபிக ரீதியாக சரிபார்க்கப்பட்டால், மாசுபாடு இல்லாத மதிப்பீடு தொழில்நுட்ப ரீதியாக வழக்கமானதாக மாறினால், ஒவ்வொரு எல்லை ஆய்வகத்திலிருந்தும் நிறுவனங்களும் கட்டுப்பாட்டாளர்களும் எதிர்பார்ப்பதை மாற்றலாம் - மேலும் சரிபார்க்கக்கூடிய உரிமைகோரல்களில் பெருகிய முறையில் கட்டமைக்கப்பட்ட சந்தையில் "எங்கள் மதிப்பெண்ணை நம்புங்கள்" கடினமான விற்பனையாக மாற்றலாம்.
---
AIக்கு முன்னால் இருங்கள்சமீபத்திய AI செய்திகள், பகுப்பாய்வு மற்றும் முன்னேற்றங்கள் - அனைத்தையும் ஒரே இடத்தில் பெறுங்கள்.
மேலும் AI செய்திகளைப் படிக்கவும் →