கூகிள் செவ்வாய்க்கிழமை ஜெமினி 3.8 ஃப்ளாஷ் அறிமுகப்படுத்தியது, அதன் புதிய வேலைக் குதிரை மாதிரியானது நிறுவனத்தின் சிறந்த பகுத்தறிவு மற்றும் குறியீட்டு அமைப்பாக நிலைநிறுத்தப்பட்டுள்ளது, ஆனால் அதன் முன்னோடியின் அதே விலையில், தற்காப்பு இணையப் பாதுகாப்புப் பணிகளுக்காக உருவாக்கப்பட்ட ஜெமினி 3.8 ஃப்ளாஷ் சைபர் என்ற சிறப்பு மாறுபாட்டுடன். கூகுளின் அதிகாரப்பூர்வ வலைப்பதிவில் தயாரிப்பு நிர்வாகத்தின் மூத்த இயக்குனர் துல்சி தோஷி மற்றும் கூகுள் டீப் மைண்டின் ஜெமினி பாதுகாப்பு முன்னணி ரலுகா அடா போபா ஆகியோரால் வெளியிடப்பட்ட இந்த அறிவிப்பு ஆறு வாரங்களில் கூகுளின் மூன்றாவது ஃப்ளாஷ் வெளியீட்டைக் குறிக்கிறது.
இந்த வெளியீடு வழக்கத்திற்கு மாறாக நெரிசலான வெளியீட்டு பருவத்தின் நடுவில் இறங்குகிறது, மேலும் இது கூகிளின் மாதிரி வரிசையில் போட்டியாளர்கள் செலுத்திய விலை மற்றும் செயல்திறன் அழுத்தத்திற்கு நேரடியான பதில். எல்லைப்புற ஆய்வகங்கள் எவ்வாறு வர்த்தகம் செய்கின்றன என்பதைப் பற்றிய விரிவான பார்வைக்கு, பிரேக்கிங் AI செய்தி குழு ஒவ்வொரு முக்கிய மாடல் வெளியீட்டையும் அது நிகழும்போது கண்காணிக்கிறது.
இரண்டு மாறுபாடுகள், ஒரு அடித்தளம்
ஜெமினி 3.8 இரண்டு பதிப்புகளில் ஒரே அடிப்படை நுண்ணறிவில் கட்டமைக்கப்பட்டுள்ளது. ஜெமினி 3.8 ஃப்ளாஷ் என்பது பொது நோக்கத்திற்கான வேலைக் குதிரையாகும்: மென்பொருள் பொறியியல், ஏஜென்டிக் பணிகள் மற்றும் சிறப்புக் களங்களில் பல-படி பகுத்தறிவு ஆகியவற்றில் 3.7 ஃப்ளாஷை விட குறிப்பிடத்தக்க மேம்பாடுகளை வழங்குவதாக கூகுள் கூறுகிறது.
ஜெமினி 3.8 ஃப்ளாஷ் சைபர் கூகுளின் மிகவும் திறமையான சைபர் செக்யூரிட்டி மாடலாக விவரிக்கப்படுகிறது, இதன் மூலம் நிறுவனம் பாதிப்புகளை கண்டறிதல் மற்றும் தானியங்கு பேட்ச்சிங் ஆகியவற்றில் எல்லை-நிலை செயல்திறனை அழைக்கிறது. நிலையான ஃப்ளாஷ் மாடலைப் போலல்லாமல், இது பரவலாகக் கிடைக்காது - கூகிள் அதை ஃபேர்விண்ட் என்ற புதிய திட்டத்தின் மூலம் நம்பகமான பாதுகாவலர்களுக்கு விநியோகிக்கிறது.
வலைப்பதிவு இடுகையின்படி, பகிரப்பட்ட மையத்தில் குறியீட்டு முறை மற்றும் பகுத்தறிவு ஆதாயங்கள் இணையப் பாதுகாப்பின் கோரும் களத்தில் கடுமையான பயிற்சியால் ஓரளவு இயக்கப்படுகின்றன, மேலும் இரண்டு மாடல்களும் நீண்டகாலமாக இயங்கும் ஏஜென்டிக் லூப்களால் முடுக்கிவிடப்பட்டன.
அளவுகோல்கள்: கடினமாக உழைக்க வேண்டும், பெரிதாகி விடுவதில்லை
கூகுளின் பெஞ்ச்மார்க் உரிமைகோரல்கள் வடிவமைப்புத் தத்துவத்தை மையமாகக் கொண்டு நிறுவனம் தெளிவாகச் சுருக்கமாகக் கூறுகிறது: 3.8 ஃப்ளாஷ் "கடினமாக வேலை செய்கிறது." சிக்கலான பணிகளில், மாடல் கூடுதல் பகுத்தறிவு படிகளை செயல்படுத்துகிறது மற்றும் கருவிகளை மீண்டும் மீண்டும் அழைக்கிறது, சில நேரங்களில் அதிக முயற்சி நிலைகளில் செயல்திறனை அதிகரிக்க அதிக டோக்கன்களை பயன்படுத்துகிறது. டெவலப்பர்கள் டோக்கன் மேல்நிலையை குறைக்க முயற்சி செய்யலாம் அல்லது ஜெமினி 3.7 ஃப்ளாஷில் தங்கலாம், இது செயல்திறன்-முதல் பணிச்சுமைக்கு முழுமையாக துணைபுரிகிறது.
கூகுள் மேற்கோள் காட்டும் தலைப்பு முடிவுகள்:
- DeepSWE v1.1 (நீண்ட அடிவான மென்பொருள் பொறியியல்): 3.8 ஃப்ளாஷ், சிக்கலான பொறியியல் சிக்கல்களைத் தன்னிச்சையாகத் தீர்ப்பதில் மிகப் பெரிய எல்லை மாடல்களை விஞ்சி, கூகிள் விலையின் ஒரு பகுதி என்று விவரிக்கிறது.
- Vals Finance Agent V2 மற்றும் Harvey's Legal Agent Benchmark: 3.8 ஃப்ளாஷ் 3.7 ஃப்ளாஷ் மற்றும் மேம்பட்ட பகுப்பாய்வு மற்றும் அறிக்கையிடல் தேவைப்படும் அளவு மற்றும் தொழில்முறை துறைகளில் மற்ற எல்லை மாதிரிகளை விஞ்சுகிறது.
- HLE-சரிபார்க்கப்பட்டது: 3.8 ஃப்ளாஷ் 54.9% ஐ அடைகிறது, இது STEM, மனிதநேயம் மற்றும் தொழில்முறை துறைகளில் பல-படி பகுத்தறிவின் சான்றாக Google வழங்குகிறது.
ஃப்ளாஷ் சைபர்: குற்றத்தின் மீது பாதுகாப்பு
சைபர் மாறுபாடு மிகவும் அசாதாரண வெளியீடு ஆகும். சுரண்டல் போன்ற தாக்குதல் திறன்களைக் காட்டிலும் பாதிப்புகளை சரிசெய்வதற்கு வேண்டுமென்றே முன்னுரிமை அளித்ததாக கூகுள் கூறுகிறது. CWE-Bench இல், Collinear மூலம் நடத்தப்படும் வெளிப்புற பேட்ச்சிங் பெஞ்ச்மார்க், ஜெமினி 3.8 Flash Cyber 47.2% இல் பாஸ்@1 ஐப் பெற்றது - கூகுள் கருத்துப்படி, 47.8% என்ற முன்னணி எல்லை மாடலுக்குப் பின்னால், ஆனால் குறிப்பிடத்தக்க அளவு குறைந்த செலவில், பெஞ்ச்மார்க்கின் Pareto எல்லையில் வைக்கிறது.
CyberGym இல், பாதிப்புகளைக் கண்டறிவதற்கான ஒரு நிலையான தொழில்துறை அளவுகோலாக, Cyber மாதிரியானது அதன் முன்னோடியான 3.5 Flash Cyber மற்றும் குறிப்பிடத்தக்க அளவு பெரிய எல்லை மாடல்களை விஞ்சி, எல்லை-நிலை தன்னாட்சி பாதிப்புக் கண்டுபிடிப்பை நிரூபிக்கிறது என்று கூகுள் கூறுகிறது. 20 நிரலாக்க மொழிகளில் கூகுளின் உள்ளக அளவுகோலில் உள்ள சிக்கலான கோட்பேஸ்களில், மாடல் 70%க்கும் அதிகமான வெற்றி விகிதத்தை எட்டியது.
ஏற்கனவே Google இன் சொந்தக் குறியீட்டைப் பாதுகாத்து வருகிறது
சைபர் மாடல் ஏற்கனவே உள்நாட்டில் பயன்படுத்தப்பட்டுள்ளதாக கூகிள் கூறுகிறது, மேலும் அது வழங்கும் எடுத்துக்காட்டுகள் குறிப்பிட்டவை:
- Chrome பாதுகாப்புக் குழுவானது, 3.8 Flash Cyber ஆனது Chrome பாதிப்புகளுக்கு 2.6 மடங்கு அதிகமான சரியான இணைப்புகளை உருவாக்கியது, அவை மிகச் சிறந்த வணிக மாதிரிகளை விட பெரியவை.
- பாதுகாப்பு நிறுவனமான Wiz இல், மற்ற முன்னணி எல்லை மாடல்களுடன் ஒப்பிடுகையில் 2.3 முதல் 5.2 மடங்கு குறைந்த செலவில் உள்ளக ஊடுருவல்-சோதனை அளவுகோலில் 7.5 முதல் 9.7 சதவிகிதப் புள்ளிகள் அதிக நினைவுகூரலைப் பெற்றது.
- கூகிளின் கிளவுட் பாதிப்பு ஆராய்ச்சிக் குழு, இரண்டு மணி நேரத்திற்குள் ஒரு முக்கியமான அடிப்படை பாதிப்பைக் கண்டறிய மாதிரியைப் பயன்படுத்தியது - ஒரு வகை பாதிப்பு, அதன் ஆராய்ச்சி மற்றும் கண்டுபிடிப்பு, பொதுவாக மாதங்கள் எடுக்கும்.
டெவலப்பர்கள் மற்றும் சந்தைக்கு இது என்ன அர்த்தம்
டெவலப்பர்களுக்கு, நடைமுறையில் எடுத்துச் செல்வது, எல்லையின் குறைந்த முடிவில் விலை நிலைத்தன்மை ஆகும். 3.7 இன் அறிமுக விலையில் 3.8 ஃப்ளாஷ் வைத்திருப்பது, ஒரு மில்லியன் டோக்கன்களுக்கு $0.75/$3.75 என்ற போட்டித்தன்மை கொண்ட குறியீட்டு மற்றும் முகவர் மாதிரியின் விலையை வைத்திருக்கிறது, இந்த பிரிவில் திறந்த-எடை சவாலாளர்கள் மற்றும் போட்டி ஆய்வகங்கள் ஆண்டு முழுவதும் பதவியில் இருப்பவர்களைக் குறைக்கின்றன. கூகிளின் செய்தி என்னவென்றால், வாங்குபவர்கள் இனி வேலை செய்யும் தரத்தில் செலவு மற்றும் திறன் ஆகியவற்றிற்கு இடையே தேர்வு செய்ய வேண்டியதில்லை.
Flash Cyber க்கான Fairwind நிரல் விநியோக மாதிரி சமமாகச் சொல்கிறது. முன்னணி-அடுக்கு ஆய்வகங்கள் பெருகிய முறையில் உயரடுக்கு சைபர் பாதுகாப்பு திறனை பரந்த அளவில் அனுப்புவதற்கு பதிலாக நுழையக்கூடிய ஒன்றாக கருதுகின்றன - தாக்குதலை தவறாக பயன்படுத்துவதற்கான சாத்தியக்கூறுகளை கட்டுப்படுத்தும் அதே வேளையில், பரிசோதிக்கப்பட்ட பாதுகாவலர்களுக்கு அதிநவீன தற்காப்பு கருவிகளை வழங்குகிறது. மாடலின் பயிற்சியில் சுரண்டல் திறன்களை விட பேட்ச் பெஞ்ச்மார்க்குகளுக்கு முன்னுரிமை அளிக்கும் கூகுளின் முடிவும் அதே தர்க்கத்தைப் பின்பற்றுகிறது.
கேடன்ஸ் கூட குறிப்பிடத்தக்கது. ஆறு வாரங்களில் மூன்று ஃப்ளாஷ் வெளியீடுகள் - மூன்று வாரங்களுக்கு முன்பு 3.7 ஃப்ளாஷ், இப்போது 3.8 - இரண்டு ஆண்டுகளுக்கு முன்பு இருந்த வருடாந்திர-பாணி வெளியீட்டு சுழற்சிகளை விட, கூகிள் அதன் நடு-அடுக்கு வரிசையை மிக வேகமாகச் செயல்படுத்துவதைக் காட்டுகிறது. OpenAI இன் GPT-6 வெளியீட்டின் போட்டி அழுத்தம் மற்றும் சீனாவில் இருந்து வேகமாக நகரும் திறந்த எடை மாடல்களின் அலை ஆகியவை அனைவரின் காலவரிசைகளையும் சுருக்கியுள்ளது, மேலும் கூகிள் அதன் எல்லை மாதிரிகள் ஆராய்ச்சிக் கொடியை ஏந்தியிருக்கும் போது, வேலைக் குதிரை அடுக்கில் வேகத்தைத் தெளிவாகத் தேர்ந்தெடுக்கிறது.
3.8 ஃப்ளாஷின் "கடினமாகச் செயல்படுகிறதா" என்ற அணுகுமுறை — விடாமுயற்சியுடன் கூடிய பல-படி பகுத்தறிவுக்கு அதிக டோக்கன்களைச் செலவழிக்கிறதா — வரவிருக்கும் மாதங்களில் டெவலப்பர்களின் பில்களில் காட்டப்படும் மூல மாதிரி அளவை விட நடைமுறையில் மிகவும் திறமையானது என்பதை நிரூபிக்கிறது. கூகுளின் சொந்த வரையறைகள் வர்த்தகம் விடாமுயற்சிக்கு சாதகமாக இருக்கும் என்று பரிந்துரைக்கிறது; சந்தை அதன் தீர்ப்பை ஒரு நேரத்தில் ஒரு API பில் வழங்கும்.
AIக்கு முன்னால் இருங்கள்
ஒவ்வொரு மாடல் வெளியீடும், பெஞ்ச்மார்க் மற்றும் விலை மாற்றம், அது நிகழும்போது கண்காணிக்கப்படும் — மேலும் AI செய்திகளைப் படிக்க →
