ஐரோப்பிய AI நிறுவனமான மல்டிவர்ஸ் கம்ப்யூட்டிங் குவாசார் 438B ஐ அறிமுகப்படுத்தியுள்ளது, இது ஐரோப்பாவில் கட்டமைக்கப்பட்ட மிகவும் புத்திசாலித்தனமான AI மாடல் என்று நிறுவனம் கூறுகிறது. நிறுவனத்தின் அறிவிப்பின்படி, Quasar 438B ஆனது செயற்கை பகுப்பாய்வு நுண்ணறிவு குறியீட்டில் 43 மதிப்பெண்களைப் பெற்றது, அந்த அளவுகோலில் அளவிடப்பட்ட எந்த ஐரோப்பிய மாடலின் மிக உயர்ந்த முடிவு.
இந்த வெளியீடு ஸ்பானிய நிறுவனத்திற்கு ஒரு குறிப்பிடத்தக்க படியைக் குறிக்கிறது. Quasar 438B என்பது மல்டிவர்ஸ் கம்ப்யூட்டிங் வெளியிட்ட முதல் பெரிய மாடலாகும், மேலும் இது அமெரிக்க மற்றும் சீன ஆய்வகங்களை முழுமையாகச் சார்ந்திருக்காத AI திறனை ஐரோப்பிய அரசாங்கங்களும் நிறுவனங்களும் வலியுறுத்தும் போது வந்துள்ளது. எங்கள் AI செய்திகளைப் பின்தொடரும் வாசகர்களுக்கு, எல்லை மாடல்களுடன் இடைவெளியை மூடுவதற்கான ஓட்டம் வழக்கமான அமெரிக்க போட்டியாளர்களுக்கு மட்டுப்படுத்தப்படவில்லை என்பதையும் வெளியீடு சமிக்ஞை செய்கிறது.
Quasar 438B உண்மையில் என்ன ஸ்கோர்கள்
செயற்கைப் பகுப்பாய்வு நுண்ணறிவு அட்டவணை (பதிப்பு 4.1.1) GDPval-AA v2, tau3-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omnisci AA-Omnisci ence ஆகிய ஒன்பது மதிப்பீடுகளை ஒருங்கிணைக்கிறது. Quasar 438B இன் கூட்டு மதிப்பெண் 43, நிறுவனத்தின் அறிவிப்பின்படி, Mistral Medium 3.5 ஐ விட 30, NVIDIA இன் Nemotron 3 Ultra 38, மற்றும் Inkling 42 ஐ விட முன்னணியில் உள்ளது.
பரந்த புலம் இன்னும் அமெரிக்க எல்லைக்கு சொந்தமானது: க்ளாட் ஓபஸ் 5 குறியீட்டில் 63 இல் முன்னிலை வகிக்கிறது. மல்டிவர்ஸ் கம்ப்யூட்டிங் வேறுவிதமாகக் கூறவில்லை. அதற்கு பதிலாக, நிறுவனம் Quasar 438B ஐ வலுவான ஐரோப்பிய விருப்பமாக வடிவமைக்கிறது, அது உயர்த்திய எட்டு தேர்ந்தெடுக்கப்பட்ட செயற்கை பகுப்பாய்வு மதிப்பீடுகளில் ஏழில் ஒப்பிடக்கூடிய ஐரோப்பிய மாடல்களை விட சிறப்பாக செயல்படுகிறது.
வேகம் என்பது இரண்டாவது வாதம்
ரா பெஞ்ச்மார்க் மதிப்பெண்கள் மல்டிவர்ஸ் கம்ப்யூட்டிங்கின் பிட்சில் பாதி மட்டுமே. Quasar 438B ஆனது 15.3 வினாடிகளில் 500 டோக்கன்களை, சிந்திக்கும் நேரத்தையும் சேர்த்து வழங்குகிறது என்று நிறுவனம் கூறுகிறது. அதன் ஒப்பீட்டில் உள்ள மாடல்களில், நெமோட்ரான் 3.5 லைட்னிங் (9.4 வினாடிகள்), ஜெமினி 3.5 ஃப்ளாஷ்-லைட் (10.8 வினாடிகள்) மற்றும் ஜெமினி 3.7 ஃப்ளாஷ் (11.5 வினாடிகள்) மட்டுமே வேகமானவை, மேலும் ஜெமினி 3.7 ஃப்ளாஷ் மட்டுமே குறியீட்டில் வேகமானதாகவும் அதிக திறன் கொண்டதாகவும் உள்ளது.
மிஸ்ட்ரல் மீடியம் 3.5க்கு எதிரான ஒப்பீடு இரண்டு அச்சுகளிலும் ஒரு வழியில் இயங்குகிறது: குவாசர் அதிக மதிப்பெண்கள் (43 எதிராக 30) மற்றும் வேகமாக பதிலளிக்கிறது (18.8 வினாடிகளுக்கு எதிராக 15.3 வினாடிகள்). 42ல் உள்ள குவாசரின் நுண்ணறிவுடன் கிட்டத்தட்ட பொருந்தக்கூடிய Inkling, அதே 500-டோக்கன் பதிலுக்கு 48.3 வினாடிகள் தேவை, இது மூன்று மடங்குக்கும் அதிகமாகும்.
வலுவான நீண்ட சூழல் பகுத்தறிவு
அறிவிப்பில் இருந்து ஒரு முடிவு தனித்து நிற்கிறது: AA-LCR இல், நீண்ட ஆவணங்களில் பரவியிருக்கும் தகவல்களைப் பிரித்தெடுக்கும், இணைக்கும் மற்றும் நியாயப்படுத்துவதற்கான திறனைச் சோதிக்கும் மதிப்பீடு, Quasar 438B மதிப்பெண்கள் 75.0. இது நிறுவனத்தின் புள்ளிவிவரங்களின்படி, க்ரோக் 4.6 (உயர்நிலை), கிளாட் ஓபஸ் 5 இன் ஒரு புள்ளியில் 75.7, மற்றும் Qwen3.8 2.4T A95B க்கு முன்னால் 75.3 இல் உள்ளது.
நிறுவன ஆராய்ச்சி, ஆவண பகுப்பாய்வு மற்றும் ஏஜென்டிக் பணிப்பாய்வு ஆகியவை இதில் கட்டமைக்கப்பட்டுள்ளதால், நீண்ட சூழல் கையாளுதல் விஷயங்கள். ஒரு மாதிரியானது ஒரு நீண்ட ஆவணத்தில் தகவலைப் பிடித்து இணைக்க முடியாவிட்டால், நிறுவனங்கள் உண்மையில் வரிசைப்படுத்த விரும்பும் பல-படி கருவிகளை அது இயக்க முடியாது. இங்குதான் குவாசர் எல்லைக் குழுவிற்கு மிக அருகில் வருகிறது.
ஏஜென்டிக் கோடிங்கில் இன்னும் ஹெட்ரூம் உள்ளது
அறிவிப்பின் பலவீனமான முடிவு டெர்மினல்-பெஞ்ச் v2.1 ஆகும், இது உண்மையான டெர்மினல் சூழல்களில் குறியீட்டு முகவர்களை வேலை செய்ய வைக்கிறது. Quasar 438B மதிப்பெண்கள் 69.3, மிஸ்ட்ரல் மீடியம் 3.5 க்கு 18.7 புள்ளிகள் மற்றும் நெமோட்ரான் 3 அல்ட்ரா 15.4, ஆனால் க்ளாட் ஓபஸ் 5 தலைமையிலான எல்லைக் குழுவை 89.1 இல் பின்னுக்குத் தள்ளியது. மல்டிவர்ஸ் கம்ப்யூட்டிங் இது மிகவும் ஹெட்ரூம் கொண்ட மதிப்பீடு என்று ஒப்புக்கொள்கிறது மற்றும் அடுத்த சுற்று வேலை அதை இலக்காகக் கொண்டது என்று கூறுகிறது.
நிறுவன முகவர்களுக்காக கட்டப்பட்டது
Quasar 438B மென்பொருள் மேம்பாட்டு முகவர்கள், தொழில்நுட்ப காப்பிலட்டுகள், ஆராய்ச்சி அமைப்புகள் மற்றும் பணிப்பாய்வு ஆட்டோமேஷன் இயங்கும் நிறுவனங்களுக்கு ஒரு மாதிரியாக நிலைநிறுத்தப்பட்டுள்ளது. இது 400-பில்லியன் அளவுரு-பிளஸ் வகுப்பில் அமர்ந்து, ஆங்கிலம் மற்றும் ஸ்பானிஷ் மொழியைக் கையாளுகிறது, மேலும் திட்டமிடல், கருவிப் பயன்பாடு, குறியீட்டைச் செயல்படுத்துதல் மற்றும் பெரிய சூழல் தேவைப்படும் பல-படி பணிகளுக்காக வடிவமைக்கப்பட்டுள்ளது.
நிறுவனத்தின் CompactifAI API மூலம் அணுகல் இயங்குகிறது, எனவே குழுக்கள் தங்கள் சொந்த உள்கட்டமைப்பை நிலைநிறுத்தாமல் மாதிரியை சோதிக்க முடியும். மல்டிவர்ஸ் கம்ப்யூட்டிங், Quasar க்கான மேலும் புதுப்பிப்புகள் வரவுள்ளதாக கூறுகிறது.
ஐரோப்பிய AI பந்தயத்திற்கு இது என்ன அர்த்தம்
வெளியீடு ஐரோப்பிய AI க்கு ஒரு விசித்திரமான தருணத்தில் இறங்குகிறது. மிஸ்ட்ரல், நீண்ட கண்டத்தின் நிலையான-தாங்கி, அதன் திசையைப் பற்றிய கேள்விகளை எதிர்கொண்டது, அதே நேரத்தில் அமெரிக்க ஆய்வகங்கள் கலப்பு அளவுகோல்களில் தங்கள் முன்னணியை ஒருங்கிணைத்துள்ளன. ஒரு சுயாதீனமான குறியீட்டில் ஐரோப்பிய துறையில் சட்டப்பூர்வமாக முதலிடம் வகிக்கும் ஒரு ஐரோப்பிய மாதிரியானது, கண்டத்தில் உள்ள நிறுவனங்களுக்கு நம்பகமான பிராந்திய விருப்பத்தை வழங்குகிறது, குறிப்பாக இருமொழி ஆங்கிலம்-ஸ்பானிஷ் வரிசைப்படுத்தல்களுக்கு.
Quasar 438B அந்த நிலையை வகிக்கிறதா என்பது வேறு விஷயம். குறியீட்டுத் தலைவர்களில் ஒரு பகுதியினர் மட்டுமே வேகமாகப் பதிலளிப்பார்கள் என்று நிறுவனம் குறிப்பிடுகிறது, மேலும் கிளாட் ஓபஸ் 5க்கான இடைவெளி இருபது புள்ளிகள் அகலமாக உள்ளது. ஆனால் கம்ப்ரஷன்-முதல் நிறுவனம் இப்போது ஹெவிவெயிட் வகுப்பில் போட்டியிட முடியும் என்பதைக் காட்டியுள்ளது, மேலும் ஐரோப்பிய நிறுவனங்கள் இறுதியாக ஒரு ஹோம்-மார்க்கெட் மாடலை தங்கள் அமெரிக்க இயல்புநிலைகளுக்கு எதிராக தரப்படுத்துகின்றன.
AIக்கு முன்னால் இருங்கள்
AI நிலப்பரப்பு மணிநேரத்திற்கு மாறுகிறது, மேலும் ஜனவரியில் தாக்க முடியாததாகத் தோன்றிய பெஞ்ச்மார்க் லீட்கள் கோடையில் மறைந்துவிடும். AI Buzz Wire இல் மேலும் AI செய்திகளைப் படிக்கவும் ஒவ்வொரு மாடல் வெளியீடு, பெஞ்ச்மார்க் முடிவு மற்றும் கொள்கை மாற்றத்தை அது நிகழும்போது கண்காணிக்கவும்.
சமீபத்திய AI மேம்பாடுகளை இங்கே பின்பற்றவும்.