ក្រុមហ៊ុន AI អ៊ឺរ៉ុប Multiverse Computing បានដាក់បង្ហាញ Quasar 438B ដែលជាគំរូហេតុផលដ៏ធំមួយដែលក្រុមហ៊ុននិយាយថាជាគំរូ AI ឆ្លាតវៃបំផុតដែលបានសាងសង់នៅអឺរ៉ុប។ យោងតាមការប្រកាសរបស់ក្រុមហ៊ុន Quasar 438B ទទួលបានពិន្ទុ 43 លើសន្ទស្សន៍វៃឆ្លាតវិភាគសិប្បនិម្មិត ដែលជាលទ្ធផលខ្ពស់បំផុតនៃម៉ូដែលអ៊ឺរ៉ុបដែលបានវាស់វែងលើស្តង់ដារនោះ។

ការបាញ់បង្ហោះនេះគឺជាជំហានដ៏សំខាន់មួយសម្រាប់ក្រុមហ៊ុនអេស្ប៉ាញ ដែលបានកសាងកេរ្តិ៍ឈ្មោះរបស់ខ្លួនលើការបង្ហាប់គំរូ AI ជាជាងការបណ្តុះបណ្តាលប្រព័ន្ធខ្នាតព្រំដែន។ Quasar 438B គឺជាគំរូដ៏ធំដំបូងគេដែល Multiverse Computing បានចេញផ្សាយ ហើយវាមកដល់នៅពេលដែលរដ្ឋាភិបាល និងក្រុមហ៊ុនអ៊ឺរ៉ុបជំរុញឱ្យសមត្ថភាព AI ដែលមិនពឹងផ្អែកទាំងស្រុងលើមន្ទីរពិសោធន៍អាមេរិក និងចិន។ សម្រាប់អ្នកអានដែលតាមដានព័ត៌មាន AI របស់យើង ការចេញផ្សាយនេះក៏បង្ហាញសញ្ញាថាការប្រណាំងដើម្បីបិទគម្លាតជាមួយនឹងគំរូព្រំដែនមិនត្រូវបានកំណត់ចំពោះគូប្រជែងរបស់អាមេរិកធម្មតាទៀតទេ។

អ្វីដែល Quasar 438B រកបានពិតប្រាកដ

សន្ទស្សន៍វៃឆ្លាតវិភាគសិប្បនិម្មិត (កំណែ 4.1.1) រួមបញ្ចូលគ្នានូវការវាយតម្លៃប្រាំបួន រួមទាំង GDPval-AA v2, tau3-Banking, Terminal-Bench v2.1, SciCode, ការប្រឡងចុងក្រោយរបស់មនុស្សជាតិ, GPQA Diamond, CritPt, AA-Omniscience និង AA-LCR ។ ពិន្ទុផ្សំរបស់ Quasar 438B នៃ 43 ធ្វើឱ្យវានាំមុខ Mistral Medium 3.5 នៅ 30, NVIDIA's Nemotron 3 Ultra នៅ 38 និង Inkling នៅ 42 តាមការប្រកាសរបស់ក្រុមហ៊ុន។

វាលកាន់តែទូលំទូលាយនៅតែជាកម្មសិទ្ធិរបស់ព្រំដែនអាមេរិក៖ Claude Opus 5 នាំមុខសន្ទស្សន៍នៅ 63 ។ Multiverse Computing មិនទាមទារបើមិនដូច្នេះទេ។ ផ្ទុយទៅវិញ ក្រុមហ៊ុនបានកំណត់ Quasar 438B ជាជម្រើសអ៊ឺរ៉ុបខ្លាំងបំផុត ដែលដំណើរការបានជាងម៉ូដែលអ៊ឺរ៉ុបដែលអាចប្រៀបធៀបបាននៅលើការវាយតម្លៃវិភាគសិប្បនិម្មិតចំនួនប្រាំបីដែលបានជ្រើសរើសដែលវាបានគូសបញ្ជាក់។

ល្បឿនគឺជាអាគុយម៉ង់ទីពីរ

ពិន្ទុគោលឆៅគឺត្រឹមតែពាក់កណ្តាលនៃទីលាន Multiverse Computing ប៉ុណ្ណោះ។ ក្រុមហ៊ុននិយាយថា Quasar 438B ត្រឡប់ 500 ថូខឹន ដោយរាប់បញ្ចូលពេលវេលាគិតក្នុងរយៈពេល 15.3 វិនាទី។ ក្នុងចំណោមម៉ូដែលនៅក្នុងការប្រៀបធៀបរបស់វា មានតែ Nemotron 3.5 Lightning (9.4 វិនាទី), Gemini 3.5 Flash-Lite (10.8 វិនាទី) និង Gemini 3.7 Flash (11.5 វិនាទី) លឿនជាង ហើយមានតែ Gemini 3.7 Flash ប៉ុណ្ណោះដែលលឿន និងមានសមត្ថភាពច្រើនជាងនៅលើសន្ទស្សន៍។

ការប្រៀបធៀបជាមួយ Mistral Medium 3.5 ដំណើរការមួយផ្លូវលើអ័ក្សទាំងពីរ៖ Quasar ទទួលបានពិន្ទុខ្ពស់ជាង (43 ទល់នឹង 30) និងឆ្លើយលឿនជាង (15.3 វិនាទីទល់នឹង 18.8 វិនាទី)។ Inkling ដែលស្ទើរតែត្រូវគ្នានឹងភាពវៃឆ្លាតរបស់ Quasar នៅអាយុ 42 ត្រូវការពេល 48.3 វិនាទីសម្រាប់ការឆ្លើយតប 500-token ដូចគ្នា ច្រើនជាងបីដង។

ហេតុផលដ៏វែងឆ្ងាយដ៏រឹងមាំ

លទ្ធផលមួយលេចធ្លោចេញពីការប្រកាស៖ នៅលើ AA-LCR ការវាយតម្លៃដែលសាកល្បងសមត្ថភាពក្នុងការទាញយក ភ្ជាប់ និងហេតុផលលើព័ត៌មានដែលរីករាលដាលនៅទូទាំងឯកសារវែង Quasar 438B ទទួលបានពិន្ទុ 75.0។ នោះគឺជាកម្រិតជាមួយនឹង Grok 4.6 (ខ្ពស់) ក្នុងចំនុចមួយនៃ Claude Opus 5 នៅ 75.7 និងនាំមុខ Qwen3.8 2.4T A95B នៅ 75.3 នេះបើយោងតាមតួលេខរបស់ក្រុមហ៊ុន។

បញ្ហាក្នុងការគ្រប់គ្រងបរិបទវែង ដោយសារតែការស្រាវជ្រាវសហគ្រាស ការវិភាគឯកសារ និងលំហូរការងារភ្នាក់ងារត្រូវបានបង្កើតឡើងនៅលើវា។ ប្រសិនបើគំរូមិនអាចរក្សាទុក និងភ្ជាប់ព័ត៌មានលើឯកសារដ៏វែងមួយនោះ វាមិនអាចផ្តល់ថាមពលដល់ក្រុមហ៊ុនឧបករណ៍ពហុជំហានដែលពិតជាចង់ដាក់ពង្រាយនោះទេ។ នេះគឺជាកន្លែងដែល Quasar មកជិតបំផុតជាមួយក្រុមព្រំដែន។

ការសរសេរកូដ Agentic នៅតែមាន Headroom

លទ្ធផលខ្សោយបំផុតនៅក្នុងការប្រកាសគឺ Terminal-Bench v2.1 ដែលដាក់ភ្នាក់ងារសរសេរកូដឱ្យដំណើរការនៅក្នុងបរិយាកាសស្ថានីយពិត។ Quasar 438B ទទួលបានពិន្ទុ 69.3 នាំមុខ Mistral Medium 3.5 ដោយ 18.7 ពិន្ទុ និង Nemotron 3 Ultra ដោយ 15.4 ប៉ុន្តែតាមពីក្រោយក្រុម Frontier ដែលដឹកនាំដោយ Claude Opus 5 នៅ 89.1 ។ Multiverse Computing ទទួល​ស្គាល់​ថា​នេះ​គឺ​ជា​ការ​វាយ​តម្លៃ​ដែល​មាន​ប្រធាន​ផ្នែក​ច្រើន​បំផុត ហើយ​និយាយ​ថា​ការងារ​បន្ទាប់​គឺ​សំដៅ​ទៅ​លើ​វា។

បង្កើតឡើងសម្រាប់ភ្នាក់ងារសហគ្រាស

Quasar 438B ត្រូវបានដាក់ជាគំរូសម្រាប់អង្គការដែលកំពុងដំណើរការភ្នាក់ងារអភិវឌ្ឍន៍កម្មវិធី អ្នកចម្លងបច្ចេកទេស ប្រព័ន្ធស្រាវជ្រាវ និងស្វ័យប្រវត្តិកម្មលំហូរការងារ។ វាស្ថិតនៅក្នុងថ្នាក់ 400-billion-parameter-plus គ្រប់គ្រងភាសាអង់គ្លេស និងអេស្ប៉ាញ ហើយត្រូវបានរចនាឡើងសម្រាប់កិច្ចការច្រើនជំហានដែលត្រូវការការធ្វើផែនការ ការប្រើប្រាស់ឧបករណ៍ ការប្រតិបត្តិកូដ និងបរិបទធំដោយគ្មានភាពយឺតយ៉ាវដែលថ្នាក់អនុវត្តជាធម្មតា។

ការចូលដំណើរការដំណើរការតាមរយៈ CompactifAI API របស់ក្រុមហ៊ុន ដូច្នេះក្រុមអាចសាកល្បងម៉ូដែលនេះដោយមិនចាំបាច់ឈរលើហេដ្ឋារចនាសម្ព័ន្ធផ្ទាល់ខ្លួនរបស់ពួកគេ។ Multiverse Computing និយាយថាការអាប់ដេតបន្ថែមទៀតសម្រាប់ Quasar នឹងមកដល់។

តើវាមានន័យយ៉ាងណាសម្រាប់ការប្រណាំង AI នៅអឺរ៉ុប

ការចេញផ្សាយនេះមកដល់ពេលដ៏ពិសេសមួយសម្រាប់ AI អឺរ៉ុប។ Mistral ដែលជាអ្នកកាន់ស្ដង់ដាររបស់ទ្វីបដ៏យូរបានប្រឈមមុខនឹងសំណួរអំពីទិសដៅរបស់វា ខណៈពេលដែលមន្ទីរពិសោធន៍របស់សហរដ្ឋអាមេរិកបានបង្រួបបង្រួមការនាំមុខរបស់ពួកគេលើស្តង់ដារសមាសធាតុ។ គំរូអ៊ឺរ៉ុបដែលឈរលើកំពូលតំបន់អឺរ៉ុបដោយស្របច្បាប់លើសន្ទស្សន៍ឯករាជ្យផ្តល់ឱ្យសហគ្រាសនៅលើទ្វីបនូវជម្រើសក្នុងតំបន់ដែលអាចជឿទុកចិត្តបាន ជាពិសេសសម្រាប់ការដាក់ពង្រាយភាសាអង់គ្លេស-អេស្ប៉ាញពីរភាសា។

ថាតើ Quasar 438B កាន់តំណែងនោះគឺជាបញ្ហាមួយផ្សេងទៀត។ ក្រុមហ៊ុនខ្លួនឯងកត់សម្គាល់ថាមានតែប្រភាគនៃអ្នកដឹកនាំលិបិក្រមឆ្លើយលឿនជាងមុនហើយគម្លាតទៅនឹង Claude Opus 5 នៅតែមានម្ភៃពិន្ទុ។ ប៉ុន្តែឥឡូវនេះក្រុមហ៊ុនដំបូងដែលបង្ហាប់បានបង្ហាញថាវាអាចប្រកួតប្រជែងក្នុងប្រភេទទម្ងន់ធ្ងន់ ហើយទីបំផុតសហគ្រាសអ៊ឺរ៉ុបមានគំរូទីផ្សារផ្ទះដែលមានតម្លៃជាគំរូធៀបនឹងលំនាំដើមរបស់សហរដ្ឋអាមេរិក។

នាំមុខ AI

ទេសភាព AI ផ្លាស់ប្តូរតាមម៉ោង ហើយការនាំមុខដែលមើលទៅមិនអាចដំណើរការបានក្នុងខែមករាត្រូវបានបាត់បង់ទៅរដូវក្តៅ។ [អានព័ត៌មាន AI បន្ថែមនៅលើ AI Buzz Wire] (https://aibuzzwire.news) ដើម្បីតាមដានរាល់ការចេញផ្សាយម៉ូដែល លទ្ធផលគោល និងការផ្លាស់ប្តូរគោលនយោបាយនៅពេលវាកើតឡើង។

តាមដានការអភិវឌ្ឍន៍ AI ចុងក្រោយបំផុតនៅទីនេះ