ဥရောပ AI ကုမ္မဏီ Multiverse Computing သည် ဥရောပတွင် တည်ဆောက်ထားသော အသိဉာဏ်အရှိဆုံး AI မော်ဒယ်ဟု ကုမ္ပဏီမှ ပြောကြားသည့် ကြီးမားသော ကျိုးကြောင်းဆင်ခြင်မှု မော်ဒယ် Quasar 438B ကို မိတ်ဆက်ခဲ့သည်။ ကုမ္ပဏီ၏ကြေငြာချက်အရ Quasar 438B သည် Artificial Analysis Intelligence Index တွင် 43 ရမှတ်ဖြစ်ပြီး အဆိုပါစံနှုန်းပေါ်တွင်တိုင်းတာသည့် မည်သည့်ဥရောပမော်ဒယ်များ၏အမြင့်ဆုံးရလဒ်ဖြစ်သည်။
ပစ်လွှတ်မှုသည် နယ်ခြားစကေးစနစ်များကို လေ့ကျင့်ခြင်းထက် AI မော်ဒယ်ချုံ့ခြင်းအပေါ် ၎င်း၏ဂုဏ်သတင်းကို တည်ဆောက်ခဲ့သည့် စပိန်ကုမ္ပဏီအတွက် သိသာထင်ရှားသောခြေလှမ်းတစ်ခုဖြစ်သည်။ Quasar 438B သည် Multiverse Computing ၏ ပထမဆုံးသော မော်ဒယ်လ်ကြီးဖြစ်ပြီး ဥရောပအစိုးရများနှင့် ကုမ္ပဏီများသည် အမေရိကန်နှင့် တရုတ်ဓာတ်ခွဲခန်းများပေါ်တွင် လုံးလုံးမမူတည်သော AI စွမ်းရည်ကို တွန်းအားပေးနေချိန်တွင် ၎င်းရောက်ရှိလာသည်။ ကျွန်ုပ်တို့၏ AI သတင်းဖော်ပြမှုကို လိုက်လျှောက်သည့် စာဖတ်သူများအတွက်၊ ထုတ်ဝေမှုသည် နယ်ခြားမော်ဒယ်များနှင့် ကွာဟချက်ကို ပိတ်ရန် ပြိုင်ဆိုင်မှုကို ပုံမှန် US ပြိုင်ဖက်များအတွက် ကန့်သတ်မထားတော့ကြောင်း အချက်ပြပါသည်။
Quasar 438B အမှန်တကယ်ရမှတ်ကဘာလဲ
Artificial Analysis Intelligence Index (ဗားရှင်း 4.1.1) သည် GDPval-AA v2၊ tau3-Banking၊ Terminal-Bench v2.1၊ SciCode၊ လူသားမျိုးနွယ်၏နောက်ဆုံးစာမေးပွဲ၊ GPQA Diamond၊ CritPt၊ AA-Omniscience နှင့် AA-LCR တို့အပါအဝင် အကဲဖြတ်ချက်ကိုးခုကို ပေါင်းစပ်ထားသည်။ Quasar 438B ၏ ပေါင်းစပ်ရမှတ် 43 သည် 30 တွင် Mistral Medium 3.5၊ NVIDIA ၏ Nemotron 3 Ultra တွင် 38 နှင့် Inkling တွင် 42 ထက် ပိုများသည်။
ပိုကျယ်သောနယ်ပယ်သည် အမေရိကန်နယ်နိမိတ်တွင်ရှိနေဆဲဖြစ်သည်- Claude Opus 5 သည် အညွှန်းကိန်း 63 တွင် ဦးဆောင်နေသည်။ Multiverse Computing သည် အခြားနည်းဖြင့် မတောင်းဆိုပါ။ ယင်းအစား၊ ကုမ္ပဏီသည် Quasar 438B အား အပြင်းထန်ဆုံး ဥရောပရွေးချယ်မှုအဖြစ် ဘောင်ခတ်ထားကာ ၎င်းကို မီးမောင်းထိုးပြထားသည့် အတုအယောင် ခွဲခြမ်းစိတ်ဖြာမှု အကဲဖြတ်မှု ရှစ်ခုအနက် ခုနစ်ခုတွင် နှိုင်းယှဉ်နိုင်သော ဥရောပမော်ဒယ်များကို စွမ်းဆောင်နိုင်ခဲ့သည်။
မြန်နှုန်းသည် ဒုတိယအငြင်းအခုံဖြစ်သည်။
Raw benchmark ရမှတ်များသည် Multiverse Computing ၏ ထက်ဝက်မျှသာဖြစ်သည်။ ကုမ္ပဏီက Quasar 438B သည် တိုကင် 500 ကို 15.3 စက္ကန့်အတွင်း ပြန်ပို့ပေးသည်ဟု ကုမ္ပဏီမှ ပြောကြားခဲ့ပါသည်။ ၎င်း၏ နှိုင်းယှဉ်ချက်အရ မော်ဒယ်များထဲတွင် Nemotron 3.5 Lightning (9.4 စက္ကန့်)၊ Gemini 3.5 Flash-Lite (10.8 စက္ကန့်) နှင့် Gemini 3.7 Flash (11.5 စက္ကန့်) သာ ပိုမြန်ပြီး Gemini 3.7 Flash သာလျှင် အညွှန်းတွင် ပိုမြန်ပြီး ပိုစွမ်းဆောင်နိုင်သည်။
Mistral Medium 3.5 နှင့် နှိုင်းယှဉ်ချက်သည် axes နှစ်ခုစလုံးတွင် တစ်လမ်းတည်းလုပ်ဆောင်သည်- Quasar ရမှတ်သည် ပိုမြင့်သည် (43 နှင့် 30) နှင့် ပိုမြန်သည် (15.3 စက္ကန့်နှင့် 18.8 စက္ကန့်) ဖြေဆိုသည်။ Inkling သည် Quasar ၏ ဥာဏ်ရည်ဥာဏ်သွေး 42 နှင့် တူညီသော တူညီသော 500-token တုံ့ပြန်မှုအတွက် 48.3 စက္ကန့် လိုအပ်ပြီး သုံးဆပိုရှည်သည်။
ခိုင်မာသော Long-Context Reasoning
ရလဒ်တစ်ခုသည် ကြေငြာချက်မှ ထင်ရှားသည်- AA-LCR တွင်၊ ရှည်လျားသောစာရွက်စာတမ်းများတစ်လျှောက်ပျံ့နှံ့နေသောအချက်အလက်များအတွက် ထုတ်ယူနိုင်မှု၊ ချိတ်ဆက်မှုနှင့် အကြောင်းပြချက်များအတွက် စမ်းသပ်နိုင်စွမ်းကို စမ်းသပ်သည့်အကဲဖြတ်မှုသည် Quasar 438B ရမှတ် 75.0 ဖြစ်သည်။ ၎င်းသည် ကုမ္ပဏီ၏ကိန်းဂဏန်းများအရ Claude Opus 5 ၏ 75.7 တွင် Grok 4.6 (အမြင့်) နှင့် Qwen3.8 2.4T A95B ထက် 75.3 ဖြင့် အဆင့်ဖြစ်သည်။
လုပ်ငန်းဆိုင်ရာ သုတေသန၊ စာတမ်းခွဲခြမ်းစိတ်ဖြာခြင်းနှင့် အေးဂျင့်လုပ်ဆောင်သော အလုပ်အသွားအလာများကို ၎င်းပေါ်တွင် တည်ဆောက်ထားသောကြောင့် ရှည်လျားသောအကြောင်းအရာကို ကိုင်တွယ်ရန် အရေးကြီးပါသည်။ မော်ဒယ်တစ်ခုသည် ရှည်လျားသောစာရွက်စာတမ်းတစ်ခုအတွင်း အချက်အလက်များကို ထိန်းထားနိုင်ခြင်းမရှိပါက၊ ၎င်းသည် လက်တွေ့အသုံးချလိုသော ကုမ္ပဏီများမှ အဆင့်ပေါင်းများစွာသော ကိရိယာများကို စွမ်းအင်မပေးနိုင်ပါ။ ဤနေရာတွင် Quasar သည် နယ်ခြားစောင့်အဖွဲ့နှင့် အနီးကပ်ဆုံး ရောက်ရှိလာသည်။
Agentic Coding တွင် Headroom ရှိပါသေးသည်။
ကြေညာချက်တွင် အညံ့ဆုံးရလဒ်မှာ Terminal-Bench v2.1 ဖြစ်ပြီး၊ ၎င်းသည် ကုဒ်အေးဂျင့်များကို အမှန်တကယ် terminal ပတ်၀န်းကျင်တွင် အလုပ်လုပ်စေပါသည်။ Quasar 438B သည် 69.3 ရမှတ်ဖြင့် Mistral Medium 3.5 ကို 18.7 မှတ်နှင့် Nemotron 3 Ultra တွင် 15.4 ဖြင့် ဦးဆောင်သော်လည်း Claude Opus 5 ဦးဆောင်သော Frontier အဖွဲ့ကို 89.1 ဖြင့် နောက်လိုက်နေပါသည်။ Multiverse Computing သည် ဤအရာသည် ခေါင်းခန်းအရှိဆုံးဖြင့် အကဲဖြတ်ခြင်းဖြစ်သည်ဟု အသိအမှတ်ပြုပြီး နောက်လုပ်မည့်အလုပ်သည် ၎င်းကို ရည်ရွယ်သည်ဟု ဆိုသည်။
လုပ်ငန်းအေးဂျင့်များအတွက် တည်ဆောက်ထားသည်။
Quasar 438B သည် ဆော့ဖ်ဝဲလ်ဖွံ့ဖြိုးတိုးတက်ရေး အေးဂျင့်များ၊ နည်းပညာပိုင်းလော့များ၊ သုတေသနစနစ်များနှင့် အလုပ်အသွားအလာ အလိုအလျောက်လုပ်ဆောင်နေသည့် အဖွဲ့အစည်းများအတွက် စံနမူနာတစ်ခုအဖြစ် နေရာယူထားသည်။ ၎င်းသည် 400-billion-parmeter-plus class တွင်ထိုင်ပြီး၊ အင်္ဂလိပ်နှင့် စပိန်တို့ကို ကိုင်တွယ်နိုင်ပြီး၊ အစီအစဉ်ဆွဲရန်၊ ကိရိယာအသုံးပြုမှု၊ ကုဒ်လုပ်ဆောင်မှု၊ ကုဒ်လုပ်ဆောင်မှုနှင့် ကြီးမားသောအကြောင်းအရာတို့ လိုအပ်သည့် အဆင့်ပေါင်းများစွာအတွက် ဒီဇိုင်းထုတ်ထားသည်။
Access သည် ကုမ္ပဏီ၏ CompactifAI API မှတဆင့် လုပ်ဆောင်သောကြောင့် အဖွဲ့များသည် ၎င်းတို့၏ကိုယ်ပိုင်အခြေခံအဆောက်အအုံကို မရပ်ဘဲ မော်ဒယ်ကို စမ်းသပ်နိုင်သည်။ Multiverse Computing က Quasar အတွက် နောက်ထပ် အပ်ဒိတ်များ လာနေပြီဟု ဆိုသည်။
ဥရောပ AI ပြိုင်ပွဲအတွက် ဘာကိုဆိုလိုလဲ။
ဖြန့်ချိမှုသည် European AI အတွက် ထူးခြားသောအခိုက်အတန့်တစ်ခုဖြစ်သည်။ Mistral သည် တိုက်ကြီး၏ စံချိန်စံညွှန်းကို ဆောင်ထားသူဖြစ်ပြီး ၎င်း၏ ဦးတည်ချက်နှင့်ပတ်သက်၍ မေးခွန်းထုတ်စရာများနှင့် ရင်ဆိုင်နေရသော်လည်း အမေရိကန်ဓာတ်ခွဲခန်းများသည် ပေါင်းစပ်စံနှုန်းများပေါ်တွင် ၎င်းတို့၏ ဦးဆောင်မှုကို စုစည်းထားသည်။ သီးခြားလွတ်လပ်သော-ish အညွှန်းကိန်းတွင် ဥရောပနယ်ပယ်ကိုတရားဝင်ဦးတည်သည့်ဥရောပပုံစံတစ်ခုသည် အထူးသဖြင့် ဘာသာစကားနှစ်ဘာသာဖြင့် အင်္ဂလိပ်-စပိန်အသုံးပြုမှုများအတွက် ခိုင်မာသောဒေသဆိုင်ရာရွေးချယ်မှုကို ပေးသည်။
Quasar 438B သည် ထိုရာထူးကို ရယူထားခြင်းရှိမရှိသည် အခြားကိစ္စတစ်ခုဖြစ်သည်။ ကုမ္ပဏီကိုယ်တိုင်က အညွှန်းကိန်းခေါင်းဆောင်များ၏ အပိုင်းတစ်ပိုင်းသာ အဖြေပိုမြန်ကြောင်းနှင့် Claude Opus 5 နှင့် ကွာဟချက်သည် အမှတ်နှစ်ဆယ် ကျယ်နေသေးသည်။ သို့သော် compression-first ကုမ္ပဏီသည် ယခုအခါ ၎င်းသည် ဟဲဗီးဝိတ်တန်းတွင် ယှဉ်ပြိုင်နိုင်ကြောင်း ပြသခဲ့ပြီး နောက်ဆုံးတွင် ဥရောပကုမ္ပဏီများသည် ၎င်းတို့၏ US စံနှုန်းများနှင့် ဆန့်ကျင်ဘက်စံနှုန်းများကို စံပြုထိုက်သည့် အိမ်တွင်းစျေးကွက်ပုံစံတစ်ခုရှိသည်။
AI ၏ရှေ့တွင်နေပါ။
AI ရှုခင်းသည် နာရီအလိုက် ပြောင်းသွားကာ ဇန်နဝါရီတွင် မရနိုင်ဟု ထင်ရသည့် စံနှုန်းများသည် နွေရာသီတွင် ကုန်ဆုံးသွားပါသည်။ မော်ဒယ်ဖြန့်ချိမှုတိုင်း၊ စံနှုန်းရလဒ်များနှင့် မူဝါဒအပြောင်းအလဲများကို ခြေရာခံရန် [AI Buzz Wire] (https://aibuzzwire.news) တွင် AI သတင်းကို ပိုမိုဖတ်ရှုပါ။
နောက်ဆုံးပေါ် AI တိုးတက်မှုများကို ဤနေရာတွင် လိုက်နာပါ။