တိုကျိုအခြေစိုက် Sakana AI သည် မော်ဒယ်များစွာကို တစ်ပြိုင်နက်တည်း လှုပ်ရှားပေါင်းစပ်ခြင်းဖြင့် အရှေ့ဘက် AI မော်ဒယ်၏ စွမ်းဆောင်ရည်ကို ပေးစွမ်းနိုင်သော Fugu စနစ်တစ်ခုကို စတင်လိုက်ပြီဖြစ်သည်။ ဧရာမအာရုံကြောကွန်ရက်ကို တည်ဆောက်ခြင်းထက် Fugu သည် လုပ်ငန်းတစ်ခုစီအတွက် အထူးပြုမော်ဒယ်များအဖွဲ့ကို စုစည်းကာ OpenAI-compatible API တစ်ခုမှ တစ်ဆင့် အခြား LLMs များကို ဖလှယ်နိုင်သော "အေးဂျင့်ရေကူးကန်" မှ အခြား LLM များကို ခေါ်ရန် လေ့ကျင့်ထားသော ဘာသာစကားပုံစံတစ်ခုဖြစ်သည်။

THE DECODER၊ MarkTechPost နှင့် MIT Sloan Management Review တို့မှ အကျုံးဝင်သော မိတ်ဆက်မှုသည် AI စွမ်းဆောင်ရည်၏နောက်ထပ် ခုန်တက်မှုသည် အကြမ်းစကေးမှ လျော့နည်းလာပြီး ရှိနှင့်ပြီးသား မော်ဒယ်များ၏ စမတ်ကျသော ပေါင်းစပ်ညှိနှိုင်းမှုမှ ပိုများလာနိုင်ကြောင်း အလောင်းအစားတစ်ခုဖြစ်သည်။ For more context on this story, see our ongoing breaking AI news.

၎င်းတို့အားလုံးကို အမိန့်ပေးရန်အတွက် ပုံစံတစ်ခု

အသုံးပြုသူအတွက် Fugu သည် မော်ဒယ်တစ်ခုတည်းကဲ့သို့ ပြုမူသည်။ ဘောင်အောက်တွင်၊ ၎င်းသည် တောင်းဆိုချက်တစ်ခုကို ကိုယ်တိုင်လုပ်ဆောင်သည် သို့မဟုတ် အထူးပြုမော်ဒယ်များအဖွဲ့တစ်ဖွဲ့ကို စုစည်းကာ၊ ရွေးချယ်မှု၊ လွှဲအပ်မှု၊ စစ်ဆေးခြင်းနှင့် ပေါင်းစပ်မှုတို့ကို စီမံခန့်ခွဲခြင်း။ Sakana AI မှ ချဉ်းကပ်မှုမှာ ကြိုးကိုင်ခြင်းနည်းပညာများကို အသုံးပြု၍ ကုဒ်ရေးခြင်းပြိုင်ပွဲတွင် လူသားကျွမ်းကျင်သူ ၁၀၀၀ အနက် ၂၁ ဦးတွင် အဆင့် ၂၁ နေရာချထားပေးသည့် ၎င်း၏ ALE-Agent ကဲ့သို့ အစောပိုင်းအလုပ်များအပေါ်တွင် တည်ဆောက်ထားကြောင်း Sakana AI မှ ပြောကြားခဲ့သည်။

ကုမ္ပဏီသည် ဗားရှင်းနှစ်မျိုးကို ထုတ်လွှတ်သည်။ အခြေခံ Fugu မော်ဒယ်သည် ကုဒ်ရေးခြင်း၊ ကုဒ်ပြန်လည်သုံးသပ်ခြင်း နှင့် chatbot အသုံးပြုမှုကိစ္စများတွင် ကြာမြင့်ချိန်နည်းပါးပြီး ခိုင်မာသောနေ့စဥ်စွမ်းဆောင်ရည်ကို ပစ်မှတ်ထားပြီး အဖွဲ့များအား သီးသန့်အေးဂျင့်များ သို့မဟုတ် လိုက်လျောညီထွေဖြစ်စေရန်အတွက် ရေကူးကန်မှ သီးခြားအေးဂျင့်များကို ဖယ်ထုတ်နိုင်စေပါသည်။ Fugu Ultra သည် သိပ္ပံနည်းကျစာတမ်းများကို ပြန်လည်ထုတ်လုပ်ခြင်း၊ ဆိုက်ဘာလုံခြုံရေးခွဲခြမ်းစိတ်ဖြာခြင်းနှင့် မူပိုင်ခွင့်နှင့် စာပေရှာဖွေခြင်းကဲ့သို့သော ရှုပ်ထွေးပြီး အဆင့်ပေါင်းများစွာ ပြဿနာများအတွက် အမြင့်ဆုံးအဖြေအရည်အသွေးအတွက် တည်ဆောက်ထားသည်။

စံနှုန်းတောင်းဆိုချက်များသည် ဦးခေါင်းများကို ပြောင်းလဲစေပါသည်။

Sakana AI ထုတ်ဝေသည့် စံနှုန်းရလဒ်များအရ Fugu Ultra သည် Anthropic's Fable 5 နှင့် Mythos Preview တို့နှင့်အတူ ကုဒ်၊ ကျိုးကြောင်းဆင်ခြင်ခြင်းနှင့် သိပ္ပံဆိုင်ရာ စံနှုန်းများအကွာအဝေးတွင် လုပ်ဆောင်သည်။ သိသာထင်ရှားသည်မှာ၊ Anthropic မော်ဒယ်နှစ်ခုစလုံးသည် လူသိရှင်ကြားမရရှိနိုင်သောကြောင့် Fugu ၏အေးဂျင့်ရေကူးကန်တွင် အမှန်တကယ်မရှိပါ၊ ဆိုလိုသည်မှာ Fugu သည် အခြားသောမော်ဒယ်များကိုအသုံးပြု၍ နှိုင်းယှဉ်နိုင်သောရမှတ်များရရှိထားသည်။

ထုတ်ပြန်ထားတဲ့ ကိန်းဂဏန်းတွေက သိသိသာသာပါပဲ။ SWE-Bench Pro တွင် Fugu Ultra သည် 73.7 ရမှတ် ၊ Opus 4.8 တွင် 69.2 ၊ Gemini 3.1 Pro တွင် 54.2 ၊ နှင့် GPT 5.5 တွင် 58.6 တွင်ရရှိခဲ့သည်။ TerminalBench 2.1 တွင် ၎င်းသည် 80.2 နှင့် Opus 4.8 ၏ 82.1 ရမှတ်ဖြစ်သည်။ LiveCodeBench တွင်၎င်းသည် GPT 5.5 ၏ 85.3 နှင့် 93.2 သို့ရောက်ရှိခဲ့ပြီး Humanity ၏နောက်ဆုံးစာမေးပွဲတွင် 50.0 ကိုတင်ခဲ့ပြီး Opus 4.8 ၏ 49.8 နှင့် GPT 5.5 ၏ 41.4 ကိုကျော်လွန်ခဲ့သည်။

Real-World Tests များသည် ရောနှောထားသော ရုပ်ပုံများကို ခြယ်မှုန်းပါသည်။

အစောပိုင်းလက်တွေ့သုံးသပ်ချက်များသည် စံနှုန်းများထက် စိတ်အားထက်သန်မှုနည်းပါသည်။ AI သုတေသီ Ethan Mollick သည် Fugu Ultra သည် 30 မိနစ်ကြာ ပုံမှန် coding tests များနှင့် "ကောင်း" သော်လည်း လက်တွေ့တွင် Fable ထက် နည်းပါးသွားကြောင်း AI သုတေသီ Ethan Mollick က X တွင် ရေးသားခဲ့သည်။ အခြားအသုံးပြုသူတစ်ဦးသည် အချက်တစ်ချက်ဖြင့် $20 အစီအစဉ်တွင် ငါးနာရီကြာ ခွဲတမ်းတစ်ခုလုံးကို မှုတ်ထုတ်ခဲ့ကြောင်း Hacker News မှ developer များက တစ်လလျှင် $200 အစီအစဉ်သည် တစ်ပတ်လျှင် သုံးနာရီအောက်သာ အသုံးပြုနိုင်သည်ဟု စောဒကတက်နေချိန်တွင် အခြားအသုံးပြုသူတစ်ဦးက တိုင်ကြားခဲ့သည်။

ကုဒ်သုံးသပ်ချက်များသည် အရည်အသွေးအရ Opus 4.8 သို့မဟုတ် GPT 5.5 နှင့် အကြမ်းဖျင်းကိုက်ညီသော တောက်ပသောနေရာတစ်ခုအဖြစ် ထွက်ပေါ်လာသည်။ ထိပ်တိုက်စမ်းသပ်မှုတစ်ခုတွင် Fugu Ultra သည် 7.32 ဒေါ်လာဖြင့် 22 မိနစ်အတွင်း ကုဒ်ရေးခြင်းလုပ်ငန်းကို ပြီးစီးကြောင်းပြသခဲ့ပြီး Opus 4.8 ၏ 79 မိနစ်နှင့် $37.85 ထက် ပိုမိုမြန်ဆန်ပြီး စျေးသက်သာသည်ကို ပြန်လည်သုံးသပ်သူမှ Opus ၏ထွက်ရှိမှုကို နှစ်သက်သော်လည်း၊

2023 ခုနှစ်တွင် တိုကျိုတွင် တည်ထောင်ခဲ့ပြီး Nvidia မှ ကျောထောက်နောက်ခံပြုထားသော Sakana AI သည် ရှိရင်းစွဲမော်ဒယ်များမှ စွမ်းဆောင်ရည်ပိုမိုရရှိစေရန် ဆင့်ကဲဖြစ်စဉ်ဆိုင်ရာ အယ်လဂိုရီသမ်များနှင့် စုပေါင်းထောက်လှမ်းရေး အိုင်ဒီယာများကို အသုံးပြုကာ သဘာဝမှုတ်သွင်းထားသော AI သုတေသနတွင် ၎င်း၏အထောက်အထားကို တည်ဆောက်ထားသည်။ Fugu သည် ထိုအတွေးအခေါ်ကို စီးပွားဖြစ်ဈေးကွက်သို့ ချဲ့ထွင်ပြီး စည်းရုံးမှုအား သူ့ကိုယ်သူ ထုတ်ကုန်တစ်ခုအဖြစ် ပြောင်းလဲပေးသည်။ ကုမ္ပဏီသည် US ဝန်ဆောင်မှုပေးသူများအပေါ် လွန်ကဲစွာမှီခိုအားထားမှုနှင့်ပတ်သက်၍ စိုးရိမ်နေသော ဂျပန်ပရိသတ်များအတွက် ဘာသာစကားနှစ်မျိုးသုံးဆိုက်တစ်ခုနှင့် တစ်ဦးချင်း developer များနှင့် လုပ်ငန်းအဖွဲ့များအတွက် ရည်ရွယ်ထားသော စျေးနှုန်းဖြင့်လည်း အဆိုပါစနစ်ကို နေရာချထားပေးပါသည်။

ရောင်းချသူ လော့ခ်ချခြင်းကို ဆန့်ကျင်သည့် အကာအကွယ်တစ်ခု

အကြမ်းထည်စွမ်းဆောင်ရည်အပြင် Sakana AI သည် မည်သည့် AI ဝန်ဆောင်မှုပေးသူကိုမဆို မှီခိုခြင်းမှ အကာအကွယ်အဖြစ် Fugu ကို မြှင့်တင်နေသည်။ ကုမ္ပဏီသည် Anthropic ၏ Fable နှင့် Mythos မော်ဒယ်များကို နိုင်ငံခြားဈေးကွက်မှ ဆွဲထုတ်ခဲ့သော မကြာသေးမီက အမေရိကန်၏ ပို့ကုန်ထိန်းချုပ်မှုများကို ထောက်ပြခဲ့သည်။

"အဖွဲ့အစည်းတစ်ခု သို့မဟုတ် နိုင်ငံတစ်ခုအတွက်၊ အရေးကြီးသော အခြေခံအဆောက်အအုံ၊ ဘဏ္ဍာရေး သို့မဟုတ် အုပ်ချုပ်မှုအတွက် ကုမ္ပဏီတစ်ခုတည်း၏ API များကို အားကိုးခြင်းသည် အားနည်းချက်တစ်ခုဖြစ်သည်" ဟု Sakana AI က ၎င်း၏ကြေညာချက်တွင် ရေးသားထားသည်။ Fugu ၏ model pool သည် အပြည့်အ၀ လဲလှယ်နိုင်သောကြောင့်၊ ပံ့ပိုးသူမှ မှောင်သွားပါက စနစ်သည် အခြားမော်ဒယ်များသို့ လမ်းကြောင်းပြောင်းနိုင်သည်။

စစ်မှန်သော အချုပ်အခြာအာဏာနှင့် မတူကြောင်း လေ့လာသုံးသပ်သူများက သတိပေးသည်။ Fugu ၏စွမ်းဆောင်ရည်သည် ၎င်း၏ရေကူးကန်တွင် မည်သည့်မော်ဒယ်များထိုင်သည်အပေါ် မူတည်ပြီး ထိပ်တန်းဝန်ဆောင်မှုပေးသူအများအပြားသည် တစ်ပြိုင်နက်ဝင်ရောက်ခွင့်ကို ကန့်သတ်ထားသောကြောင့် ၎င်း၏ရွေးချယ်ခွင့်များကို လျော့ပါးစေမည်ဖြစ်သည်။ ကုမ္ပဏီသည် တိုကင်အသုံးပြုမှုနှင့် ကုန်ကျစရိတ်ကို မည်မျှအထိ တွန်းအားပေးသည့် တီးမှုတ်အလွှာကို ထုတ်ဖော်ပြောကြားခြင်းမရှိသေးပေ။ သို့တိုင်၊ Frontier မော်ဒယ်များသည် ပထဝီဝင်နိုင်ငံရေး ပိုင်ဆိုင်မှုများဖြစ်လာပြီး တစ်ဦးတည်းရောင်းချသူ lock-in သည် အန္တရာယ်ပိုများလာသည်နှင့်အမျှ Fugu သည် ပေါင်းစပ်ညှိနှိုင်းနိုင်စွမ်းရှိသလောက် အရေးကြီးသည့် AI လုပ်ငန်းတစ်ခု၏ အကြိုသုံးသပ်ချက်ကို ပေးပါသည်။

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →