Startup TypeSafe AI မှမဟုတ်သော LLM "ဆုံးဖြတ်ချက်မော်ဒယ်" ဖြစ်သော Jev သည် Pokémon Red ကို 37 နာရီနှင့် 40 မိနစ်အတွင်း Pallet Town မှ Fame Hall of Fame သို့ ယှဉ်ပြိုင်ရန် စုစုပေါင်းတွက်ချက်မှုကုန်ကျစရိတ် $1.65 ခန့်ဖြင့် ကစားနိုင်ခဲ့ကြောင်း ပရောဂျက်၏ဝဘ်ဆိုဒ်တွင်ဖော်ပြထားသည်။

ဆော့ဖ်ဝဲရေးသားသူ Christian Mathiesen မှ တည်ဆောက်ထားသော အဆိုပါ လည်ပတ်မှုကို တိုကင်များနှင့် ကုန်ကျစရိတ်များဖြင့် တိုက်ရိုက်ထုတ်လွှင့်ခဲ့ပြီး GitHub တွင် အခမဲ့အရင်းအမြစ်ဖြင့် ထုတ်လွှင့်ခဲ့သည်။ ၎င်းသည် သီတင်းပတ်ကုန်တွင် ဟက်ကာသတင်းများ၏ ရှေ့ဆုံးစာမျက်နှာသို့ ရောက်ရှိလာခဲ့ပြီး ရာနှင့်ချီသော ထောက်ခံမဲများရယူကာ AI အေးဂျင့်များ၏ အနာဂတ်နှင့်ပတ်သက်၍ ၎င်းပြောဆိုသည့်အရာနှင့်ပတ်သက်၍ သက်ဝင်လှုပ်ရှားစွာ ဆွေးနွေးခဲ့သည်။ သမားရိုးကျ chatbot များသည် လအတော်ကြာ ရပ်နေခဲ့သည့် LLM မဟုတ်သော အင်ဂျင်သည် အောင်မြင်ကြောင်း မှတ်သားထားပြီး Tom's Hardware သည် အောင်မြင်မှုကို ဖုံးကွယ်ထားသည် — နှင့် Claude Opus 5 သည် မော်ဒယ်ကို အဆုံးစွန်ထိ သင်ကြားပေးခဲ့သည်။

နံပါတ်များဖြင့် လည်ပတ်သည်။

ပရောဂျက်၏ကိုယ်ပိုင်ခြေရာခံခြင်းမှ ကိန်းဂဏန်းစာရင်းဇယားများသည် AI စနစ်အတွက် ဤလုပ်ဆောင်ချက်သည် မည်မျှထူးခြားသည်ကို ပြသသည်-

စုစုပေါင်းအချိန် : 37 နာရီ 40 မိနစ်
  • ဆုံးဖြတ်ချက်များ- 16,150
  • Input tokens: အကြမ်းဖျင်းအားဖြင့် 39.2 သန်း
  • စုစုပေါင်း Jev ကုန်ကျစရိတ်- $1.65 ခန့်
  • ပုံမှန်ဆုံးဖြတ်ချက်အချိန်- 0.4 စက္ကန့်
အတိုက်အခံများ : ခန့်မှန်းခြေအားဖြင့် 1,660
  • အဖွဲ့လိုက် သုတ်ခြင်း ၁၆
  • Elite လေးကြိမ်ကြိုးစားမှု ၁၅
  • အပြင်းထန်ဆုံးလမ်း- အောင်ပွဲလမ်း

Graveler (62)၊ Nidoqueen (45)၊ Beedrill (44)၊ Haunter (39) နှင့် Primeape (29) တို့က ကျောထောက်နောက်ခံပြုထားသော အဆင့် 83 တွင် Charizard ၏ နောက်ဆုံးခန်းမ။

ဘောဂဗေဒသည် ခေါင်းစဉ်ဖြစ်သည်။ ကော်ဖီတစ်လုံး၏စျေးနှုန်းထက်နည်းသောတစ်သောင်းခြောက်ထောင်ဆုံးဖြတ်ချက်များသည် LLM-based ဂိမ်းကစားသည့်အေးဂျင့်များနှင့် သိသိသာသာဆန့်ကျင်ဘက်ဖြစ်ပြီး ရှည်လျားသောဆက်ရှင်များတစ်လျှောက်တွင် တိုကင်ဒေါ်လာဆယ်ဂဏန်းအထိ လောင်ကျွမ်းသွားနိုင်သည်။ Mathiesen က Jev သည် လျင်မြန်စွာ ဆုံးဖြတ်နိုင်သည်ဟု နိဂုံးချုပ်ပြီးနောက် Pokémon ကို ရွေးချယ်ခဲ့သော်လည်း Doom ကို ကစားရန် မလုံလောက်သေးကြောင်း ပြောကြားခဲ့သည်။

Pokémon Red သည် AI အတွက် အဘယ်ကြောင့် ခက်ခဲသနည်း။

Pokémon Red သည် အေးဂျင့် AI အတွက် မဖြစ်နိုင်သော စံသတ်မှတ်ချက်တစ်ခု ဖြစ်လာသည်။ 1996 ခုနှစ် Game Boy ဂန္ထဝင်သည် ရှည်လျားသောမိုးကုပ်စက်ဝိုင်းစီမံကိန်းကို တောင်းဆိုသည်- အဆင့်များကို ကြိတ်ခွဲခြင်း၊ ပါတီခြောက်ခုကို စီမံခန့်ခွဲခြင်း၊ မြေပုံမရှိသော ဝင်္ကပါကဲ့သို့ ဂူများကို သွားလာခြင်းနှင့် သော့ချက်အရာတစ်ခု လွတ်သွားသည့်အခါ နောက်ကြောင်းပြန်လှည့်ခြင်းတို့ကို တောင်းဆိုပါသည်။ ဘာသာစကား-မော်ဒယ် အေးဂျင့်များသည် သမိုင်းကြောင်းအရ စက်ဝိုင်းအတွင်း လှည့်လည်ခဲ့ပြီး၊ ဂူထဲတွင် ပိတ်မိနေကာ မလိုအပ်သည့် လုပ်ဆောင်ချက်များအတွက် ဘတ်ဂျက်များစွာကို မီးရှို့ခဲ့သည်။

Jev သည် အခြေခံအားဖြင့် ကွဲပြားသော ချဉ်းကပ်မှုကို ယူသည်။ စာသားကိုထုတ်လုပ်မည့်အစား၊ မော်ဒယ်သည် ချိန်ညှိထားသော ဆုံးဖြတ်ချက်များကို တိုက်ရိုက်ပြန်ပေးသည် — ဒီဇိုင်း TypeSafe AI သည် မော်ဒယ်ကြီးများ၏ တမင်သက်သက် ဘာသာစကား-လေးလံသောအကြောင်းပြချက်ဖြင့် "System One" အစားထိုးအဖြစ် စျေးကွက်တင်ထားသည်။ Tom's Hardware ၏အစောပိုင်းဖော်ပြမှုအရ၊ ကုမ္ပဏီသည် Jev သည် အကြမ်းဖျင်းအားဖြင့် 193 ဆပိုမိုမြန်ဆန်ပြီး LLM အခြားရွေးချယ်စရာများထက် 445 ဆ စျေးသက်သာသည်ဟုဆိုသည်။

ဖမ်းမိသည် ၊ ဆော့ဖ်ဝဲရေးသားသူ အသိအမှတ်ပြုသည်မှာ Jev အကူအညီ လိုအပ်နေပါသည်။ Tom's Hardware အလိုက်၊ Claude Opus 5 သည် အဆုံးအဖြတ်ပေးသည့်ပုံစံကို အဆုံးအဖြတ်ပေးသည့်ပုံစံကို သင်ကြားပေးခဲ့သည် — ကြီးမားသောဘာသာစကားပုံစံတစ်ခုသည် မဟာဗျူဟာလမ်းညွှန်မှုကို ပံ့ပိုးပေးသည့် အမြန်၊ ဈေးပေါသောမော်ဒယ်သည် ထောင်ပေါင်းများစွာသော တစ်ဦးချင်းစီ၏ ဆုံးဖြတ်ချက်များကို လုပ်ဆောင်နေချိန်တွင် ပေါင်းစပ်ချဉ်းကပ်မှုဖြစ်သည်။ ပရောဂျက်စာမျက်နှာတွင် Jev က "လမ်းညွန်ချက်ရှိသောကြောင့် နောက်ဘယ်ကိုသွားရမည်ကိုသာ သိသည်" ဟု ကောက်ချက်ချသည်။

AI အေးဂျင့်တွေအတွက် ဘာအဓိပ္ပာယ်လဲ။

ရလဒ်သည် AI အေးဂျင့်များ၏အနာဂတ်သည် အရာရာကိုလုပ်ဆောင်နေသည့် ဧရာမမော်ဒယ်တစ်ခုမဟုတ်သော်လည်း အလုပ်သမားပိုင်းခွဲမှု- ကြိမ်နှုန်းမြင့်သောဆုံးဖြတ်ချက်များကို ကိုင်တွယ်ဖြေရှင်းသည့် မြန်ဆန်သော၊ ဈေးပေါပြီး အထူးပြုမော်ဒယ်များ၊ နှေးကွေးသောအကြောင်းပြချက်ဖြင့် အကြောင်းပြချက်မသေချာသည့်မော်ဒယ်များဆီသို့ တိုးလာနေသည့် ရလဒ်အနေဖြင့် တိုးပွားလာသောအငြင်းပွားမှုတစ်ခုတွင် ဒေတာအချက်တစ်ခုဖြစ်သည်။

စက်ရုပ်များ၊ ဂိမ်းကစားခြင်းနှင့် အချိန်နှင့်တပြေးညီ ထိန်းချုပ်မှုစနစ်များအတွက် — ဆုံးဖြတ်ချက်များသည် မီလီစက္ကန့်အတွင်း ရောက်ရှိရမည့် ဒိုမိန်းများနှင့် ဘတ်ဂျက်များကို ဆင့်ဖြင့် တိုင်းတာသည့် ဒိုမိန်းများ — ထိုဗိသုကာလက်ရာသည် ဆွဲဆောင်မှုရှိပါသည်။ ဂိုဒေါင်စက်ရုပ်၊ ဂိမ်းကစားသည့် NPC သို့မဟုတ် ကုန်သွယ်မှုစနစ်သည် အသေးစားလုပ်ဆောင်ချက်တိုင်းအတွက် 2 စက္ကန့် GPT စတိုင် အသွားအပြန်ခရီးကို မတတ်နိုင်ပါ။

Hacker News မှ သံသယရှိသူများသည် ပြေးခြင်း၏သတိပေးချက်ကို ထောက်ပြခဲ့သည်- ဂိမ်းသည် ဆယ်စုနှစ်များစွာကြာပြီး နှိုက်နှိုက်ချွတ်ချွတ် မှတ်တမ်းတင်ထားပြီး၊ နည်းပြပုံစံသည် မဟာဗျူဟာမြောက် အလေးအနက်ထားမှုကို လုပ်ဆောင်ခဲ့ပြီး Elite လေးခု၏ ကြိုးပမ်းချက် 15 ခုသည် အစမ်းအမှားများစွာကို အကြံပြုထားသည်။ ၎င်းတို့သည် တရားမျှတသောအချက်များဖြစ်သည် — သို့သော် ၎င်းတို့သည် ပို၍စိတ်ဝင်စားစရာကောင်းသည့်အချက်ကို လက်လွတ်သွားကြသည်။ တစ်သောင်းခြောက်ထောင် $0.0001 ဖြင့် ကောင်းမွန်သော ဆုံးဖြတ်ချက်တစ်ခုစီသည် ၎င်းတို့သည် အတိုင်းအတာတစ်ခုအထိ လုပ်ဆောင်မည်ဆိုပါက ကိုယ်ပိုင်အုပ်ချုပ်ခွင့်ရအေးဂျင့်များ လိုအပ်သည့် ကုန်ကျစရိတ်အတိအကျဖြစ်သည်။

OpenAI RLHF သုတေသီဟောင်းမှ တည်ထောင်ခဲ့သော TypeSafe AI သည် Jev ကို အစားထိုးခြင်းထက် ဘာသာစကားမော်ဒယ်များအတွက် ဖြည့်စွက်တစ်ခုအဖြစ် နေရာချထားခဲ့သည်။ Pokémon ပရောဂျက် — ကုဒ်၊ တိုက်ရိုက်ထုတ်လွှင့်မှုနှင့် ကုန်ကျစရိတ်ခွဲခြမ်းစိတ်ဖြာမှု—သည် ဆုံးဖြတ်ချက်-ပထမအစုတစ်ခုလုပ်ဆောင်နိုင်သည့်အရာအတွက် အထင်ရှားဆုံးသရုပ်ပြမှုဖြစ်သည်။

အရင်းအမြစ်ကုဒ်အပြည့်အစုံကို GitHub တွင်ရရှိနိုင်ပြီး အောင်မြင်မှုလမ်းပေါ်ရှိ ရှင်းလင်းချက်တိုင်းအပါအဝင် ပြီးဆုံးသွားသည့်အပြေးကို YouTube တွင် ကြည့်ရှုနိုင်ပါသည်။

AI ထက်သာလွန်နေပါစေ

နောက်ဆုံးထွက် AI တိုးတက်မှုများအတွက် AI Buzz Wire ကို လိုက်နာပါ။

AI သတင်းအပြည့်အစုံကို ဖတ်ရှုရန် →