Jev, "mfano wa maamuzi" usio wa LLM kutoka kwa TypeSafe AI ya kuanzisha, amekamilisha Pokémon Red - akipigana kutoka Pallet Town hadi Hall of Fame katika muda wa saa 37 na dakika 40 za kucheza kwa gharama ya jumla ya $ 1.65, kulingana na tovuti ya mradi huo.

Uendeshaji, ulioundwa na msanidi Christian Mathiesen, ulitiririshwa moja kwa moja na tokeni na gharama kwenye onyesho na chanzo huria kwenye GitHub. Ilipiga ukurasa wa mbele wa Habari za Hacker mwishoni mwa juma, ikivutia mamia ya kura na mjadala wa kusisimua kuhusu kile inachosema kuhusu mustakabali wa mawakala wa AI. Tom's Hardware ilishughulikia mafanikio hayo, ikibainisha kuwa injini isiyo ya LLM ilifaulu ambapo chatbots za kitamaduni zilikwama kwa miezi kadhaa - na kwamba Claude Opus 5 alifunza modeli hiyo kupitia malengo yake mafupi.

Kukimbia kwa Hesabu

Takwimu kutoka kwa ufuatiliaji wa mradi wenyewe zinaonyesha jinsi uendeshaji huu ulivyokuwa wa kawaida kwa mfumo wa AI:

  • Jumla ya muda: Saa 37, dakika 40
  • Maamuzi yaliyofanywa: 16,150
  • Tokeni za kuingiza: takriban milioni 39.2
  • Jumla ya gharama ya Jev: takriban $1.65
  • Muda wa kawaida wa kufanya uamuzi: sekunde 0.4
  • Wapinzani walipigana: takriban 1,660
  • Vifuta vya timu: 16
  • Wasomi Majaribio manne: 15
  • Njia ngumu zaidi: Barabara ya Ushindi

Timu ya mwisho ya Hall of Fame: Charizard katika kiwango cha 83, akiungwa mkono na Graveler (62), Nidoqueen (45), Beedrill (44), Haunter (39), na Primeape (29).

Uchumi ndio kichwa cha habari. Maamuzi elfu kumi na sita kwa bei ya chini ya bei ya kahawa ni tofauti ya kushangaza na mawakala wa kucheza mchezo wa LLM, ambao wanaweza kuteketeza makumi ya dola katika tokeni kwa vipindi virefu. Mathiesen alisema alichagua Pokémon baada ya kuhitimisha kuwa Jev anaweza kuamua haraka, lakini bado si haraka vya kutosha kucheza Doom.

Kwa nini Pokémon Nyekundu Ni Ngumu kwa AI

Pokémon Nyekundu imekuwa kigezo kisichowezekana cha AI ya wakala. Mchezo wa kwanza wa 1996 wa Game Boy unadai upangaji wa upeo wa macho: viwango vya kusaga, kudhibiti karamu ya watu sita, kusogeza mapango kama mdudu bila ramani, na kurudi nyuma wakati kitu muhimu kilipokosekana. Maajenti wa modeli za lugha wametangatanga katika miduara kihistoria, walikwama mapangoni, na kuchoma bajeti kubwa juu ya vitendo visivyo vya lazima.

Jev inachukua mbinu tofauti kimsingi. Badala ya kutoa maandishi, muundo huo hurejesha maamuzi yaliyorekebishwa moja kwa moja - muundo wa TypeSafe AI imeuza kama "Mfumo wa Kwanza" badala ya hoja za kimakusudi na nzito za miundo mikubwa. Kulingana na maelezo ya awali ya Tom's Hardware ya modeli, kampuni inadai Jev ina kasi ya takriban mara 193 na nafuu mara 445 kuliko njia mbadala za LLM kwenye kazi za maamuzi.

Kinachovutia, msanidi alikiri, ni kwamba Jev alihitaji usaidizi. Per Tom's Hardware, Claude Opus 5 alifundisha muundo wa uamuzi kupitia ncha zake - mbinu mseto ambapo muundo mkubwa wa lugha hutoa mwongozo wa kimkakati huku muundo wa haraka na wa bei nafuu hutekeleza maelfu ya maamuzi ya mtu binafsi. Ukurasa wa mradi unabainisha kuwa Jev "alijua tu pa kwenda kwa sababu alikuwa na mwongozo."

Inamaanisha Nini kwa Mawakala wa AI

Matokeo yake ni hoja ya data katika hoja inayokua kwamba siku zijazo za mawakala wa AI sio mfano mmoja mkubwa wa kufanya kila kitu, lakini mgawanyiko wa wafanyikazi: mifano ya haraka, ya bei nafuu, maalum inayoshughulikia maamuzi ya masafa ya juu, na mifano ya polepole ya kusababu huingia tu wakati hali inapata utata.

Kwa robotiki, michezo na mifumo ya udhibiti wa wakati halisi - vikoa ambapo maamuzi lazima yafikie kwa milisekunde na bajeti hupimwa kwa senti - usanifu huo unavutia. Roboti ya ghala, NPC inayocheza mchezo, au mfumo wa biashara hauwezi kumudu safari ya kwenda na kurudi ya mtindo wa GPT ya sekunde 2 kwa kila hatua ndogo.

Wanaoshuku juu ya Habari za Hacker walidokeza tahadhari za kukimbia: mchezo ni wa miongo kadhaa na umeandikwa vizuri, mtindo wa kufundisha ulifanya mkakati wa kuinua vitu vizito, na majaribio 15 ya Elite Four yanapendekeza majaribio mengi na makosa. Hizo ni pointi za haki - lakini wanakosa ishara ya kuvutia zaidi. Maamuzi elfu kumi na sita mazuri ya $0.0001 kila moja ndio gharama ambayo mawakala wanaojiendesha wanahitaji ikiwa watawahi kufanya kazi kwa kiwango.

TypeSafe AI, iliyoanzishwa na mtafiti wa zamani wa OpenAI RLHF, imeweka Jev kama kikamili kwa miundo ya lugha badala ya kibadala. Mradi wa Pokémon - msimbo, mtiririko, na uchanganuzi wa gharama zote za umma - ni onyesho dhahiri zaidi la kile ambacho safu ya uamuzi wa kwanza inaweza kufanya.

Msimbo kamili wa chanzo unapatikana kwenye GitHub, na ukimbiaji uliokamilika unaweza kutazamwa kwenye YouTube, ikijumuisha kila ufutaji kwenye Barabara ya Ushindi.

Kaa Mbele ya AI

Fuata AI Buzz Wire kwa maendeleo ya hivi punde ya AI.

Soma habari zaidi za AI →