Uanzishaji mpya wa AI ulioanzishwa na mtafiti wa zamani wa OpenAI umezindua kile inachokiita darasa mpya kabisa la modeli - ambalo haliwezi kukuandikia insha, na kusema hiyo ndiyo hoja haswa.
TypeSafe AI ilitangaza Jumanne kutolewa kwa "Mfano wa Kwanza wa Mfumo," unaoitwa Jev, unaopatikana mara moja katika ufikiaji wa mapema. Kampuni hiyo ilianzishwa na Diogo Almeida, ambaye anasema utafiti wa kufuata maagizo ya ChatGPT ulikua nje ya kazi aliyochangia OpenAI. Baada ya miaka miwili ya siri, anabisha kwamba uboreshaji wa tasnia kwenye gumzo umefichwa ambapo otomatiki hushindwa. For more context on this story, see our ongoing latest AI developments.
"Miundo imekuwa ya kibinadamu zaidi kwenye gumzo kwa miaka, kwa hivyo mitambo yote ya kiotomatiki iko wapi?" Almeida aliandika katika chapisho la uzinduzi. "Hilo limekuwa swali langu la kuendesha gari kwa miaka minne iliyopita."
Mfano wa 'System One' Ulivyo Kweli
Jina linatokana na tofauti ya saikolojia kati ya mawazo ya haraka, ya kisilika na mawazo ya polepole, ya kimakusudi. Ambapo miundo mikubwa ya lugha huzalisha tokeni ya maandishi kwa tokeni - inayonyumbulika, ya jumla, na yenye kukabiliwa na upuuzi wa mara kwa mara - Jev ya TypeSafe imeundwa kufanya jambo finyu zaidi: kuchukua hali isiyokuwa na mpangilio kama ingizo na urejeshaji uliochapwa, maamuzi yaliyopangwa na uwezekano uliorekebishwa.
Kampuni inafafanua Jev kama "wito wa utendaji wa kijasusi wa mipakani: hali isiyo na muundo, iliyochapwa maamuzi ya uwezekano." Kwa sababu matokeo yanayowezekana yanafafanuliwa mapema na modeli kamwe haitoi mifuatano isiyolipishwa, TypeSafe inadai haiwezi kutoa makosa ya aina - mali ambayo kampuni inasema imehakikishwa kihisabati badala ya uwezekano wa kitakwimu - na haiwezi kudanganya kwa jinsi miundo ya kutengeneza maandishi inaweza.
Usanifu huondoka kutoka kwa mazoezi ya kawaida kwa njia tatu, kulingana na chapisho la uzinduzi: muundo mpya wa usanifu, sampuli sambamba ambayo hutoa matokeo yote katika swali moja badala ya mfuatano, na mbinu ya mafunzo ambayo kampuni inaita Kuimarisha Mafunzo kwa Maamuzi Yaliyorekebishwa (RLCD), ambayo huboresha kwa uwazi na matokeo ya upendeleo wa kibinadamu badala ya uwezekano wa uaminifu wa kibinadamu.
Madai: Mara 100 Haraka zaidi, Sehemu ya Gharama
Nambari za TypeSafe inachapisha ni fujo. Kampuni hiyo inasema Jev inatoa akili kulinganishwa na LLM za mpaka zilizopo kwenye kile inachokiita kazi za "System One shaped" - uainishaji, upangaji, bao, uchimbaji na maamuzi ya matawi - huku ikijibu kwa milisekunde 70 hadi 500, dhidi ya nyakati za mwitikio wa mwisho hadi mwisho wa sekunde 3 hadi 329 kwa mifano ya mipaka. Hiyo inafanya kazi hadi 40x hadi 200x haraka, kampuni inasema.
Bei vile vile si ya kawaida: $0.042 kwa kila tokeni za pembejeo milioni, na tokeni za pato bila malipo, kwani matokeo yanakokotolewa sambamba badala ya tokeni zinazozalishwa kwa tokeni. Kampuni hiyo ilikubali katika chapisho lake kwamba bado haiwezi kuthibitisha kuwa bei ni endelevu kwa kiwango.
"Madai yasiyo ya kawaida yanahitaji ushahidi wa ajabu," chapisho linasoma, kabla ya kutoa ushahidi gani unao.
Stakabadhi — na Wanaoshuku Wanasema Nini
TypeSafe ilichapisha onyesho la ubavu kwa upande likilinganisha Jev dhidi ya GPT-5.6 Terra, ambayo inaelezea kama kielelezo cha mipaka kinachoweza kulinganishwa zaidi katika akili sawa, na inasema kutokubaliana pekee katika onyesho lililorekodiwa kulihusisha wito wa uamuzi usio na utata. Pia ilianzisha mbinu mpya ya "utathmini wa mtiririko wa kazi" ambayo hupima modeli dhidi ya makubaliano ya miundo mikubwa zaidi ya nje - Astra ya OpenAI na Hadithi ya Anthropic - ndani ya grafu ya hesabu isiyobadilika, na inadai Jev "anamiliki mpaka wa Pareto kwa karibu oda 2 za ukubwa."
Hasa, kampuni ilichapisha chapisho linaloambatana na "antibenchmaxxing" ikielezea kwa nini inaepuka alama za kitamaduni, ikisema kuwa kielelezo kilichoundwa kwa maamuzi yaliyopangwa ndani ya utiririshaji wa programu hupinga ulinganisho wa maana wa kimataifa.
Maoni kwenye Hacker News, ambapo uzinduzi ulivuta mamia ya pointi ndani ya saa moja, ulianzia msisimko wa kweli hadi mashaka makubwa. Watoa maoni kadhaa walibainisha kuwa ushahidi wa umma unajumuisha kwa kiasi kikubwa video za onyesho - ikiwa ni pamoja na moja inayoonyesha modeli inayoendesha kitanzi cha uchezaji wa Doom - badala ya tathmini zinazoweza kurudiwa za watu wengine. Wengine walisema mbinu hiyo inaeleweka vyema kama kiainishaji cha haraka sana, cha ubora wa mpaka, muhimu kwa kipande cha mzigo wa kazi badala ya kuchukua nafasi ya LLM.
Hata watazamaji wenye huruma waliweka mzigo wa uthibitisho waziwazi. "Ndio, wanazungumza kama watu wanaoshuku lakini hawatoi ushahidi mwingi, isipokuwa video kadhaa za demos," mtoa maoni mmoja aliandika. "Onyesho la moja kwa moja lingekuwa la kushawishi zaidi."
Kwa Nini Inaweza Kuwa Muhimu Hata Hivyo
Lami inatua kwenye sehemu ya maumivu halisi. Sehemu kubwa ya simu za LLM za uzalishaji katika programu za kibiashara hazizai hata kidogo - ni maamuzi ya jozi, kazi za kategoria, na maamuzi ya uelekezaji yaliyofungwa kwa nathari. Iwapo modeli inaweza kupiga simu hizo kwa ujasiri uliorekebishwa kwa milisekunde 70 na bila gharama yoyote ya kutozwa, uchumi wa programu inayoendeshwa na AI hubadilika sana: miingiliano ya wakati halisi ya mtumiaji inakuwa ya vitendo, na hatua za bomba ambazo zilikuwa ghali sana kujiendesha na LLM zinakuwa nafuu vya kutosha kufanya kazi kila mahali.
Matukio ya utumiaji yaliyopendekezwa ya TypeSafe ni pamoja na kuainisha na kuelekeza data, kuthibitisha na kulinda matokeo ya LLM, kugundua mapumziko ya jela, na uchanganuzi wa kupunguza ramani kwenye hifadhidata kubwa - mzigo wa kazi ambapo msimbo unaozunguka unaweza kukandamiza uhuru wa mfano na kukamata makosa.
Kampuni iko wazi kuhusu maswali yaliyo wazi: tathmini zake zilizochapishwa ziliendeshwa kutoka kwa kompyuta za mkononi kwenye Pwani ya Magharibi ya Marekani, na uendelevu wa bei wa muda mrefu bado haujathibitishwa. Ikiwa madai ya kijasusi ya Jev yatadumu katika majaribio ya kujitegemea yatabainisha kama "Miundo ya Kwanza ya Mfumo" inakuwa aina au udadisi.
Ufikiaji wa mapema umefunguliwa sasa kupitia tovuti ya kampuni.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →