Timu ya Qwen ya Alibaba ilitoa Qwen3.8-Flash-Next siku ya Jumatano, muundo wa mchanganyiko wa wataalam wa aina nyingi ambao huongezeka maradufu kama hakiki ya usanifu wa Qwen4 ijayo - na ambayo inatoa matokeo ambayo kampuni hiyo inasema kuwashinda Qwen3.7-Plus yake kubwa zaidi kwa takriban moja ya tisa ya gharama ya mafunzo. Reuters, Bloomberg, na The Dekoda zote zilishughulikia uzinduzi huo, ambao unaweka uzani wazi kwenye Hugging Face na ModelScope siku hiyo hiyo Z.ai ilisafirisha modeli yake ya wazi iliyo karibu na mipaka. Fuata habari muhimu za AI jinsi mbio za uzani wa wazi zinavyoongezeka.
Usanifu mpya katika picha ndogo
Vipimo vya kichwa ni ufanisi. Qwen3.8-Flash-Next ina jumla ya vigezo bilioni 125 lakini inawasha bilioni 6 tu kwa tokeni. Kwa kulinganisha, Qwen3.7-Plus - kielelezo kinachofanya vizuri zaidi katika viwango vilivyochapishwa vya Alibaba - ina jumla ya vigezo bilioni 397 na bilioni 17 zilizowashwa kwa kila tokeni, karibu mara tatu ya hesabu amilifu ya Flash-Next.
Kipande cha kuvutia zaidi kiufundi ni safu ya upachikaji ya N-gram iliyobeba vigezo bilioni 51. Safu hii huhifadhi vikundi vya maneno vya kawaida kama maingizo yanayojitegemea katika kile ambacho The Decoder's Matthias Bastian alikielezea kama aina ya "kamusi ya vifungu vya maneno," ikitoa maelezo ya kiwango cha vifungu vya maneno mwanzoni mwa mtandao. La muhimu zaidi, iko katika mfumo wa kawaida wa RAM badala ya kumbukumbu ya gharama kubwa ya GPU, kwa kile timu ya Qwen inaita gharama ya chini ya ziada - uvumbuzi wa usanifu unaopangwa kubeba hadi Qwen4.
Kienyeji muundo huu unaauni dirisha la muktadha wa tokeni 262,144 na hulinganisha hadi tokeni milioni moja kwa kutumia kiendelezi cha muktadha wa YaRN. Ripoti ya kiufundi imechapishwa kwenye GitHub.
Vigezo: kuweka misimbo na kazi ya ofisini
Vigezo vya Alibaba vinatofautisha Flash-Next dhidi ya DeepSeek-V4-Flash (vigezo bilioni 284, bilioni 13 vinavyotumika) na Anthropic Claude Opus 4.6 (Max). Licha ya wapinzani wote wawili kuwa wakubwa zaidi au ghali zaidi, Flash-Next inaongoza katika kazi nyingi zilizojaribiwa, ikiwa na faida kubwa zaidi katika usimbaji na tija ofisini.
Kwenye usimbaji wa mawakala, Flash-Next ilipata alama 58.7 kwenye DeepSWE 1.1 na 62.5 kwenye SWE-bench Pro, na kuwashinda DeepSeek-V4-Flash na Claude Opus 4.6. Pengo la majukumu ya ofisini bado ni pana: 73.9 kwenye CoWorkBench dhidi ya 45.1 ya DeepSeek-V4-Flash, na 55.7 kwenye JobBench - karibu mara mbili ya Qwen3.7-Plus 27.6. Hoja za kisayansi zinalinganishwa kwa karibu kote uwanjani, na Flash-Next ikiwa 91.7 kwenye GPQA Diamond na 91.9 kwenye LiveCodeBench v6. Claude Opus 4.6 hutangulia tu kwenye Mtihani wa Mwisho wa Humanity, 40.0 hadi 35.9, na ni muundo wa zamani wa Anthropic kuanzia Februari 2026. Kama kawaida, alama za msingi zilizochapishwa na utendaji wa ulimwengu halisi unaweza kutofautiana.
Shinikizo la bei kwa kila mpinzani
Toleo la uzalishaji husafirishwa kama Qwen3.8-Flash kupitia QwenCloud, bei yake ni $0.16 kwa kila tokeni milioni na $0.47 kwa tokeni za pato milioni. Hiyo inapunguza hata GLM-5.3-Flash ya Z.ai, iliyotolewa siku hiyo hiyo kwa $0.15 na $0.50 mtawalia - kwa ufanisi usawa chini ya soko.
Pengo la umaarufu wa Alibaba ni kubwa. Qwen3.8-Max, iliyoanzishwa mapema Agosti ili kushindana na Claude Opus 4.8, Gemini 3.1 Pro, na GPT-5.6 Sol, inagharimu $2.00 kwa tokeni za pembejeo milioni na $6.00 kwa tokeni za pato milioni. Flash-Next hufanya kazi chini ya kinara, kulingana na nambari za Alibaba yenyewe, kwa takriban moja ya kumi na mbili ya bei kwenye pembejeo na pato.
Muktadha mrefu huongeza thamani ya vitendo zaidi ya laha maalum. Katika ishara za asili 262,144, ombi moja linaweza kushikilia hazina kadhaa kubwa za nambari, seti kamili ya mkataba, au masaa ya mikutano iliyonakiliwa; ikipanuliwa hadi tokeni milioni moja kwa kutumia YaRN, uchanganuzi wa jumla unawezekana bila urejeshaji wa kiunzi. Kwa mzigo wa kazi wa uandishi wa usimbaji ambapo Flash-Next huchapisha alama zake bora zaidi - kutafuta na kurekebisha hitilafu kwa kujitegemea katika miradi halisi ya programu - dirisha kubwa humaanisha mapungufu machache ya usimamizi wa muktadha katikati ya kazi. Timu ya Qwen pia imechapisha ripoti ya kiufundi juu ya GitHub, ikialika hasa aina ya uchunguzi huru wa usanifu ambao maabara za wamiliki huepuka.
Kwa nini toleo hili ni muhimu
Qwen3.8-Flash-Next inaeleweka vyema kama mazoezi ya mavazi ya umma kwa Qwen4. Safu ya upachikaji wa N-gram, uwiano mkali wa kigezo amilifu, na upakiaji wa RAM wa vigezo vingi-lakini-vinavyohitajika mara chache huchora falsafa ya muundo: akili ya kusonga mbele kwa kila dola, si akili kwa kila GPU. Kufunza modeli ya kuzidi kiwango cha Qwen3.7-Plus kwa moja ya tisa ya gharama ndiyo uwezo ambao hurahisisha mizunguko ya kurudia-rudiwa - na kasi ya kurudia, zaidi ya alama yoyote, ndiyo huamua ni nani atasimama kwenye mipaka mwaka mmoja kuanzia sasa.
Kuwasili kwa siku hiyo hiyo kwa modeli mbili za uzani wa wazi zilizo karibu na mipaka kutoka kwa maabara za Uchina - GLM-5.3-Flash ya Z.ai na Flash-Next ya Alibaba - pia kunaashiria mabadiliko ya mwako, kama FourWeekMBA ilivyobaini. Maabara za Magharibi bado zina viwango vya juu, lakini kiwango cha uzani wazi sasa husafirisha ubora wa karibu wa mipaka kila wiki, kwa bei ambayo ni ya chini zaidi.
Kwa wasanidi programu, uondoaji wa vitendo ni rahisi: gharama ya kielelezo chenye uwezo, muktadha wa muda mrefu, imeshuka tena, ikiwa na uzani unaoweza kupakuliwa kama bima dhidi ya mtoa huduma yeyote. Kwa washindani, ujumbe si mzuri - mipaka ya ufanisi sasa inakwenda kwa kasi zaidi kuliko bei kuu inavyoweza kufuata kihalisi, na Alibaba haijaonyesha dalili yoyote ya kupunguza kasi.
---
Kaa Mbele ya AIPata habari za hivi punde za AI, uchanganuzi na mafanikio - yote katika sehemu moja.
Soma habari zaidi za AI →