Maabara ya AI ya Uchina ya DeepSeek imetoa V4.1-Flash, modeli ya uzani wazi ya modi nyingi ambayo inaoanisha uti wa mgongo wa parameta bilioni 552 na mgandamizo mkali zaidi wa kumbukumbu ambao bado umesafirishwa katika mfumo wa kiwango cha mipaka. Mtindo huo ulianza moja kwa moja Jumatano na leseni ya MIT kwenye Hugging Face na ripoti ya kiufundi inayoandamana, Reuters iliripoti, ikijumuisha mfululizo wa vichwa vya habari vya maabara ya Hangzhou.

Toleo ni zaidi ya mapema toleo la kawaida. DeepSeek imesitisha wakati huo huo kiwango chake kikuu cha V4 Pro, na TechNode iliripoti kwamba maombi kwa V4 Pro sasa yanatumwa kwa V4.1-Flash - taarifa ya kushangaza ya kuamini muundo ambao una jina la "Mweko" bado unachapisha nambari za alama kwenye au juu ya muundo unaobadilisha. For more context on this story, see our ongoing more AI stories.

"Mweko" Kubwa Wenye Mswada Ndogo wa Kumbukumbu

Kulingana na kadi ya kielelezo rasmi, DeepSeek-V4.1-Flash ni kielelezo cha Mchanganyiko-wa-Wataalamu (MoE) chenye vigezo vya uti wa mgongo bilioni 552 pamoja na kipengele cha kumbukumbu cha masharti cha "Engram" cha bilioni 196 ambacho kinaweza kufikiwa kwa urahisi kupitia ukaguzi wa msingi wa tokeni. Licha ya ukubwa kamili, mtindo huwasha vigezo bilioni 8 kwa kila ishara wakati wa kujaza mapema na bilioni 16 wakati wa kusimbua - vigezo vichache vya kazi kuliko mtangulizi wake wa 284B-parameta, ambayo iliendesha mara kwa mara bilioni 13.

Kitovu cha usanifu ndicho DeepSeek inachokiita Muundo wa Kisimbaji Kisimbaji cha Sababu (CED): Kibadilishaji cha safu 40 kilichogawanyika na kuwa kisimbaji cha sababu cha safu 20 kikifuatwa na avkodare ya safu 20. Kwa sababu kashe ya kimataifa ya KV ya avkodare inakadiriwa kutoka kwa hali iliyofichwa ya kisimbaji cha mwisho badala ya kukusanywa kwa safu kwa safu, kumbukumbu inayohitajika ili kudumisha mazungumzo marefu hupungua kwa kiasi kikubwa.

Nambari za kubana ndio kichwa cha habari. Na FP4 kuu ya akiba ya KV katika umbizo la E2M1, akiba ya kimataifa ya KV inashuka hadi baiti 890 kwa tokeni - takriban robo moja ya DeepSeek-V4-Flash. Mbinu iitwayo SWA Bounded Replay inaunda upya hali zinazokosekana kwa kucheza tena dirisha la hivi majuzi la tokeni, na kukata kashe ya KV inayoendelea hadi takriban moja ya nane ya muundo wa awali wa Flash. Kwa kadi ya kielelezo, punguzo ni takriban mara nne dhidi ya V4-Flash na mara 437 dhidi ya DeepSeek-V1. Vipengee vya ziada ni pamoja na Compressed Sparse Attention 2 (CSA2), ambayo hukabidhi kila safu ya usikivu mojawapo ya modi tatu tuli, na usimbaji wa kubahatisha wa DSpark kwa ajili ya uzalishaji haraka.

Chini ya kifuniko, kila safu ya MoE inachanganya mtaalam mmoja aliyeshirikiwa na wataalam 384 walioelekezwa, kuamilisha wataalam sita wanaoelekezwa kwa kila tokeni.

Vigezo: Mbele ya Bendera Aliyestaafu

Kwenye tathmini za miundo msingi katika ripoti ya kiufundi, kingo za V4.1-Flash kupita V4 Pro kubwa zaidi kwenye majaribio kadhaa muhimu: 74.1 kwenye MMLU-Pro dhidi ya 73.5, 79.4 kwenye HumanEval dhidi ya 76.8, 60.6 kwenye BigCodeBench, na GSM3K. Gazeti la South China Morning Post liliripoti kuwa DeepSeek inasema mtindo huo mpya unamshinda Kimi K3 kwenye vigezo vya mtandao na usimbaji, madai yanayojulikana katika uga wa modeli huria ya Uchina ambayo pia inajumuisha GLM-5.3 ya Z.ai na laini ya Qwen ya Alibaba.

Kwa bidii ya juu zaidi ya kufikiria, modeli ya kufundisha inapata alama 90.9 kwenye Almasi ya GPQA - ya kuvutia, ingawa bado iko nyuma ya mifumo inayoongoza ya mipaka iliyorejelewa katika jedwali la kulinganisha la DeepSeek, GPT-5.6 Sol kwa 94.1 na Claude Opus 5.0 kwa 93.4. Kimi K3 anakaa 92.9. Wasomaji waaminifu: hii ni mfano wa karibu wa mipaka kwa bei ya uzani wazi, sio kufagia safi kwa maabara zilizofungwa.

V4.1-Flash pia ni ya aina nyingi. Kisimbaji cha maono cha DeepSeek-ViT, kilichofunzwa kuanzia mwanzo, hulisha picha kupitia projekta ya safu mbili, na kielelezo kilifunzwa kwa maandishi na picha kwa pamoja tangu kuanza kwa mafunzo ya awali. Imepata alama 56.5 kwenye MMMU-Pro na 95.6 kwenye DocVQA.

Imeundwa kwa Ajenti, Inauzwa kwa Kiasi

Chaguo za muundo hufanya hadhira lengwa kuwa wazi: mizigo ya kazi ya mawakala, ambapo miundo husoma miktadha mikubwa na kutenda kwa upeo mrefu. Muundo huu unaauni madirisha ya muktadha wa hadi tokeni milioni moja, ulifunzwa kwenye mfumo wa tokeni wa trilioni 45, na unatoa njia inayoweza kudhibitiwa ya kupiga simu kutoka 1 hadi 100 ambayo inauza gharama ya makisio dhidi ya usahihi. Chanjo ya Dekoda ilisisitiza kuwa uhifadhi wa kumbukumbu unapunguza haswa gharama ya kuendesha mawakala wa AI - mzigo wa kazi ambao hutumia wakati mwingi kusoma maandishi kuliko kutoa matokeo.

Mwitikio wa jumuiya umekuwa msisitizo. Mazungumzo ya uzinduzi kwenye Habari ya Hacker ilivuta zaidi ya pointi 650, na mazungumzo ya awali yenye kichwa "DeepSeek inazindua v4.1 flash kwa bei nafuu na yenye uwezo zaidi kuliko v4 pro" ilikusanya karibu 400 zaidi. Watoa maoni wanaoendesha miundo ya ndani walibainisha kuwa vigezo vya Engram vinaweza kupakuliwa kwa SSD za haraka, na kufungua njia ya uelekezaji wa karibu wa mpaka kwenye maunzi ya watumiaji.

Kutafuta Alpha kuliunda hisa za kibiashara bila kuficha, na kuiita muundo wa gharama ya chini kabisa ambao unatoa changamoto kwa maabara za mipaka ya Marekani - ukumbusho kwamba vita vya bei katika marejeleo ya AI haionyeshi dalili ya kupoa.

Muda wa Kusudi wa Tangazo

Muda unasema. Siku moja kabla ya uzinduzi, Reuters iliripoti kwamba DeepSeek iligusa Dhamana za CITIC kupanga IPO kwenye Soko la STAR la Shanghai, kufuatia kuripoti mapema kwamba mapato ya maabara yameongezeka mara kumi kabla ya orodha inayowezekana. Usafirishaji wa modeli wazi ya kunyakua kichwa cha habari siku chache baadaye huendeleza kasi hiyo.

Toleo hilo pia linatua huku kukiwa na uchunguzi mkubwa wa makampuni ya AI ya China. Mapema wiki hii, mashirika ya Marekani ikiwa ni pamoja na NSA, CISA na FBI walitaja makampuni sita ya Kichina ya AI katika ushauri kuhusu muundo wa viwandani wa kunereka - ukumbusho kwamba mafanikio ya kiufundi ya DeepSeek sasa yanawasili pamoja na mizigo ya kijiografia.

Hakuna hayo yanayofifisha hadithi ya uhandisi. V4 Pro ikiwa imestaafu na trafiki yake ikielekezwa kwa muundo wa bei nafuu na wenye nguvu zaidi, DeepSeek imetoa hoja iliyo wazi kabisa kwamba mnamo 2026 mipaka ya kuvutia ya AI inaweza sio tu kuwa ni nani anayeunda muundo mkubwa zaidi - lakini anayetumikia uwezo zaidi kwa kila gigabyte ya kumbukumbu.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →