DeepSeek ilitangaza Jumatano kwamba imeshirikiana na Huawei kutengeneza zana za programu kwa wasindikaji wa Ascend AI wa Huawei - na inatoa matokeo wazi, pamoja na toleo la lugha yake ya TileLang iliyowekwa kama mbadala rahisi kwa CUDA ya Nvidia.
Hatua hiyo inalenga sehemu laini zaidi katika vazi la Nvidia. Utawala wa kampuni katika kompyuta ya AI haujawahi tu kuhusu silicon; inategemea CUDA, mfumo ikolojia wa programu ambao karibu kila msanidi wa AI amefunza. Kwa muktadha wa kwa nini hiyo ni muhimu, chanjo yetu ya tasnia ya AI imeandika mara kwa mara kwamba maunzi hushinda tu wakati programu inayoizunguka hufanya kubadili kuwa chungu.
Zana sita za chanzo huria za Ascend
Kulingana na Reuters, DeepSeek inatoa moduli sita za programu-wazi zilizoundwa kwa jukwaa la Ascend la Huawei. Kifurushi hiki kinajumuisha maktaba zinazolenga kuboresha utendakazi wa kompyuta na mawasiliano kote kwenye chipsi, zilizotengenezwa kwa kile DeepSeek inaelezea kama usaidizi mkubwa wa kiufundi kutoka kwa Huawei.
Sehemu kuu ni TileLang, lugha ya programu huria ya kiwango cha juu iliyoundwa kwa ajili ya vichapuzi vya AI. DeepSeek inadai kuwa wasanidi programu wanahitaji lugha inayoweza kufikiwa na yenye uwezo wa kutoa utendakazi wa hali ya juu kutoka kwa maunzi ya msingi, na inasema TileLang inatoa muundo rahisi wa programu kuliko CUDA. Ikitolewa, kizuizi cha kuandika msimbo kwa chipsi za AI za Kichina hupungua sana - ambayo ndiyo hoja haswa.
Supernodi ya chip 128 kama uthibitisho wa ukubwa
Ushirikiano huo pia ulitoa matokeo ya vifaa. DeepSeek na Huawei wanasema walifanya kazi kwenye mfumo wa supernode unaochanganya chip 128 Ascend 950, unaolenga kuboresha mawasiliano kati ya vichakataji na vile vile utendakazi wa jumla wa kompyuta - tatizo la muunganisho ambalo kihistoria limetenganisha vichapuzi vya niche kutoka kwa majukwaa halisi ya kituo cha data.
Tangazo hilo linakuja muda mfupi baada ya Huawei kutambulisha kizazi kijacho cha wasindikaji wa AI na mifumo ya kompyuta ya "supernode", na kampuni hiyo inatarajia miundombinu yake ya AI kuona matumizi makubwa kwa mafunzo ya kielelezo kuanzia mwaka ujao. Maabara ya mipakani inayochapisha programu ya mifumo yake kwa jukwaa la chip ya ndani ni ishara yenye nguvu zaidi kwamba kampuni za AI za Uchina zinakusudia kuendesha mzigo mkubwa wa mafunzo bila vifaa vya Nvidia.
Kwa nini handaki la CUDA ndio uwanja wa kweli wa vita
CUDA imekuwa sehemu kuu ya utawala wa Nvidia kwa sababu ya mfumo mkubwa wa ikolojia wa programu uliojengwa karibu na GPU zake - wakusanyaji, maktaba, na miongo miwili ya ujuzi wa wasanidi programu. Kila toleo la PyTorch, kila mfumo wa uelekezaji, kila repo ya utafiti inachukua CUDA inafanya kazi. Hali hiyo, zaidi ya vipimo mbichi vya chip, ndiyo imewaweka wapinzani pembeni.
Mantiki ya kimkakati ya kutafuta vyanzo huria ni ya makusudi sawa. Rafu za programu za chipu za umiliki hushinda kwa kuwa chaguo-msingi; mifumo ya ikolojia iliyo wazi inashinda kwa kuwa njia mbadala ya kila mtu. Kwa kuchapisha zana za Ascend chini ya leseni zilizo wazi, DeepSeek inapunguza gharama ya kubadilisha kwa msanidi programu au mwendeshaji wa wingu yeyote anayetafuta faida dhidi ya bei ya Nvidia - na hufanya maunzi ya Huawei kuwa na faida kwa wanunuzi ambao hawatawahi kukubali rundo la muuzaji mmoja.
Ndio maana ushirikiano wa DeepSeek-Huawei ni muhimu zaidi ya Uchina. Inaonyesha msukumo mpana ndani ya nchi ili kukuza maunzi ya ndani ya AI na programu inayohitajika ili kuiendesha kwa ufanisi, kupunguza utegemezi wa teknolojia ya Nvidia wakati ambapo udhibiti wa usafirishaji wa Amerika tayari umezuia ufikiaji wa chipsi za hali ya juu zaidi za Nvidia. Gazeti la New York Times lilianzisha ushirikiano huo kama shambulio la moja kwa moja kwa chanzo kikuu cha utawala wa AI wa Nvidia - sio chips zenyewe, lakini kanuni inayozifanya ziwe muhimu sana.
Kujenga ushirikiano uliopo
Toleo la Jumatano sio ishara ya kwanza ya kamari ya DeepSeek kwenye silicon ya nyumbani. Mnamo Aprili, Benzinga na South China Morning Post waliripoti kwamba modeli ya V4 ya DeepSeek ilijengwa na kufunzwa kwa chipsi za Huawei, katika kile SCMP ilielezea kama ushirikiano wa kuimarisha Uchina wa kujitegemea wa AI. Kilicho tofauti sasa ni programu: V4 ilithibitisha miundo inaweza kuendeshwa kwenye Ascend, wakati toleo hili linampa kila msanidi programu mwingine wa Kichina zana za kufuata.
Barabara haijawa laini. Generation-NT iliripoti kwamba DeepSeek hapo awali ilichelewesha modeli yake ya R2 huku kukiwa na shida na chipsi za Huawei Ascend, uamuzi ambao duka lilisema ulifichua udhaifu wa mfumo wa ikolojia mchanga. Huawei, kwa upande wake, imeendelea kuongeza kasi - The Business Times iliripoti katikati ya Septemba kwamba kampuni hiyo ilikuwa ikiendelea na uzinduzi wa Chip mpya ya AI kuchukua Nvidia. Toleo la chanzo huria hubadilisha kikamilifu maumivu hayo yanayokua kuwa miundombinu inayoshirikiwa: matatizo ambayo DeepSeek hutatua yenyewe huwa matatizo kila msanidi wa Ascend hufaidika kutokana na kutatuliwa.
Nini cha kutazama baadaye
Mambo matatu yataamua ikiwa juhudi hii itauma. Kwanza, kupitishwa: zana huria ni muhimu tu ikiwa watengenezaji wa Kichina wanaunda nazo, na jaribio la kweli la TileLang ni kama mafunzo ya kielelezo kwenye vikundi vya Ascend yanakuwa kawaida badala ya majaribio. Pili, utendakazi: Miundo yenyewe ya DeepSeek tayari imeripotiwa kutumika kwenye silikoni ya Huawei, lakini vinavyolingana na mafunzo ya enzi ya CUDA katika mizigo mingi ya kazi ni upau tofauti. Tatu, spillover: ikiwa TileLang itakomaa na kuwa lugha inayoweza kubebeka kihalisi kwa viongeza kasi vya AI, inaweza kutatiza msimamo wa Nvidia nje ya mipaka ya Uchina.
Kwa sasa, ujumbe uko wazi. Awamu inayofuata ya mbio za vifaa vya AI inapigwa vita katika programu, na DeepSeek imechapisha tu hoja zake za ufunguzi hadharani.
---
Kaa Mbele ya AIPata habari za hivi punde za AI, uchanganuzi na mafanikio - yote katika sehemu moja.
Soma habari zaidi za AI →