Společnost DeepSeek ve středu oznámila, že se spojila s Huawei na vývoji programovacích nástrojů pro procesory Huawei Ascend AI – a výsledky získává z otevřených zdrojů, včetně verze svého jazyka TileLang umístěné jako jednodušší alternativa k CUDA od Nvidie.
Pohyb míří na nejměkčí místo v brnění Nvidie. Dominance společnosti v oblasti AI computingu nikdy nebyla pouze o křemíku; spočívá na CUDA, softwarovém ekosystému, na kterém se školil prakticky každý vývojář umělé inteligence. Pro kontext, proč na tom záleží, naše pokrytí odvětví AI opakovaně zdokumentovalo, že hardware vítězí pouze tehdy, když je kvůli softwaru kolem něj přepínání bolestivé.
Šest open-source nástrojů pro Ascend
Podle agentury Reuters DeepSeek vydává šest softwarových modulů s otevřeným zdrojovým kódem vytvořených pro platformu Ascend společnosti Huawei. Balíček obsahuje knihovny zaměřené na zlepšení výpočetního a komunikačního výkonu napříč čipy, vyvinuté s tím, co DeepSeek popisuje jako rozsáhlou technickou podporu od Huawei.
Středobodem je TileLang, open-source programovací jazyk na vysoké úrovni určený pro akcelerátory AI. DeepSeek tvrdí, že vývojáři potřebují jazyk, který je zároveň dostupný a schopný extrahovat maximální výkon ze základního hardwaru, a říká, že TileLang nabízí jednodušší programovací model než CUDA. Pokud se to podaří, bariéra pro psaní kódu pro čínské čipy AI se podstatně sníží – což je přesně ta pointa.
128čipový superuzel jako důkaz měřítka
Spolupráce přinesla také hardwarové výsledky. DeepSeek a Huawei tvrdí, že pracovali na supernode systému kombinujícím 128 čipů Ascend 950 se zaměřením na optimalizaci komunikace mezi procesory a také na celkový výpočetní výkon – problém propojení, který historicky odděloval specializované akcelerátory od skutečných platforem datových center.
Oznámení přichází krátce poté, co společnost Huawei představila svou další generaci procesorů AI a „supernode“ výpočetních systémů a společnost očekává, že její infrastruktura AI bude od příštího roku širší využití pro školení modelů. Hraniční laboratoř vydávající svůj systémový software pro domácí čipovou platformu je zatím nejsilnějším signálem, že čínské společnosti s umělou inteligencí hodlají provozovat seriózní tréninkovou zátěž bez hardwaru Nvidia.
Proč je příkop CUDA tím pravým bojištěm
CUDA se stala ústřední součástí dominance Nvidie kvůli obrovskému softwarovému ekosystému postavenému kolem jejích GPU – kompilátorů, knihoven a dvě desetiletí znalosti vývojářů. Každé vydání PyTorch, každý inferenční rámec, každé výzkumné úložiště předpokládá, že CUDA funguje. Tato setrvačnost, více než hrubé specifikace čipů, je to, co drží soupeře na uzdě.
Strategická logika open-sourcingu je stejně záměrná. Proprietární sady čipového softwaru vítězí tím, že jsou výchozí; otevřené ekosystémy vyhrávají tím, že jsou záložními pro všechny. Zveřejněním nástrojů Ascend pod otevřenými licencemi snižuje DeepSeek náklady na přechod pro každého vývojáře nebo cloudového operátora, který hledá páku oproti cenám Nvidia – a činí hardware Huawei životaschopným přesně pro ty kupující, kteří by nikdy nepřijali sadu od jednoho dodavatele.
To je důvod, proč je spolupráce DeepSeek-Huawei důležitá i mimo Čínu. Odráží to širší tlak v rámci země na vývoj domácího hardwaru AI a softwaru potřebného k jeho efektivnímu provozu, což snižuje závislost na technologii Nvidia v době, kdy americké kontroly exportu již omezily přístup k nejpokročilejším čipům Nvidia. The New York Times naplánoval partnerství jako přímý útok na klíčový zdroj dominance AI společnosti Nvidia – nikoli na samotné čipy, ale na kód, který je činí nepostradatelnými.
Stavíme na stávajícím partnerství
Středeční vydání není první známkou sázení DeepSeek na domácí křemík. V dubnu Benzinga i South China Morning Post uvedly, že model V4 společnosti DeepSeek byl postaven a vyškolen na čipech Huawei, což SCMP popsal jako spolupráci posilující čínskou soběstačnost AI. Co je nyní jiné, je software: V4 dokázal, že modely mohou běžet na Ascendu, zatímco toto vydání dává každému dalšímu čínskému vývojáři nástroje, které mohou následovat.
Cesta nebyla hladká. Generation-NT oznámila, že DeepSeek dříve odložil svůj model R2 kvůli potížím s čipy Huawei Ascend, rozhodnutí, jak uvedl outlet, odhalilo křehkost rodícího se ekosystému. Huawei ze své strany neustále zrychluje – The Business Times v polovině září informovaly, že společnost posouvá uvedení nového čipu AI na trh s Nvidií. Vydání s otevřeným zdrojovým kódem efektivně převádí tyto rostoucí potíže do sdílené infrastruktury: problémy, které DeepSeek řeší sám pro sebe, se stávají problémy, z jejichž vyřešení má prospěch každý vývojář Ascend.
Na co se dále dívat
O tom, zda toto úsilí kousne, rozhodnou tři věci. Za prvé, osvojení: open-source nástroje mají význam pouze tehdy, pokud s nimi čínští vývojáři skutečně staví, a skutečným testem TileLang je, zda se modelové školení na clusterech Ascend stává rutinou spíše než experimentální. Za druhé, výkon: Vlastní modely DeepSeek již byly hlášeny, že běží na křemíku Huawei, ale sladit propustnost školení z éry CUDA napříč heterogenními pracovními zátěžemi je jiná laťka. Za třetí, přelévání: pokud TileLang dospěje do skutečně přenosného jazyka pro akcelerátory AI, mohlo by to zkomplikovat pozici Nvidie i mimo čínské hranice.
Prozatím je poselství jasné. V další fázi hardwarového závodu AI se bojuje v softwaru a DeepSeek právě zveřejnil své úvodní argumenty na veřejnosti.
---
Stay Ahead of AIZískejte nejnovější zprávy, analýzy a průlomové informace o umělé inteligenci – vše na jednom místě.
Přečtěte si další zprávy o AI →