W środę firma DeepSeek ogłosiła, że nawiązała współpracę z Huawei w celu opracowania narzędzi programistycznych dla procesorów Ascend AI firmy Huawei i udostępnia na zasadach open source wyniki, w tym wersję języka TileLang, która jest prostszą alternatywą dla CUDA firmy Nvidia.
Celem tego ruchu jest najsłabszy punkt zbroi Nvidii. Dominacja firmy w dziedzinie obliczeń AI nigdy nie dotyczyła wyłącznie krzemu; opiera się na CUDA, ekosystemie oprogramowania, w którym szkolił się praktycznie każdy programista AI. Aby wyjaśnić, dlaczego to ma znaczenie, nasza branża AI wielokrotnie udokumentowała, że sprzęt wygrywa tylko wtedy, gdy otaczające go oprogramowanie sprawia, że zmiana jest bolesna.
Sześć narzędzi typu open source dla Ascend
Według Reuters DeepSeek wypuszcza sześć modułów oprogramowania typu open source zbudowanych dla platformy Ascend firmy Huawei. Pakiet zawiera biblioteki mające na celu poprawę wydajności obliczeniowej i komunikacyjnej w obrębie chipów, opracowane w ramach, jak DeepSeek określa, szerokiego wsparcia technicznego ze strony Huawei.
Najważniejszym elementem jest TileLang, język programowania wysokiego poziomu o otwartym kodzie źródłowym, przeznaczony dla akceleratorów AI. DeepSeek twierdzi, że programiści potrzebują języka, który jest zarówno dostępny, jak i zdolny do wydobycia maksymalnej wydajności ze sprzętu bazowego, i twierdzi, że TileLang oferuje prostszy model programowania niż CUDA. Jeśli tak się stanie, bariera w pisaniu kodu dla chińskich chipów AI znacznie spadnie – i właśnie o to chodzi.
Superwęzeł składający się ze 128 chipów jako dowód skali
Współpraca przyniosła także rezultaty w zakresie sprzętu. DeepSeek i Huawei twierdzą, że pracowały nad systemem supernodów składającym się ze 128 chipów Ascend 950, koncentrując się na optymalizacji komunikacji między procesorami, a także ogólnej wydajności obliczeniowej — problemu wzajemnych połączeń, który w przeszłości oddzielał niszowe akceleratory od prawdziwych platform centrów danych.
Ogłoszenie następuje wkrótce po wprowadzeniu przez Huawei nowej generacji procesorów AI i systemów obliczeniowych „supernodów”, a firma spodziewa się, że od przyszłego roku jej infrastruktura AI będzie szerzej wykorzystywana do szkolenia modelowego. Pionierskie laboratorium publikujące swoje oprogramowanie systemowe dla krajowej platformy chipowej to jak dotąd najsilniejszy sygnał, że chińskie firmy zajmujące się sztuczną inteligencją zamierzają wykonywać poważne zadania szkoleniowe bez sprzętu Nvidia.
Dlaczego fosa CUDA jest prawdziwym polem bitwy
CUDA stała się centralną częścią dominacji Nvidii ze względu na ogromny ekosystem oprogramowania zbudowany wokół jej procesorów graficznych – kompilatory, biblioteki i dwie dekady znajomości programistów. Każde wydanie PyTorch, każde środowisko wnioskowania, każde repozytorium badawcze zakłada, że CUDA działa. To właśnie ta bezwładność, większa niż surowe specyfikacje chipów, powstrzymuje konkurentów.
Strategiczna logika open source jest równie przemyślana. Zastrzeżone stosy oprogramowania chipowego wygrywają, będąc domyślnym; otwarte ekosystemy wygrywają, będąc rezerwą dla wszystkich. Publikując narzędzia Ascend na otwartych licencjach, DeepSeek obniża koszty zmiany oprogramowania dla każdego programisty lub operatora chmury szukającego dźwigni w stosunku do cen Nvidii – i sprawia, że sprzęt Huawei jest opłacalny dla nabywców, którzy nigdy nie zaakceptowaliby stosu od jednego dostawcy.
Właśnie dlatego współpraca DeepSeek-Huawei ma znaczenie poza Chinami. Odzwierciedla to szersze wysiłki w kraju mające na celu rozwój krajowego sprzętu AI i oprogramowania wymaganego do jego wydajnej obsługi, zmniejszając zależność od technologii Nvidii w czasie, gdy amerykańskie kontrole eksportu ograniczyły już dostęp do najbardziej zaawansowanych chipów Nvidii. „The New York Times” określił tę współpracę jako bezpośredni atak na kluczowe źródło dominacji Nvidii w dziedzinie sztucznej inteligencji – nie same chipy, ale kod, który czyni je niezbędnymi.
Opieranie się na istniejącym partnerstwie
Środowa publikacja nie jest pierwszą oznaką, że DeepSeek stawia na krajowy krzem. W kwietniu zarówno Benzinga, jak i South China Morning Post doniosły, że model V4 firmy DeepSeek został zbudowany i wyszkolony na chipach Huawei, co SCMP określiło jako współpracę wzmacniającą samodzielność Chin w zakresie sztucznej inteligencji. Tym, co różni się teraz, jest oprogramowanie: wersja V4 udowodniła, że modele mogą działać na platformie Ascend, podczas gdy ta wersja zapewnia każdemu innemu chińskiemu programiście narzędzia do naśladowania.
Droga nie była gładka. Generation-NT poinformowało, że DeepSeek wcześniej opóźniał wprowadzenie modelu R2 ze względu na problemy z chipami Huawei Ascend, a decyzja ta ujawniła kruchość rodzącego się ekosystemu. Huawei ze swojej strony stale przyspiesza — w połowie września dziennik The Business Times doniósł, że firma przyspiesza wprowadzenie na rynek nowego chipa AI, aby zmierzyć się z Nvidią. Wersja open source skutecznie przekształca rosnące problemy we wspólną infrastrukturę: problemy, które DeepSeek sam rozwiązuje, stają się problemami, z których rozwiązania korzysta każdy programista Ascend.
Co obejrzeć dalej
O tym, czy ten wysiłek będzie skuteczny, zadecydują trzy rzeczy. Po pierwsze, przyjęcie: narzędzia typu open source mają znaczenie tylko wtedy, gdy chińscy programiści faktycznie z nich korzystają, a prawdziwym testem TileLang jest to, czy szkolenie modeli w klastrach Ascend stanie się rutynowe, a nie eksperymentalne. Po drugie, wydajność: donoszono już, że własne modele DeepSeek działają na krzemie Huawei, ale dopasowywanie przepustowości szkoleniowej z ery CUDA przy heterogenicznych obciążeniach to inna poprzeczka. Po trzecie, skutki uboczne: jeśli TileLang stanie się naprawdę przenośnym językiem dla akceleratorów AI, może to skomplikować pozycję Nvidii także poza granicami Chin.
Na razie przekaz jest jasny. Kolejna faza wyścigu sprzętu AI toczy się w oprogramowaniu, a DeepSeek właśnie opublikował publicznie swoje pierwsze argumenty.
---
Wyprzedź sztuczną inteligencjęOtrzymuj najnowsze wiadomości, analizy i przełomowe informacje dotyczące sztucznej inteligencji — wszystko w jednym miejscu.
Przeczytaj więcej aktualności o sztucznej inteligencji →