Η DeepSeek ανακοίνωσε την Τετάρτη ότι συνεργάστηκε με την Huawei για την ανάπτυξη εργαλείων προγραμματισμού για τους επεξεργαστές Ascend AI της Huawei — και προμηθεύει τα αποτελέσματα, συμπεριλαμβανομένης μιας έκδοσης της γλώσσας TileLang που τοποθετείται ως απλούστερη εναλλακτική του CUDA της Nvidia.

Η κίνηση στοχεύει στο πιο μαλακό σημείο στην πανοπλία της Nvidia. Η κυριαρχία της εταιρείας στον τομέα της τεχνητής νοημοσύνης δεν αφορούσε ποτέ μόνο το πυρίτιο. Βασίζεται στο CUDA, το οικοσύστημα λογισμικού στο οποίο έχει εκπαιδευτεί σχεδόν κάθε προγραμματιστής τεχνητής νοημοσύνης. Για λόγους σημασίας, η κάλυψη της βιομηχανίας τεχνητής νοημοσύνης έχει τεκμηριώσει επανειλημμένα ότι το υλικό κερδίζει μόνο όταν το λογισμικό γύρω του κάνει την εναλλαγή επώδυνη.

Έξι εργαλεία ανοιχτού κώδικα για το Ascend

Σύμφωνα με το Reuters, η DeepSeek κυκλοφορεί έξι ενότητες λογισμικού ανοιχτού κώδικα που έχουν δημιουργηθεί για την πλατφόρμα Ascend της Huawei. Το πακέτο περιλαμβάνει βιβλιοθήκες που στοχεύουν στη βελτίωση της απόδοσης υπολογιστών και επικοινωνίας στα τσιπ, που αναπτύχθηκαν με αυτό που το DeepSeek περιγράφει ως εκτεταμένη τεχνική υποστήριξη από την Huawei.

Το κεντρικό στοιχείο είναι η TileLang, μια ανοιχτού κώδικα γλώσσα προγραμματισμού υψηλού επιπέδου που έχει σχεδιαστεί για επιταχυντές τεχνητής νοημοσύνης. Το DeepSeek υποστηρίζει ότι οι προγραμματιστές χρειάζονται μια γλώσσα που να είναι προσβάσιμη και ικανή να εξάγει τη μέγιστη απόδοση από το υποκείμενο υλικό και λέει ότι το TileLang προσφέρει ένα απλούστερο μοντέλο προγραμματισμού από το CUDA. Εάν παραδοθεί, το εμπόδιο στη σύνταξη κώδικα για κινεζικά τσιπ τεχνητής νοημοσύνης μειώνεται σημαντικά — αυτό ακριβώς είναι το ζητούμενο.

Ένας υπερκόμβος 128 τσιπ ως απόδειξη κλίμακας

Η συνεργασία έδωσε επίσης αποτελέσματα υλικού. Η DeepSeek και η Huawei λένε ότι εργάστηκαν σε ένα σύστημα υπερκόμβων που συνδυάζει 128 τσιπ Ascend 950, εστιάζοντας στη βελτιστοποίηση της επικοινωνίας μεταξύ των επεξεργαστών καθώς και στη συνολική υπολογιστική απόδοση - το πρόβλημα διασύνδεσης που ιστορικά διαχώρισε τους εξειδικευμένους επιταχυντές από τις γνήσιες πλατφόρμες κέντρων δεδομένων.

Η ανακοίνωση έρχεται λίγο αφότου η Huawei παρουσίασε την επόμενη γενιά επεξεργαστών τεχνητής νοημοσύνης και υπολογιστικών συστημάτων «supernode» και η εταιρεία αναμένει ότι η υποδομή AI της θα έχει ευρύτερη χρήση για εκπαίδευση μοντέλων από το επόμενο έτος. Ένα συνοριακό εργαστήριο που δημοσιεύει το λογισμικό συστημάτων του για μια εγχώρια πλατφόρμα τσιπ είναι το ισχυρότερο μήνυμα μέχρι τώρα ότι οι κινεζικές εταιρείες τεχνητής νοημοσύνης σκοπεύουν να εκτελέσουν σοβαρούς φόρτους εργασίας εκπαίδευσης χωρίς υλικό Nvidia.

Γιατί η τάφρο του CUDA είναι το πραγματικό πεδίο μάχης

Το CUDA έχει γίνει κεντρικό μέρος της κυριαρχίας της Nvidia λόγω του τεράστιου οικοσυστήματος λογισμικού που έχει χτιστεί γύρω από τις GPU της — μεταγλωττιστές, βιβλιοθήκες και δύο δεκαετίες εξοικείωσης με τους προγραμματιστές. Κάθε έκδοση PyTorch, κάθε πλαίσιο συμπερασμάτων, κάθε αποθετήριο έρευνας προϋποθέτει ότι το CUDA λειτουργεί. Αυτή η αδράνεια, περισσότερο από τις προδιαγραφές ακατέργαστων τσιπ, είναι που κράτησε τους αντιπάλους σε απόσταση.

Η στρατηγική λογική του ανοιχτού κώδικα είναι εξίσου σκόπιμη. Οι ιδιόκτητες στοίβες λογισμικού τσιπ κερδίζουν ως προεπιλογή. τα ανοιχτά οικοσυστήματα κερδίζουν με το να είναι το backback όλων. Δημοσιεύοντας το εργαλείο Ascend υπό ανοικτές άδειες, το DeepSeek μειώνει το κόστος εναλλαγής για οποιονδήποτε προγραμματιστή ή χειριστή cloud που αναζητά μόχλευση έναντι της τιμολόγησης της Nvidia — και καθιστά το υλικό της Huawei βιώσιμο ακριβώς για τους αγοραστές που δεν θα δέχονταν ποτέ μια στοίβα ενός προμηθευτή.

Αυτός είναι ο λόγος για τον οποίο η συνεργασία DeepSeek-Huawei έχει σημασία πέρα ​​από την Κίνα. Αντικατοπτρίζει μια ευρύτερη ώθηση εντός της χώρας για την ανάπτυξη εγχώριου υλικού τεχνητής νοημοσύνης και του λογισμικού που απαιτείται για την αποτελεσματική λειτουργία του, μειώνοντας την εξάρτηση από την τεχνολογία της Nvidia σε μια εποχή που οι έλεγχοι εξαγωγών των ΗΠΑ έχουν ήδη περιορίσει την πρόσβαση στα πιο προηγμένα τσιπ της Nvidia. Οι New York Times χαρακτήρισαν τη συνεργασία ως μια άμεση επίθεση στη βασική πηγή της κυριαρχίας της τεχνητής νοημοσύνης της Nvidia - όχι τα ίδια τα τσιπ, αλλά ο κώδικας που τα καθιστά απαραίτητα.

Χτίζοντας σε μια υπάρχουσα συνεργασία

Η κυκλοφορία της Τετάρτης δεν είναι το πρώτο σημάδι στοιχηματισμού του DeepSeek στο εγχώριο πυρίτιο. Τον Απρίλιο, τόσο η Benzinga όσο και η South China Morning Post ανέφεραν ότι το μοντέλο V4 της DeepSeek κατασκευάστηκε και εκπαιδεύτηκε σε τσιπ της Huawei, σε αυτό που η SCMP περιέγραψε ως μια συνεργασία που ενισχύει την αυτοδυναμία της Κίνας στην τεχνητή νοημοσύνη. Αυτό που είναι διαφορετικό τώρα είναι το λογισμικό: το V4 απέδειξε ότι τα μοντέλα θα μπορούσαν να λειτουργούν στο Ascend, ενώ αυτή η έκδοση δίνει σε κάθε άλλο Κινέζο προγραμματιστή τα εργαλεία που πρέπει να ακολουθήσουν.

Ο δρόμος δεν ήταν ομαλή. Η Generation-NT ανέφερε ότι η DeepSeek προηγουμένως καθυστέρησε το μοντέλο R2 της εν μέσω δυσκολιών με τα τσιπ Huawei Ascend, μια απόφαση που είπε το κατάστημα αποκάλυψε την ευθραυστότητα του εκκολαπτόμενου οικοσυστήματος. Η Huawei, από την πλευρά της, συνέχισε να επιταχύνει — Οι Business Times ανέφεραν στα μέσα Σεπτεμβρίου ότι η εταιρεία προχωρούσε στην κυκλοφορία ενός νέου τσιπ AI για να αντιμετωπίσει τη Nvidia. Η έκδοση ανοιχτού κώδικα μετατρέπει αποτελεσματικά αυτούς τους αυξανόμενους πόνους σε κοινή υποδομή: τα προβλήματα που επιλύει το DeepSeek από μόνο του γίνονται προβλήματα που κάθε προγραμματιστής του Ascend επωφελείται από την επίλυση.

Τι να παρακολουθήσετε στη συνέχεια

Τρία πράγματα θα καθορίσουν αν αυτή η προσπάθεια δαγκώνει. Πρώτον, υιοθέτηση: τα εργαλεία ανοιχτού κώδικα έχουν σημασία μόνο εάν οι Κινέζοι προγραμματιστές χτίζουν πραγματικά με αυτά και η αληθινή δοκιμή του TileLang είναι εάν η εκπαίδευση μοντέλων σε συμπλέγματα Ascend γίνεται ρουτίνα και όχι πειραματική. Δεύτερον, απόδοση: Τα μοντέλα της DeepSeek έχουν ήδη αναφερθεί ότι λειτουργούν με πυρίτιο Huawei, αλλά η αντίστοιχη απόδοση εκπαίδευσης της εποχής CUDA σε ετερογενείς φόρτους εργασίας είναι μια διαφορετική γραμμή. Τρίτον, spillover: εάν η TileLang ωριμάσει σε μια πραγματικά φορητή γλώσσα για επιταχυντές τεχνητής νοημοσύνης, θα μπορούσε να περιπλέξει τη θέση της Nvidia πολύ έξω από τα σύνορα της Κίνας.

Προς το παρόν, το μήνυμα είναι ξεκάθαρο. Η επόμενη φάση της κούρσας υλικού τεχνητής νοημοσύνης διεξάγεται σε λογισμικό και το DeepSeek μόλις δημοσίευσε δημόσια τα εναρκτήρια επιχειρήματά του.

---

Μείνετε μπροστά από την τεχνητή νοημοσύνη

Λάβετε τα τελευταία νέα, αναλύσεις και ανακαλύψεις AI — όλα σε ένα μέρος.

Διαβάστε περισσότερα νέα AI →