Phòng thí nghiệm AI Trung Quốc DeepSeek đã hợp tác với Huawei để phát hành bộ công cụ lập trình nguồn mở cho chip AI Ascend của Huawei, một động thái nhắm trực tiếp vào hệ sinh thái phần mềm đã củng cố sự thống trị của Nvidia trong lĩnh vực điện toán trí tuệ nhân tạo.
Thông báo được đưa ra trên kênh WeChat chính thức của DeepSeek và được xác nhận bởi Reuters, Bloomberg và The New York Times. Theo The Decoding, bản phát hành bao gồm các thư viện để tính toán và di chuyển dữ liệu giữa các chip - và tất cả đều là nguồn mở. DeepSeek cho biết Huawei "hoàn toàn hỗ trợ" công việc này.
Đối với độc giả theo dõi tin nóng về AI về ngành công nghiệp chip của Trung Quốc, đây là một trong những đợt phát hành phần mềm mang lại kết quả lớn nhất trong năm: đây là dấu hiệu rõ ràng nhất cho thấy phòng thí nghiệm AI hàng đầu của Trung Quốc đang xây dựng nền tảng của mình xoay quanh silicon trong nước thay vì GPU Nvidia.
Những gì DeepSeek thực sự được phát hành
Trọng tâm của bản phát hành là TileLang, một ngôn ngữ lập trình nguồn mở dành cho chip AI được phát triển ban đầu bởi các nhà nghiên cứu tại Đại học Bắc Kinh. Theo The Decode, DeepSeek đã sử dụng ngôn ngữ này trong nội bộ khoảng một năm và lần đầu tiên thử nghiệm nó trên các chip Nvidia cũ hơn trước khi đưa nó vào phần cứng của Huawei.
Lập luận của DeepSeek là bất kỳ ai đang cố gắng xây dựng một hệ sinh thái phần mềm độc lập cho chip AI đều cần một ngôn ngữ phổ quát, dễ lập trình trong khi vẫn khai thác được toàn bộ hiệu suất từ phần cứng. Theo quan điểm của công ty, TileLang cung cấp một mô hình lập trình đơn giản hơn CUDA, nền tảng độc quyền của Nvidia vốn là tiêu chuẩn thực tế để phát triển AI trong gần hai thập kỷ.
Tờ New York Times đưa tin rằng TileLang hiện là công cụ chính trong công việc của DeepSeek hướng tới trí tuệ nhân tạo tổng hợp - một sự chứng thực đáng chú ý, vì các mô hình của DeepSeek được đào tạo và phục vụ ở quy mô biên giới.
Ngoài ngôn ngữ
Cùng với TileLang, DeepSeek đã cung cấp các thư viện nguồn mở bao gồm tính toán và di chuyển dữ liệu giữa các chip, hai khối lượng công việc chi phối hoạt động đào tạo và suy luận AI quy mô lớn. Công ty cũng cho biết họ đã cùng Huawei tối ưu hóa một "siêu nút" - một cụm gồm 128 chip Ascend 950 được thiết kế để hoạt động như một hệ thống duy nhất.
Tại sao điều này lại nhắm thẳng vào Nvidia
Lợi thế của Nvidia chưa bao giờ chỉ nằm ở thiết kế chip. Con hào thực sự của công ty là CUDA và hệ sinh thái xung quanh nó: ước tính có khoảng bốn triệu nhà phát triển trên toàn thế giới xây dựng bằng CUDA và cơ sở được cài đặt đó là thứ mà các đối thủ như AMD đã phải vật lộn để vượt qua ngay cả khi phần cứng của họ trông có vẻ cạnh tranh trên giấy tờ, The Decoder lưu ý.
Đó là điều khiến việc ra mắt DeepSeek-Huawei khác với những lần công bố chip trước đây của Trung Quốc. Thay vì chỉ xây dựng phần cứng nhanh hơn, ngành AI của Trung Quốc hiện đang cố gắng tái tạo lớp phần mềm đang giam giữ các nhà phát triển.
Tờ New York Times đưa tin rằng cho đến nay, các nhà sản xuất mô hình Trung Quốc như Z.ai và Moonshot AI đã phát triển nhanh hơn các nhà sản xuất chip trong nước - có nghĩa là các mô hình tốt nhất của Trung Quốc vẫn chủ yếu phụ thuộc vào điện toán nước ngoài. Huawei muốn thu hẹp khoảng cách đó. Hai tuần trước thông báo của DeepSeek, Huawei đã tiết lộ thế hệ bộ xử lý AI và hệ thống siêu nút mới và cho biết chúng sẽ được sử dụng rộng rãi để đào tạo mô hình vào năm tới.
Phông nền kiểm soát xuất khẩu
Mối quan hệ hợp tác không thể tách rời khỏi các biện pháp kiểm soát xuất khẩu của Hoa Kỳ, vốn đã dần dần loại bỏ các công ty Trung Quốc khỏi các GPU tiên tiến nhất của Nvidia. Theo The Decoding, Chủ tịch luân phiên của Huawei, Eric Xu, cho biết công ty không thể chấp nhận một tương lai phụ thuộc vào việc liệu những người khác có sẵn sàng bán chip cho Trung Quốc hay không. Động thái xuất bản công khai phần mềm chip của DeepSeek cũng khiến bất kỳ nhà cung cấp nào - Trung Quốc hay Mỹ - khó kiểm soát lớp mà mọi người phụ thuộc vào.
CUDA Moat có thực sự bị nứt không?
Bối cảnh thú vị đến từ công ty nghiên cứu SemiAnalysis, công ty gần đây đã thử nghiệm Jalapeño, chip suy luận nội bộ của OpenAI và kết luận rằng hào CUDA "có khả năng đã chết" — lưu ý rằng OpenAI có các mô hình mới chạy trên phần cứng của riêng mình một cách nhanh chóng và Jalapeño đã đánh bại Blackwell của Nvidia về hiệu suất trên mỗi watt trong hầu hết các kịch bản được thử nghiệm, như The Decode báo cáo.
Nhưng các nhà phân tích đã bổ sung thêm những cảnh báo quan trọng. Họ chỉ thử nghiệm các kịch bản tương đối dễ tối ưu hóa với khoảng 8.000 mã thông báo đầu vào và 1.000 mã thông báo đầu ra và họ chưa chạy AgentX, một chuẩn mực đo lường cách các tác nhân AI xử lý các tác vụ nhiều bước - chính xác là nơi SemiAnalysis đã tìm thấy Nvidia dẫn đầu vào tháng 8 gần đây.
Ý nghĩa của nó đối với ngành
Thực tế đọc không phải là CUDA sụp đổ chỉ sau một đêm. Bốn triệu nhà phát triển, hai thập kỷ thư viện và vô số hoạt động triển khai sản xuất không di chuyển nhanh chóng. Nhưng sự kết hợp giữa phần mềm của DeepSeek, chip mới của Huawei và những nỗ lực về silicon tùy chỉnh như của OpenAI cho thấy việc khóa phần mềm khiến Nvidia trở thành mặc định đang bị loại bỏ khỏi nhiều hướng cùng một lúc.
Đối với Trung Quốc, phần thưởng mang tính chiến lược: một kho phần mềm thay thế mở, khả thi giúp các con chip trong nước có thể sử dụng được trên quy mô lớn, làm giảm đòn bẩy của chính sách xuất khẩu của Hoa Kỳ. Đối với những người khác, hệ sinh thái TileLang mã nguồn mở cuối cùng có thể giảm chi phí nhắm mục tiêu đến phần cứng không phải của Nvidia ở bất kỳ đâu trên thế giới.
DeepSeek và Huawei chưa tiết lộ điểm chuẩn hiệu suất so sánh ngăn xếp mới với CUDA trên phần cứng tương đương, do đó, các tuyên bố cụ thể về tốc độ và hiệu quả vẫn chưa được chứng minh. Điều rõ ràng là hướng đi: phòng thí nghiệm AI được theo dõi nhiều nhất ở Trung Quốc không còn coi phần mềm của Nvidia là sự phụ thuộc không thể tránh khỏi.
Đi trước AI
Bỏ lỡ một câu chuyện? Đọc thêm tin tức về AI →
