Trung Quốc đã giành lại vị trí dẫn đầu trong danh sách TOP500 siêu máy tính nhanh nhất thế giới lần đầu tiên sau gần một thập kỷ. Hệ thống này có tên LineShine và đặt tại Thâm Quyến, ra mắt ở vị trí số một trong phiên bản xếp hạng thứ 67, được công bố tại hội nghị ISC 2026 ở Hamburg, Đức.

Kết quả này là một cột mốc quan trọng không chỉ về hiệu suất thô mà còn về những gì nó báo hiệu về khả năng tự cung cấp của Trung Quốc trong lĩnh vực điện toán hiệu năng cao. Đối với những phát triển phần cứng AI mới nhất và phạm vi phủ sóng của siêu máy tính, mục LineShine đánh dấu lần đầu tiên Trung Quốc chính thức lọt vào TOP500 sau 9 năm.

Người khổng lồ chỉ có CPU

Điều khiến LineShine trở nên khác thường là kiến trúc của nó. Hệ thống này hoàn toàn dựa trên CPU - không có GPU. Nó được xây dựng dựa trên bộ xử lý tùy chỉnh có tên LX2, một con chip tương thích Armv9 có hỗ trợ các phần mở rộng SVE2 và SME. Mỗi gói LX2 chứa 304 lõi hoạt động chạy ở tốc độ 1,55 GHz, cung cấp công suất điện toán FP64 được trích dẫn là 60,3 teraflop ở công suất 690 watt trên mỗi ổ cắm.

Con chip này được xây dựng từ hai khuôn tính toán, mỗi khuôn chứa bốn cụm 40 lõi. Hai lõi trên mỗi cụm bị vô hiệu hóa để đạt năng suất, để lại 38 lõi hoạt động trên mỗi cụm và 152 lõi trên mỗi khuôn. Mỗi die mang 114 MB bộ đệm L2, nâng toàn bộ gói lên 228 MB L2.

Ký ức là nơi thiết kế trở nên đặc biệt thú vị. LX2 bao gồm tám ngăn "bộ nhớ băng thông cao" trên gói với tổng dung lượng 32 GB với băng thông 4 TB/s. Các nhà phân tích tại Chips and Cheese, người đã báo cáo chi tiết điểm chuẩn, lưu ý rằng bộ nhớ này "có thể không phải là HBM thông thường" và có thể là sản phẩm phát triển bản địa của Trung Quốc, vì 32 GB là nhỏ bất thường đối với bộ xử lý ở quy mô này. Mỗi LX2 cũng được hỗ trợ bởi bộ nhớ DDR5 256 GB như một mức lan tỏa lớn hơn.

Ở cấp độ nút, mỗi nút điện toán chứa hai CPU LX2 được ghép nối với mạng 800 Gbps, cho tổng băng thông kết nối trên mỗi nút là 1,6 terabit/giây. Tám nút được nhóm thành một lưỡi tính toán, với mười sáu lưỡi kết hợp thành một giá đỡ — một cấu trúc liên kết dày đặc, có lượng fanout cao giải thích cách một thiết kế chỉ dành cho CPU đạt được thông lượng exascale. Việc phụ thuộc vào silicon dựa trên Arm tùy chỉnh thay vì GPU là một sự khác biệt có chủ ý với kế hoạch chi tiết do Nvidia thống trị mà gần như mọi hệ thống hàng đầu khác đều tuân theo.

Những con số đằng sau vương miện

Ở cấp độ hệ thống, LineShine đã đạt được hiệu suất FP64 (Rmax) duy trì ở mức 2,198 exaflop trên điểm chuẩn HPL, vượt xa mức đỉnh lý thuyết (Rpeak) là 2,735 exaflop. Hệ thống này tiêu thụ 42,22 megawatt điện trong quá trình chạy, mang lại hiệu suất 52,07 gigaflop mỗi watt — kém xa so với 73,28 gigaflop mỗi watt của người dẫn đầu Green500, nhưng được mô tả là ấn tượng đối với một chiếc máy chỉ có CPU.

Điều quan trọng, LineShine không chỉ đơn thuần là một chuyên gia về điểm chuẩn. Nó cũng khẳng định vị trí số một trong tiêu chuẩn HPCG, một bài kiểm tra khắt khe hơn phản ánh tốt hơn hiệu suất ứng dụng trong thế giới thực, với kết quả là 22,004 petaflop mỗi giây. Điều đó đã đánh bại người dẫn đầu HPCG trước đây, El Capitan của Phòng thí nghiệm quốc gia Lawrence Livermore, đạt 17,406 petaflop mỗi giây. Phân tích của Chips and Cheese lưu ý rằng "không giống như các siêu máy tính trước đây của Trung Quốc, hệ thống này không chỉ là một LINPACK-đặc biệt."

Sự trở lại lâu dài của Trung Quốc

Sự vắng mặt của Trung Quốc trong TOP500 là điều dễ thấy. Sau khi Mỹ trừng phạt một số trung tâm siêu máy tính của Trung Quốc vào năm 2021, các tổ chức của Trung Quốc phần lớn đã ngừng gửi kết quả vào danh sách, ngay cả khi họ vẫn tiếp tục xây dựng hệ thống. Khoảng cách 9 năm – phân tích ghi ngày đệ trình chính thức gần đây nhất là vào khoảng năm 2017 – khiến phương Tây không chắc chắn về việc hoạt động sản xuất chip nội địa của Trung Quốc đã thực sự tiến triển đến mức nào.

Mục LineShine trả lời câu hỏi đó một cách dứt khoát. Việc sử dụng bộ xử lý Armv9 tùy chỉnh với bộ nhớ băng thông rộng trong nước rõ ràng cho thấy Trung Quốc đã xây dựng một hệ thống tính toán song song khả thi mà không phụ thuộc vào GPU Nvidia hoặc HBM tiêu chuẩn từ các nhà cung cấp thông thường của Hàn Quốc. Đối với một ngành công nghiệp AI đang buộc phải tìm giải pháp thay thế cho các biện pháp kiểm soát xuất khẩu chip của Hoa Kỳ, sự tồn tại của nền tảng HPC cạnh tranh trong nước có sức nặng vượt xa thứ hạng siêu máy tính - nó chứng tỏ rằng các chuỗi cung ứng bị trừng phạt có thể được thay thế, ít nhất là ở cấp độ cao của điện toán truyền thống.

Các động lực khác trong danh sách

Danh sách TOP500 thứ 67 bao gồm những thay đổi đáng chú ý khác. Hệ thống HPC7 của Eni ở Ý đứng ở vị trí thứ sáu, đạt được 571,5 petaflop hiệu suất FP64 trên cùng nền tảng HPE Cray EX4000 và các APU AMD Instinct MI300A được El Capitan sử dụng, nhưng ở khoảng 30% quy mô của nó. Với HPC7, Ý hiện có nhiều máy tính được liệt kê trong TOP500 hơn bất kỳ quốc gia châu Âu nào khác, vượt qua Đức, quốc gia vẫn giữ hệ thống exascale duy nhất khác của châu Âu.

Danh sách này cũng đánh dấu một sự chuyển đổi thể chế. Tập đoàn ISC đã thông báo sẽ chuyển giao quyền quản lý danh sách TOP500 cho ACM SIGHPC, nghĩa là các bảng xếp hạng trong tương lai sẽ mang số DOI chuyên dụng, giúp việc tham khảo các phiên bản cụ thể của danh sách trong công việc học tập trở nên dễ dàng hơn.

Đối với thế giới siêu máy tính, kết quả của LineShine là một lời cảnh tỉnh. Trung Quốc không chỉ quay trở lại bảng xếp hạng mà còn trở lại vị trí dẫn đầu với silicon cây nhà lá vườn và kiến ​​trúc thoát khỏi khuôn mẫu thống trị bởi GPU.

Đi trước AI

Từ siêu máy tính exascale đến chip AI thế hệ tiếp theo, AI Buzz Wire đề cập đến phần cứng hỗ trợ trí tuệ nhân tạo trong tương lai.

Đọc thêm tin tức về AI →