中国近十年来首次登上全球最快超级计算机TOP500榜首。该系统名为 LineShine,位于深圳,在德国汉堡 ISC 2026 会议上公布的第 67 届排名中首次排名第一。

这一结果不仅对于原始性能而言是一个里程碑,也标志着中国在高性能计算领域的自给自足。对于最新的人工智能硬件发展 和超级计算报道,LineShine 参赛标志着中国九年来首次正式提交 TOP500。

仅 CPU 巨头

LineShine 的与众不同之处在于它的架构。该系统完全基于 CPU,没有 GPU。它围绕名为 LX2 的定制处理器构建,这是一款兼容 Armv9 的芯片,支持 SVE2 和 SME 扩展。每个 LX2 封装包含 304 个运行频率为 1.55 GHz 的活动核心,每插槽 690 瓦的功率下可提供 60.3 teraflops 的 FP64 计算能力。

该芯片由两个计算芯片构成,每个芯片包含四个 40 核集群。为了提高产量,每个集群禁用两个核心,每个集群留下 38 个活动核心,每个芯片留有 152 个核心。每个芯片都带有 114 MB 的 L2 缓存,使整个封装达到 228 MB 的 L2。

内存是设计变得特别有趣的地方。 LX2 包括八个封装“高带宽内存”堆栈,总计 32 GB,带宽为 4 TB/s。 Chips and Cheese 的分析师报告了基准测试的详细信息,他们指出,这种内存“可能不是传统的 HBM”,并且可能是中国本土开发的,因为 32 GB 对于这种规模的处理器来说非常小。每个 LX2 还配备 256 GB DDR5 内存作为更大的溢出层。

在节点级别,每个计算节点都配有两个 LX2 CPU,与 800 Gbps 网络配对,每个节点的互连带宽总计为 1.6 太比特每秒。八个节点被分组为一个计算刀片,十六个刀片组合成一个机架——这是一种密集的高扇出拓扑,解释了仅 CPU 的设计如何达到百亿亿次吞吐量。对基于 Arm 的定制芯片而不是 GPU 的依赖是与几乎所有其他顶级系统都遵循的 Nvidia 主导蓝图的故意背离。

皇冠背后的数字

在系统层面,LineShine 在 HPL 基准测试中实现了 2.198 exaflops 的 FP64 性能 (Rmax),而理论峰值 (Rpeak) 为 2.735 exaflops。该系统在运行期间消耗了 42.22 兆瓦的功率,产生每瓦 52.07 gigaflops 的效率,远远落后于 Green500 领先者的每瓦 73.28 gigaflops,但对于仅使用 CPU 的机器来说,这令人印象深刻。

至关重要的是,LineShine 不仅仅是基准测试专家。它还在 HPCG 基准测试中排名第一,这是一项要求更高的测试,可以更好地反映实际应用程序性能,结果为每秒 22.004 petaflops。这击败了之前 HPCG 的领先者劳伦斯·利弗莫尔国家实验室的 El Capitan,后者的速度为每秒 17.406 petaflops。 Chips and Cheese 分析指出,“与之前的中国超级计算机不同,该系统不仅仅是 LINPACK 专用系统。”

中国的长远回报

中国在TOP500中的缺席十分引人注目。 2021年美国制裁多个中国超级计算中心后,中国机构基本上停止向该名单提交结果,尽管它们仍在继续建设系统。九年的差距——该分析的最后一次正式提交时间为 2017 年左右——让西方无法确定中国国内芯片制造实际上取得了多大进展。

LineShine 条目明确地回答了这个问题。使用定制的 Armv9 处理器和明显的国产高带宽内存表明中国已经构建了一个可行的并行计算堆栈,该堆栈不依赖于 Nvidia GPU 或通常韩国供应商的标准 HBM。对于被迫寻找美国芯片出口管制解决方案的人工智能行业来说,有竞争力的国内高性能计算平台的存在远远超出了超级计算排名——它表明受制裁的供应链是可以被取代的,至少在传统计算的高端领域是这样。

名单上的其他搬家公司

第 67 届 TOP500 榜单还包括其他值得注意的变化。 Eni 位于意大利的 HPC7 系统排名第六,在 El Capitan 使用的同一 HPE Cray EX4000 平台和 AMD Instinct MI300A APU 上实现了 571.5 petaflops 的 FP64 性能,但规模约为其规模的 30%。凭借 HPC7,意大利现在在 TOP500 上列出的计算量超过任何其他欧洲国家,超过了德国,后者仍然拥有欧洲唯一的其他百亿亿级系统。

该名单还标志着制度的转变。 ISC 集团宣布将把 TOP500 列表的管理权移交给 ACM SIGHPC,这意味着未来的排名将带有专用的 DOI 编号,以便在学术工作中更容易引用该列表的特定版本。

对于超级计算领域来说,LineShine 的结果是一个警钟。中国不仅重返排行榜,还凭借本土芯片和打破 GPU 主导模式的架构重回榜首。

保持人工智能领先地位

从百亿亿级超级计算机到下一代人工智能芯片,AI Buzz Wire 涵盖了为人工智能未来提供动力的硬件。

阅读更多人工智能新闻 →