중국이 거의 10년 만에 처음으로 세계에서 가장 빠른 슈퍼컴퓨터 TOP500 목록에서 1위를 탈환했습니다. 선전에 위치한 LineShine이라는 시스템은 독일 함부르크에서 열린 ISC 2026 컨퍼런스에서 공개된 제67차 순위에서 1위로 데뷔했습니다.

그 결과는 원시 성능뿐만 아니라 고성능 컴퓨팅 분야에서 중국의 자급자족을 나타내는 이정표입니다. 최신 AI 하드웨어 개발 및 슈퍼컴퓨팅 보도에 대해 LineShine 출품작은 9년 만에 중국이 처음으로 공식 TOP500 제출을 기록했습니다.

CPU만으로 이루어진 거대 기업

LineShine을 특이하게 만드는 것은 아키텍처입니다. 시스템은 완전히 CPU 기반이며 GPU가 없습니다. SVE2 및 SME 확장을 지원하는 Armv9 호환 칩인 LX2라는 맞춤형 프로세서를 기반으로 구축되었습니다. 각 LX2 패키지는 1.55GHz에서 실행되는 304개의 활성 코어를 포함하여 소켓당 690와트에서 60.3테라플롭스의 FP64 컴퓨팅을 제공합니다.

이 칩은 각각 4개의 40코어 클러스터를 포함하는 2개의 컴퓨팅 다이로 구성됩니다. 클러스터당 2개의 코어는 수율을 위해 비활성화되어 클러스터당 38개의 활성 코어와 다이당 152개의 코어를 남깁니다. 각 다이에는 114MB의 L2 캐시가 포함되어 전체 패키지를 228MB의 L2 캐시로 가져옵니다.

메모리는 디자인이 특히 흥미로워지는 부분입니다. LX2에는 총 32GB, 4TB/s의 대역폭을 갖춘 8개의 온패키지 "고대역폭 메모리" 스택이 포함되어 있습니다. 벤치마크 세부 사항을 보고한 Chips and Cheese의 분석가는 이 메모리가 "기존 HBM이 아닐 가능성이 높으며" 32GB가 이 규모의 프로세서에 비해 비정상적으로 작다는 점을 고려하면 중국 고유의 개발일 수 있다고 지적했습니다. 각 LX2는 또한 더 큰 스필오버 계층으로 256GB의 DDR5 메모리로 지원됩니다.

노드 수준에서 각 컴퓨팅 노드에는 800Gbps 네트워킹과 쌍을 이루는 2개의 LX2 CPU가 탑재되어 노드당 상호 연결 대역폭이 초당 1.6테라비트에 이릅니다. 8개의 노드가 하나의 컴퓨팅 블레이드로 그룹화되고 16개의 블레이드가 하나의 랙으로 결합됩니다. 이는 CPU 전용 설계가 엑사급 처리량에 도달하는 방법을 설명하는 밀도 높은 팬아웃 토폴로지입니다. GPU가 아닌 맞춤형 Arm 기반 실리콘에 대한 의존은 거의 모든 다른 최상위 시스템이 따르는 Nvidia가 지배하는 청사진과의 의도적인 차이입니다.

왕관 뒤의 숫자

시스템 수준에서 LineShine은 이론적 최고치(Rpeak) 2.735엑사플롭 중 HPL 벤치마크에서 FP64 성능(Rmax)의 지속적인 2.198엑사플롭을 달성했습니다. 이 시스템은 실행 중에 42.22메가와트의 전력을 소비하여 와트당 52.07기가플롭의 효율을 얻었습니다. 이는 Green500 리더의 와트당 73.28기가플롭에 비해 훨씬 뒤떨어졌지만 CPU 전용 시스템에서는 인상적이라고 설명됩니다.

결정적으로 LineShine은 단순한 벤치마크 전문가가 아닙니다. 또한 실제 애플리케이션 성능을 더 잘 반영하는 더욱 까다로운 테스트인 HPCG 벤치마크에서도 초당 22.004페타플롭의 결과로 1위를 차지했습니다. 이는 이전 HPCG 리더인 로렌스 리버모어 국립 연구소(Lawrence Livermore National Laboratory)의 엘 캐피탄(El Capitan)을 능가한 초당 17.406페타플롭스입니다. Chips and Cheese 분석에서는 "이전 중국 슈퍼컴퓨터와 달리 이 시스템은 단지 LINPACK만의 특별한 시스템이 아닙니다"라고 지적했습니다.

중국의 장기 복귀

TOP500에서 중국의 부재가 눈에 띄게 나타났습니다. 미국이 2021년 여러 중국 슈퍼컴퓨팅 센터를 제재한 후, 중국 기관들은 시스템 구축을 계속하면서도 목록에 결과를 제출하는 것을 대부분 중단했습니다. 9년 간의 격차(분석에 따르면 마지막 공식 제출이 대략 2017년으로 추정됨)로 인해 서구는 중국의 국내 칩 제조가 실제로 얼마나 발전했는지에 대해 불확실해졌습니다.

LineShine 항목은 그 질문에 단호하게 대답합니다. 국내 고대역폭 메모리가 탑재된 맞춤형 Armv9 프로세서를 사용하는 것은 중국이 일반적인 한국 공급업체의 Nvidia GPU 또는 표준 HBM에 의존하지 않는 실행 가능한 병렬 컴퓨팅 스택을 구축했음을 시사합니다. 미국 칩 수출 통제를 위한 해결 방법을 찾아야만 했던 AI 산업의 경우, 경쟁력 있는 국내 HPC 플랫폼의 존재는 슈퍼컴퓨팅 순위를 훨씬 뛰어넘는 중요한 의미를 갖습니다. 이는 적어도 기존 컴퓨팅의 최고급 수준에서는 승인된 공급망을 대체할 수 있음을 보여줍니다.

목록에 있는 다른 이사업체

67번째 TOP500 목록에는 다른 주목할만한 변화가 포함되었습니다. 이탈리아에 있는 Eni의 HPC7 시스템은 El Capitan이 사용하는 동일한 HPE Cray EX4000 플랫폼 및 AMD Instinct MI300A APU에서 571.5페타플롭의 FP64 성능을 달성했지만 규모는 약 30%에 불과하여 6위로 진입했습니다. 이제 HPC7을 통해 이탈리아는 다른 유럽 국가보다 TOP500에 더 많은 컴퓨팅 성능을 보유하게 되었으며, 여전히 유럽 유일의 엑사스케일 시스템을 보유하고 있는 독일을 앞지르고 있습니다.

이 목록은 또한 제도적 전환을 표시했습니다. ISC 그룹은 TOP500 목록의 관리권을 ACM SIGHPC에 넘길 것이라고 발표했습니다. 이는 향후 순위에 전용 DOI 번호가 포함되어 학술 작업에서 목록의 특정 버전을 더 쉽게 참조할 수 있음을 의미합니다.

슈퍼컴퓨팅 세계에서 LineShine 결과는 경종을 울립니다. 중국은 단순히 순위만 돌아온 것이 아닙니다. 자체 개발한 실리콘과 GPU 중심의 틀에서 벗어난 아키텍처를 바탕으로 최상위권으로 돌아왔습니다.

AI보다 앞서 나가세요

엑사스케일 슈퍼컴퓨터부터 차세대 AI 칩까지, AI Buzz Wire에서는 인공지능의 미래를 뒷받침하는 하드웨어를 다룹니다.

AI 뉴스 자세히 보기 →