China a recuperat primul loc pe lista TOP500 a celor mai rapide supercomputere din lume pentru prima dată în aproape un deceniu. Sistemul, numit LineShine și situat în Shenzhen, a debutat pe locul unu la cea de-a 67-a ediție a clasamentului, care a fost dezvăluit la conferința ISC 2026 din Hamburg, Germania.

Rezultatul este o piatră de hotar nu doar pentru performanța brută, ci și pentru ceea ce semnalează despre autosuficiența Chinei în calculul de înaltă performanță. Pentru cele mai recente dezvoltări hardware AI și acoperirea supercalculaturii, intrarea LineShine marchează prima depunere oficială TOP500 a Chinei în nouă ani.

Un gigant numai pentru procesor

Ceea ce face LineShine neobișnuit este arhitectura sa. Sistemul este în întregime bazat pe CPU - fără GPU. Este construit în jurul unui procesor personalizat numit LX2, un cip compatibil Armv9 cu suport pentru extensii SVE2 și SME. Fiecare pachet LX2 include 304 de nuclee active care rulează la 1,55 GHz, oferind 60,3 teraflopi de calcul FP64 la 690 de wați per soclu.

Cipul este construit din două matrițe de calcul, fiecare conținând patru clustere cu 40 de nuclee. Două nuclee per cluster sunt dezactivate pentru randament, lăsând 38 de nuclee active per cluster și 152 per die. Fiecare matriță poartă 114 MB de cache L2, aducând pachetul complet la 228 MB de L2.

Memoria este locul în care designul devine deosebit de interesant. LX2 include opt stive de „memorie cu lățime de bandă mare” în pachet, totalizând 32 GB cu lățime de bandă de 4 TB/s. Analiștii de la Chips and Cheese, care au raportat detaliile de referință, au remarcat că această memorie „probabil să nu fie un HBM convențional” și ar putea fi o dezvoltare autohtonă chineză, având în vedere că 32 GB sunt neobișnuit de mici pentru un procesor de această scară. Fiecare LX2 este, de asemenea, susținut de 256 GB de memorie DDR5, ca un nivel de spillover mai mare.

La nivel de nod, fiecare nod de calcul găzduiește două procesoare LX2 asociate cu 800 Gbps de rețea, pentru o lățime de bandă de interconectare combinată de 1,6 terabiți pe secundă per nod. Opt noduri sunt grupate într-o lamă de calcul, cu șaisprezece lame combinându-se într-un rack - o topologie densă, cu fanout mare, care explică modul în care un design numai pentru CPU ajunge la o capacitate exascale. Dependența de siliciul personalizat bazat pe Arm, mai degrabă decât de GPU-uri, este o divergență deliberată față de modelul dominat de Nvidia pe care îl urmează aproape orice alt sistem de top.

Numerele din spatele coroanei

La nivel de sistem, LineShine a atins un nivel susținut de 2,198 exaflopi de performanță FP64 (Rmax) la benchmark-ul HPL, dintr-un vârf teoretic (Rpeak) de 2,735 exaflopi. Sistemul a consumat 42,22 megawați de putere în timpul rulării, producând o eficiență de 52,07 gigaflopi pe watt - cu mult în urma celor 73,28 gigaflopi pe watt ai liderului Green500, dar descris ca fiind impresionant pentru o mașină doar cu CPU.

În mod esențial, LineShine nu este doar un specialist de referință. De asemenea, a revendicat poziția numărul unu în benchmarkul HPCG, un test mai solicitant care reflectă mai bine performanța aplicațiilor din lumea reală, cu un rezultat de 22,004 petaflopi pe secundă. Aceasta l-a învins pe precedentul lider HPCG, El Capitan de la Lawrence Livermore National Laboratory, care a marcat 17,406 petaflopi pe secundă. Analiza Chips and Cheese a remarcat că „spre deosebire de supercalculatoarele chineze anterioare, acest sistem nu este doar un LINPACK-special”.

Întoarcerea lungă a Chinei

Absența Chinei din TOP500 a fost evidentă. După ce SUA au sancționat mai multe centre de supercalculatură chineze în 2021, instituțiile chineze au încetat în mare măsură să trimită rezultate pe listă, chiar dacă au continuat să construiască sisteme. Decalajul de nouă ani – analiza datează ultima transmitere oficială în aproximativ 2017 – a lăsat Occidentul nesigur cu privire la cât de departe a progresat efectiv fabricarea de cipuri din China.

Intrarea LineShine răspunde decisiv la această întrebare. Utilizarea unui procesor Armv9 personalizat cu memorie internă cu lățime de bandă mare sugerează că China a construit o stivă de calcul paralelă viabilă, care nu se bazează pe GPU-uri Nvidia sau HBM standard de la furnizorii coreeni obișnuiți. Pentru o industrie de inteligență artificială care a fost forțată să găsească soluții pentru controalele exporturilor de cipuri din SUA, existența unei platforme HPC naționale competitive are o greutate mult dincolo de clasamentele de supercomputing - demonstrează că lanțurile de aprovizionare sancționate pot fi înlocuite, cel puțin la vârful de calcul tradițional.

Alte mutări de pe listă

Cea de-a 67-a listă TOP500 a inclus și alte schimbări notabile. Sistemul HPC7 al Eni din Italia a intrat pe locul șase, atingând 571,5 petaflopi de performanță FP64 pe aceeași platformă HPE Cray EX4000 și APU-uri AMD Instinct MI300A utilizate de El Capitan, dar la aproximativ 30% din scara sa. Cu HPC7, Italia are acum mai multe calculatoare listate pe TOP500 decât orice altă țară europeană, depășind Germania, care încă deține singurul alt sistem exascale din Europa.

Lista a marcat și o tranziție instituțională. Grupul ISC a anunțat că va preda administrarea listei TOP500 către ACM SIGHPC, ceea ce înseamnă că clasamentele viitoare vor avea numere DOI dedicate, ușurând referirea la ediții specifice ale listei în activitatea academică.

Pentru lumea supercalculaturii, rezultatul LineShine este un semnal de alarmă. China nu doar a revenit în clasament, ci a revenit chiar în frunte, cu siliciu de origine și o arhitectură care se rupe de tipul dominat de GPU.

Rămâi înaintea AI

De la supercalculatoare exascale la cipurile AI de generație următoare, AI Buzz Wire acoperă hardware-ul care alimentează viitorul inteligenței artificiale.

Citiți mai multe știri AI →