ប្រទេស​ចិន​បាន​ដណ្តើម​តំណែង​កំពូល​ក្នុង​បញ្ជី TOP500 នៃ​កុំព្យូទ័រ​ទំនើប​លឿន​បំផុត​របស់​ពិភពលោក​ជា​លើក​ដំបូង​ក្នុង​រយៈពេល​ជិត​មួយ​ទសវត្សរ៍​។ ប្រព័ន្ធនេះត្រូវបានគេហៅថា LineShine និងមានទីតាំងនៅ Shenzhen បានបង្ហាញខ្លួនជាលើកដំបូងនៅចំណាត់ថ្នាក់ទី 67 នៃចំណាត់ថ្នាក់ដែលត្រូវបានបង្ហាញនៅក្នុងសន្និសីទ ISC 2026 នៅទីក្រុង Hamburg ប្រទេសអាល្លឺម៉ង់។

លទ្ធផលនេះគឺជាព្រឹត្តិការណ៍ដ៏សំខាន់មួយមិនត្រឹមតែសម្រាប់ដំណើរការឆៅប៉ុណ្ណោះទេ ប៉ុន្តែសម្រាប់អ្វីដែលវាបង្ហាញអំពីភាពគ្រប់គ្រាន់ដោយខ្លួនឯងរបស់ប្រទេសចិននៅក្នុងកុំព្យូទ័រដែលមានប្រសិទ្ធភាពខ្ពស់។ សម្រាប់ [ការអភិវឌ្ឍន៍ផ្នែករឹង AI ចុងក្រោយបង្អស់] (https://aibuzzwire.news) និងការគ្របដណ្តប់លើកុំព្យូទ័រទំនើប ធាតុ LineShine គឺជាការដាក់ស្នើ TOP500 ផ្លូវការលើកដំបូងរបស់ប្រទេសចិនក្នុងរយៈពេលប្រាំបួនឆ្នាំ។

ស៊ីភីយូតែមួយគត់

អ្វីដែលធ្វើឱ្យ LineShine មិនធម្មតាគឺស្ថាបត្យកម្មរបស់វា។ ប្រព័ន្ធនេះគឺផ្អែកលើស៊ីភីយូទាំងស្រុង - មិនមាន GPUs ។ វាត្រូវបានបង្កើតឡើងជុំវិញប្រព័ន្ធដំណើរការផ្ទាល់ខ្លួនដែលហៅថា LX2 ដែលជាបន្ទះឈីបអនុលោមតាម Armv9 ជាមួយនឹងការគាំទ្រសម្រាប់ផ្នែកបន្ថែម SVE2 និង SME ។ កញ្ចប់ LX2 នីមួយៗមានស្នូលសកម្មចំនួន 304 ដែលដំណើរការនៅ 1.55 GHz ដោយផ្តល់នូវការដកស្រង់ 60.3 teraflops នៃ FP64 compute នៅ 690 វ៉ាត់ក្នុងមួយរន្ធ។

បន្ទះឈីបនេះត្រូវបានបង្កើតឡើងពីកុំព្យូទ័រពីរដែលងាប់ ដែលនីមួយៗមានចង្កោម 40-core ចំនួនបួន។ ស្នូលពីរក្នុងមួយចង្កោមត្រូវបានបិទសម្រាប់ទិន្នផល ដោយបន្សល់ទុក 38 ស្នូលសកម្មក្នុងមួយចង្កោម និង 152 ក្នុងមួយចង្កោម។ ការស្លាប់នីមួយៗផ្ទុកឃ្លាំងសម្ងាត់ L2 ចំនួន 114 MB ដោយនាំយកកញ្ចប់ពេញលេញទៅ 228 MB នៃ L2 ។

ការចងចាំគឺជាកន្លែងដែលការរចនាទទួលបានការចាប់អារម្មណ៍ជាពិសេស។ LX2 រួមបញ្ចូលចំនួនប្រាំបីនៃ "អង្គចងចាំកម្រិតបញ្ជូនខ្ពស់" នៅលើកញ្ចប់ដែលមានទំហំសរុប 32 GB ជាមួយនឹងកម្រិតបញ្ជូន 4 TB/s ។ អ្នកវិភាគនៅ Chips and Cheese ដែលបានរាយការណ៍ពីព័ត៌មានលម្អិតគោលបានកត់សម្គាល់ថាអង្គចងចាំនេះគឺ "ទំនងជាមិនមែនជា HBM ធម្មតា" ហើយអាចជាការអភិវឌ្ឍន៍របស់ជនជាតិដើមចិន ដោយសារទំហំ 32 GB គឺតូចខុសពីធម្មតាសម្រាប់ដំណើរការនៃមាត្រដ្ឋាននេះ។ LX2 នីមួយៗក៏ត្រូវបានគាំទ្រដោយអង្គចងចាំ 256 GB នៃ DDR5 ដែលជាកម្រិតធំជាង។

នៅកម្រិតថ្នាំង កុំព្យូទ័រនីមួយៗមានស៊ីភីយូ LX2 ពីរដែលផ្គូផ្គងជាមួយបណ្តាញ 800 Gbps សម្រាប់ការរួមបញ្ចូលគ្នា 1.6 តេរ៉ាប៊ីតក្នុងមួយវិនាទីនៃកម្រិតបញ្ជូនអន្តរកម្មក្នុងមួយថ្នាំង។ ថ្នាំងចំនួនប្រាំបីត្រូវបានដាក់ជាក្រុមទៅជាបន្ទះកុំព្យូទ័រ ដោយមានដាវចំនួនដប់ប្រាំមួយរួមបញ្ចូលគ្នាចូលទៅក្នុង rack មួយ - ដង់ស៊ីតេខ្ពស់ និងអ្នកគាំទ្រខ្ពស់ដែលពន្យល់ពីរបៀបដែលការរចនាសម្រាប់តែស៊ីភីយូឈានដល់កម្រិត exascale ។ ការពឹងផ្អែកលើស៊ីលីកុនដែលមានមូលដ្ឋានលើដៃផ្ទាល់ខ្លួនជាជាង GPUs គឺជាការបង្វែរដោយចេតនាពីប្លង់មេដែលគ្រប់គ្រងដោយ Nvidia ដែលស្ទើរតែគ្រប់ប្រព័ន្ធលំដាប់កំពូលផ្សេងទៀតធ្វើតាម។

លេខនៅពីក្រោយក្រោន

នៅកម្រិតប្រព័ន្ធ LineShine សម្រេចបាននូវការគាំទ្រ 2.198 exaflops នៃការអនុវត្ត FP64 (Rmax) នៅលើ HPL benchmark ចេញពីកំពូលទ្រឹស្តី (Rpeak) នៃ 2.735 exaflops ។ ប្រព័ន្ធនេះទាញថាមពលបាន 42.22 មេហ្គាវ៉ាត់ ក្នុងអំឡុងពេលដំណើរការ ដែលផ្តល់ប្រសិទ្ធភាព 52.07 ជីហ្គាហ្វ្លូបក្នុងមួយវ៉ាត់ ដែលនៅពីក្រោយ 73.28 ជីហ្គាហ្វ្លូប ក្នុងមួយវ៉ាត់ អ្នកដឹកនាំ Green500 ប៉ុន្តែត្រូវបានពិពណ៌នាថាគួរឱ្យចាប់អារម្មណ៍សម្រាប់ម៉ាស៊ីនតែស៊ីភីយូ។

សំខាន់ LineShine មិនមែនគ្រាន់តែជាអ្នកឯកទេសគោលទេ។ វាក៏បានទាមទារតំណែងលេខមួយនៅលើស្តង់ដារ HPCG ដែលជាការធ្វើតេស្តទាមទារកាន់តែច្រើនដែលឆ្លុះបញ្ចាំងឱ្យឃើញកាន់តែប្រសើរឡើងនូវការអនុវត្តកម្មវិធីក្នុងពិភពពិត ជាមួយនឹងលទ្ធផលនៃ 22.004 petaflops ក្នុងមួយវិនាទី។ នោះបានផ្តួលអ្នកដឹកនាំ HPCG មុនគឺលោក Lawrence Livermore National Laboratory's El Capitan ដែលបានទទួលពិន្ទុ 17.406 petaflops ក្នុងមួយវិនាទី។ ការវិភាគ Chips and Cheese បានកត់សម្គាល់ថា "មិនដូចកុំព្យូទ័រទំនើបរបស់ចិនពីមុនទេ ប្រព័ន្ធនេះមិនមែនគ្រាន់តែជា LINPACK-special ប៉ុណ្ណោះទេ"។

ការត្រលប់មកវិញដ៏យូររបស់ប្រទេសចិន

អវត្តមានរបស់ប្រទេសចិនពី TOP500 ត្រូវបានគេមើលឃើញយ៉ាងច្បាស់។ បន្ទាប់ពីសហរដ្ឋអាមេរិកបានដាក់ទណ្ឌកម្មមជ្ឈមណ្ឌលកុំព្យូទ័រទំនើបរបស់ចិនជាច្រើននៅឆ្នាំ 2021 ស្ថាប័នចិនភាគច្រើនបានបញ្ឈប់ការបញ្ជូនលទ្ធផលទៅក្នុងបញ្ជី បើទោះបីជាពួកគេបន្តបង្កើតប្រព័ន្ធក៏ដោយ។ គម្លាតរយៈពេលប្រាំបួនឆ្នាំ - ការវិភាគកំណត់កាលបរិច្ឆេទនៃការដាក់ស្នើជាផ្លូវការចុងក្រោយប្រហែល 2017 - បានធ្វើឱ្យលោកខាងលិចមិនច្បាស់លាស់អំពីថាតើការផលិតបន្ទះសៀគ្វីក្នុងស្រុករបស់ប្រទេសចិនពិតជារីកចម្រើនដល់កម្រិតណា។

ធាតុ LineShine ឆ្លើយសំណួរនោះយ៉ាងម៉ឺងម៉ាត់។ ការប្រើប្រាស់ប្រព័ន្ធដំណើរការ Armv9 ផ្ទាល់ខ្លួនជាមួយនឹងអង្គចងចាំដែលមានកម្រិតបញ្ជូនខ្ពស់ក្នុងស្រុកបង្ហាញថាប្រទេសចិនបានបង្កើតជង់កុំព្យូទ័រប៉ារ៉ាឡែលដែលអាចសម្រេចបាន ដែលមិនពឹងផ្អែកលើ Nvidia GPUs ឬស្តង់ដារ HBM ពីអ្នកផ្គត់ផ្គង់កូរ៉េធម្មតា។ សម្រាប់ឧស្សាហកម្ម AI ដែលត្រូវបានបង្ខំឱ្យស្វែងរកដំណោះស្រាយសម្រាប់ការគ្រប់គ្រងការនាំចេញបន្ទះឈីបរបស់សហរដ្ឋអាមេរិក អត្ថិភាពនៃវេទិកា HPC ក្នុងស្រុកដែលមានការប្រកួតប្រជែងមានទម្ងន់លើសពីចំណាត់ថ្នាក់នៃកុំព្យូទ័រទំនើប - វាបង្ហាញថាខ្សែសង្វាក់ផ្គត់ផ្គង់ដែលមានទណ្ឌកម្មអាចត្រូវបានជំនួស យ៉ាងហោចណាស់នៅចុងកម្រិតខ្ពស់នៃការគណនាបែបប្រពៃណី។

ការផ្លាស់ប្តូរផ្សេងទៀតនៅក្នុងបញ្ជី

បញ្ជី TOP500 ទី 67 រួមបញ្ចូលការផ្លាស់ប្តូរគួរឱ្យកត់សម្គាល់ផ្សេងទៀត។ ប្រព័ន្ធ HPC7 របស់ Eni នៅក្នុងប្រទេសអ៊ីតាលីបានចូលដល់លេខ 6 ដោយសម្រេចបាន 571.5 petaflops នៃការអនុវត្ត FP64 នៅលើវេទិកា HPE Cray EX4000 ដូចគ្នា និង AMD Instinct MI300A APUs ដែលប្រើដោយ El Capitan ប៉ុន្តែប្រហែល 30% នៃទំហំរបស់វា។ ជាមួយនឹង HPC7 អ៊ីតាលីឥឡូវនេះមានការគណនាច្រើនជាងក្នុងបញ្ជី TOP500 ជាងប្រទេសនៅអឺរ៉ុបផ្សេងទៀត ដោយកាត់ចេញពីប្រទេសអាល្លឺម៉ង់ ដែលនៅតែរក្សាប្រព័ន្ធ exascale តែមួយគត់របស់អឺរ៉ុប។

បញ្ជីនេះក៏បានសម្គាល់ការផ្លាស់ប្តូរស្ថាប័នផងដែរ។ ISC Group បានប្រកាសថា ខ្លួននឹងប្រគល់ការគ្រប់គ្រងបញ្ជី TOP500 ដល់ ACM SIGHPC ដែលមានន័យថា ចំណាត់ថ្នាក់នាពេលអនាគតនឹងមានលេខ DOI ដែលខិតខំប្រឹងប្រែង ធ្វើឱ្យវាកាន់តែងាយស្រួលក្នុងការយោងការបោះពុម្ពជាក់លាក់នៃបញ្ជីនៅក្នុងការងារសិក្សា។

សម្រាប់ពិភពកុំព្យូទ័រទំនើប លទ្ធផល LineShine គឺជាការដាស់តឿន។ ប្រទេស​ចិន​មិន​គ្រាន់​តែ​បាន​វិល​មក​កាន់​ចំណាត់​ថ្នាក់​វិញ​ទេ ពោល​គឺ​វា​បាន​ត្រឡប់​មក​វិញ​នៅ​លំដាប់​កំពូល​វិញ​ដោយ​មាន​ស៊ីលីកុន​ផលិត​នៅ​ស្រុក និង​ស្ថាបត្យកម្ម​ដែល​បំបែក​ចេញ​ពី​ផ្សិត​ដែល​គ្រប​ដណ្ដប់​ដោយ GPU។

នាំមុខ AI

ពីកុំព្យូទ័រទំនើប exascale ទៅបន្ទះឈីប AI ជំនាន់ក្រោយ AI Buzz Wire គ្របដណ្តប់លើផ្នែករឹងដែលផ្តល់ថាមពលដល់អនាគតនៃបញ្ញាសិប្បនិម្មិត។

អានព័ត៌មាន AI បន្ថែម →