Intel បានបើកសន្និសិទ Hot Chips នៅឆ្នាំនេះជាមួយនឹងការជ្រមុជទឹកយ៉ាងជ្រៅទៅក្នុងកោះអឌ្ឍចន្ទ ដែលជាមជ្ឈមណ្ឌលទិន្នន័យ GPU ដែលវាត្រូវបានភ្នាល់សម្រាប់ដំណាក់កាលបន្ទាប់នៃបន្ទុកការងារ AI៖ ការសន្និដ្ឋានភ្នាក់ងារ។ បង្ហាញដោយ Chief Enterprise AI Systems Architect Sumit Mohan និង Intel Fellow Hong Jiang កិច្ចពិភាក្សាផ្តោតលើរង្វាស់បីដែលក្រុមហ៊ុននិយាយថាកំណត់យុគសម័យភ្នាក់ងារ - ថូខឹនក្នុងមួយវ៉ាត់ សមត្ថភាពចងចាំធំ និងជង់កម្មវិធីបើកចំហ។

ពេលវេលាសំខាន់។ Nvidia បានប្រើសន្និសិទដូចគ្នានេះដើម្បីរៀបរាប់លម្អិតអំពីប្រព័ន្ធជញ្ជីង Vera Rubin NVL72 របស់ខ្លួន ហើយរាល់អ្នកលក់ឧបករណ៍បង្កើនល្បឿននៅ Hot Chips 2026 ឥឡូវនេះកំពុងបង្កើនប្រសិទ្ធភាពជាជាងដំណើរការកំពូលឆៅ។ ចម្លើយរបស់ Intel គឺជាផ្នែកមួយដែលផ្លាស់ប្តូរបច្ចេកវិទ្យាមេម៉ូរីដែល AI GPUs ប្រើប្រាស់សម្រាប់អ្វីដែលថោកជាងក្នុងមួយជីហ្គាបៃ ហើយវាធ្វើឱ្យមានតួលេខគួរឱ្យចាប់អារម្មណ៍។ For more context on this story, see our ongoing breaking AI news.

កាត PCIe ទំហំ 480GB មានកម្លាំង 350 វ៉ាត់

Crescent Island គឺជាកុំព្យូទ័រ PCIe GPU ដែលមានកម្លាំង 350 វ៉ាត់។ កាតយីហោរបស់ក្រុមហ៊ុន Intel ដឹកជញ្ជូនជាមួយអង្គចងចាំ 160GB នៃ LPDDR5X ប៉ុន្តែការរចនានេះអនុញ្ញាតឱ្យដៃគូ ODM បង្កើតវ៉ារ្យ៉ង់ដែលមានរហូតដល់ 480GB នៅលើយន្តហោះ - ប្រហែលបីដងនៃសមត្ថភាពនៃកាតបង្កើនល្បឿនកម្រិតខ្ពស់ធម្មតា ហើយគ្រប់គ្រាន់ដើម្បីរក្សាឃ្លាំងសម្ងាត់ KV ដែលមានទំហំធំសម្រាប់បរិបទវែង និងបន្ទុកការងារភ្នាក់ងារពហុវគ្គ។ ការរចនាគ្របដណ្តប់ប្រភេទទិន្នន័យចាប់ពី FP4 និង MXFP4 ឡើងទៅរហូតដល់ FP64 ។

ជម្រើសនៃការចងចាំគឺជាការសម្រេចចិត្តជាយុទ្ធសាស្ត្រនៅក្នុងផលិតផល។ LPDDR5X ជួញដូរកម្រិតបញ្ជូនសម្រាប់សមត្ថភាព និងថ្លៃដើម ដែលសមនឹងទម្រង់បន្ទុកការងារដែលសន្មត់ថា បង្អួចបរិបទដ៏ធំ និងរង្វិលជុំហៅឧបករណ៍ប្រើប្រាស់សមត្ថភាពអង្គចងចាំច្រើនជាងការគណនាឆៅ។ Intel រៀបចំការរចនាទាំងមូលជុំវិញ "tokens per watt" - ផ្តល់នូវទិន្នផលដែលមានប្រយោជន៍ច្រើនជាងក្នុងមួយឯកតានៃថាមពល ជាជាងការឈ្នះការប្រៀបធៀប peak-FLOPS ។

Xe3P Silicon: 32 Cores, 256 XMX Engines

នៅក្រោមក្រណាត់ Crescent Island គឺជាស្ថាបត្យកម្ម Xe3P របស់ Intel ហើយ Intel បានបង្ហាញវាថាជាការលោតផ្លោះជំនាន់មួយលើជំនាន់ Xe2 ដែលមានមូលដ្ឋានលើ Battlemage ។ កន្លែងដែល Xe2 ផ្តល់ 20 Xe cores និង 4-deep systolic XMX array, Crescent Island នាំមកនូវ 32 Xe cores និង 16-deep systolic array ដោយផ្តល់អាហារដល់ម៉ាស៊ីន XMX សរុបចំនួន 256 ។

ផ្នែកបន្ថែម Xe Matrix ជំនាន់ទី 3 បន្ថែមការរចនាម៉ាទ្រីស Xe ដែលបានពង្រីកបីផ្លូវជាមួយនឹងបញ្ហាសហការភាពជាក់លាក់ FP4 និងការគាំទ្រ FP64 ។ ស្នូល Xe នីមួយៗផ្ទុកឯកសារចុះឈ្មោះទូទៅ 1MB និងឃ្លាំងសម្ងាត់ 512KB នៃ L1 ជាមួយនឹង L2 បង្រួបបង្រួមទំហំ 32MB ដែលចែករំលែកនៅទូទាំងឧបករណ៍។ ម៉ាស៊ីនមេឌៀដែលមានឧបករណ៍ឌិកូដចំនួនបួន និងឧបករណ៍បំប្លែងចំនួនបួនអង្គុយនៅជាប់គ្នា ហើយ SoC ទាំងមូលភ្ជាប់នៅលើ PCIe Gen5 x16 ជាមួយនឹងការគាំទ្រសម្រាប់ការពង្រីកលើក្រណាត់កុងតាក់បើកចំហ។ ក្រុមហ៊ុន Intel រាយបញ្ជីថាមពលទំនេរសកម្ម 50 វ៉ាត់ ឬតិចជាងនេះនៅក្នុងរដ្ឋ G0 និងប្រហែល 10 វ៉ាត់នៅក្នុងរដ្ឋ G8 ថាមពលទាប ដែលសម្រេចបានតាមរយៈដែនថាមពលចែកចាយ រ៉ោតទ័របណ្តាញនៅលើបន្ទះឈីបដែលមានកញ្ចប់ព័ត៌មានដែលមាននាឡិការោទិ៍ និងផ្លូវដែក DVFS ឯករាជ្យសម្រាប់ក្រាហ្វិក និងមេឌៀ។

លក្ខណៈពិសេស RAS ត្រូវបានខ្ចីពី Server Playbook

សម្រាប់ផ្នែកមជ្ឈមណ្ឌលទិន្នន័យ វិស្វកម្មភាពអាចជឿជាក់បានទទួលបានដំណាក់កាលច្រើនដូចការបញ្ជូន - ប្រធានបទ Nvidia ក៏បានភ្ជាប់ជាមួយ Vera Rubin ផងដែរ។ កោះអឌ្ឍចន្ទមាន ECC និងភាពស្មើគ្នានៅទូទាំងរចនាសម្ព័ន្ធអង្គចងចាំសំខាន់ៗ កំហុសក្នុងការពិនិត្យលើរាល់ការភ្ជាប់ទំនាក់ទំនងខាងក្នុង ភាពមិនដំណើរការនៃទំព័រថាមវន្ត ការជួសជុលកញ្ចប់ក្រោយរឹង និងការរាយការណ៍កំហុសកម្រិតខ្ពស់ PCI Express ។ ក្រុមហ៊ុន Intel និយាយថាការរួមបញ្ចូលគ្នានេះកាត់បន្ថយអំពើពុករលួយទិន្នន័យស្ងាត់ ដែលជារបៀបបរាជ័យដែលមានសារៈសំខាន់បំផុតសម្រាប់ការសន្និដ្ឋានដែលមិនមានការយកចិត្តទុកដាក់យូរអង្វែង។

Intel ក៏បានដាក់ទីតាំងផ្នែកនេះនៅក្នុងផលប័ត្រដែលលាតសន្ធឹងពី Arc Pro workstation GPUs តាមរយៈ SambaNova SN50 RDUs ដែលខ្លួនទទួលបានដោយមាន Crescent Island ជាយុថ្កាមជ្ឈមណ្ឌលទិន្នន័យសហគ្រាសនៅផ្នែកខាងលើ។ ក្រុមហ៊ុន​បាន​បង្ហាញ​ពី​ខ្សែ​បន្ទាត់​ផែនទី​បង្ហាញ​ផ្លូវ​ដែល​ដំណើរការ​ជាង​ប្រាំមួយ​ឆ្នាំ​មក​ហើយ ដោយ​ដាក់ GPU ជា​ការ​រចនា​ជំនាន់​ទី​បី​ដែល​ចាស់ទុំ​ជាង​ការ​ព្យាយាម​លើក​ដំបូង។ កាតនេះត្រូវបានដាក់បង្ហាញជាលើកដំបូងនៅ Computex ក្នុងខែមិថុនា។ Hot Chips បានផ្តល់ព័ត៌មានលម្អិតអំពីស្ថាបត្យកម្មនៅពីក្រោយវា។

ហេតុអ្វីបានជា Agentic Inference ពេញចិត្តការរចនានេះ។

អាគុយម៉ង់បន្ទុកការងារគឺជាផ្នែកគួរឱ្យចាប់អារម្មណ៍បំផុតនៃទីលានរបស់ Intel ។ Agentic AI - ម៉ូដែលដែលឧបករណ៍ខ្សែសង្វាក់ហៅទូរសព្ទ បើកបរិបទវែងៗ និងសំរបសំរួលរវាង CPU និង GPU - បង់ពន្ធភាពយឺតយ៉ាវ សមត្ថភាពអង្គចងចាំ និងដំណើរការប្រព័ន្ធក្នុងពេលដំណាលគ្នា ជាជាងទម្រង់ការបញ្ជូនបន្តនៃការបម្រើ chatbot ។ សមត្ថភាព KV-cache សម្រាប់បរិបទវែង និងវគ្គដំណាលគ្នានៃដែនដែលបានបង្ហាប់ត្រូវបានបង្កើតឡើងនៅក្នុងការរចនា SoC យ៉ាងច្បាស់លាស់។

ស៊ុមនោះក៏ពន្យល់ពីការភ្នាល់ LPDDR5X ផងដែរ។ ប្រសិនបើរលកបន្ទាប់នៃ AI compute គឺជាភ្នាក់ងារដែលស្រេកឃ្លានការចងចាំជាជាងការហ្វឹកហាត់ នោះកាត 480GB នៅ 350 វ៉ាត់គឺជាជម្រើសដ៏គួរឱ្យទុកចិត្តមួយសម្រាប់ផ្នែកដែលមានមូលដ្ឋានលើ HBM - ផ្តល់ជូនជង់កម្មវិធី។ ការសង្កត់ធ្ងន់របស់ Intel លើជង់បើកចំហ និងក្រណាត់កុងតាក់បើកចំហគឺសំដៅលើអ្នកទិញដោយប្រយ័ត្នប្រយែងចំពោះការចាក់សោរវេទិការួមបញ្ចូលគ្នារបស់ Nvidia ។

កោះ Crescent នឹងមិនផ្លាស់ប្តូរឧបករណ៍បង្កើនល្បឿនហ្វឹកហាត់ដែលគ្របដណ្តប់លើចំណងជើង AI ទេ ហើយ Intel មិនបានបង្ហាញពីតម្លៃ ឬភាពអាចរកបាននៅក្នុងសន្និសីទនោះទេ។ ប៉ុន្តែជាសេចក្តីថ្លែងការណ៍នៃកន្លែងដែល Intel គិតថាការសន្និដ្ឋាននឹងទៅ - ការចងចាំខ្លាញ់, ថាមពលគ្មានខ្លាញ់, ក្រណាត់បើកចំហ - វាគឺជារឿងរ៉ាវស្ថាបត្យកម្មដ៏ច្បាស់លាស់មួយនៃ Hot Chips នៅឆ្នាំនេះ។

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →