ក្រុមហ៊ុនបានប្រកាសនៅថ្ងៃទី 24 ខែសីហា ឆ្នាំ 2026 ក្នុងអំឡុងពេលសន្និសីទ Hot Chips ។ បន្ទះឈីបដែលជាផ្នែកបន្ថែមនៃវេទិកា Vera Rubin របស់ Nvidia បានផ្តល់កំណត់ត្រាលទ្ធផល 3,400 និមិត្តសញ្ញាក្នុងមួយវិនាទីនៅក្នុងការប្រៀបធៀបការវិភាគសិប្បនិម្មិត ខណៈពេលដែលដំណើរការនូវប្រភពបើកចំហរ Gemma 4 31B model ជាមួយនឹងបង្អួចបរិបទ 100,000-token សកម្ម ដែលជាដំណើរការលឿនបំផុតមិនធ្លាប់មានសម្រាប់ម៉ូដែលនោះ។
ការបើកដំណើរការនេះគឺជាព្រឹត្តិការណ៍ដ៏សំខាន់បំផុតនៃផលិតផលដែលមិនទាន់បានមកពីការទិញយក Nvidia $ 20 ពាន់លានដុល្លាររបស់អ្នកជំនាញការសន្និដ្ឋាន Groq ដែលជាកិច្ចព្រមព្រៀងដែលក្រុមហ៊ុនឥឡូវនេះកំពុងផ្លាស់ប្តូរទៅជាទុនលើតម្រូវការសម្រាប់ការកើនឡើងនៃការសន្និដ្ឋានទាប។ ស្ថានីយទូរទស្សន៍ CNBC បានរាយការណ៍ថា Nvidia និយាយថា ស៊ុបភើ Groq ដំបូងនឹងដាក់លក់នៅលើអ៊ីនធឺណិតមុនដំណាច់ឆ្នាំនេះ។ សម្រាប់បរិបទបន្ថែមអំពីរឿងនេះ សូមមើល [ការគ្របដណ្តប់ឧស្សាហកម្ម AI] (https://aibuzzwire.news) ដែលកំពុងដំណើរការរបស់យើង។
ហេតុអ្វីបានជាការបង្កើតថូខឹនមានល្បឿនលឿន
ប្រព័ន្ធ AI ភ្នាក់ងារ - កម្មវិធីដែលហេតុផល ឧបករណ៍ហៅទូរសព្ទ សរសេរ និងសាកល្បងកូដ ហើយធ្វើម្តងទៀតឆ្លងកាត់រាប់រយ ឬរាប់ពាន់ជំហាននៃការសន្និដ្ឋាន - បង្កើតបរិមាណដ៏ធំសម្បើមនៃនិមិត្តសញ្ញាលទ្ធផល។ ល្បឿនដែលសញ្ញាសម្ងាត់ទាំងនោះត្រូវបានផលិត ដែលគេស្គាល់ថាជាអន្តរកម្ម ឬឆ្លងកាត់ការឌិកូដ កំណត់ថាតើភ្នាក់ងារអាចបញ្ចប់ជំហាននីមួយៗនៃការងាររបស់វាបានលឿនប៉ុណ្ណា។
Nvidia និយាយថា Groq 3 LPX ផ្តល់នូវការឆ្លើយតបលឿនជាង 4x សម្រាប់ភ្នាក់ងារ និងបន្ទុកការងារដែលងាយនឹងបង្កហេតុជាងវេទិកាជំនួសដែលនៅជិតបំផុត។ នៅក្នុងការដាក់ពង្រាយចម្រុះគ្នា ប្រព័ន្ធ Vera Rubin NVL72 ដោះស្រាយការបញ្ចូលបរិបទ និងការគណនាការបំពេញជាមុន ខណៈពេលដែលអង្គភាព Groq 3 LPX ដំណើរការដំណាក់កាលបង្កើតសញ្ញាសម្ងាត់ដែលប្រកាន់អក្សរតូចធំ។
លោក Jensen Huang ស្ថាបនិក និងជានាយកប្រតិបត្តិនៃ Nvidia បាននិយាយនៅក្នុងសេចក្តីប្រកាសថា "ការសន្និដ្ឋានគឺជាម៉ាស៊ីនរីកចម្រើននៃ AI" ។ "Vera Rubin ពង្រីកចក្ខុវិស័យនោះជាមួយនឹងការកំណត់រចនាសម្ព័ន្ធរោងចក្រ AI ដែលត្រូវបានធ្វើឱ្យប្រសើរឡើងនូវបន្ទុកការងារដែលបានរចនាឡើងសម្រាប់យុគសម័យនៃភ្នាក់ងារ AI ដោយជំរុញការអនុវត្តព្រំដែនជាមួយ LPX សម្រាប់ការបង្កើតនិមិត្តសញ្ញាដែលមានល្បឿនលឿនបំផុត។"
នៅខាងក្នុង Hardware
យោងតាមការវិភាគបច្ចេកទេសរបស់ StorageReview ថាសគណនាត្រជាក់ 2U នីមួយៗផ្ទុកនូវ Groq 3 LPUs ចំនួន 16 រួមជាមួយ CPU ម៉ាស៊ីន តក្កវិជ្ជាពង្រីកក្រណាត់ និង DRAM បូករួមទាំង BlueField-4 DPU ឬកាតបណ្តាញ ConnectX-9 ។ ថាសនេះមានតំណភ្ជាប់អុបទិកពីបន្ទះឈីបទៅបន្ទះឈីប 32 LPU និងអ៊ីសឺរណិត 400Gb/s នៅលើបន្ទះខាងមុខ។
នៅឯមាត្រដ្ឋាន rack ការដាក់ពង្រាយ Groq 3 LPX រួមបញ្ចូលឧបករណ៍បង្កើនល្បឿនដល់ទៅ 256 LP30 ដែលភ្ជាប់តាមរយៈការភ្ជាប់ទំនាក់ទំនងដោយផ្ទាល់ពីបន្ទះឈីបទៅបន្ទះឈីបដែលមានល្បឿនលឿន។ បន្ទះដាក់ចូលទៅក្នុងហេដ្ឋារចនាសម្ព័ន្ធរោងចក្រ Vera Rubin AI ដ៏ទូលំទូលាយរបស់ Nvidia ដែលក្រុមហ៊ុនពិពណ៌នាថាជាវេទិកាទូលំទូលាយបំផុតដែលមិនធ្លាប់មាន៖ បន្ទះសៀគ្វីចំនួនប្រាំពីរដាច់ដោយឡែកពីគ្នាលើការកំណត់រចនាសម្ព័ន្ធ rack ដែលបង្កើតឡើងក្នុងគោលបំណងចំនួនប្រាំ រួមមាន BlueField-4 DPUs, Vera CPU racks, Vera BlueField-4 STX storage, និង Spectrum-6 SPX networking E.
Nvidia ក៏បានធ្វើបច្ចុប្បន្នភាពការអះអាងអំពីការអនុវត្តកម្រិតវេទិការបស់ខ្លួនផងដែរ ដោយបញ្ជាក់ថា Vera Rubin NVL72 ផ្តល់ថាមពលដល់ទៅ 30 ដងនៃថូខឹនក្នុងមួយមេហ្កាវ៉ាត់ បើធៀបនឹង GB300 NVL72 លើបន្ទុកការងារសរសេរកូដភ្នាក់ងារ 140,000 ជាមួយនឹងអត្ថប្រយោជន៍កាន់តែទូលំទូលាយនៅពេលដែលគោលដៅអន្តរកម្មរបស់អ្នកប្រើប្រាស់កើនឡើង។
តារាងពិន្ទុជាមួយសញ្ញាផ្កាយ
ចំណងជើងលេខ 3,400 ថូខឹនក្នុងមួយវិនាទី ភ្ជាប់មកជាមួយការព្រមានដែលគួរកត់សម្គាល់។ ដូចដែល StorageReview បានចង្អុលបង្ហាញ លទ្ធផលរបស់ Nvidia ត្រូវបានវាស់វែងលើចំណុចបញ្ចប់នៃការចេញផ្សាយមុនឯកជននៅថ្ងៃទី 21 ខែសីហា ខណៈពេលដែលចំនួនប្រកួតប្រជែងដែលវាត្រូវបានប្រៀបធៀបគឺមកពីចំណុចបញ្ចប់ផលិតកម្មដែលមិនមានម៉ាស៊ីនមេ។ ការអនុវត្តជាក់ស្តែងលើសេវាកម្មដែលមានជាទូទៅអាចខុសគ្នាពីការកំណត់រចនាសម្ព័ន្ធស្តង់ដារកំណត់កំណត់ត្រា។
ទោះបីជាយ៉ាងណាក៏ដោយ អង្គការចាត់តាំងឯករាជ្យ ការវិភាគសិប្បនិម្មិតបានកត់ត្រាលទ្ធផលថាជាល្បឿនដែលវាស់វែងបំផុតមិនធ្លាប់មានសម្រាប់ Gemma 4 31B នៅប្រវែងបរិបទនោះ ហើយការទាមទារមូលដ្ឋាន - ស៊ីលីកុនដែលបង្កើតឡើងក្នុងគោលបំណងអាចពន្លឿនដំណាក់កាលនៃការឌិកូដនៃការសន្និដ្ឋានបានយ៉ាងខ្លាំង - ស្របតាមរបៀបដែលឧស្សាហកម្មនេះត្រូវបានធ្វើស្ថាបត្យកម្មឡើងវិញសម្រាប់បន្ទុកការងារភ្នាក់ងារ។
ការអនុម័តលើពពកចាប់ផ្តើម
Nebius ដែលជា AI cloud ដែលមានទីស្នាក់ការកណ្តាលនៅទីក្រុង Amsterdam គឺជាអ្នកផ្តល់សេវាដំបូងគេដែលប្តេជ្ញាដាក់ពង្រាយ Groq 3 LPX ដោយគ្រោងនឹងនាំយកវាទៅក្នុងរោងចក្រ Nebius Token ដែលជាវេទិការសន្និដ្ឋានផលិតកម្មរបស់វា។
Danila Shtan ប្រធានផ្នែកបច្ចេកវិទ្យានៃក្រុមហ៊ុន Nebius បាននិយាយថា "ជំនាន់គឺជាដំណាក់កាលនៃការសន្និដ្ឋានដែលកំណត់ថាតើប្រព័ន្ធ AI ពិតជាមានការឆ្លើយតបយ៉ាងណា ហើយនោះជាអ្វីដែល NVIDIA Groq 3 LPX ត្រូវបានបង្កើតឡើងដើម្បីបង្កើនល្បឿន" ។ "ក្នុងនាមជាពពក AI ដំបូងដែលនាំវាទៅផលិតកម្មតាមរយៈរោងចក្រ Nebius Token យើងកំពុងធ្វើឱ្យប្រាកដថាគ្រប់ជំហាននៃរង្វិលជុំរបស់ភ្នាក់ងារមានអារម្មណ៍ភ្លាមៗ — តាមរយៈអ្នកអភិវឌ្ឍន៍ API ដូចគ្នាកំពុងប្រើប្រាស់រួចហើយ ដោយមិនមានការផ្លាស់ទីទៅជង់ថ្មីទេ។"
អ្នកផ្តល់ការសន្និដ្ឋាន Groq ដែលឥឡូវជាផ្នែកមួយនៃគ្រួសារ Nvidia គ្រោងនឹងស្ថិតក្នុងចំណោមអ្នកទទួលយកដំបូងបំផុតរបស់វេទិកា។
រូបភាពធំជាង
សេចក្តីប្រកាសអំពីការផលិតពេញលេញបង្ហាញពីរបៀបដែលទីផ្សារហេដ្ឋារចនាសម្ព័ន្ធ AI បានជំរុញយ៉ាងខ្លាំងពីការបណ្តុះបណ្តាលរហូតដល់ការសន្និដ្ឋាន។ នៅពេលដែលសហគ្រាសផ្លាស់ប្តូរថវិកាពីការបណ្តុះបណ្តាលមុនគំរូដើមឆ្ពោះទៅរកការវែកញែកក្នុងពេលវេលាជាក់ស្តែង និងការរៀបចំភ្នាក់ងារស្វយ័ត សេដ្ឋកិច្ចនៃសញ្ញាសម្ងាត់ - តើវាអាចបង្កើតបានលឿនប៉ុណ្ណា និងតម្លៃថាមពលអ្វី - បានក្លាយជាសមរភូមិប្រកួតប្រជែងកណ្តាល។
សម្រាប់ Nvidia, Groq 3 LPX ពង្រីកការការពារសិទ្ធិផ្តាច់មុខរោងចក្រ AI របស់ខ្លួននៅពេលមួយនៅពេលដែលស៊ីលីកុនផ្ទាល់ខ្លួនពីអ្នកផ្តល់សេវាពពក និងអ្នកចាប់ផ្តើមអាជីវកម្មដូចគ្នាកំពុងស្វែងរកបន្ទុកការងារការសន្និដ្ឋានដូចគ្នា។ Racks ដែលនឹងមកដល់តាមអ៊ិនធរណេតនៅឆ្នាំនេះ ដូចដែល CNBC បានរាយការណ៍នឹងដាក់ប្រព័ន្ធផលិតកម្មដំបូងនៅក្នុងដៃរបស់អតិថិជនជាច្រើនខែបន្ទាប់ពីការទិញបានបិទ ដែលជាការរួមបញ្ចូលយ៉ាងឆាប់រហ័សដោយស្តង់ដារឧស្សាហកម្ម semiconductor ។
ក្រុមហ៊ុនមិនបានបង្ហាញពីតម្លៃសម្រាប់ប្រព័ន្ធថ្មីនេះទេ។ Groq 3 LPX នឹងត្រូវបានផ្តល់ជូននៅលើមូលដ្ឋាននៅពេលណា និងប្រសិនបើមានតាមរយៈដៃគូ AI cloud ដោយ Nebius ត្រូវបានគេរំពឹងថានឹងក្លាយជាអ្នកដំបូងដែលផ្តល់ការចូលប្រើទៅកាន់អ្នកអភិវឌ្ឍន៍តាមរយៈចំណុចបញ្ចប់ API ដែលមានស្រាប់របស់វា។
---
ស្នាក់នៅមុន AIទទួលបានព័ត៌មាន AI ការវិភាគ និងរបកគំហើញចុងក្រោយបំផុត — ទាំងអស់នៅកន្លែងតែមួយ។
អានព័ត៌មាន AI បន្ថែម →