Inception Labs បានចេញផ្សាយ Mercury 2.5 កាលពីថ្ងៃអង្គារ ដែលជាកំណែថ្មីនៃគំរូភាសាផ្សព្វផ្សាយពាណិជ្ជកម្មរបស់ខ្លួន ដែលក្រុមហ៊ុនពណ៌នាថាជា LLM ដែលមានសមត្ថភាពបំផុតនៅលើទីផ្សារ ហើយតាមចំនេះដឹងរបស់វា គឺជាគំរូភាសាចែកចាយដ៏ធំបំផុតដែលមិនធ្លាប់បានបណ្តុះបណ្តាល។ យោងតាមការប្រកាសរបស់ក្រុមហ៊ុន ម៉ូដែលនេះផ្តល់នូវការបង្កើនភាពវៃឆ្លាត 40% ជាង Mercury 2 ជំនាន់មុនរបស់ខ្លួន ខណៈពេលដែលរក្សាទម្រង់នៃការបម្រើតម្លៃទាបដូចគ្នា ដែលធ្វើឲ្យស្ថាបត្យកម្មផ្សព្វផ្សាយមានភាពទាក់ទាញសម្រាប់បរិមាណការងារខ្ពស់។

ក្រុមហ៊ុនដែលដឹកនាំដោយនាយកប្រតិបត្តិ Stefano Ermon អះអាងថា Mercury 2.5 អាចប្រៀបធៀបទៅនឹងម៉ូដែលព្រំដែនដែលមានតម្លៃថ្លៃបំផុត រួមមាន GPT-5.6 Luna (Low), Gemini 3.5 Flash-Lite និង Claude Haiku 4.5 ។ ការប្រៀបធៀបទាំងនោះត្រូវបានរាយការណ៍ដោយអ្នកលក់ ហើយមិនទាន់ត្រូវបានផ្ទៀងផ្ទាត់ដោយស្តង់ដារឯករាជ្យនៅឡើយទេ ប៉ុន្តែពួកគេដាក់គំរូនៃការសាយភាយ ដែលជាការចង់ដឹងចង់ឃើញពីការស្រាវជ្រាវដ៏យូរមួយ ដែលជាជម្រើសផលិតកម្មចំពោះអ្នកកាន់តំណែង autoregressive ។ សម្រាប់ព័ត៌មានអំពីគំរូ AI ចុងក្រោយបំផុត សូមតាមដានការគ្របដណ្តប់គំរូដែលកំពុងដំណើរការរបស់ AI Buzz Wire ។ [ព័ត៌មានគំរូ AI ចុងក្រោយ] (https://aibuzzwire.news)

ល្បឿន បរិបទ និងតម្លៃ

លេខចំណងជើងគឺឈ្លានពាន។ Inception Labs និយាយថា Mercury 2.5 បង្កើត 1,107 tokens ក្នុងមួយវិនាទីនៅលើ NVIDIA GPUs ដែលមានយ៉ាងទូលំទូលាយ ជាមួយនឹងបង្អួចបរិបទនៃ 260,000 tokens។ តម្លៃត្រូវបានកំណត់ត្រឹម 0.20 ដុល្លារក្នុងមួយលានធាតុបញ្ចូល និង 0.75 ដុល្លារក្នុងមួយលាននិមិត្តសញ្ញាទិន្នផល ជាមួយនឹងការផ្សព្វផ្សាយការបញ្ចុះតម្លៃម៉ូដែល 80% ទៅ 0.04 ដុល្លារក្នុងមួយលានបញ្ចូល និង 0.15 ដុល្លារក្នុងមួយលានទិន្នផល។

នៅផ្នែកខាងសមត្ថភាព ម៉ូដែលបញ្ជូនជាមួយហេតុផលដែលអាចកែតម្រូវបាន — អនុញ្ញាតឱ្យអ្នកអភិវឌ្ឍន៍ធ្វើពាណិជ្ជកម្មភាពយឺតយ៉ាវសម្រាប់ភាពស៊ីជម្រៅលើមូលដ្ឋានសំណើនីមួយៗ — រួមជាមួយនឹងការហៅឧបករណ៍ស្របគ្នា និងលទ្ធផល JSON ដែលតម្រឹមតាមគ្រោងការណ៍សម្រាប់ជំនាន់ដែលមានរចនាសម្ព័ន្ធ។ ក្រុមហ៊ុនបានកំណត់ការចេញផ្សាយជាលទ្ធផលដំបូងនៃរង្វិលជុំបណ្តុះបណ្តាលដែលជំរុញដោយតេឡេម៉ែត្រផលិតកម្ម៖ ចាប់តាំងពី Mercury 2 បានចាប់ផ្តើម អ្នកអភិវឌ្ឍន៍រាប់ពាន់នាក់បានសាងសង់ជាមួយវា សហគ្រាសរាប់សិបបានដាក់ពង្រាយវា ហើយការប្រើប្រាស់បានកើនឡើងលើសពីលំដាប់នៃរ៉ិចទ័រ។

ហេតុអ្វី​បាន​ជា​គំរូ Diffusion បង្កើត​អត្ថបទ​លឿន​ជាង

Mainstream LLMs ពី OpenAI, Google និង Anthropic គឺមានលក្ខណៈស្វ័យប្រវត្តិ៖ ពួកគេបង្កើតអត្ថបទមួយក្នុងពេលតែមួយ ដោយនិមិត្តសញ្ញានីមួយៗមានលក្ខខណ្ឌលើអ្វីគ្រប់យ៉ាងដែលបានបង្កើតមុនវា។ ភាពអាស្រ័យបន្តបន្ទាប់គ្នានោះធ្វើឱ្យជាន់រឹងមួយនៅក្រោមល្បឿននៃជំនាន់។ គំរូភាសានៃការសាយភាយ ជំនួសមកវិញដោយចាប់ផ្តើមដោយប្លុកនៃសំលេងរំខាន ហើយធ្វើការកែតម្រូវឡើងវិញនូវសញ្ញាសម្ងាត់ទាំងអស់ស្របគ្នា ដែលអនុញ្ញាតឱ្យមានដំណើរការខ្ពស់ជាងនៅលើផ្នែករឹង GPU ធម្មតា នៅពេលដែលគំរូនេះត្រូវបានបណ្តុះបណ្តាលឱ្យបញ្ចូលគ្នាយ៉ាងស្អាត។

ការដោះដូរមានគុណភាពជាប្រវត្តិសាស្ត្រ៖ គំរូនៃការសាយភាយបានតាមពីក្រោយ autoregressive លើការវែកញែក និងការណែនាំដែលធ្វើតាមគោលការណ៍ណែនាំ។ ការភ្នាល់ស្នូលរបស់ Inception Labs — និងការទាមទារដែលផ្អែកលើ Mercury 2.5 — គឺថាគម្លាតនេះបានរួមតូចដល់ចំណុចដែលការសាយភាយឈ្នះលើអ័ក្ស អតិថិជនភាគច្រើនពិតជាមានអារម្មណ៍ថា៖ ភាពយឺតយ៉ាវ និងតម្លៃនៅបរិមាណផលិតកម្ម។

ផលិតកម្មទាមទារពីអតិថិជនដំបូង

ការប្រកាសនេះពឹងផ្អែកខ្លាំងទៅលើការដាក់ឱ្យប្រើប្រាស់របស់អតិថិជនជាជាងតារាងគោល។ OpenCall ដែលបង្កើតភ្នាក់ងារទូរស័ព្ទ AI សម្រាប់ការហៅទូរសព្ទផ្ទាល់របស់អតិថិជនបានរាយការណ៍ថាការផ្លាស់ប្តូរទៅ Mercury បាននាំមកនូវភាពយឺតយ៉ាវនៃការឆ្លើយតបគំរូជាមធ្យមរបស់វាដល់ប្រហែល 170 មីលីវិនាទី។ Oliver Silverstein សហស្ថាបនិក និងជានាយកប្រតិបត្តិរបស់ OpenCall បាននិយាយថា ពេលវេលាឆ្លើយតប P99 របស់ក្រុមហ៊ុនបានធ្លាក់ចុះពីច្រើននាទីទៅមួយវិនាទី ហើយជាមធ្យមរបស់វាពី 0.4 វិនាទីទៅក្រោម 0.2 — តួលេខដែលគាត់បានពិពណ៌នាថាលឿនជាងអ្នកផ្តល់សេវាផ្សេងទៀតដែលក្រុមហ៊ុនបានសាកល្បង រួមទាំងការបើកហេតុផលផងដែរ។

Augment Code ដែលជាអ្នកបង្កើតជំនួយការសរសេរកូដ AI ប្រើ Mercury សម្រាប់ការបង្រួមបរិបទ ការកំណត់ផ្លូវគំរូ និងការស្វែងរកឧបករណ៍ MCP ។ យោងតាម ​​Inception Labs ការផ្លាស់ប្តូរបន្ទុកការងារបង្រួមទៅ Mercury កាត់បន្ថយភាពយឺតនៃជំហាននោះ 82% ពីប្រហែល 150 វិនាទីទៅ 27 វិនាទី ហើយកាត់បន្ថយការចំណាយរបស់វា 90% ខណៈពេលដែលរក្សាគុណភាព។ ករណីប្រើប្រាស់បង្ហាញអំពីកន្លែងដែលសេដ្ឋកិច្ចខាំ៖ ភ្នាក់ងារសរសេរកូដបង្កើតការហៅទូរសព្ទគំរូតូចៗជាច្រើននៅជុំវិញជំនាន់បឋមនីមួយៗ និងភាពយឺតយ៉ាវ និងការចំណាយលើការហៅទូរសព្ទទាំងនោះ។

NVIDIA ដែលផ្នែករឹងដំណើរការម៉ូដែលនេះក៏មានទម្ងន់ផងដែរ។ Shruti Koparkar អ្នកគ្រប់គ្រងជាន់ខ្ពស់នៃផលិតផលនៅក្នុងក្រុម Accelerated Computing Group របស់ NVIDIA បាននិយាយថា Inception មានគំរូភាសាដែលមានមូលដ្ឋានលើការសាយភាយកម្រិតខ្ពស់នៅលើហេដ្ឋារចនាសម្ព័ន្ធ NVIDIA AI ហើយការបង្កើនគុណភាពរបស់ Mercury 2.5 ជាមួយនឹងល្បឿនប្រកបដោយនិរន្តរភាពបង្ហាញពីរបៀបដែលប្រព័ន្ធស្ថាបត្យកម្មថ្មីអាចដំណើរការបានយ៉ាងឆាប់រហ័ស។

ការមើលជាមុននូវសំឡេងបារត និងរ៉ោតទ័របារត

ទន្ទឹមនឹងម៉ូដែលនេះ ក្រុមហ៊ុន Inception Labs បានប្រកាសពីការមើលជាមុននៃផលិតផលថ្មីចំនួនពីរ។ Mercury Voice គឺជាការចែកចាយ LLM ដែលត្រូវបានធ្វើឱ្យប្រសើរសម្រាប់ភ្នាក់ងារសំឡេងដែលមានថវិកាយឺតយ៉ាវបំផុត ពេលវេលាផ្សាយពាណិជ្ជកម្មពីសញ្ញាសម្ងាត់ទៅទីមួយក្រោម 170 មីលីវិនាទី។ រ៉ោតទ័រ Mercury ប្រើគំរូនៃការសាយភាយដើម្បីយល់ពីការជម្រុញចូល ហើយបញ្ជូនវាទៅម៉ូដែលណាមួយ — បើក ឬបិទ — ផ្តល់នូវការលាយបញ្ចូលគ្នាដ៏ល្អបំផុតនៃគុណភាព ល្បឿន និងតម្លៃ ដោយដាក់ទីតាំង Inception ជាស្រទាប់ខាងលើដៃគូប្រកួតប្រជែងរបស់វា ក៏ដូចជាមួយក្នុងចំណោមពួកវាផងដែរ។

Mercury 2.5 អាចរកបានតាមរយៈ API ផ្ទាល់របស់ Inception ក៏ដូចជាតាមរយៈ Baseten និង OpenRouter ។ ការដាក់ពង្រាយសហគ្រាសបន្ថែមសមត្ថភាពជាក់លាក់ ការធ្វើមាត្រដ្ឋានដោយស្វ័យប្រវត្តិ ការត្រួតពិនិត្យការអនុលោម និងការរក្សាទិន្នន័យដែលអាចកំណត់រចនាសម្ព័ន្ធបាន។ ក្រុមហ៊ុនកំពុងផ្តល់ជូន 100 លានថូខឹនដោយឥតគិតថ្លៃដល់អ្នកអភិវឌ្ឍន៍សាកល្បង API ។

ក្រុមហ៊ុនក៏បាននិយាយផងដែរថា ខ្លួនបានចាប់ផ្តើមបណ្តុះបណ្តាលគំរូបន្ទាប់របស់ខ្លួនរួចហើយ ដែលជាទំហំធំបំផុតរបស់វា ដែលត្រូវបានកំណត់គោលដៅសម្រាប់ការចេញផ្សាយនៅប៉ុន្មានខែខាងមុខនេះ ដែលវាពិពណ៌នាថាជាការកើនឡើងនៃសមត្ថភាពដែលមិនបោះបង់ល្បឿននៃការសាយភាយ ឬប្រសិទ្ធភាពសញ្ញាសម្ងាត់ឡើយ។ ប្រសិនបើការទាមទារនោះរក្សា សម្ពាធលើអ្នកកាន់តំណែងដែលគ្រប់គ្រងដោយស្វ័យប្រវត្តិនឹងត្រូវបានគេដឹងជាលើកដំបូងនៅក្នុងកម្រិតទំនិញនៃទីផ្សារ ដែលតម្លៃនិងភាពយឺតយ៉ាវសម្រេចចិត្តលើកិច្ចសន្យាភាគច្រើន។

[បន្តទៅមុខនៃ AI] (https://aibuzzwire.news)

តាមដានការវិវឌ្ឍន៍ AI ចុងក្រោយបង្អស់ និងការទម្លាយព័ត៌មានបញ្ញាសិប្បនិមិត្ត នៅពេលដែលស្ថាបត្យកម្មគំរូថ្មីប្រកួតប្រជែងក្នុងការផលិត។

អានព័ត៌មាន AI បន្ថែម →