Google បានដាក់ឱ្យដំណើរការ Gemini 3.8 Live និង Gemini 3.8 Live Extended Thinking ដែលជាគំរូនៃការសន្ទនាផ្ទាល់ដែលក្រុមហ៊ុនបានពិពណ៌នាថាមានភាពជឿនលឿនបំផុតសម្រាប់ការសន្ទនាតាមសំឡេងធម្មជាតិ។ ម៉ូដែលនេះបានចាប់ផ្តើមដាក់ឱ្យប្រើប្រាស់នៅថ្ងៃទី 15 ខែកញ្ញា នៅទូទាំង Gemini API, Google AI Studio, Search Live, Gemini Live និង Google Workspace ជាមួយនឹងការចូលប្រើសហគ្រាសនៅក្នុងការមើលជាមុនតាមរយៈ Gemini Enterprise ។

ការប្រកាសនេះបានមកពី Tom Ouyang ដែលជាវិស្វករសំខាន់ និង Malini Jaganathan សមាជិកបុគ្គលិកបច្ចេកទេស សរសេរក្នុងនាមក្រុម Gemini Audio។ វាពង្រីកគ្រួសារ Gemini 3.8 ដែលបានបង្ហាញខ្លួននៅដើមខែនេះជាមួយនឹងម៉ូដែល Flash និង Flash Cyber ​​ហើយវាកត់សម្គាល់ការជំរុញដ៏ខ្លាំងក្លាបំផុតរបស់ Google ចូលទៅក្នុងជំនួយសំឡេងពហុមុខងារក្នុងពេលវេលាជាក់ស្តែង ដែលជាទីផ្សារដែលរបៀបសំឡេងរបស់ OpenAI និងរលកនៃការចាប់ផ្តើមនៃការនិយាយកំពុងប្រកួតប្រជែងសម្រាប់ករណីប្រើប្រាស់ប្រចាំថ្ងៃដូចគ្នា។

ការដាក់ឱ្យដំណើរការនេះសមទៅនឹងការលាតសន្ធឹងដ៏ច្រើនសន្ធឹកសន្ធាប់សម្រាប់បន្ទាត់គំរូរបស់ Google ។ ការគ្របដណ្តប់នៃ [ការអភិវឌ្ឍ AI ចុងក្រោយបំផុត] (https://aibuzzwire.news) បង្ហាញថាក្រុមហ៊ុនឥឡូវនេះបានដឹកជញ្ជូនម្តងហើយម្តងទៀតក្នុងរយៈពេលពីរបីសប្តាហ៍ព្រោះវាប្រឆាំងនឹងគូប្រជែងលើតម្លៃ ការសរសេរកូដ និងសំឡេងឥឡូវនេះ។

បង្កើតឡើងសម្រាប់ការសន្ទនាតាមពេលវេលាជាក់ស្តែង

អ្វី​ដែល​ប្លែក​ពី​ម៉ូដែល​ផ្ទាល់​ពី​គំរូ​ជជែក​តាម​ស្តង់ដារ​ដែល​ភ្ជាប់​ជាមួយ​មីក្រូហ្វូន​គឺ​ភាព​យឺតយ៉ាវ និង​ស្ថានភាព។ ឯកសារ Live API របស់ Google ពិពណ៌នាអំពីចំណុចប្រទាក់ដែលមានភាពយឺតយ៉ាវទាប ដែលដំណើរការការផ្សាយជាបន្តនៃអូឌីយ៉ូ រូបភាព និងអត្ថបទតាមរយៈការតភ្ជាប់ WebSocket រដ្ឋ ទទួលយកអូឌីយ៉ូ PCM ឆៅ 16kHz រូបភាព JPEG ដល់ទៅមួយហ្វ្រេមក្នុងមួយវិនាទី និងអត្ថបទ និងត្រលប់មកវិញនូវអូឌីយ៉ូដែលនិយាយក្នុងពេលវេលាជាក់ស្តែង។

ម៉ូដែលដំណើរការការបញ្ចូលដែលមើលឃើញនៅជិតពេលវេលាជាក់ស្តែង ដោយអនុញ្ញាតឱ្យជំនួយការមើលឃើញនូវអ្វីដែលអ្នកប្រើឃើញ — វីដេអូបង្ហាញរបស់ Google បង្ហាញ Gemini 3.8 Live ណែនាំនិយោជិតដែលកំពុងឡើងជិះដោយប្រើបរិបទដែលមើលឃើញ លេងអុកក្នុងពេលជាក់ស្តែង និងបង្កើតផែនការអាជីវកម្មពេញលេញ និងប្រអប់ឧបករណ៍ទីផ្សារផ្ទាល់ខ្លួនតាមរយៈការនិយាយធម្មជាតិ។ ម៉ូដែលក៏អាចរកឃើញ និងផ្លាស់ប្តូររវាងភាសាដែលបានគាំទ្រចំនួន 97 ដោយស្វ័យប្រវត្តិ ពាក់កណ្តាលការសន្ទនា ដោយមិនចាំបាច់ប្តូរការកំណត់របស់អ្នកប្រើនោះទេ។

ប្រហែលជាសំខាន់បំផុតសម្រាប់ការប្រើប្រាស់ជាក់ស្តែង៖ ម៉ូដែលដំណើរការឧបករណ៍ និងការហៅ API នៅក្នុងផ្ទៃខាងក្រោយ ខណៈពេលដែលការសន្ទនានៅតែបន្ត ទទួលស្គាល់សំណើ និងរក្សាការសន្ទនានៅពេលបញ្ចប់កិច្ចការ។ នោះប្រែក្លាយជំនួយការពីអ្នកឆ្លើយតបដែលមានមូលដ្ឋានយ៉ាងតឹងរ៉ឹងទៅជាអ្វីមួយដែលជិតស្និទ្ធនឹងភ្នាក់ងារដែលកើតឡើងដើម្បីនិយាយ។

លេខដែល Google កំពុងនិយាយ

Google រាយការណ៍ថា Gemini 3.8 Live Extended Thinking បានចាប់យកតំណែងរួមកំពូលនៅលើសន្ទស្សន៍គុណភាពនៃការនិយាយទៅការនិយាយរបស់ការវិភាគសិប្បនិម្មិតជាមួយនឹងពិន្ទុ 82.6 ។ នៅលើការបញ្ចប់ភារកិច្ចភ្នាក់ងារ ក្រុមហ៊ុនបានដកស្រង់ 68.6% លើ τ-Voice benchmark និង 35.1% លើការវាយតម្លៃ τ-Voice-banking របស់ Sierra រួមជាមួយនឹងពិន្ទុ 97.7% នៅលើ Big Bench Audio ។

ទាំងនេះគឺជាតួលេខដែលបានរាយការណ៍ផ្ទាល់របស់ Google ហើយការផ្ទៀងផ្ទាត់ឯករាជ្យនឹងត្រូវការពេលវេលា ប៉ុន្តែការទាមទារទៅលើតារាងនៃការវិភាគសិប្បនិម្មិត ប្រសិនបើវាមាននោះនឹងធ្វើឱ្យ Google នាំមុខការផ្តល់ជូនដែលបង្កើនប្រសិទ្ធភាពការនិយាយពី OpenAI និងក្រុមហ៊ុន AI សំលេងដែលខិតខំប្រឹងប្រែងលើគុណភាពនៃការសន្ទនារួម។ Google ក៏និយាយថា Extended Thinking រក្សាបាននូវចំណុចតម្លៃប្រកួតប្រជែងខ្ពស់ ដែលជាការងក់ក្បាលដោយចេតនាចំពោះសម្ពាធតម្លៃដែលបានកំណត់ជំនាន់ 3.8 ។

អូឌីយ៉ូទាំងអស់ដែលបង្កើតដោយម៉ូដែលនេះត្រូវបានសម្គាល់ដោយទឹក SynthID ដែលជាសញ្ញាសម្គាល់ទឹកដែលមិនអាចយល់បានរបស់ Google ដូច្នេះការនិយាយដែលបង្កើតដោយ AI នៅតែអាចរកឃើញបាន ដែលជាការការពារការអនុលោមតាមច្បាប់ និងព័ត៌មានមិនពិតដែលកំពុងក្លាយជាស្តង់ដារនៅទូទាំងផលិតផលបង្កើតរបស់ Google ។

កន្លែងដែលអ្នកអាចប្រើវាបាន

ភាពអាចរកបានខុសគ្នារវាងម៉ូដែលទាំងពីរ។ Gemini 3.8 Live គឺអាចរកបានសម្រាប់អ្នករាល់គ្នានៅខាងក្នុង Search Live ដែលជារបៀបស្វែងរកតាមពេលវេលាជាក់ស្តែងរបស់ Google ។ Extended Thinking មាននៅក្នុង Gemini Live ក្នុង Docs សម្រាប់អតិថិជន Google AI Pro និង Ultra តាមរយៈ Workspace និងនៅក្នុង Gmail និង Keep សម្រាប់អ្នកប្រើប្រាស់ Google ទាំងអស់។

អ្នកអភិវឌ្ឍន៍ទទួលបានគំរូតាមរយៈ Gemini API និង Google AI Studio ហើយ Google និយាយថា Live API ត្រូវបានប្រើប្រាស់រួចហើយដោយវេទិកានានារួមមាន Agora, Fishjam, LiveKit, Pipecat, Vercel និង Vision Agents ដើម្បីបង្កើតចំណុចប្រទាក់ដែលជំរុញដោយសំឡេងនៅលើហេដ្ឋារចនាសម្ព័ន្ធពេលវេលាជាក់ស្តែងរបស់ Google ។ Salesforce, Genspark និង Lumeris ត្រូវបានគេដាក់ឈ្មោះថាជាដៃគូចាប់ផ្តើមសម្រាប់ម៉ូដែលថ្មី។

ទីផ្សារ AI សម្លេងដ៏ច្រើនកុះករ

Voice កំពុងក្លាយជាសមរភូមិចំណុចប្រទាក់នៃឆ្នាំ 2026 ព្រោះវាជាកន្លែងដែល AI គេចផុតពីក្តារចុច។ គំរូដែលអាចមើលឃើញ ស្តាប់ ប្តូរភាសា និងដំណើរការឧបករណ៍នៅពេលនិយាយគឺប្រកួតប្រជែងមិនមែនជាមួយ chatbots ផ្សេងទៀតទេ ប៉ុន្តែជាមួយនឹងការហៅទូរស័ព្ទ ខ្សែជំនួយអតិថិជន និងជំនួយការផ្ទាល់ខ្លួន។

អត្ថប្រយោជន៍របស់ Google គឺការចែកចាយ៖ ការស្វែងរក ប្រព័ន្ធប្រតិបត្តិការ Android កន្លែងធ្វើការ និង Chrome ផ្តល់ឱ្យម៉ូដែលផ្ទាល់នូវមូលដ្ឋានដែលបានដំឡើង គ្មានគូប្រជែងអាចផ្គូផ្គងបាន។ ក្រុមហ៊ុនកំពុងភ្នាល់ថាវត្តមាននៅគ្រប់ជ្រុងនៃថ្ងៃរបស់អ្នកប្រើប្រាស់ - ឥឡូវនេះជាមួយនឹងគំរូសំឡេងដ៏ល្អបំផុតរបស់ខ្លួន - នឹងមានសារៈសំខាន់ជាងការឈ្នះពិន្ទុគោលណាមួយ។ គូប្រជែងនឹងទទួលបានឱកាសរបស់ពួកគេក្នុងការឆ្លើយតប ប៉ុន្តែ Google បានបញ្ជាក់យ៉ាងច្បាស់ថា សំឡេងដែលធ្លាប់ជាមុខងារសាកល្បង ឥឡូវនេះគឺជាខ្សែផលិតផលលំដាប់ទីមួយ។

សម្រាប់អ្នកអភិវឌ្ឍន៍ សារគឺស្រដៀងគ្នាដោយផ្ទាល់។ តាមរយៈការបោះផ្សាយទម្រង់បញ្ចូលពិតប្រាកដ ចងក្រងឯកសារអំពីការអនុវត្តឧបករណ៍ផ្ទៃខាងក្រោយ និងបង្កើតប្រព័ន្ធអេកូឡូស៊ីជាមួយវេទិកា Live API នោះ Google កំពុងព្យាយាមបង្កើតជង់របស់វាជាស្រទាប់ខាងក្រោមលំនាំដើមសម្រាប់នរណាម្នាក់ដែលបង្កើតចំណុចប្រទាក់និយាយ — ពីរូបយន្តជំនួយអតិថិជន ទៅជាជំនួយការដែលអាចពាក់បាន។ មិនថាការទាមទារគុណភាពរបស់ Gemini 3.8 Live ស្ថិតក្រោមការសាកល្បងឯករាជ្យទេ ការលេងដែលអាចរកបានគឺស្ថិតនៅក្នុងចលនារួចហើយ។

---

ស្នាក់នៅមុន AI

ទទួលបានព័ត៌មាន AI ការវិភាគ និងរបកគំហើញចុងក្រោយបំផុត — ទាំងអស់នៅកន្លែងតែមួយ។

អានព័ត៌មាន AI បន្ថែម →