ក្រុមហ៊ុន Google បានបើកដំណើរការ Gemini 3.8 Flash កាលពីថ្ងៃអង្គារ ដែលជាគំរូការងារថ្មីបំផុតរបស់ខ្លួន ដែលត្រូវបានដាក់ជាប្រព័ន្ធហេតុផល និងសរសេរកូដដ៏ល្អបំផុតរបស់ក្រុមហ៊ុន ដែលមានតម្លៃដូចគ្នាទៅនឹងជំនាន់មុនរបស់វា រួមជាមួយនឹងកំណែពិសេសមួយហៅថា Gemini 3.8 Flash Cyber ​​ដែលបង្កើតឡើងសម្រាប់ការងារការពារសុវត្ថិភាពតាមអ៊ីនធឺណិត។ សេចក្តីប្រកាសដែលត្រូវបានចេញផ្សាយនៅលើប្លក់ផ្លូវការរបស់ Google ដោយ Tulsee Doshi នាយកជាន់ខ្ពស់នៃការគ្រប់គ្រងផលិតផល និង Raluca Ada Popa ដែលជាប្រធានផ្នែកសុវត្ថិភាព Gemini នៅ Google DeepMind គឺជាការចេញផ្សាយ Flash លើកទីបីរបស់ Google ក្នុងរយៈពេលត្រឹមតែ 6 សប្តាហ៍ប៉ុណ្ណោះ។

ការបើកដំណើរការនេះធ្វើឡើងនៅពាក់កណ្តាលរដូវកាលនៃការចេញផ្សាយដែលមានមនុស្សច្រើនខុសពីធម្មតា ហើយវាគឺជាចម្លើយផ្ទាល់ចំពោះគូប្រជែងតម្លៃ និងសម្ពាធនៃការអនុវត្តដែលបានដាក់នៅលើបន្ទាត់គំរូរបស់ Google ។ សម្រាប់ទិដ្ឋភាពកាន់តែទូលំទូលាយអំពីរបៀបដែលមន្ទីរពិសោធន៍ព្រំដែនកំពុងជួបបញ្ហា ក្រុមការងារ [ព័ត៌មាន AI បែកធ្លាយ] (https://aibuzzwire.news) តាមដានរាល់ការចេញផ្សាយគំរូសំខាន់ៗ ដូចដែលវាកើតឡើង។

វ៉ារ្យ៉ង់ពីរ មូលនិធិមួយ។

Gemini 3.8 មាន​ជា​ពីរ​កំណែ​ដែល​បាន​បង្កើត​ឡើង​នៅ​លើ​ការ​ស៊ើបការណ៍​សម្ងាត់​មូលដ្ឋាន​ដូច​គ្នា។ Gemini 3.8 Flash គឺជាកម្លាំងពលកម្មដែលមានគោលបំណងទូទៅ៖ Google និយាយថាវាផ្តល់នូវការកែលម្អយ៉ាងសំខាន់លើ 3.7 Flash នៅទូទាំងផ្នែកវិស្វកម្មសូហ្វវែរ ភារកិច្ចភ្នាក់ងារ និងហេតុផលពហុជំហាននៅក្នុងដែនឯកទេស ក្នុងតម្លៃណែនាំដូចគ្នា 0.75 ដុល្លារក្នុងមួយលាននិមិត្តសញ្ញាបញ្ចូល និង 3.75 ដុល្លារក្នុងមួយលាននិមិត្តសញ្ញាទិន្នផល។

Gemini 3.8 Flash Cyber ​​ត្រូវបានពិពណ៌នាថាជាគំរូសុវត្ថិភាពតាមអ៊ីនធឺណិតដែលមានសមត្ថភាពបំផុតរបស់ Google ជាមួយនឹងអ្វីដែលក្រុមហ៊ុនហៅថាការអនុវត្តកម្រិតព្រំដែនក្នុងការរកឃើញភាពងាយរងគ្រោះ និងការបំណះដោយស្វ័យប្រវត្តិ។ មិនដូចគំរូ Flash ស្តង់ដារទេ វាមិនអាចប្រើបានទូលំទូលាយទេ — Google កំពុងចែកចាយវាទៅក្រុមអ្នកការពារដែលអាចទុកចិត្តបានតាមរយៈកម្មវិធីថ្មីមួយដែលមានឈ្មោះថា Fairwind ។

យោងតាមការបង្ហោះប្លុក ការកើនឡើងនៃការសរសេរកូដ និងហេតុផលនៅទូទាំងស្នូលដែលបានចែករំលែកត្រូវបានជំរុញមួយផ្នែកដោយការបណ្តុះបណ្តាលយ៉ាងម៉ត់ចត់នៅក្នុងដែនទាមទារនៃសុវត្ថិភាពអ៊ីនធឺណិត ហើយម៉ូដែលទាំងពីរត្រូវបានពន្លឿនដោយរង្វិលជុំភ្នាក់ងារដែលដំណើរការជាយូរមកហើយដែលត្រូវបានរចនាឡើងដើម្បីវាយតម្លៃឡើងវិញ និងកែលម្អគំរូមូលដ្ឋាន។

គោលការណ៏៖ ប្រឹងប្រែងធ្វើការ មិនមែនចេះតែធំជាងនេះទេ។

ការ​អះអាង​គោល​របស់ Google ផ្តោត​លើ​ទស្សនវិជ្ជា​នៃ​ការ​រចនា​ដែល​ក្រុមហ៊ុន​បាន​សង្ខេប​យ៉ាង​ច្បាស់៖ 3.8 Flash "ធ្វើការ​កាន់តែ​លំបាក"។ នៅលើកិច្ចការស្មុគ្រស្មាញ គំរូនេះអនុវត្តជំហាននៃហេតុផលបន្ថែម និងហៅឧបករណ៍ម្តងហើយម្តងទៀត ជួនកាលប្រើប្រាស់សញ្ញាសម្ងាត់បន្ថែមទៀត ដើម្បីបង្កើនប្រសិទ្ធភាពការងារនៅកម្រិតខ្ពស់។ អ្នកអភិវឌ្ឍន៍អាចហៅទូរស័ព្ទទៅការខិតខំប្រឹងប្រែងដើម្បីកាត់បន្ថយសញ្ញាសម្ងាត់ ឬបន្តនៅលើ Gemini 3.7 Flash ដែលនៅតែត្រូវបានគាំទ្រយ៉ាងពេញលេញសម្រាប់ប្រសិទ្ធភាពការងារដំបូង។

ចំណងជើងលទ្ធផល Google ដកស្រង់៖

  • DeepSWE v1.1 (វិស្វកម្មផ្នែកទន់វែងឆ្ងាយ)៖ 3.8 Flash ដំណើរការជាងម៉ូដែលព្រំដែនធំៗភាគច្រើនក្នុងការដោះស្រាយបញ្ហាវិស្វកម្មស្មុគ្រស្មាញដោយស្វ័យភាពដល់ទីបញ្ចប់ តាមអ្វីដែល Google ពិពណ៌នាថាជាប្រភាគនៃការចំណាយ។
  • Vals Finance Agent V2 and Harvey's Legal Agent Benchmark: 3.8 Flash ដំណើរការជាង 3.7 Flash និងគំរូព្រំដែនផ្សេងទៀតក្នុងវិស័យបរិមាណ និងវិជ្ជាជីវៈដែលទាមទារការវិភាគ និងការរាយការណ៍កម្រិតខ្ពស់។
  • HLE-Verified: 3.8 Flash សម្រេចបាន 54.9% ដែល Google បង្ហាញជាភស្តុតាងនៃហេតុផលពហុជំហាននៅទូទាំង STEM មនុស្សធម៌ និងវិស័យវិជ្ជាជីវៈ។

Flash Cyber: ការការពារប្រឆាំងនឹងបទល្មើស

វ៉ារ្យ៉ង់ Cyber គឺជាការចេញផ្សាយមិនធម្មតាជាង។ Google និយាយថា ខ្លួនបានកំណត់អាទិភាពក្នុងការជួសជុលភាពងាយរងគ្រោះដោយចេតនាលើសមត្ថភាពវាយលុក ដូចជាការកេងប្រវ័ញ្ចជាដើម។ នៅលើ CWE-Bench ដែលជាស្តង់ដារបំណះខាងក្រៅដែលដំណើរការដោយ Collinear Gemini 3.8 Flash Cyber ​​ទទួលបានពិន្ទុ pass@1 នៃ 47.2% - គ្រាន់តែនៅពីក្រោយគំរូជួរមុខឈានមុខគេនៅ 47.8% យោងតាម ​​Google ប៉ុន្តែក្នុងតម្លៃទាបជាងយ៉ាងខ្លាំង ដោយដាក់វានៅលើព្រំដែន Pareto របស់គោល។

នៅលើ CyberGym ដែលជាស្តង់ដារឧស្សាហកម្មស្តង់ដារសម្រាប់ការស្វែងរកភាពងាយរងគ្រោះ Google និយាយថា គំរូ Cyber ​​បង្ហាញពីការរកឃើញភាពងាយរងគ្រោះដោយស្វ័យភាពកម្រិតព្រំដែន ដែលលើសពីជំនាន់មុន 3.5 Flash Cyber ​​ក៏ដូចជាម៉ូដែលព្រំដែនធំជាង។ នៅលើតារាងពិន្ទុខាងក្នុងរបស់ Google ដែលលាតសន្ធឹងលើមូលដ្ឋានកូដស្មុគ្រស្មាញក្នុង 20 ភាសាសរសេរកម្មវិធី គំរូនេះបានឈានដល់អត្រាជោគជ័យលើសពី 70% ។

ធានាលេខកូដផ្ទាល់ខ្លួនរបស់ Google រួចហើយ

Google និយាយថា Cyber model ត្រូវបានដាក់ពង្រាយខាងក្នុងរួចហើយ ហើយឧទាហរណ៍ដែលវាផ្តល់គឺជាក់លាក់៖

  • ក្រុមសុវត្ថិភាព Chrome បានរកឃើញថា 3.8 Flash Cyber ​​បានផលិតបំណះត្រឹមត្រូវ 2.6 ដងចំពោះភាពងាយរងគ្រោះរបស់ Chrome ជាងម៉ូដែលពាណិជ្ជកម្មល្អបំផុត ដែលមានទំហំធំជាង។
  • នៅក្រុមហ៊ុនសន្តិសុខ Wiz ម៉ូដែលនេះសម្រេចបានពិន្ទុភាគរយខ្ពស់ពី 7.5 ទៅ 9.7 ពិន្ទុខ្ពស់លើការធ្វើតេស្តការជ្រៀតចូលខាងក្នុងដោយតម្លៃទាបជាងពី 2.3 ទៅ 5.2 ដងធៀបនឹងម៉ូដែលជួរមុខផ្សេងទៀត។
  • ក្រុមស្រាវជ្រាវ Cloud Vulnerability របស់ Google បានប្រើគំរូនេះដើម្បីស្វែងរកភាពងាយរងគ្រោះជាមូលដ្ឋានដ៏សំខាន់មួយក្នុងរយៈពេលតិចជាងពីរម៉ោង — ថ្នាក់នៃភាពងាយរងគ្រោះដែលការស្រាវជ្រាវ និងការរកឃើញរបស់ Google ជាធម្មតាចំណាយពេលច្រើនខែ។

តើវាមានន័យយ៉ាងណាសម្រាប់អ្នកអភិវឌ្ឍន៍ និងទីផ្សារ

សម្រាប់អ្នកអភិវឌ្ឍន៍ ការអនុវត្តជាក់ស្តែងគឺស្ថិរភាពតម្លៃនៅចុងទាបនៃព្រំដែន។ ការកាន់ 3.8 Flash នៅតម្លៃណែនាំរបស់ 3.7 រក្សាតម្លៃនៃគំរូ coding-and-agentic ប្រកួតប្រជែងនៅ $0.75/$3.75 ក្នុងមួយលានថូខឹន ដែលជាផ្នែកមួយដែលអ្នកប្រកួតប្រជែងទម្ងន់បើកចំហ និងមន្ទីរពិសោធន៍គូប្រជែងបានកាត់បន្ថយអ្នកកាន់តំណែងពេញមួយឆ្នាំ។ សាររបស់ Google គឺថាអ្នកទិញលែងត្រូវការជ្រើសរើសរវាងតម្លៃ និងសមត្ថភាពនៅក្នុងលំដាប់ workhorse ទៀតហើយ។

គំរូចែកចាយកម្មវិធី Fairwind សម្រាប់ Flash Cyber ​​គឺប្រាប់ដូចគ្នា។ មន្ទីរពិសោធន៍លំដាប់ជួរមុខកំពុងកាន់តែខ្លាំងឡើងក្នុងការព្យាបាលសមត្ថភាពសន្តិសុខតាមអ៊ីនធឺណិតជាវរជនជាអ្វីមួយដែលត្រូវបិទទ្វារជាជាងដឹកជញ្ជូនយ៉ាងទូលំទូលាយ ដោយផ្តល់នូវឧបករណ៍ការពារទំនើបបំផុតដល់អ្នកការពារដែលត្រូវបានត្រួតពិនិត្យ ខណៈពេលដែលកំណត់សក្តានុពលសម្រាប់ការប្រើប្រាស់ខុសឆ្គង។ ការសម្រេចចិត្តរបស់ Google ក្នុងការផ្តល់អាទិភាពដល់ការបំប្លែងគំរូគោលលើសមត្ថភាពកេងប្រវ័ញ្ចនៅក្នុងការបណ្តុះបណ្តាលរបស់ម៉ូដែលនេះ គឺធ្វើតាមតក្កវិជ្ជាដូចគ្នា។

ចង្វាក់ក៏គួរឱ្យកត់សម្គាល់ផងដែរ។ ការចេញផ្សាយ Flash ចំនួនបីក្នុងរយៈពេលប្រាំមួយសប្តាហ៍ — 3.7 Flash កាលពីបីសប្តាហ៍មុន ឥឡូវនេះ 3.8 — បង្ហាញ Google ឡើងវិញនូវបន្ទាត់ពាក់កណ្តាលកម្រិតរបស់វាលឿនជាងវដ្តនៃការចេញផ្សាយរចនាប័ទ្មប្រចាំឆ្នាំកាលពី 2 ឆ្នាំមុន។ សម្ពាធប្រកួតប្រជែងពីការចេញផ្សាយ GPT-6 របស់ OpenAI និងរលកនៃម៉ូដែលទម្ងន់បើកចំហដែលមានចលនាលឿនពីប្រទេសចិនបានបង្រួមពេលវេលារបស់អ្នកគ្រប់គ្នា ហើយ Google កំពុងជ្រើសរើសយ៉ាងច្បាស់លាស់នូវល្បឿននៅកម្រិត workhorse ខណៈពេលដែលម៉ូដែលជួរមុខរបស់វាកាន់ទង់ស្រាវជ្រាវ។

ថាតើវិធីសាស្រ្ត "ធ្វើការកាន់តែលំបាក" របស់ 3.8 Flash — ការចំណាយថូខឹនកាន់តែច្រើនលើហេតុផលច្រើនជំហានដោយឧស្សាហ៍ព្យាយាម — បង្ហាញថាមានប្រសិទ្ធភាពជាងក្នុងការអនុវត្តជាងខ្នាតគំរូឆៅនឹងបង្ហាញនៅក្នុងវិក្កយបត្ររបស់អ្នកអភិវឌ្ឍន៍ក្នុងរយៈពេលប៉ុន្មានខែខាងមុខនេះ។ ស្តង់ដារផ្ទាល់ខ្លួនរបស់ Google បង្ហាញថាពាណិជ្ជកម្មអាចអនុគ្រោះដល់ការឧស្សាហ៍ព្យាយាម។ ទីផ្សារនឹងប្រកាសសាលក្រមរបស់ខ្លួនវិក័យប័ត្រ API មួយក្នុងពេលតែមួយ។

នាំមុខ AI

រាល់ការចេញលក់ម៉ូដែល ស្តង់ដារ និងការផ្លាស់ប្តូរតម្លៃ ត្រូវបានតាមដាននៅពេលដែលវាកើតឡើង — អានព័ត៌មាន AI បន្ថែម →