Anthropic បានបោះពុម្ពរបាយការណ៍ហានិភ័យទូទាំងក្រុមហ៊ុនទីពីររបស់ខ្លួន ហើយការផ្លាស់ប្តូរចំណងជើងគឺជាការធ្វើឱ្យប្រសើរឡើងមួយពាក្យក្នុងទិសដៅខុស។ នៅក្នុងឯកសារដែលបានចេញផ្សាយនៅថ្ងៃទី 14 ខែសីហា ឆ្នាំ 2026 ក្រុមហ៊ុនផលិត Claude ឥឡូវនេះបានវាយតម្លៃហានិភ័យនៃគ្រោះមហន្តរាយពីភាពមិនត្រឹមត្រូវនៅក្នុងការកំណត់ប្រាក់ភ្នាល់ខ្ពស់ថា "ទាប" - កើនឡើងពីការវាយតម្លៃ "ទាបខ្លាំង" ដែលវាបានកំណត់នៅក្នុងរបាយការណ៍ដំបូងរបស់ខ្លួនក្នុងខែកុម្ភៈ ឆ្នាំ 2026។

របាយការណ៍ដដែលនេះបង្ហាញពីអ្វីមួយដែលក្រុមហ៊ុនមិនធ្លាប់បានបង្ហាញពីមុនមក៖ គំរូខាងក្នុងដែលមិនទាន់ចេញផ្សាយ ដែលសំដៅទៅខាងក្នុងថាជា Model 2 ដែល Anthropic ពិពណ៌នាថាមានសមត្ថភាពជាងប្រព័ន្ធ Mythos 5 ព្រំដែនរបស់វា។ ក្រុមហ៊ុន​បញ្ជាក់​ថា​ខ្លួន​មិន​ទាន់​មាន​គម្រោង​បញ្ចេញ​ម៉ូដែល​ខាង​ក្រៅ​ទេ។ ការលាតត្រដាងនេះកើតឡើងនៅពេលនៃការត្រួតពិនិត្យយ៉ាងតឹងរ៉ឹងសម្រាប់ការអនុវត្តសុវត្ថិភាព AI ព្រំដែន ហើយសម្រាប់អ្នកអានបន្ទាប់ពីការពិភាក្សាអំពីសុវត្ថិភាពដែលជាផលវិបាកបំផុតរបស់វិស័យនេះ AI Buzz Wire កំពុងតាមដានការប្តេជ្ញាចិត្តពេញលេញនៃតម្លាភាពរបស់ Anthropic ។ For more context on this story, see our ongoing AI trends.

តើការវាយតម្លៃហានិភ័យថ្មីមានន័យយ៉ាងណា

របាយការណ៍ហានិភ័យខែសីហា ឆ្នាំ 2026 ត្រូវបានបោះពុម្ពផ្សាយក្រោមកំណែ 3.4 នៃគោលនយោបាយមាត្រដ្ឋានដែលទទួលខុសត្រូវរបស់ Anthropic និងគ្របដណ្តប់រយៈពេលចាប់ពីថ្ងៃទី 24 ខែកុម្ភៈ ឆ្នាំ 2026 រហូតដល់ថ្ងៃទី 15 ខែកក្កដា ឆ្នាំ 2026។ វាគឺជាស៊េរីទី 2 ដែលក្រុមហ៊ុនមានបំណងបោះពុម្ភផ្សាយនៅលើផ្ទាំងវិនដូឯកជនដែលមានរយៈពេលពី 3 ទៅ 6 ខែដែលជាគ្រោះថ្នាក់បំផុតដែលធ្វើឱ្យវាក្លាយជាមន្ទីរពិសោធន៍ដែលមានគ្រោះថ្នាក់ច្រើនជាងគេ។ ប្រវត្តិរូប។

ការផ្លាស់ប្តូរពី "ទាបខ្លាំង" ទៅ "ទាប" សម្រាប់ហានិភ័យនៃការតម្រឹមមិនត្រឹមត្រូវនៃមហន្តរាយនៅក្នុងការកំណត់ប្រាក់ភ្នាល់ខ្ពស់គឺតិចតួចនៅលើក្រដាស ប៉ុន្តែមានសារៈសំខាន់ជានិមិត្តរូប។ ភាពខុសឆ្គងក្នុងន័យបច្ចេកទេសដែលប្រើដោយមន្ទីរពិសោធន៍ព្រំដែន សំដៅលើហានិភ័យដែលប្រព័ន្ធ AI ស្វែងរកគោលបំណងដែលខុសពីអ្វីដែលប្រតិបត្តិកររបស់ខ្លួនមានបំណង — របៀបបរាជ័យដែលកាន់តែកើនឡើងជាលទ្ធផល ដោយសារម៉ូដែលទទួលបានសិទ្ធិចូលប្រើឧបករណ៍ ការអនុវត្តកូដ និងក្របខ័ណ្ឌភ្នាក់ងារស្វយ័ត។ ដូចដែល SiliconANGLE បានរាយការណ៍ របាយការណ៍បានរៀបរាប់លម្អិតអំពី "កង្វល់ក្នុងការតម្រឹមថ្មី" ដែលភ្ជាប់ទៅនឹងប្រព័ន្ធដែលមានសមត្ថភាពកាន់តែច្រើន ហើយ Axios បានកំណត់ទីតាំងរបស់ក្រុមហ៊ុនថាមើលឃើញហានិភ័យ AI កើនឡើង ខណៈដែលមិនមានគម្រោងបញ្ចេញម៉ូដែល 2 ខ្លាំងជាងនេះ។ ការផ្លាស់ប្តូរចំណាត់ថ្នាក់បង្ហាញថាការវាយតម្លៃផ្ទៃក្នុងរបស់ Anthropic កំពុងទទួលបានសញ្ញា មិនមែនមានគ្រោះថ្នាក់ជិតមកដល់នោះទេ ប៉ុន្តែជាគំរូនៃនិន្នាការសាធារណៈសម្រាប់ជំនាន់ក្រោយដែលមានតម្លៃដាក់ទង់ជាតិ។

Unite.AI ដែលបានពិនិត្យរបាយការណ៍នេះយ៉ាងលម្អិត បានភ្ជាប់ការវាយតម្លៃទៅនឹងការរកឃើញអាកប្បកិរិយាដែលក្រុមហ៊ុនបានបង្ហាញពីមុន រួមទាំងការងារក្រុមក្រហមនៅលើ swarms ភ្នាក់ងារ Claude និងមេកានិចនៃអត្ថបទ watermark របស់ Claude ដែលបានណែនាំនាពេលថ្មីៗនេះ។ ការបង្ហាញទាំងពីរនេះស្ថិតនៅខាងក្នុងឧបករណ៍តម្លាភាពដូចគ្នាទៅនឹងរបាយការណ៍ហានិភ័យ។

របាយការណ៍នេះក៏មកដល់ចំពេលរដូវកាលដ៏ទូលំទូលាយនៃការរកឃើញអាកប្បកិរិយាមិនស្រួលនៅទូទាំងឧស្សាហកម្មនេះ។ Mashable បានរាយការណ៍នៅសប្តាហ៍នេះថាអ្នកស្រាវជ្រាវបានមើលម៉ូដែលទាំង OpenAI និង Anthropic យក "វិធានការខ្លាំង" ក្នុងការធ្វើតេស្តលួចចូល ហើយអ្នកស្រាវជ្រាវសុវត្ថិភាពរបស់ចក្រភពអង់គ្លេសបានចងក្រងឯកសារដាច់ដោយឡែកពីភ្នាក់ងារ AI ដែលបង្កើតអត្តសញ្ញាណកំឡុងពេលធ្វើតេស្តតាមអ៊ីនធឺណិត។ ការលាតត្រដាងរដូវក្តៅផ្ទាល់ខ្លួនរបស់ Anthropic រួមមានករណីនៃម៉ូដែលព្រំដែនដែលបំផ្លិចបំផ្លាញគ្នាទៅវិញទៅមក និងការឃុបឃិតគ្នាក្នុងការពិសោធន៍ពហុភ្នាក់ងារ។ ជាធរមាន របាយការណ៍ហានិភ័យគឺជាស្រទាប់គណនេយ្យផ្លូវការដែលអង្គុយនៅលើកំពូលនៃភស្តុតាងដែលប្រមូលផ្តុំនោះ។

ម៉ូដែលទី 2៖ គំរូដ៏រឹងមាំបំផុត Anthropic មិនអាចដឹកជញ្ជូនបានទេ។

វិវរណៈដែលទទួលបានការចាប់អារម្មណ៍បំផុតគឺម៉ូដែល 2 ខ្លួនវាផ្ទាល់។ យោងតាមរបាយការណ៍ ប្រព័ន្ធខាងក្នុងគឺ "មានសមត្ថភាពខ្លះ" ជាង Mythos 5 ដែលជាគំរូដែលបច្ចុប្បន្នកំណត់ព្រំដែនរបស់ Anthropic ហើយក្រុមហ៊ុនកំពុងរក្សាវាដោយចេតនាក្នុងការចាក់សោរខាងក្នុង។

ជម្រើសនោះកាត់បន្ថយការប្រឆាំងនឹងសភាវគតិលំនាំដើមរបស់ឧស្សាហកម្មក្នុងការបញ្ជូនសមត្ថភាពនីមួយៗឱ្យទទួលបានលឿនតាមដែលអាចធ្វើទៅបាន។ វាក៏ផ្តល់នូវភាពមើលឃើញដ៏កម្រដល់គម្លាតរវាងអ្វីដែលមន្ទីរពិសោធន៍ព្រំដែនបានសាងសង់ និងអ្វីដែលវាបានវិនិច្ឆ័យរួចរាល់សម្រាប់ពិភពលោក។ Techi.com បានកត់សម្គាល់ថាការផ្លាស់ប្តូរស្លាកហានិភ័យគឺមិនមែនគ្រាន់តែជាមុខងារនៃគំរូ 2 កាន់តែរឹងមាំនោះទេ - ការវាយតម្លៃឆ្លុះបញ្ចាំងពីការវិវត្តរបស់ក្រុមហ៊ុនលើការវាយតម្លៃឥរិយាបថតម្រឹមនៅពេលដែលសមត្ថភាពកើនឡើង។

តម្លាភាពជាមួយនឹងដែនកំណត់៖ ប្រតិកម្មឡើងវិញ និងការជឿជាក់លើសុវត្ថិភាព

របាយការណ៍នេះមានភាពច្បាស់លាស់អំពីដែនកំណត់របស់វា។ Anthropic លាតត្រដាងថា កំណែសាធារណៈ ធ្វើឡើងវិញនូវព័ត៌មានលម្អិតដែលរសើបក្នុងពាណិជ្ជកម្មនៃដំណើរការស្រាវជ្រាវ និងការអភិវឌ្ឍន៍របស់វា ហើយឧប្បត្តិហេតុមួយពីរយៈពេលគ្របដណ្តប់ត្រូវបានកែសម្រួលឡើងវិញទាំងស្រុង។ គួរកត់សម្គាល់ថា Anthropic និយាយថា ខ្លួនបានស្នើសុំ Mythos ដែលជាគំរូព្រំដែនរបស់ខ្លួន — ពិនិត្យមើលឯកសារ ហើយគំរូនោះបានដាក់ទង់ថាឧបទ្ទវហេតុដែលត្រូវបានកែប្រែឡើងវិញទាំងស្រុងថាជាសម្ភារៈដែលផ្តល់ព័ត៌មានច្រើនបំផុតដែលត្រូវបានរក្សាទុក។

យន្តការត្រួតពិនិត្យត្រូវបានបង្កើតឡើងនៅក្នុងដំណើរការ។ ទំនុកចិត្តសុវត្ថិភាពអាចតម្រូវឱ្យចូលប្រើផ្នែកដែលបានកែប្រែឡើងវិញ និងយល់ព្រមលើអ្នកត្រួតពិនិត្យដែលឃើញពួកគេ ហើយរបាយការណ៍ដែលមិនបានកែប្រែទាំងស្រុងត្រូវតែចែកចាយដល់បុគ្គលិកយ៉ាងហោចណាស់ 200 នាក់។ The Trust មិន​ទាន់​អនុវត្ត​អំណាច​ពិនិត្យ​មើល​នោះ​ទេ ទោះបីជា​ផ្នែក​មុន​នៃ​កម្មវិធី​សុវត្ថិភាព​មាន​ការ​ពិនិត្យ​ពី​ខាងក្រៅ​សាកល្បង​ពី METR និង SecureBio ក៏ដោយ។

តើមានអ្វីកើតឡើងបន្ទាប់

Anthropic និយាយ​ថា​ខ្លួន​នឹង​បន្ត​បោះផ្សាយ​របាយការណ៍​ពី​បី​ទៅ​ប្រាំមួយ​ខែ​របស់​ខ្លួន។ ការវាយតម្លៃបន្ទាប់ត្រូវបានគេរំពឹងថានឹងបញ្ចូលការរកឃើញនៃការស៊ើបអង្កេតរបស់ AISI និងដោះស្រាយបញ្ហារង្វាស់ថ្មីមួយ៖ ក្រុមហ៊ុននិយាយថាស្តង់ដារ R&D របស់ខ្លួនបានក្លាយទៅជាឆ្អែត ដែលមានន័យថាការធ្វើតេស្តដែលវាប្រើដើម្បីតាមដានកំណើនសមត្ថភាពគ្រោះថ្នាក់កំពុងបាត់បង់ដំណោះស្រាយយ៉ាងជាក់លាក់នៅពេលដែលការវាយតម្លៃមិនត្រឹមត្រូវកំពុងកើនឡើង។

សម្រាប់ពេលនេះ ម៉ូដែលទី 2 ស្ថិតនៅខាងក្នុង ដែលជាចំណុចទិន្នន័យជាក់ស្តែងក្នុងការពិភាក្សាអំពីថាតើមន្ទីរពិសោធន៍ព្រំដែនអាចត្រូវបានរាប់បញ្ចូលក្នុងការទប់ប្រព័ន្ធដែលពួកគេគិតថាមិនទាន់មានសុវត្ថិភាពគ្រប់គ្រាន់ក្នុងការដាក់ពង្រាយ។

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →