Anthropic បានបោះពុម្ភរូបរាងជាលើកដំបូងនៅក្នុងបំពង់បង្ហូរប្រេងអភិវឌ្ឍន៍របស់ខ្លួនក្នុងសប្តាហ៍នេះ ដោយបង្ហាញថាម៉ូដែល Claude របស់ខ្លួនឥឡូវនេះ "នាំមុខ" 26% នៃការងារស្រាវជ្រាវ និងអភិវឌ្ឍន៍ AI នៅក្រុមហ៊ុន - កើនឡើងពីក្រោម 1% ក្នុងខែកុម្ភៈ ឆ្នាំ 2026។ តួលេខនេះបានបង្ហាញនៅក្នុងប្លុករបស់ក្រុមហ៊ុនដែលមានចំណងជើងថា "វិធានការសម្រាប់ការយល់ដឹងអំពីល្បឿននៃការអភិវឌ្ឍន៍ AI នៅខាងក្នុង កាសែត រ៉យទ័រ ថ្ងៃទី 1 ខែកញ្ញា" ។ និងកន្លែងលក់ផ្សេងទៀត។

ការបង្ហោះនេះគឺជាផ្នែកមួយនៃការអនុវត្តតម្លាភាព និងជាអំណះអំណាងមួយផ្នែក៖ Anthropic ចង់ឱ្យមន្ទីរពិសោធន៍ព្រំដែនផ្សេងទៀតផ្សព្វផ្សាយប្រភេទលេខដូចគ្នា ដូច្នេះសាធារណជន និងរដ្ឋាភិបាលអាចតាមដានថាតើ AI កំពុងត្រូវបានផ្តល់គន្លឹះក្នុងការកសាង AI យ៉ាងឆាប់រហ័ស។ For more context on this story, see our ongoing latest AI developments.

លេខបីដើម្បីតាមដានការអភិវឌ្ឍន៍ AI

ក្រុមហ៊ុនបានស្នើរង្វាស់ចំនួនបីដែលវានិយាយថា បំភ្លឺល្បឿននៃការអភិវឌ្ឍន៍នៅក្នុងមន្ទីរពិសោធន៍ព្រំដែន៖ តើ AI R&D ត្រូវបានអនុវត្តដោយ AI ខ្លួនវាប៉ុណ្ណា សកម្មភាពរបស់ភ្នាក់ងារ AI ត្រូវបានត្រួតពិនិត្យបានល្អ និងរបៀបដែលការគណនាត្រូវបានបែងចែករវាងការងារសមត្ថភាព និងការងារសុវត្ថិភាព។

លេខចំណងជើងបានមកពីអ្វីដែល Anthropic ហៅថាសន្ទស្សន៍ R&D Automation Index របស់ខ្លួន។ ក្រុមហ៊ុនបានធ្វើកាតាឡុកគ្រប់ប្រភេទនៃការងារ AI R&D ដែលបានធ្វើនៅក្រុមហ៊ុន វាយតម្លៃពីរបៀបដែលកិច្ចការនីមួយៗបច្ចុប្បន្នកំពុងដំណើរការដោយស្វ័យប្រវត្តិ និងបានប្រមូលផ្តុំលទ្ធផលដោយប្រើខ្នាតដែលបង្កើតឡើងដោយក្រុមស្រាវជ្រាវ Epoch AI ។ មាត្រដ្ឋានដំណើរការពី AL0 (គ្មានការចូលរួមពី AI) ដល់ AL5 (AI ដំណើរការដោយស្វ័យភាពពេញលេញ ដោយគ្មានមនុស្សនៅក្នុងរង្វង់) ដោយ AL3 មានន័យថា AI "សហការ" លើផ្នែកធំនៃការងារក្រោមការដឹកនាំរបស់មនុស្សជិតស្និទ្ធ និង AL4 មានន័យថា AI "ដឹកនាំ" ដែលបញ្ចប់កិច្ចការភាគច្រើនពីចុងដល់ចប់ ពីការត្រួតពិនិត្យមនុស្សកម្រិតខ្ពស់ ខណៈពេលដែលមានការបញ្ជាពីមនុស្សកម្រិតខ្ពស់។

គិតត្រឹមខែសីហាឆ្នាំ 2026 Anthropic បានរាយការណ៍ថាលោក Claude ដឹកនាំ 26% នៃការងារ AI R&D របស់ក្រុមហ៊ុន។ ចំណែកនៃការងារនៅ ឬលើសពីកម្រិត "AIសហការ" គឺលើសពី 90%។ Claude មិនដំណើរការដោយស្វ័យភាពពេញលេញសម្រាប់ផ្នែករងដែលបានវាស់វែងនៃការងារ AI R&D ទេ។

ភ្នាក់ងារ 30,000, ម៉ូនីទ័រមួយ។

ការវាស់វែងទីពីរទាក់ទងនឹងការត្រួតពិនិត្យ។ Anthropic បានលាតត្រដាងថា គិតត្រឹមខែសីហា ឆ្នាំ 2026 មានភ្នាក់ងារប្រមាណ 30,000 ដែលកំពុងធ្វើការស្រាវជ្រាវ និងការងារវិស្វកម្មនៅក្នុងក្រុមហ៊ុននៅពេលណាមួយនៅលើវេទិកាផ្ទៃក្នុងដែលប្រើប្រាស់ច្រើនបំផុត។

រាល់សកម្មភាពភ្នាក់ងារទាំងនោះឆ្លងកាត់តាមរយៈម៉ូនីទ័រអនឡាញ មុនពេលវាត្រូវបានប្រតិបត្តិ ជាធម្មតាក្នុងរយៈពេលប៉ុន្មានវិនាទី នេះបើយោងតាមការបង្ហោះ។ Anthropic និយាយថា ខ្លួនបានវិភាគការសម្រេចចិត្តជាងមួយពាន់លានពីភ្នាក់ងារស្រាវជ្រាវ និងវិស្វកម្មរបស់ខ្លួនកាលពីខែសីហា ហើយបានរកឃើញថាចំណែកនៃសកម្មភាពដែលត្រូវបានរារាំង ឬកើនឡើងដោយអ្នកត្រួតពិនិត្យគឺ 0.002% ។

នៅលើការបែងចែកការគណនា ការវាស់វែងទីបី ក្រុមហ៊ុនបាននិយាយថា ក្នុងសប្តាហ៍ដែលបានពិនិត្យប្រហែល 6% នៃកុំព្យូទ័រដែលបានទៅ AI R&D ត្រូវបានបែងចែកឆ្ពោះទៅរកសុវត្ថិភាព។

កសាង​អ្នក​ស្នង​តំណែង​របស់​ខ្លួន — ដោយ​មាន​មនុស្ស​ត្រួត​ពិនិត្យ

ស៊ុមមានសារៈសំខាន់ដូចតួលេខ។ គំរូរបស់ Anthropic កំពុងចូលរួមកាន់តែខ្លាំងឡើងក្នុងការកសាងជំនាន់ក្រោយនៃម៉ូដែលដូចគ្នាទាំងនោះ ដែលជាអ្វីដែលអ្នកស្រាវជ្រាវហៅថាការកែលម្អខ្លួនឯងឡើងវិញ ហើយអ្វីដែលចំណងជើងរបស់កាសែត Washington Post បានពណ៌នាកាន់តែច្បាស់ថាជា chatbot "ទទួលយកការងារនៃការកសាងអ្នកស្នងតំណែងរបស់ខ្លួន" ។

Anthropic មានការប្រុងប្រយ័ត្នក្នុងការគូរបន្ទាត់រវាង "AI នាំមុខ" និង "AI ជំនួស" ។ នៅ AL4 មនុស្សនៅតែត្រួតពិនិត្យ និងអាចធ្វើអន្តរាគមន៍។ ក្រុមហ៊ុនបានរាយការណ៍យ៉ាងច្បាស់ថាមិនមានសំណុំរងដែលបានវាស់វែងនៃការងារ R&D របស់ខ្លួនដំណើរការនៅ AL5 ទេ។ ប៉ុន្តែគន្លងគឺចោត៖ ពីក្រោម 1% ទៅ 26% ក្នុងរយៈពេលប្រហែលប្រាំពីរខែបង្ហាញថាចំណែកនៃការងារដែលដឹកនាំដោយ AI អាចឆ្លងកាត់ពាក់កណ្តាលបានយ៉ាងល្អមុនដំណាច់ទសវត្សរ៍នេះ ប្រសិនបើនិន្នាការបច្ចុប្បន្ននៅតែមាន។

វិធីសាស្រ្តមានដែនកំណត់ពិតប្រាកដ ហើយ Anthropic និយាយដូច្នេះ។ ការវាយតម្លៃស្វ័យប្រវត្តិកម្មរបស់វាត្រូវបានផលិតដោយការយកគំរូតាមកំណត់ត្រាការងារផ្ទាល់ខ្លួនរបស់ក្រុមហ៊ុន — រួមទាំងសារ Slack និងឯកសារខាងក្នុង — ហើយមានទាំងមនុស្ស និងចៅក្រមវាយតម្លៃថាតើការងារនីមួយៗដំណើរការដោយរបៀបណា។ នៅក្នុងការសាកល្បងពិការភ្នែក បុគ្គលិកបានវាយតម្លៃការងារដោយមិនដឹងថា ភស្តុតាងអ្វីខ្លះដែលគំរូបានប្រមូលផ្តុំ។ ក្រុមហ៊ុនបានរាយការណ៍ថាចៅក្រមគំរូរបស់ខ្លួនបានយល់ព្រមជាមួយមនុស្សអំពីជាញឹកញាប់ដូចដែលមនុស្សបានយល់ព្រមជាមួយគ្នា៖ កិច្ចព្រមព្រៀងគំរូដល់មនុស្សពិតប្រាកដគឺ 59% ខណៈដែលកិច្ចព្រមព្រៀងពីមនុស្សទៅមនុស្សមានត្រឹមតែ 35% ហើយការវាយតម្លៃគំរូ និងការវាយតម្លៃរបស់មនុស្សបានឈានដល់កម្រិតមួយពីគ្នាទៅវិញទៅមក 97% នៃពេលវេលា។

ក្រុមហ៊ុនក៏បានទទួលស្គាល់ហានិភ័យនៃការយោងដោយខ្លួនឯងនៅក្នុងវិធីសាស្រ្តផ្ទាល់ខ្លួនរបស់វាផងដែរ៖ Anthropic បានប្រើគំរូផ្ទាល់ខ្លួនរបស់វាដើម្បីជួយវាយតម្លៃប្រព័ន្ធរបស់ខ្លួន ដែលអាចមានន័យថាគំរូចៅក្រមធ្វើឱ្យមានកំហុសដូចគ្នាទៅនឹងគំរូដែលខ្លួនកំពុងត្រួតពិនិត្យ។ ការផ្ទៀងផ្ទាត់ភាគីទីបី វាប្រកែកថាជាចម្លើយពិត។

ភ្នែកខាងក្រៅមកដល់ហើយ។

ដល់ទីបញ្ចប់នេះ Anthropic និយាយថា ខ្លួនមានគម្រោងបង្កប់អ្នកវាយតម្លៃភាគីទីបីឯករាជ្យពីស្ថាប័នជាច្រើននៅក្នុងក្រុមហ៊ុន ដោយផ្តល់ឱ្យពួកគេនូវដំណើរការផ្ទៃក្នុង ប្រព័ន្ធ និងទិន្នន័យដែលអាចប្រៀបធៀបទៅនឹងអ្វីដែលក្រុមវាយតម្លៃហានិភ័យខាងក្នុងមាន។ ស្ថាប័នស្រាវជ្រាវ AI ខាងក្រៅ METR មិនរកប្រាក់ចំណេញពីមុនបានក្រុមក្រហមនៃវេទិកាត្រួតពិនិត្យក្រៅបណ្តាញរបស់ Anthropic ។

ការ​លាតត្រដាង​នេះ​បាន​មក​ដល់​ចំ​ពេល​ដែល​មាន​ការ​ជជែក​វែកញែក​កាន់​តែ​ខ្លាំង​អំពី​ការ​បោះ​ជំហាន។ នាយកប្រតិបត្តិ Anthropic លោក Dario Amodei បានអំពាវនាវឱ្យមានការសម្របសម្រួលលើការពន្យឺតព្រំដែន ហើយក្រុមហ៊ុនកត់សំគាល់ថាចំនួនផ្ទាល់ខ្លួនរបស់វានឹងត្រូវបានគេរំពឹងថានឹងផ្លាស់ប្តូរប្រសិនបើការសម្របសម្រួលបែបនេះមាន។ នៅសប្តាហ៍នេះ Anthropic និង OpenAI ក៏ជាកម្មវត្ថុនៃលិខិតសាធារណៈពីអ្នកជំនាញសុវត្ថិភាពដែលលើកហេតុផលថាមន្ទីរពិសោធន៍ត្រូវការអ្នកវាយតម្លៃសុវត្ថិភាពឯករាជ្យពិតប្រាកដ។

ថាតើគូប្រជែងដើរតាមការនាំមុខរបស់ Anthropic គឺជាសំណួរបើកចំហ។ ក្រុមហ៊ុនអះអាងថា អ្នកអភិវឌ្ឍន៍ព្រំដែនណាមួយអាចផ្សព្វផ្សាយវិធានការទាំងនេះជាទៀងទាត់ដោយប្រើវិធីសាស្រ្តសាធារណៈ។ រហូតទាល់តែពួកគេធ្វើបាន លេខសាធារណៈតែមួយគត់ដែលថា AI កំពុងបង្កើត AI លឿនប៉ុណ្ណា គឺមកពីមន្ទីរពិសោធន៍ខ្លួនឯង។

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →