Anthropic បានបោះពុម្ភផ្សាយសំណុំលម្អិតនៃការវាស់វែងដោយខ្លួនឯងកាលពីថ្ងៃសៅរ៍ដែលមានបំណងអនុញ្ញាតឱ្យសាធារណៈជន អ្នកកាសែត និងរដ្ឋាភិបាលតាមដានថាតើ AI ព្រំដែនពិតជាកំពុងត្រូវបានអភិវឌ្ឍលឿនប៉ុណ្ណា — រួមទាំងសន្ទស្សន៍ប្រភេទទីមួយនៃចំនួននៃការស្រាវជ្រាវផ្ទាល់ខ្លួនរបស់ក្រុមហ៊ុនដែលឥឡូវនេះត្រូវបានអនុវត្តដោយ AI និងការបង្ហាញដែលថាភ្នាក់ងារ AI ប្រហែល 30,000 កំពុងធ្វើការស្រាវជ្រាវ និងវិស្វកម្មណាមួយនៅក្នុងក្រុមហ៊ុន។
ការបង្ហោះដែលមានចំណងជើងថា "ការវាស់វែងសម្រាប់ការយល់ដឹងពីល្បឿននៃការអភិវឌ្ឍន៍ AI នៅខាងក្នុងមន្ទីរពិសោធន៍ព្រំដែន" បានមកដល់ចំណុចកណ្តាលនៃអាគុយម៉ង់ជាផលវិបាកបំផុតនៅក្នុងឧស្សាហកម្មនេះ៖ ថាតើការអភិវឌ្ឍន៍ព្រំដែនគួរតែយឺតដោយចេតនាដែរឬទេ។ Dario Amodei បានអំពាវនាវឱ្យមានការសម្របសម្រួលដើម្បី "ជំរុញព្រំដែន" ដែលជាសំណើដែលបានធ្វើឱ្យទីផ្សាររង្គោះរង្គើ ទាក់ទាញការប្តឹងអ្នកប្រើប្រាស់ដោយចោទប្រកាន់ថាមានការឃុបឃិតគ្នាក្នុងចំណោមមន្ទីរពិសោធន៍ធំ ៗ និងបានជំរុញឱ្យប្រធានាធិបតី Trump ប្រកាស "កងកម្លាំង AI" ដែលឧទ្ទិសដល់ការការពារការយឺតយ៉ាវណាមួយ។ ការដាក់ស៊ុមរបស់ Anthropic មានភាពច្បាស់លាស់អំពីបរិបទនោះ៖ "នៅពេលដែលពិភពលោកពិចារណាពីការថយចុះល្បឿននៃការអភិវឌ្ឍន៍ AI ព្រំដែន សាធារណជនត្រូវការព័ត៌មានបន្ថែម"។
វិធានការចំនួនបីសម្រាប់ការតាមដានវឌ្ឍនភាព AI
ក្រុមហ៊ុនបានដាក់ចេញនូវតំបន់វាស់វែងចំនួនបី ដែលខ្លួនអះអាងថា មន្ទីរពិសោធន៍ព្រំដែនណាមួយអាចបោះពុម្ពផ្សាយបានទៀងទាត់៖
១. តើ AI R&D ត្រូវបានអនុវត្តដោយ AI ខ្លួនឯងប៉ុន្មាន។ Anthropic បានបង្កើតគំរូ "Anthropic R&D Automation Index" ដោយធ្វើកាតាឡុករាល់ប្រភេទនៃការស្រាវជ្រាវ AI និងការងារអភិវឌ្ឍន៍ដែលបានធ្វើនៅក្រុមហ៊ុន ដោយវាយតម្លៃពីរបៀបដែលកិច្ចការនីមួយៗបច្ចុប្បន្នមានដោយស្វ័យប្រវត្តិ និងសរុបលទ្ធផល។ ការវាយតម្លៃប្រើប្រាស់មាត្រដ្ឋាន "កម្រិតស្វ័យប្រវត្តិ" សាធារណៈរបស់ Epoch AI ដែលដំណើរការពី AL0 (មិនមានការចូលរួមពី AI) ដល់ AL5 (AI ដំណើរការដោយស្វ័យភាពពេញលេញដោយគ្មានមនុស្សនៅក្នុងរង្វង់)។ នៅលើមាត្រដ្ឋាននេះ AL3 មានន័យថា AI "សហការគ្នា" - ធ្វើការងារធំ ៗ ក្រោមការដឹកនាំរបស់មនុស្សជិតស្និទ្ធ - ខណៈពេលដែល AL4 មានន័យថា AI "ដឹកនាំ" ដែលបញ្ចប់ភារកិច្ចភាគច្រើនពីចុងដល់ចប់ពីកម្រិតខ្ពស់ខណៈពេលដែលមនុស្សត្រួតពិនិត្យ។ចំណុចនៃលិបិក្រមគឺដើម្បីវាស់ស្ទង់ថាតើមន្ទីរពិសោធន៍ណាមួយកំពុងខិតទៅរកការកែលំអខ្លួនឯងឡើងវិញដោយស្វ័យភាព - គំរូបង្កើតអ្នកស្នងតំណែងដោយស្វ័យភាពពេញលេញ។ Anthropic កត់សម្គាល់ថា គំរូដែលពន្លឿនការអភិវឌ្ឍ AI "អាចធ្វើឱ្យវាកាន់តែពិបាកសម្រាប់មនុស្សក្នុងការយល់ដឹង ឬគ្រប់គ្រងប្រព័ន្ធទាំងនេះ"។
២. តើសកម្មភាពរបស់ភ្នាក់ងារ AI ត្រូវបានត្រួតពិនិត្យបានល្អប៉ុណ្ណា។ នេះគឺជាកន្លែងដែលតួលេខ 30,000 លេចឡើង។ គិតត្រឹមខែសីហា ឆ្នាំ 2026 ភ្នាក់ងារប្រមាណ 30,000 នាក់កំពុងធ្វើការស្រាវជ្រាវ និងការងារវិស្វកម្មនៅពេលណាមួយនៅក្នុងវេទិកាផ្ទៃក្នុងដែលប្រើច្រើនបំផុតរបស់ Anthropic ដោយផ្ទេរភារកិច្ចឱ្យគ្នាទៅវិញទៅមក និងធ្វើការពាក់កណ្តាលស្វយ័តសម្រាប់រយៈពេលយូរ។ ក្រុមហ៊ុនវាស់វែងរឿងបីយ៉ាងអំពីការត្រួតពិនិត្យភ្នាក់ងារទាំងនោះ៖ ការគ្របដណ្តប់ (ចំណែកនៃសកម្មភាពភ្នាក់ងារដែលឆ្លងកាត់ម៉ូនីទ័រមុន ឬក្រោយការប្រតិបត្តិ) ការពិនិត្យភាពយឺតយ៉ាវ (ថាតើសកម្មភាពដែលបានដាក់ទង់បានលឿនប៉ុណ្ណាត្រូវបានពិនិត្យ ទីមួយដោយម៉ូនីទ័រស្វ័យប្រវត្តិហើយបន្ទាប់មកដោយមនុស្ស) និងអត្រាកើនឡើង (ចំណែកនៃសកម្មភាពដែលត្រូវបានរារាំង បញ្ជូនបន្ត ឬដាក់ទង់សម្រាប់ការត្រួតពិនិត្យ)។ទិន្នន័យត្រួតពិនិត្យរបស់ Anthropic រហូតមកដល់ពេលនេះបង្ហាញថាភ្នាក់ងារនីមួយៗកម្រមានអាកប្បកិរិយាខុសឆ្គង ប៉ុន្តែក្រុមហ៊ុនព្រមានថា "នៅពេលដែលមានភ្នាក់ងាររាប់លាន ឬរាប់ពាន់លានដែលកំពុងប្រតិបត្តិការនៅក្នុងសេដ្ឋកិច្ច សូម្បីតែព្រឹត្តិការណ៍ដ៏កម្រក៏អាចកើតឡើងជាទៀងទាត់ដែរ"។
៣. របៀបគណនាត្រូវបានបែងចែក។ ការវាស់វែងទីបីតាមដានពីរបៀបដែលធនធានកុំព្យូទ័ររបស់មន្ទីរពិសោធន៍ត្រូវបានចែកចាយ — ធាតុបញ្ចូលឆៅដែលទាក់ទងនឹងសមត្ថភាពគំរូ។ រួមជាមួយនឹងរង្វាស់ពីរផ្សេងទៀត Anthropic អះអាងថា នេះផ្តល់ឱ្យអ្នកខាងក្រៅនូវវិធីមួយដើម្បីទាក់ទងធាតុបញ្ចូលគំរូជាមួយនឹងលទ្ធផលគំរូ ដោយបំពេញបន្ថែមការវាយតម្លៃសមត្ថភាពដែលក្រុមហ៊ុនបានផ្សព្វផ្សាយរួចហើយតាមរយៈរបាយការណ៍ហានិភ័យគោលនយោបាយមាត្រដ្ឋានដែលទទួលខុសត្រូវរបស់ខ្លួន។លេខនឹងផ្លាស់ទីក្រោមការយឺតយ៉ាវ
បន្ទាត់ដែលចង្អុលទៅខាងនយោបាយបំផុតនៅក្នុងការប្រកាសគឺសំដៅដោយផ្ទាល់ទៅលើការជជែកដេញដោលគ្នា៖ Anthropic និយាយថាវា "នឹងរំពឹងថាចំនួនទាំងនេះនឹងផ្លាស់ប្តូរប្រសិនបើមានការសម្របសម្រួលលើការកំណត់ព្រំដែន ដូចដែលបានអំពាវនាវដោយនាយកប្រតិបត្តិ Anthropic Dario Amodei" ។ ម៉្យាងទៀត ប្រសិនបើឧស្សាហកម្មធ្លាក់ចុះយ៉ាងពិតប្រាកដនោះ រង្វាស់ទាំងនេះគឺជារបៀបដែលសាធារណៈជនអាចផ្ទៀងផ្ទាត់វា ហើយប្រសិនបើក្រុមហ៊ុនអះអាងថាមានល្បឿនខណៈពេលដែលចំនួនរបស់ពួកគេបន្តកើនឡើង ការវាស់វែងនឹងបង្ហាញឱ្យឃើញផងដែរ។
ការផ្ទៀងផ្ទាត់ឯករាជ្យគឺជាបំណែកដែលបាត់
Anthropic ទទួលស្គាល់ចំណុចខ្សោយកណ្តាលនៃរង្វាស់ដែលរាយការណ៍ដោយខ្លួនឯង៖ វាកំពុងប្រើគំរូរបស់វាដើម្បីវាយតម្លៃប្រព័ន្ធរបស់ខ្លួន ដែលមានន័យថាគំរូ "ចៅក្រម" អាចចែករំលែកចំណុចងងឹតនៃគំរូដែលកំពុងត្រូវបានត្រួតពិនិត្យ។ ក្រុមហ៊ុនក៏បានកត់សម្គាល់ផងដែរពីកង្វះវិធីសាស្រ្តរួមនៅទូទាំងមន្ទីរពិសោធន៍ ដែលធ្វើអោយការប្រៀបធៀបពិបាក។
ដំណោះស្រាយដែលបានស្នើឡើងរបស់វាគឺដើម្បីបង្កប់អ្នកវាយតម្លៃភាគីទីបីឯករាជ្យពីអង្គការជាច្រើននៅខាងក្នុង Anthropic ដោយផ្តល់ឱ្យពួកគេនូវដំណើរការផ្ទៃក្នុង ប្រព័ន្ធ និងទិន្នន័យដែលប្រៀបធៀបទៅនឹងអ្វីដែលក្រុមវាយតម្លៃហានិភ័យខាងក្នុងមើលឃើញ។ ភាគីទីបីទាំងនោះនឹងផ្ទៀងផ្ទាត់ការអនុវត្តសុវត្ថិភាព រាយការណ៍ពីឧប្បត្តិហេតុ និងតាមដានការវាស់វែងថ្មី។ ក្រុមហ៊ុននិយាយថា METR ដែលជាអង្គការវាយតម្លៃមិនស្វែងរកប្រាក់ចំណេញ ពីមុនបានបង្កើតជាក្រុមដោយឯករាជ្យនូវវេទិកាត្រួតពិនិត្យក្រៅបណ្តាញរបស់ខ្លួន ហើយថាខ្លួនមានគម្រោងផ្សព្វផ្សាយការវាស់វែងទាំងនេះជាទៀងទាត់ក្នុងទម្រង់ដែលអ្នកដទៃអាចផ្ទៀងផ្ទាត់បាន។
ការវាស់វែងនេះភ្ជាប់ទៅក្នុងសំណើគម្រោង AI Framework ដ៏ទូលំទូលាយរបស់ Anthropic ដែលដាក់ចេញ "ច្បាប់នៃផ្លូវ" សម្រាប់ការចេញផ្សាយគំរូព្រំដែន រួមទាំងកាតព្វកិច្ចតម្លាភាពដែលរដ្ឋាភិបាលអាចទាមទារ ដូចជារបាយការណ៍ហានិភ័យស្តង់ដារ។
ការធ្វើតេស្តសម្រាប់ឧស្សាហកម្មទាំងមូល
សារៈសំខាន់កាន់តែស៊ីជម្រៅនៃការប្រកាសអាចជាការប្រកួតប្រជែង។ Anthropic កំពុងប្រកួតប្រជែងយ៉ាងមានប្រសិទ្ធភាពគ្រប់មន្ទីរពិសោធន៍ព្រំដែនទាំងអស់ក្នុងការបោះពុម្ពលេខដូចគ្នា ដោយលើកហេតុផលថា "អ្នកអភិវឌ្ឍន៍ព្រំដែនណាមួយអាចបោះពុម្ពវិធានការទាំងនេះជាទៀងទាត់ ដោយប្រើវិធីសាស្រ្តសាធារណៈ"។ ប្រសិនបើគូប្រជែងធ្លាក់ចុះ ភាពផ្ទុយគ្នានឹងក្លាយទៅជាចំណុចទិន្នន័យផ្ទាល់របស់វានៅក្នុងការពិភាក្សាអំពីសុវត្ថិភាព។ ប្រសិនបើពួកគេយល់ព្រម ឧស្សាហកម្មនេះទទួលបាន yardstick ទូទៅដំបូងសម្រាប់ល្បឿន AI ពិតជាជឿនលឿន។
សម្រាប់ពេលនេះ លេខត្រូវបានរាយការណ៍ដោយខ្លួនឯងដោយក្រុមហ៊ុនដែលមានចំណាប់អារម្មណ៍ជាក់ស្តែងនៅក្នុងការសន្ទនាដែលមានល្បឿន។ ប៉ុន្តែពួកគេតំណាងឱ្យអ្វីមួយដែលការជជែកដេញដោលខ្វះខាត៖ ជាក់ស្តែង ការវាស់វែងដែលអាចកើតឡើងដដែលៗដែលនឹងបង្ហាញថា តើព្រំដែនកំពុងបង្កើនល្បឿន រក្សាស្ថិរភាព ឬពិតជាថយចុះ។
នាំមុខ AI
ការលាតត្រដាងមន្ទីរពិសោធន៍ Frontier បែបនេះ ដីមួយប្រចាំសប្តាហ៍។ សម្រាប់ការស្រាវជ្រាវ AI និងការគ្របដណ្តប់ឧស្សាហកម្មដែលបែកធ្លាយបន្ថែមទៀត សូមអនុវត្តតាម AI Buzz Wire។
អានព័ត៌មាន AI ចុងក្រោយបំផុត →