នៅពេលដែលមនុស្សរាប់លាននាក់ងាកទៅរក AI chatbots ដើម្បីរកចម្លើយលើព័ត៌មាន អំណះអំណាងនយោបាយ និងសូម្បីតែរបៀបបោះឆ្នោត ការសិក្សាថ្មីមួយបានសួរសំណួរមិនស្រួលមួយ៖ នៅពេលដែលម៉ូដែលមិនយល់ស្របជាមួយយើង តើពួកគេពឹងផ្អែកលើវិធីណា?

គម្រោងមួយដែលត្រូវបានបោះពុម្ពផ្សាយដោយអ្នកចាប់ផ្តើមវិភាគ Trakkr ក្នុងខែមិថុនា ឆ្នាំ 2026 បានរៀបចំផែនទីយ៉ាងពិតប្រាកដនោះ។ អ្នកស្រាវជ្រាវបានដាក់រាល់គំរូ AI សំខាន់ៗតាមរយៈថ្មដូចគ្នានៃសំណួរដែលចោទសួរអំពីនយោបាយ សេដ្ឋកិច្ច ការនិយាយ និងសង្គម ហើយការរកឃើញចំណងជើងគឺថាពួកគេភាគច្រើនគ្មានខ្លាញ់ដូចគ្នា ទោះបីជាមិនមានបរិមាណដូចគ្នា និងមិនស្អាតដូចអ្នកសង្កេតការណ៍ធម្មតាអាចសន្មត់បាន។ For more context on this story, see our ongoing AI news.

របៀបដែលការសិក្សាដំណើរការ

យោងតាមវិធីសាស្រ្តរបស់ Trakkr ម៉ូដែលនីមួយៗត្រូវបានសួរសំណួរបើកចំហដូចគ្នាជាច្រើនដង ដោយ ការស្វែងរកតាមគេហទំព័របានបិទ ហើយមិនមានការបញ្ចូលប្រព័ន្ធទេ។ ព័ត៌មានលម្អិតនោះសំខាន់៖ ជាមួយនឹងការបិទការទាញយកមកវិញ ការអានឆ្លុះបញ្ចាំងពីអ្វីដែលគំរូខ្លួនឯងងាកទៅរក ដោយឯករាជ្យពីអ្វីដែលកើតឡើងនៅលើអ៊ីនធឺណិតនៅពេលនេះ។

អ្នកចាត់ថ្នាក់អព្យាក្រឹតដាច់ដោយឡែក បន្ទាប់មកអានចម្លើយឆៅនីមួយៗ កត់ត្រាជំហរដែលបានចុះហត្ថលេខា កម្រិតនៃការការពារ ប្រភេទនៃការបដិសេធ និងភាសាដែលបានផ្ទុកណាមួយ។ លទ្ធផលត្រូវបានគ្រោងទុកជាមធ្យោបាយដែលមានទម្ងន់ជាមួយនឹងចន្លោះពេលទំនុកចិត្ត 95 ភាគរយ ហើយរាល់ចម្លើយឆៅត្រូវបានរក្សាទុកជាអចិន្ត្រៃយ៍ ដូច្នេះពិន្ទុអាចត្រូវបានគណនាឡើងវិញ។

សំខាន់ ម៉ូដែលនីមួយៗត្រូវបានបង្ហាញជា ពពក ជាជាងចំណុចតែមួយ។ ដោយសារតែគ្រប់ម៉ូដែលទាំងអស់ត្រូវបានដំណើរការជាច្រើនដង ការមើលឃើញចាប់យកការរីករាលដាលពេញលេញនៃកន្លែងដែលវាបានចុះចតនៅទូទាំងការរត់ — ជារូបភាពដ៏ស្មោះត្រង់ជាងស្លាកតែមួយ។

យោងតាមទិន្នន័យដែលប្រមូលបានរហូតដល់ថ្ងៃទី 17 ខែមិថុនា ឆ្នាំ 2026 ការសិក្សាបានគ្របដណ្តប់លើគំរូចំនួន 6 និងច្រើនជាង 4,400 ចម្លើយ។

ការរកឃើញ

គំរូត្រូវបានគូសវាសតាមអ័ក្សពីរ៖ អ័ក្សសេដ្ឋកិច្ចរត់ពីឆ្វេងទៅស្តាំ និងអ័ក្សសង្គមដំណើរការពីសេរីនិយមទៅផ្តាច់ការ។

ម៉ូដែល 4 ក្នុងចំណោម 6 បត់ឆ្វេងពីកណ្តាល។ ការលើកលែងដែលលេចធ្លោគឺស្ថិតនៅលើចុងម្ខាងនៃវិសាលគម៖
  • Grok បានវាស់ឆ្ងាយបំផុតទៅខាងស្ដាំនៃម៉ូដែលណាមួយដែលបានសាកល្បង ហើយគួរឱ្យកត់សម្គាល់វាស់ប្រហែល 0.36 ខាងស្ដាំជាងអ្វីដែលវាទាមទារនៅពេលសួរដោយផ្ទាល់ថាតើវាទំនោរទៅណា។
  • Gemini គឺជាគំរូស្ថិរភាពបំផុត ដោយអង្គុយជិតបំផុតទៅនឹងមជ្ឈមណ្ឌលស្លាប់នៅលើអ័ក្សសេដ្ឋកិច្ច។

គម្លាត​រវាង​អ្វី​ដែល​គំរូ​និយាយ និង​អ្វី​ដែល​វា​ធ្វើ​បាន​បង្ហាញ​ថា​ជា​ម៉ែត្រ​បង្ហាញ​ឱ្យ​ឃើញ​បំផុត​ក្នុង​ការ​សិក្សា។ លោក Claude បានវាស់នៅជុំវិញ 0.34 នៅខាងឆ្វេងជាងការរាយការណ៍ដោយខ្លួនឯង។ ChatGPT និង Llama របស់ Meta ទាំងពីរបានអះអាងថាអព្យាក្រឹតភាពនៅតែវាស់វែងទៅខាងឆ្វេងប្រហែល 0.29 និង 0.17 រៀងគ្នា។ DeepSeek បានចុះចតនៅជិតមជ្ឈមណ្ឌល ហើយភាគច្រើនត្រូវគ្នានឹងការពិពណ៌នាដោយខ្លួនឯង។

ផែនទីមិនមែនជាសាលក្រមទេ។

Trakkr ប្រុងប្រយ័ត្នក្នុងការរៀបចំការងារជាការពិពណ៌នាជាជាងតាមវេជ្ជបញ្ជា។ គម្រោង​នេះ​រាយការណ៍​ពី​អ្វី​ដែល​ម៉ូដែល​បាន​និយាយ​ដោយ​មិន​បាន​កំណត់​ថា​អ្នក​ណា​ត្រូវ។ ក្ដារលាយពណ៌គឺចេតនាមិនមែនជាពណ៌ក្រហម និងខៀវនៃនយោបាយសហរដ្ឋអាមេរិកទេ ហើយការវិភាគមិនដែលបញ្ជាក់ថាបង្គោលមួយណាដែលល្អជាង។

ដើម្បីផ្តល់អត្ថន័យនៃកូអរដោណេអរូបី អ្នកស្រាវជ្រាវបានបោះយុថ្កាលើផែនទីដោយប្រើតួរលេខយោងក្នុងពិភពពិត - ប្រមុខរដ្ឋ មេដឹកនាំបក្ស និងចលនានយោបាយ - ដែលមុខតំណែងរបស់ពួកគេបានមកពីការស្ទង់មតិអ្នកជំនាញដែលបានបង្កើតឡើង ជាពិសេសការស្ទង់មតិ Chapel Hill Expert Survey (CHES) ឆ្នាំ 2024 និងសំណុំទិន្នន័យ V-Dem ជាជាងការវិនិច្ឆ័យផ្ទាល់របស់ក្រុម។

ការសិក្សាក៏បានបំបែកសំណួរជាក់លាក់ដែលបែងចែកម៉ូដែលភាគច្រើន តួរលេខក្នុងពិភពពិត ម៉ូដែលនីមួយៗសរសើរយ៉ាងកក់ក្តៅ ឬបដិសេធមិនរិះគន់ និងកញ្ចក់ "ទស្សនៈពិភពលោក" ដែលពិនិត្យមើលគំរូដូចគ្នាឡើងវិញតាមទស្សនៈនៃប្រទេស និងភាសាផ្សេងៗគ្នា។

ហេតុអ្វីវាសំខាន់

ការជំរុញឱ្យមានតម្លាភាពកើតឡើងចំពេលដែលការពិនិត្យមើលកាន់តែខ្លាំងក្លាអំពីរបៀបដែលប្រព័ន្ធ AI បង្កើតការនិយាយជាសាធារណៈ។ ភាពស្លូតបូតរបស់តារាបង្ហាញម៉ូត សូម្បីតែភាពស្រើបស្រាលក៏អាចដឹកនាំដោយស្ងៀមស្ងាត់នូវវិធីដែលវាសង្ខេបរឿងព័ត៌មាន ថ្លឹងថ្លែងការដោះដូរគោលនយោបាយ ឬលក្ខណៈអ្នកនយោបាយ។ ដោយសារតែចម្លើយរបស់ chatbot តែងតែមកជាមួយខ្យល់នៃសិទ្ធិអំណាចអព្យាក្រឹត អ្នកប្រើប្រាស់កម្រមានវិធីដើម្បីរកឃើញការរសាត់នោះ។

តាមរយៈការបោះផ្សាយធនាគារសំណួរបើកចំហជាមួយនឹងទម្ងន់ពិន្ទុ ការដាក់ស្លាកធាតុនីមួយៗថាជាការពិត ឬផ្អែកលើតម្លៃ និងការចេញផ្សាយទិន្នន័យមូលដ្ឋានក្រោមអាជ្ញាប័ណ្ណ Creative Commons Trakkr កំពុងអញ្ជើញអ្នកស្រាវជ្រាវខាងក្រៅឱ្យផ្ទៀងផ្ទាត់ និងពង្រីកការងារ ដែលផ្ទុយនឹងការវាយតម្លៃជាញឹកញាប់ស្រអាប់ដែលចេញផ្សាយដោយមន្ទីរពិសោធន៍ដែលបង្កើតគំរូដោយខ្លួនឯង។

ដែនកំណត់

ការសិក្សាទទួលស្គាល់ការព្រមានសំខាន់ៗ។ ជំហរ​នយោបាយ​មាន​លក្ខណៈ​ចម្រុះ ហើយ​ការ​បង្ហាប់​វា​ទៅ​លើ​អ័ក្ស​ពីរ​ដោយ​ជៀស​មិន​រួច​បាត់បង់​ភាព​មិន​ច្បាស់។ ចម្លើយអាចផ្លាស់ប្តូរជាមួយឃ្លា ភាសា និងតំបន់ ដែលនេះជាមូលហេតុដែលក្រុមវាស់ស្ទង់ស្ថេរភាពនៃការរត់ទៅរត់ ហើយដំណើរការ "ការធ្វើតេស្តព្រំដែន" ដាច់ដោយឡែក ដើម្បីមើលពីរបៀបដែលការបង្វែរការស្វែងរកគេហទំព័រត្រឡប់មកវិញលើលទ្ធផលនៃការផ្លាស់ប្តូរតាមទីតាំង។

នេះ​មិន​មាន​ការ​បញ្ជាក់​ថា​ម៉ូដែល​ណា​មួយ​គឺ​ជា​បក្ស​ពួក​ដោយ​ចេតនា។ ប៉ុន្តែវាបង្ហាញថាប្រព័ន្ធ AI សំខាន់ៗមិនកាន់កាប់ដីដូចគ្នាទេ ហើយនៅពេលដែលមនុស្សរាប់លាននាក់ពិគ្រោះជាមួយពួកគេលើសំណួរដែលប្រកួតប្រជែង ភាពខុសគ្នាតូចៗទាំងនោះបានបន្ថែម។

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →