Claude Opus 5.5 របស់ Anthropic បានបោះបង់ចោលទាំងអស់ លើកលែងតែ em dash ដែលជា tics ដែលអាចស្គាល់បានបំផុតនៃអត្ថបទដែលបង្កើតដោយ AI នេះបើយោងតាមការវិភាគថ្មីពីវេទិកាគោល Arena ។ គំរូឥឡូវនេះប្រើសញ្ញាដាច់ ៗ តិចជាង em ប្រហែល 95 ភាគរយជាងអ្នកកាន់តំណែងមុន សរសេរជាប្រយោគខ្លីជាង និងចូលចិត្តពាក្យសាមញ្ញជាង។ មានការដោះដូរគួរឱ្យកត់សម្គាល់មួយ៖ ចម្លើយរបស់វាកាន់តែយូរ។

ការរកឃើញនេះបានមកពីការវិភាគរបស់ Arena នៃការឆ្លើយតបដែលមានហេតុផលខ្ពស់ដែលប្រមូលបានតាមរយៈ Text Arena ចន្លោះខែសីហា និងខែកញ្ញា ឆ្នាំ 2026 ដូចដែលបានរាយការណ៍ដោយ BleepingComputer ។ ក្នុងចំណោមវិធានការសរសេរទាំងដប់ពីរ Arena បានតាមដាន ដប់បានផ្លាស់ប្តូរនៅក្នុងអ្វីដែលវេទិកានេះចាត់ទុកថាជាទិសដៅប្រសើរជាងបើធៀបនឹង Claude Opus 5 ។ For more context on this story, see our ongoing more AI stories.

លេខនៅពីក្រោយការផ្លាស់ប្តូររចនាប័ទ្មរបស់ Claude

ស្ថិតិចំណងជើងគឺជាការដួលរលំនៃ em dash ។ Opus 5 បានប្រើ 15.2 em dashes ក្នុង 1,000 ពាក្យ ខណៈពេលដែល Opus 5.5 បានទម្លាក់តួលេខនោះមកត្រឹមតែ 0.8 ដែលជាការថយចុះប្រហែល 95 ភាគរយ នេះបើយោងតាមទិន្នន័យរបស់ Arena ។

សញ្ញាសម្គាល់ដែលជាទម្លាប់នៃការដាក់វណ្ណយុត្តិមួយផ្សេងទៀតដែលជារឿយៗត្រូវបានសម្គាល់ថាដូចម៉ាស៊ីនបានធ្លាក់ចុះយ៉ាងខ្លាំងផងដែរ ពី 6.10 ទៅ 1.64 ក្នុង 1,000 ពាក្យ។ រចនាសម្ព័ន្ធប្រយោគបានផ្លាស់ប្តូរស្របនឹងវណ្ណយុត្តិ៖ ប្រយោគជាមធ្យមនៅក្នុងការឆ្លើយតប Opus 5.5 ឥឡូវនេះដំណើរការ 10.03 ពាក្យ ធ្លាក់ចុះពី 12.14 ពាក្យសម្រាប់ Opus 5 ជាមួយនឹងការវិភាគក៏បានកត់សម្គាល់ពីជម្រើសពាក្យសាមញ្ញជាង និងតិចជាងនៃប្រយោគដែលជាប់គាំងវែង ដែលបានក្លាយជាហត្ថលេខានៃគំរូមុនៗ។

សំណុំទិន្នន័យរបស់ Arena ផ្តោតលើការឆ្លើយតបដែលមានហេតុផលខ្ពស់ពី Text Arena ក្នុងរយៈពេលពីរខែ ដែលមានន័យថាការប្រៀបធៀបត្រូវបានកំណត់ទៅការកំណត់ការវាយតម្លៃជាក់លាក់ជាជាងការប្រើប្រាស់ប្រចាំថ្ងៃ។ ទោះបីជាដូច្នេះក៏ដោយ ទិសដៅនៃការផ្លាស់ប្តូរគឺស្របគ្នានៅទូទាំងវិធានការភាគច្រើនដែលវេទិកាបានតាមដាន។

ហេតុអ្វីបានជា Em Dash ក្លាយជាកាតហៅរបស់ AI

The em dash បានកាន់កាប់ទីតាំងចម្លែកមួយនៅក្នុងវប្បធម៌សរសេរ AI ។ អស់រយៈពេលជាច្រើនឆ្នាំ ការខ្ចាត់ខ្ចាយនៃសញ្ញាដាច់ ៗ ត្រូវបានចាត់ទុកដោយអ្នកអាន អ្នកកែសម្រួល និងឧបករណ៍រាវរក AI ដែលកំណត់រចនាប័ទ្មដោយខ្លួនឯងថាជាសញ្ញានៃការនិយាយដែលបង្កើតដោយម៉ាស៊ីន រហូតដល់សញ្ញាវណ្ណយុត្តិបានក្លាយជាពាក្យខ្លីសម្រាប់បាតុភូតទូលំទូលាយនៃមាតិកាដែលផលិតដោយម៉ាស៊ីនដែលមានគុណភាពទាប ដែលជារឿយៗត្រូវបានច្រានចោលថាជា "AI slop" ។

ថាតើគំរូនៃគំរូនេះធ្លាប់ជាសញ្ញាដែលអាចទុកចិត្តបានគឺអាចជជែកវែកញែកបាន ចាប់តាំងពីអ្នកសរសេរអត្ថបទជាច្រើនប្រើសញ្ញាដាច់ ៗ ដោយសេរី ហើយអត្ថបទ AI ជាច្រើនបានជៀសវាងពួកគេ។ ប៉ុន្តែការយល់ឃើញមានសារៈសំខាន់ជាពិសេសសម្រាប់អាជីវកម្មដែលប្រើគំរូភាសាធំៗដើម្បីធ្វើសេចក្តីព្រាងច្បាប់ចម្លងទីផ្សារ ឯកសារ និងអត្ថបទ ហើយមិនចង់ឱ្យលទ្ធផលរបស់ពួកគេអានជាការសំយោគជាក់ស្តែង។

ប្រឆាំងនឹងផ្ទៃខាងក្រោយនោះ គំរូដែលបង្ហាញឱ្យឃើញពីការជៀសវាងគំរូមានចំណុចលក់ជាក់ស្តែង។ ដូចដែល BleepingComputer បានសង្កេតនៅក្នុងរបាយការណ៍របស់ខ្លួន ការកាត់បន្ថយការពឹងផ្អែករបស់ Opus 5.5 លើគំរូសរសេរ AI ជាក់ស្តែងមានន័យថាអ្នកប្រើប្រាស់ទំនងជាមិនសូវបង្កើតអត្ថបទដែលអានជាលទ្ធផលម៉ាស៊ីនទូទៅទេ។

The Trade-Off: ប្រយោគខ្លីជាង ចម្លើយវែងជាង

រង្វាស់មួយដែលផ្លាស់ប្តូរផ្លូវខុសគឺពាក្យសំដី។ យោងតាមលេខរបស់ Arena ប្រវែងចម្លើយជាមធ្យមសម្រាប់ Opus 5.5 បានកើនឡើងពី 453 ពាក្យទៅ 481 ពាក្យធៀបនឹង Opus 5 ដែលធ្វើឱ្យវាក្លាយជាគំរូ Opus ដែលសរសេរវែងជាងគេក្នុងការប្រៀបធៀប។

នោះអាចហាក់ដូចជាការកើនឡើងតិចតួច ប៉ុន្តែវាដំណើរការផ្ទុយទៅនឹងនិន្នាការឧស្សាហកម្មដ៏ទូលំទូលាយឆ្ពោះទៅរក terser លទ្ធផលនៃគំរូផ្ទាល់កាន់តែច្រើន ហើយវាមានន័យថាអ្នកប្រើប្រាស់ដែលដុតសញ្ញាសម្ងាត់នៅលើការហៅ API អាចចំណាយច្រើនជាងបន្តិចសម្រាប់សារធាតុដូចគ្នា។ ប្រយោគខ្លីៗ រួមផ្សំនឹងចម្លើយដែលវែងជាងនេះ ក៏បង្កប់ន័យច្រើនជាងនេះផងដែរ៖ គំរូកំពុងបំបែកការនិយាយរបស់វាទៅជាបំណែកតូចៗ ខណៈដែលនិយាយរួមកាន់តែច្រើន។

ជា​ការ​ពិត​ណាស់ ការ​និយាយ​ពាក្យ​សំដី​មិន​មែន​ជា​កំហុស​ដោយ​ស្វ័យ​ប្រវត្តិ​ទេ។ សម្រាប់កិច្ចការដូចជា ការពន្យល់ ឯកសារ និងការវិភាគ ប្រយោគបន្ថែមមួយចំនួនអាចបន្ថែមភាពច្បាស់លាស់។ សម្រាប់​ចម្លើយ​រហ័ស ឬ​បន្ទុក​ការងារ​ដែល​ងាយ​នឹង​ចំណាយ វា​ជា​និន្នាការ​ដែល​គួរ​មើល។

តើវាមានន័យយ៉ាងណាសម្រាប់អ្នកនិពន្ធ អ្នកកែសម្រួល និងឧបករណ៍ស្វែងរក

ការវិភាគគឺជាការរំលឹកថាស្នាមម្រាមដៃស្ថិតិនៃអត្ថបទ AI កំពុងផ្លាស់ទីគោលដៅ។ ឧបករណ៍ និងសរីរវិទ្យាដែលបង្កើតឡើងដើម្បីដាក់ទង់សញ្ញាដាច់ ៗ ទម្លាប់នៃសញ្ញាក្បៀស ឬប្រវែងប្រយោគនឹងថយចុះ នៅពេលដែលមន្ទីរពិសោធន៍កំណត់លំនាំទាំងនោះដោយចេតនា ថាតើត្រូវកែលម្អលទ្ធភាពអាន ឬគ្រាន់តែគេចចេញពីការមាក់ងាយដែលភ្ជាប់ជាមួយពួកគេ។

វាក៏គូសបញ្ជាក់ផងដែរថាតើការប្រកួតប្រជែងប៉ុន្មានក្នុងចំណោមម៉ូដែលជួរមុខបានផ្លាស់ប្តូរឆ្ពោះទៅរកគុណភាពដែលពិបាកនឹងចាប់យកតាមស្តង់ដារប្រពៃណី។ ទិន្នន័យរបស់ Arena បង្ហាញថា Anthropic កំពុងយកចិត្តទុកដាក់លើរបៀបដែលគំរូរបស់វាសរសេរ មិនមែនត្រឹមតែរបៀបដែលវាសរសេរកូដនោះទេ។ BleepingComputer កត់សម្គាល់ថា Opus 5.5 ត្រូវបានចាត់ទុកថាជាគំរូដ៏រឹងមាំបំផុតមួយសម្រាប់ការសរសេរកូដ ហើយគុណភាពនៃការសរសេរបានក្លាយជាភាពខុសគ្នាដ៏ស្ងប់ស្ងាត់នៅក្នុងទីផ្សារដែលការប្រៀបធៀបសាធារណៈភាគច្រើនទាក់ទងនឹងការវាយតម្លៃភ្នាក់ងារ និងកម្មវិធី។

ការផ្លាស់ប្តូរតូចមួយជាមួយនឹងបាតជើងដែលអាចមើលឃើញ

គ្មាន​នរណា​ម្នាក់​អាន​តារាង​ពិន្ទុ​គោល​និង​ផ្លាស់​ប្តូ​រ​ពាក្យ​របស់​ពួក​គេ​។ ប៉ុន្តែគុណនឹងបរិមាណដ៏ធំនៃអត្ថបទដែលគំរូភាសាធំ ៗ ឥឡូវនេះផលិតជារៀងរាល់ថ្ងៃ ការធ្លាក់ចុះ 95 ភាគរយនៃការប្រើប្រាស់ em dash គឺជាប្រភេទនៃការផ្លាស់ប្តូរដែលអាចមើលឃើញនៅក្នុងធម្មជាតិ ដូចដែលរបាយការណ៍បានដាក់វា បន្ទាត់ដាច់ ៗ តិចជាងមុននៅលើអ៊ីនធឺណិត។

សម្រាប់​ពេល​នេះ ការ​យក​ចេញ​គឺ​ត្រង់។ Claude Opus 5.5 សរសេរ​ដោយ​ប្រើ​ទម្លាប់​វណ្ណយុត្តិ​តិច​ជាង​ដែល​ទាក់ទង​នឹង​អត្ថបទ​ដែល​បង្កើត​ដោយ AI រក្សា​ប្រយោគ​ឱ្យ​ខ្លី និង​ប្រើ​ពាក្យ​សាមញ្ញ​ជាង​ពាក្យ​ជំនាន់​មុន​របស់​វា។ វាក៏និយាយបន្តិចទៀត។ ថាតើការបញ្ចូលគ្នានោះអានបានល្អជាង គឺជាការវិនិច្ឆ័យសម្រាប់អ្នកប្រើប្រាស់ម្នាក់ៗ ប៉ុន្តែវាគឺជាឧទាហរណ៍ជាក់ស្តែងដែលអាចវាស់វែងបាននៃមន្ទីរពិសោធន៍ដែលផ្លាស់ប្តូរយ៉ាងសកម្មនូវអ្វីដែលការសរសេរម៉ាស៊ីនស្តាប់ទៅដូចនោះ។

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →