ម៉ូដែល Frontier AI មានភាពខុសប្លែកគ្នាយ៉ាងខ្លាំងនៅក្នុងរបៀបដែលពួកគេពិបាកបំបែក នេះបើយោងតាមស្តង់ដារថ្មីមួយពីអង្គការមិនរកប្រាក់ចំណេញសុវត្ថិភាព FAR.AI ហើយគម្លាតនេះគឺធំជាងការសន្មត់ជាច្រើន។
កាលពីថ្ងៃទី 29 ខែកក្កដា ក្រុមហ៊ុន FAR.AI បានបើកដំណើរការ AI Security Leaderboard របស់ខ្លួន ដោយសាកល្បងការការពារនៃម៉ូដែលនាំមុខចំនួន 4 ក្រោមលក្ខខណ្ឌដូចគ្នា។ អង្គការនេះបាននិយាយថា Claude Fable 5 របស់ Anthropic និង GPT-5.6 Sol របស់ OpenAI បានរក្សាយ៉ាងរឹងមាំប្រឆាំងនឹងការវាយប្រហារនេះ ខណៈដែល xAI's Grok 4.5 និង Gemini 3.1 Pro របស់ Google បានបំបែកក្នុងតម្លៃក្រោម 300 ដុល្លារ។ FAR.AI បានពិពណ៌នាអំពីភាពខុសគ្នារវាងម៉ូដែលដែលរឹងមាំបំផុត និងតិចបំផុតថាជា "គម្លាតរាប់រយ" ក្នុងការការពារ។ For more context on this story, see our ongoing latest AI developments.
ទន្ទឹមនឹងតារាងពិន្ទុ FAR.AI បានណែនាំនូវអ្វីដែលវាហៅថា Minimal Standard for Safeguards ដែលជាមូលដ្ឋានសុវត្ថិភាពរួមគ្នាដែលប្រមូលផ្តុំទាំងស្រុងពីការការពារដែលអ្នកអភិវឌ្ឍន៍ដូចគ្នាដំណើរការរួចហើយនៅក្នុងផលិតកម្ម។ គោលដៅគឺផ្តល់ឱ្យមន្ទីរពិសោធន៍នូវជាន់បេតុងមួយដើម្បីជួប - និងធ្វើឱ្យការការពារខ្សោយមើលឃើញ។
ការរកឃើញបានបន្ទរលើការធ្វើតេស្តស្ត្រេសមុនរបស់ FAR.AI។ របាយការណ៍ខែឧសភាបានរកឃើញថាការការពាររបស់ DeepSeek-V4-Pro បាន "ដួលរលំស្ទើរតែទាំងស្រុង" ដោយអ្នកវាយប្រហារដែលមានជំនាញទាបបានឆ្លងកាត់យន្តការសុវត្ថិភាព 98-100% នៃពេលវេលានៅទូទាំងដែនទាំងអស់ដែលបានសាកល្បង។ ការ jailbreak ដែលអាចប្រើបានជាសាធារណៈដែលបង្កើតឡើងសម្រាប់អ្នកជំនាន់មុនរបស់ម៉ូដែលបានដំណើរការដោយគ្មានការកែប្រែតែមួយ ដែលបង្ហាញថាភាពងាយរងគ្រោះដែលគេស្គាល់បានមិនត្រូវបានជួសជុល។
WIRED ដែលរាយការណ៍នៅលើតារាងពិន្ទុបានសន្និដ្ឋានថាវានៅតែ "ងាយស្រួលគួរឱ្យភ័យខ្លាចក្នុងការ jailbreak ម៉ូដែល AI ព្រំដែនមួយចំនួន" ។ នៅពេលដែលភ្នាក់ងារទទួលយកកិច្ចការរសើបកាន់តែច្រើន ភាពមិនស្មើគ្នាបង្កឱ្យមានសំណួរជាខ្លាំងអំពីប្រព័ន្ធណាដែលមានសុវត្ថិភាពក្នុងការដាក់ពង្រាយ។
សម្រាប់ការគ្របដណ្តប់ជាបន្តបន្ទាប់នៃការស្រាវជ្រាវសុវត្ថិភាព និងសុវត្ថិភាព AI អ្នកអានអាចធ្វើតាម AI Buzz Wire ។
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →