Anthropic បានដាក់ឱ្យដំណើរការ OSS Scanner ដែលជាសេវាកម្មជ្រើសរើសដោយឥតគិតថ្លៃដែលប្រើគំរូ AI ខ្លាំងបំផុតរបស់ក្រុមហ៊ុន — រួមទាំង Claude Mythos — ដើម្បីស្កែនគម្រោងប្រភពបើកចំហដែលមានសិទ្ធិជាទៀងទាត់សម្រាប់ភាពងាយរងគ្រោះផ្នែកសុវត្ថិភាព និងផ្តល់របាយការណ៍កំហុសដែលបង្កើតដោយគំរូពេញលេញដោយផ្ទាល់ទៅកាន់អ្នកថែទាំ។

សេវាកម្មដែលត្រូវបានប្រកាសកាលពីថ្ងៃពុធនៅក្នុងការបង្ហោះប្លុករបស់ក្រុមហ៊ុនគឺជាផលិតផលនៃការផ្លាស់ប្តូរស្ងាត់នៅក្នុងការងារសុវត្ថិភាពរបស់ Anthropic៖ ម៉ូដែលរបស់វាថ្មីៗនេះបានស្វែងរកភាពងាយរងគ្រោះលឿនជាងក្រុមសន្តិសុខផ្ទាល់ខ្លួនរបស់ Anthropic អាចផ្ទៀងផ្ទាត់ពួកគេ។ សម្រាប់អ្នកអភិវឌ្ឍន៍ដែលតាមដានឧបករណ៍ផ្លាស់ប្តូរសុវត្ថិភាពកម្មវិធី ការបើកដំណើរការគឺជាពេលវេលាដ៏សំខាន់សម្រាប់ការគ្របដណ្តប់របស់យើងនៃ [ការអភិវឌ្ឍន៍ AI] (https://aibuzzwire.news) នៅក្នុងហេដ្ឋារចនាសម្ព័ន្ធប្រភពបើកចំហ។

ពីគម្រោង Glasswing ទៅជាសេវាសាធារណៈ

OSS Scanner ត្រូវបានជូនដំណឹងដោយបទពិសោធន៍របស់ Anthropic ដោយប្រើ Claude ដើម្បីស្វែងរកភាពងាយរងគ្រោះក្នុងអំឡុងពេល Project Glasswing ដែលជាកិច្ចខិតខំប្រឹងប្រែងស្វែងរកភាពងាយរងគ្រោះខាងក្នុងរបស់ក្រុមហ៊ុន។ លេខពីការងារនោះពន្យល់ពីមូលហេតុដែល Anthropic បើកបំពង់បង្ហូរប្រេងដល់សាធារណៈជន។

ក្នុងរយៈពេលប្រាំមួយខែកន្លងមកនេះ Anthropic និយាយថា ម៉ូដែលចុងក្រោយបំផុតរបស់ខ្លួនបានបង្ហាញពីភាពងាយរងគ្រោះរបស់បេក្ខជនជាង 29,000 នៅក្នុងគម្រោងកម្មវិធីសំខាន់ៗមួយចំនួនរបស់ពិភពលោក ប៉ុន្តែក្រុមហ៊ុនអាចពិនិត្យ និងសាកល្បងដោយដៃបានត្រឹមតែ 6,000 ប៉ុណ្ណោះក្នុងចំណោមពួកគេ។ សមត្ថភាពផ្ទៀងផ្ទាត់របស់មនុស្ស មិនមែនជាសមត្ថភាពគំរូ បានក្លាយជាឧបសគ្គ។

ភាគីទាមទារប្រាប់រឿងស្រដៀងគ្នា។ របាយការណ៍ Anthropic ដែលអ្នកថែទាំដែលទទួលបានរបាយការណ៍ដំបូងរបស់ខ្លួនកាន់តែខ្លាំងឡើងស្នើសុំអ្វីគ្រប់យ៉ាងដែលក្រុមហ៊ុនមាន: របាយការណ៍ជិត 5,000 ត្រូវបានផ្ញើដោយផ្ទាល់ទៅអ្នកថែទាំដែលបានស្នើសុំការបញ្ជូនភាគច្រើននៃការរកឃើញដែលមិនបានបញ្ជាក់ បំណះរួមបញ្ចូល។

បរិបទសមត្ថភាពគឺស្រឡះ។ នៅលើ CyberGym ដែលជាស្តង់ដារស្វែងរកភាពងាយរងគ្រោះក្នុងការសិក្សា គំរូភាសាធំៗបានបាត់បង់ពីការស្វែងរកភាពងាយរងគ្រោះក្រោម 20 ភាគរយនៅដើមឆ្នាំមុនរហូតដល់ជាង 85 ភាគរយនៅឆ្នាំនេះ នេះបើយោងតាម ​​Anthropic ដែលជាការកើនឡើងដែលបានផ្លាស់ប្តូររបាយការណ៍កំហុស AI ពីសំលេងរំខានទៅជាការរកឃើញដែលអាចធ្វើសកម្មភាពបាន។

របៀបដែលលេខជាប់ក្នុងការធ្វើតេស្ត

មុនពេលចាប់ផ្តើមដំណើរការ Anthropic បានធ្វើឱ្យបំពង់បង្ហូរប្រេងមានសុពលភាពជាមួយនឹងគម្រោងប្រភពបើកចំហរាប់សិប ដោយផលិតរបាយការណ៍បញ្ហារាប់រយ — រួមទាំងភាពងាយរងគ្រោះដែលក្រុមហ៊ុននិយាយថាអាចត្រូវបានដាក់ច្រវាក់ចូលទៅក្នុងការកេងប្រវ័ញ្ចការប្រតិបត្តិកូដពីចម្ងាយដែលមិនមានការផ្ទៀងផ្ទាត់។

ការ​ធ្វើ​តេស្ត​ដែល​ប្រាប់​ច្រើន​បំផុត​ទាក់​ទង​នឹង​ការ​ពិនិត្យ​មើល​ខាង​ក្រៅ។ Anthropic បានសួរអ្នកសាកល្បងការជ្រៀតចូលអ្នកជំនាញដែលពិនិត្យមើលការរកឃើញភាពងាយរងគ្រោះដែលបានសម្របសម្រួល (CVD) របស់ខ្លួនដើម្បីពិនិត្យមើលការរកឃើញសំខាន់ៗចំនួន 97 ពីម៉ាស៊ីនស្កែន ដែលដកចេញពីគម្រោងចំនួន 48 ។ ក្នុងចំណោមនោះ 85 — 88 ភាគរយ — បានជួបរបារសម្រាប់ដំណើរការ CVD របស់ Anthropic ។ ក្នុងចំណោម 12 ដែលនៅសេសសល់ 11 គឺពិតប្រាកដ ប៉ុន្តែបានចម្លងបញ្ហាដែលគេស្គាល់ ឬការរកឃើញផ្សេងទៀតពីការស្កេនដូចគ្នា។ មាន​តែ​មួយ​គត់​ជា​វិជ្ជមាន​មិន​ពិត​ទាំងស្រុង។

របាយការណ៍នីមួយៗ ក្រុមហ៊ុនបាននិយាយថា មានឧបករណ៍ផលិតឡើងវិញដែលមានផ្ទុកដោយខ្លួនឯង និងការពន្យល់អំពីភាពងាយរងគ្រោះ រួមទាំងផ្នែក bisection ដើម្បីកំណត់ពីពេលដែលកំហុសត្រូវបានណែនាំ។

ការដោះដូរ៖ ល្បឿនលើសពីភាពប្រាកដប្រជា

ការសម្រេចចិត្តរចនាកណ្តាលនៃ OSS Scanner ក៏ជាហានិភ័យដ៏ធំបំផុតរបស់វាផងដែរ៖ របាយការណ៍ត្រូវបានបង្កើតជាគំរូយ៉ាងពេញលេញ ដោយមិនមានការពិនិត្យឡើងវិញ ឬ triage របស់មនុស្សឡើយ។ Anthropic មានភាពច្បាស់លាស់ដែលវាធ្វើឱ្យការស្កេនកាន់តែលឿន និងញឹកញាប់ជាងមុន ប៉ុន្តែរបាយការណ៍មួយចំនួននឹងមិនត្រឹមត្រូវ ឬមិនត្រឹមត្រូវ។

ក្រុមហ៊ុនកំណត់ការដោះដូរនេះថាជាការឆ្លើយតបទៅនឹងតម្រូវការអ្នកថែទាំ។ ដោយសារឥឡូវនេះការកេងប្រវ័ញ្ចអាចត្រូវបានបង្កើតឡើងក្នុងរយៈពេលតែប៉ុន្មាននាទីប៉ុណ្ណោះ គម្រោងកាន់តែចូលចិត្តទទួលបានរាល់ការរកឃើញដែលមិនបានបញ្ជាក់ភ្លាមៗ ដោយភ្ជាប់ជាមួយបំណះដែលបានស្នើឡើង — ជាងការរង់ចាំសម្រាប់ការពិនិត្យមនុស្ស។ បានបំផុសគំនិតដោយ OSS-Fuzz របស់ Google ដែលបានស្កេនកម្មវិធីប្រភពបើកចំហជាមួយ fuzzers ជាច្រើនឆ្នាំ OSS Scanner អនុវត្តតក្កវិជ្ជាដូចគ្នាទៅនឹងការវិភាគកូដដែលជំរុញដោយ AI ។

គម្រោងដែលចូលចិត្តការដោះស្រាយបែបប្រពៃណីមិនត្រូវបានទុកចោលទេ៖ Anthropic និយាយថា វានឹងបន្តបង្ហាញរបាយការណ៍ភាពងាយរងគ្រោះដែលត្រូវបានផ្ទៀងផ្ទាត់ដោយមនុស្សតាមរយៈដំណើរការ CVD ដែលមានស្រាប់របស់វា ជាពិសេសសម្រាប់គម្រោងដែលមិនមានធនធានដើម្បីសាកល្បងរបាយការណ៍ខ្លួនឯង។ ផ្លូវលឿនជាជម្រើសគឺអាចរកបានសម្រាប់អ្នកដែលចង់បានការរកឃើញឆៅភ្លាមៗនៅពេលដែលពួកគេត្រូវបានបង្កើត។

តើអ្នកណាអាចចុះឈ្មោះបាន — និងអ្វីដែល Anthropic បានប្រកាស

អ្នកថែទាំស្នូលនៃគម្រោងដែលមានសិទ្ធិអាចចុះឈ្មោះដោយដាក់សំណើទាញទៅកាន់ឃ្លាំង GitHub តាមគំរូគម្រោងស្តង់ដារ។ សិទ្ធិទទួលបានឆ្លុះបញ្ចាំងពីលក្ខណៈវិនិច្ឆ័យរបស់ OSS-Fuzz៖ គម្រោងគួរមានផលប៉ះពាល់យ៉ាងធ្ងន់ធ្ងរលើហេដ្ឋារចនាសម្ព័ន្ធ និងសុវត្ថិភាពអ្នកប្រើប្រាស់ ដោយមានការយល់ព្រមពីករណីនីមួយៗ។

ម៉ាស៊ីនស្កែនមកដល់ជាមួយនឹងសំណុំទូលំទូលាយនៃគំនិតផ្តួចផ្តើមសុវត្ថិភាព Anthropic ។ កម្មវិធីផ្ទៀងផ្ទាត់តាមអ៊ីនធឺណិតរបស់ក្រុមហ៊ុនធ្វើឱ្យសមត្ថភាពអ៊ីនធឺណេតកម្រិតខ្ពស់ និងកាត់បន្ថយការទប់ស្កាត់ការចាត់ថ្នាក់ដែលមានសម្រាប់អ្នកជំនាញផ្នែកសន្តិសុខដែលមានលក្ខណៈសម្បត្តិគ្រប់គ្រាន់ — កម្មវិធី Anthropic បានពង្រីកនៅដើមសប្តាហ៍នេះជាមួយនឹងកម្រិតបីនៃការចូលប្រើ Claude សម្រាប់ក្រុមសន្តិសុខ។ Claude ដាច់ដោយឡែកសម្រាប់កិច្ចខិតខំប្រឹងប្រែង OSS ផ្តល់នូវការជាវ Claude Max 20x ដោយឥតគិតថ្លៃ ដើម្បីជួយអ្នកថែទាំជួសជុលភាពងាយរងគ្រោះ និងកែលម្អគម្រោងរបស់ពួកគេ។ SiliconANGLE ក៏បានរាយការណ៍ផងដែរនូវកម្មវិធី Anthropic ថ្មីដែលផ្តោតលើការការពារហេដ្ឋារចនាសម្ព័ន្ធសំខាន់ៗ ដោយរៀបចំសេចក្តីប្រកាសប្រចាំសប្តាហ៍ថាជាការជំរុញសម្របសម្រួលចូលទៅក្នុងសន្តិសុខតាមអ៊ីនធឺណិត។

តើវាមានន័យយ៉ាងណាសម្រាប់សុវត្ថិភាពប្រភពបើកចំហ

ប្រសិនបើ OSS Scanner ដំណើរការដូចដែលបានផ្សព្វផ្សាយ នោះវាសម្គាល់ការផ្លាស់ប្តូររចនាសម្ព័ន្ធនៅក្នុងសុវត្ថិភាពប្រភពបើកចំហ៖ AI រកឃើញកំហុស ហើយមនុស្សផ្លាស់ប្តូរពីការបរបាញ់ទៅការផ្ទៀងផ្ទាត់។ ការផ្លាស់ប្តូរនោះផ្លាស់ទីបន្ទុកពិតប្រាកដទៅលើអ្នកថែទាំ ដែលត្រូវតែពិនិត្យមើលរបាយការណ៍ដែលបង្កើតដោយម៉ាស៊ីន - ខ្លះខុស - ខណៈពេលដែលការសម្រេចចិត្តថាតើត្រូវទុកចិត្តលើបំណះស្វ័យប្រវត្តិ។

អត្រាសុពលភាព 88 ភាគរយបង្ហាញថា អនុបាតសញ្ញាទៅសំឡេងរំខានឥឡូវនេះគឺល្អគ្រប់គ្រាន់ដើម្បីឱ្យមានតម្លៃពេលវេលារបស់អ្នកថែទាំ យ៉ាងហោចណាស់សម្រាប់គម្រោងហេដ្ឋារចនាសម្ព័ន្ធសំខាន់ៗ។ ថាតើប្រព័ន្ធអេកូកាន់តែធំទូលាយយល់ព្រមនឹងបង្ហាញនៅក្នុងលេខចុះឈ្មោះ — និងក្នុងចំនួនគម្រោងដែលបានចុះឈ្មោះដោយស្ងៀមស្ងាត់ជ្រើសរើសមិនចេញបន្ទាប់ពីរបាយការណ៍ទឹកជំនន់ដំបូងរបស់ពួកគេ។

---

ស្នាក់នៅមុន AI

ទទួលបានព័ត៌មាន AI ការវិភាគ និងរបកគំហើញចុងក្រោយបំផុត — ទាំងអស់នៅកន្លែងតែមួយ។

អានព័ត៌មាន AI បន្ថែម →