Mistral AI បានចេញផ្សាយ Shieldstral នៅថ្ងៃទី 4 ខែសីហា ឆ្នាំ 2026 ដែលជាឧបករណ៍ចាត់ថ្នាក់សុវត្ថិភាពទម្ងន់បើកចំហ 3 ពាន់លានដែលវិនិច្ឆ័យអត្ថបទ និងរូបភាពប្រឆាំងនឹងគោលការណ៍សម្របសម្រួលដែលសរសេរជាភាសាសាមញ្ញនៅពេលសន្និដ្ឋាន ជាជាងការពឹងផ្អែកលើសំណុំនៃប្រភេទគ្រោះថ្នាក់ដែលបានដាក់ចូលទៅក្នុងគំរូអំឡុងពេលហ្វឹកហាត់។ ការចេញផ្សាយនេះតំណាងឱ្យការចាកចេញទស្សនវិជ្ជាគួរឱ្យកត់សម្គាល់ពីរបៀបដែលគំរូ guardrail ភាគច្រើនត្រូវបានសាងសង់នៅថ្ងៃនេះ។

ម៉ូដែលនេះមាននៅលើ Hugging Face ក្រោមអាជ្ញាប័ណ្ណ Apache 2.0 គ្របដណ្តប់ 12 ភាសា និងដំណើរការលើ GPU 16GB តែមួយ។ នៅពេលដែលវិស័យ AI របស់អឺរ៉ុបបន្តផលិតប្រព័ន្ធទម្ងន់បើកចំហដែលមានការប្រកួតប្រជែងនោះ Shieldstral បន្ថែមវិមាត្រមួយទៀតទៅ [ព័ត៌មាន AI ដ៏ទាន់ហេតុការណ៍] (https://aibuzzwire.news) ដែលកំពុងផ្លាស់ប្តូររបៀបដែលអ្នកអភិវឌ្ឍន៍ចូលទៅជិតសុវត្ថិភាព។

របៀបដែល Shieldstral ដំណើរការ

ម៉ូដែល Guardrail ភាគច្រើនបានកំណត់កូដនៃប្រភេទគ្រោះថ្នាក់ទៅក្នុងទម្ងន់របស់ពួកគេអំឡុងពេលហ្វឹកហាត់ ដែលមានន័យថាការសម្របខ្លួនពួកគេទៅនឹងបរិបទផលិតផលថ្មីតម្រូវឱ្យមានវដ្តនៃការហ្វឹកហាត់ឡើងវិញពេញលេញ។ Shieldstral ប្រើវិធីសាស្រ្តផ្សេងគ្នាជាមូលដ្ឋាន៖ គោលការណ៍សម្របសម្រួលត្រូវបានផ្គត់ផ្គង់ជាផ្នែកនៃការបញ្ចូលនៅពេលសន្និដ្ឋាន។

យោងតាមការវិភាគរបស់ Unite.AI យន្តការកាត់បន្ថយរាល់កិច្ចការសម្របសម្រួលដល់ការឆ្លើយសំណួរគោលពីរ។ សំណើនីមួយៗមានផ្នែកដាក់ស្លាកចំនួនបី៖ វាល `` ដែលផ្ទុកនូវបរិបទវាយតម្លៃ និងកម្រិតភាពតឹងរ៉ឹង វាល `` ដែលមានសំណួរបាទ/ចាស តែមួយដូចជា "តើខ្លឹមសារនេះជំរុញឱ្យមានអំពើហិង្សាលើរាងកាយមែនទេ?" និងវាល `` ដែលផ្ទុកខ្លឹមសារដើម្បីវិនិច្ឆ័យ ដែលអាចជាប្រអប់បញ្ចូល ការឆ្លើយតប ការឆ្លើយតបភ្លាមៗជាមួយនឹងជម្រើសជាអក្សរ ឬជារូបភាព។

តាមការសន្និដ្ឋាន គំរូអានតែលេខសម្គាល់សម្រាប់សញ្ញា "បាទ" និង "ទេ" ហើយ softmax- normalizes ពួកវាទៅជាពិន្ទុបន្ត កម្រិត 0.5 សម្រាប់សាលក្រមគោលពីរ។ ការបង្កើតនោះអនុញ្ញាតឱ្យប៉ុស្តិ៍ត្រួតពិនិត្យតែមួយស្រូបយកការចាត់ថ្នាក់ភ្លាមៗ ការសម្របសម្រួលការឆ្លើយតប ការរកឃើញការបដិសេធ និងការរកឃើញជាតិពុលដែលជាករណីនៃបញ្ហាមូលដ្ឋានដូចគ្នា។

ច្រកមួយ គោលការណ៍ជាច្រើន។

ការអនុវត្តជាក់ស្តែងគឺសំខាន់។ ប៉ុស្តិ៍ត្រួតពិនិត្យដូចគ្នាអាចពិនិត្យឧបករណ៍ស្រាវជ្រាវសុវត្ថិភាពតាមអ៊ីនធឺណិត និងវេទិកាសុខភាពផ្លូវចិត្តប្រឆាំងនឹងស្តង់ដារខុសគ្នាទាំងស្រុងដោយមិនមានការកែប្រែ។ ប្រតិបត្តិករសរសេរសំណួរ បាទ/ចាស ទេ ផ្តល់ការណែនាំដែលពិពណ៌នាអំពីបរិបទនៃការវាយតម្លៃ និងភាពតឹងរ៉ឹង ហើយម៉ូដែលនេះត្រឡប់ពិន្ទុសុវត្ថិភាពដែលបានក្រិតតាមខ្នាតពីលទ្ធផលនិមិត្តសញ្ញាតែមួយ។

ការរចនាតាមគោលការណ៍នេះ ដោះស្រាយការខកចិត្តជាបន្តបន្ទាប់ក្នុងការដាក់ពង្រាយប្រព័ន្ធសុវត្ថិភាព AI៖ ការលំបាកក្នុងការសម្រួលការសម្របសម្រួលទៅនឹងករណីប្រើប្រាស់ជាក់លាក់ដោយមិនចាំបាច់មានការបង្វឹកថ្លៃ។ chatbot សេវាកម្មហិរញ្ញវត្ថុ កម្មវិធីអប់រំរបស់កុមារ និងវេទិកាបើកចំហសម្រាប់អ្នកស្រាវជ្រាវសន្តិសុខទាំងអស់ត្រូវការ guardrails ខុសគ្នាយ៉ាងខ្លាំង ហើយ Shieldstral មានគោលបំណងដោះស្រាយទាំងបីពីសំណុំទម្ងន់ដូចគ្នា។

ស្ថាបត្យកម្ម និងការអនុវត្ត

Shieldstral ត្រូវបានបង្កើតឡើងនៅលើ Ministral-3-3B ដែលជាគំរូពហុមុខងារតូចរបស់ Mistral ជាមួយនឹងឧបករណ៍បំប្លែងរូបភាព Pixtral Vision គ្រប់គ្រងការបញ្ចូលរូបភាព។ កាតគំរូរាយបញ្ជីបង្អួចបរិបទនិមិត្តសញ្ញា 32,000 ហើយ Mistral និយាយថាម៉ូដែលនេះត្រូវគ្នានឹងគំរូយាមដែលបើកចំហរហូតដល់ 7 ដងនៃទំហំរបស់វានៅលើស្តង់ដារសុវត្ថិភាពអត្ថបទខណៈពេលដែលកំណត់ស្ថានភាពសិល្បៈថ្មីលើការសម្របសម្រួលពហុម៉ូឌុល។

ទាំងនេះគឺជាការទាមទារយ៉ាងខ្លាំងសម្រាប់គំរូ 3B-parameter ហើយ Mistral បានគាំទ្រការចេញផ្សាយនេះជាមួយនឹងចំនួនឯកសារមិនធម្មតា។ របាយការណ៍បច្ចេកទេសដែលពិពណ៌នាអំពីរូបមន្តបណ្តុះបណ្តាល និងការវាយតម្លៃត្រូវបានបង្ហោះទៅកាន់ arXiv នៅថ្ងៃទី 28 ខែកក្កដា ឆ្នាំ 2026 អមដោយកាតគំរូពេញលេញនៅក្នុងឯកសាររបស់ Mistral និងទម្ងន់ខ្លួនឯង ដែលទាំងពីរបានចេញផ្សាយនៅថ្ងៃទី 4 ខែសីហា។

ការរិះគន់ចំៗអំពីស្ថានភាព

Mistral បានដាក់ស៊ុមលើការចេញផ្សាយ Shieldstral ជុំវិញការរិះគន់ដ៏ចង្អុលនៃរបៀបដែលគំរូ guardrail ត្រូវបានសាងសង់ជាធម្មតា។ ក្រុមហ៊ុនអះអាងថា ការសរសេរកូដដែលបង្កគ្រោះថ្នាក់ដល់និក្ខេបបទទៅជាទម្ងន់គំរូបង្កើតភាពមិនអាចបត់បែនបាន ដោយបង្ខំអ្នកអភិវឌ្ឍន៍ឱ្យធ្វើការហ្វឹកហាត់ឡើងវិញរាល់ពេលដែលការផ្លាស់ប្តូរគោលនយោបាយ ឬផលិតផលថ្មីចាប់ផ្តើម។

នេះគឺច្រើនជាងអាគុយម៉ង់បច្ចេកទេស; វាគឺជាសេចក្តីថ្លែងការណ៍នៃទីតាំងប្រកួតប្រជែង។ តាមរយៈការចេញផ្សាយគំរូ Apache-2.0-licensed ដែលអាចធ្វើជាម្ចាស់ផ្ទះដោយខ្លួនឯង និងសម្របខ្លួនដោយមិនមានការបង្ហាត់បង្រៀនឡើងវិញនោះ Mistral កំពុងកំណត់គោលដៅលើអ្នកអភិវឌ្ឍន៍ដែលចង់គ្រប់គ្រងលើជង់សុវត្ថិភាពរបស់ពួកគេ ដោយគ្មានតម្លៃលើសនៃសេវាកម្មដែលបានគ្រប់គ្រង ឬអ្នកចាត់ថ្នាក់ដែលមានកម្មសិទ្ធិ។

វិធីសាស្រ្តទម្ងន់បើកចំហក៏ដោះស្រាយកង្វល់ដែលកំពុងកើនឡើងក្នុងចំណោមអ្នកប្រើប្រាស់សហគ្រាស៖ ភាពស្រអាប់នៃប្រព័ន្ធសុវត្ថិភាពបិទជិត។ នៅពេលដែល guardrail រារាំងមាតិកា ប្រតិបត្តិករជាញឹកញាប់មិនអាចពិនិត្យមើលមូលហេតុបានទេ។ ការរចនាគោលនយោបាយជាធាតុបញ្ចូលប្រកបដោយតម្លាភាពរបស់ Shieldstral អនុញ្ញាតឱ្យអ្នកអភិវឌ្ឍន៍មើលឃើញយ៉ាងច្បាស់ថាច្បាប់មួយណាដែលបង្កើតសាលក្រមដែលបានផ្តល់ឱ្យ។

សន្ទុះទម្ងន់បើកចំហកាន់តែទូលំទូលាយ

Shieldstral មកដល់ចំពេលមានការកើនឡើងយ៉ាងទូលំទូលាយនៅក្នុងការចេញផ្សាយ AI ទម្ងន់បើកចំហនៅទូទាំងឧស្សាហកម្មនេះ។ ម៉ូដែលនេះចូលរួមជាមួយការពង្រីកផលប័ត្រនៃប្រព័ន្ធបើកចំហរបស់ Mistral ដោយពង្រឹងយុទ្ធសាស្រ្តរបស់ក្រុមហ៊ុនក្នុងការប្រកួតប្រជែងលើភាពងាយស្រួល និងបទពិសោធន៍អ្នកអភិវឌ្ឍន៍ ជាជាងខ្នាតព្រំដែនឆៅ។

សម្រាប់ក្រុមដែលបង្កើតកម្មវិធី AI សមត្ថភាពក្នុងការដំណើរការកម្មវិធីចាត់ថ្នាក់សុវត្ថិភាពពហុមុខងារដែលមានសមត្ថភាពនៅលើ GPU កម្រិតអ្នកប្រើប្រាស់តែមួយ ដោយមិនបញ្ជូនទិន្នន័យទៅ API ភាគីទីបី កាត់បន្ថយទាំងការចំណាយ និងឧបសគ្គឯកជនភាពក្នុងការដាក់ពង្រាយការសម្របសម្រួលដ៏រឹងមាំ។ នោះអាចពន្លឿនការអនុម័តនៅក្នុងឧស្សាហកម្មដែលមានការគ្រប់គ្រង ដែលទិន្នន័យស្នាក់នៅ និងសវនកម្មមិនអាចចរចារបាន។

នាំមុខ AI

ម៉ូដែលសុវត្ថិភាពទម្ងន់បើកចំហដូចជា Shieldstral កំពុងផ្លាស់ប្តូររបៀបដែលអ្នកអភិវឌ្ឍន៍គិតអំពី guardrails ហើយល្បឿននៃការច្នៃប្រឌិតមិនបង្ហាញពីសញ្ញានៃការយឺតយ៉ាវនោះទេ។ អនុវត្តតាម AI Buzz Wire សម្រាប់ការរាយការណ៍ច្បាស់លាស់ ជាក់ស្តែងលើម៉ូដែល ឧបករណ៍ និងការស្រាវជ្រាវដែលជំរុញវិស័យនេះ។

អានព័ត៌មាន AI បន្ថែម →