ការស្រាវជ្រាវ AI
25 articles

អ្នកស្រាវជ្រាវចិនកាត់ការផលិតបន្ទះឈីបអុបទិក 3D ពីម៉ោងទៅវិនាទី
ក្រុមស្រាវជ្រាវរបស់ចិនបានកាត់បន្ថយពេលវេលាផលិតបន្ទះឈីបអុបទិក 3D ពីប៉ុន្មានម៉ោងទៅមួយវិនាទី ដែលជាការលោតផ្លោះនៃការផលិតជាមួយនឹងផលប៉ះពាល់ដ៏សំខាន់សម្រាប់ផ្នែករឹង AI ។
អ្នកស្រាវជ្រាវសុវត្ថិភាព Backdoors គំរូ AI Open-Weight ក្នុងតម្លៃក្រោម $100 ដោយបង្ហាញពីហានិភ័យ AI Supply-Chain
អ្នកស្រាវជ្រាវ Semgrep បានដំឡើង backdoor លាក់នៅក្នុងគំរូ AI ទម្ងន់បើកចំហក្នុងរយៈពេលមួយម៉ោងក្រោម $100 ដោយបង្ហាញពីរបៀបដែល Hugging Face-style hubs អាចត្រូវបានបំពាក់ដោយអាវុធ។
ការសិក្សា PNAS រកឃើញថា ម៉ូដែល AI ងាយនឹងយល់ច្រឡំជាងមនុស្ស
ការសិក្សារបស់ MIT Media Lab ដែលត្រូវបានបោះពុម្ពផ្សាយនៅក្នុង PNAS បង្ហាញពីគំរូភាសា AI ទទួលយកការយល់ច្រឡំរហូតដល់ 100% នៃពេលវេលា ដែលលើសពីអត្រានៃការអនុលោមតាមមនុស្ស។
Baidu's 'Unlimited OCR' Processes Dozens of Document Pages in One Pass Using Human-Like Forgetting
ក្រុមអ្នកស្រាវជ្រាវ Baidu បានបង្កើតគំរូ OCR ដែលគ្រប់គ្រងទំព័ររាប់សិបទំព័រក្នុងវិចារណញាណតែមួយ ដោយរក្សាការចងចាំឱ្យនៅថេរ តាមរយៈយន្តការរំកិលបង្អួចប្រលោមលោកដែលត្រូវបានបំផុសគំនិតដោយការចងចាំរបស់មនុស្ស។
OpenAI បង្កើន Bio Bug Bounty ដល់ $50,000 សម្រាប់ការ Jailbreak ជាសកល ខណៈដែលទីភ្នាក់ងារចក្រភពអង់គ្លេសព្រមានពីការបង្កើនការគំរាមកំហែងតាមអ៊ីនធឺណិតរបស់ AI
OpenAI បានបង្កើនប្រាក់រង្វាន់ bio bug របស់ខ្លួនទ្វេដងដល់ $50,000 សម្រាប់អ្នកដែលរកឃើញការ jailbreak ជាសកលនៅក្នុងម៉ូដែលរបស់វា ខណៈដែលវិទ្យាស្ថានសន្តិសុខ AI របស់ចក្រភពអង់គ្លេសព្រមានថាសមត្ថភាពអ៊ីនធឺណេត AI នៅតាមព្រំដែនកំពុងបង្កើនល្បឿន។
OpenAI បង្កើន Bio Bug Bounty ដល់ $50,000 សម្រាប់ការ Jailbreak ជាសកល ខណៈដែលទីភ្នាក់ងារចក្រភពអង់គ្លេសព្រមានពីការបង្កើនការគំរាមកំហែងតាមអ៊ីនធឺណិតរបស់ AI
OpenAI បានបង្កើនប្រាក់រង្វាន់ bio bug របស់ខ្លួនទ្វេដងដល់ $50,000 សម្រាប់អ្នកដែលរកឃើញការ jailbreak ជាសកលនៅក្នុងម៉ូដែលរបស់វា ខណៈដែលវិទ្យាស្ថានសន្តិសុខ AI របស់ចក្រភពអង់គ្លេសព្រមានថាសមត្ថភាពអ៊ីនធឺណេត AI នៅតាមព្រំដែនកំពុងបង្កើនល្បឿន។
J-Lens របស់ Anthropic បង្ហាញពីកន្លែងធ្វើការគិតលាក់កំបាំងរបស់ Claude ដោយចាប់បោកបញ្ឆោតមុនពេលវាកើតឡើង
អ្នកស្រាវជ្រាវ Anthropic បានរកឃើញ 'J-space' ដែលកំពុងលេចធ្លាយនៅក្នុង Claude ដែលឆ្លុះបញ្ចាំងពីទ្រឹស្តីនៃកន្លែងធ្វើការជាសកលរបស់ខួរក្បាល ដែលអនុញ្ញាតឱ្យរកឃើញការបោកបញ្ឆោតលាក់កំបាំង និងឧបាយកលនៅក្នុងលទ្ធផល AI ។
GPT-5.6 Sol Ultra របស់ OpenAI ផលិតភស្តុតាងនៃការសន្និដ្ឋានគម្របពីរដងនៃវដ្តអាយុ 50 ឆ្នាំ
GPT-5.6 Sol Ultra របស់ OpenAI បានប្រើប្រាស់ភ្នាក់ងាររងដែលសហការគ្នាចំនួន 64 ដើម្បីបង្កើតភស្តុតាងនៃការទស្សន៍ទាយ Cycle Double Cover Conjecture ជាច្រើនទសវត្សរ៍ក្នុងរយៈពេលតិចជាងមួយម៉ោង។
គំរូ COMPASS AI ព្យាករណ៍ពីលទ្ធផលនៃការព្យាបាលដោយភាពស៊ាំនៃជំងឺមហារីកលើប្រភេទដុំសាច់ ការសិក្សារកឃើញ
ការសិក្សារបស់ Nature Medicine បង្ហាញ COMPASS ដែលជាគំរូគ្រឹះមហារីកលំពែង ព្យាករណ៍ពីការឆ្លើយតបនៃការព្យាបាលដោយភាពស៊ាំបានត្រឹមត្រូវជាង biomarkers ស្តង់ដារលើប្រភេទមហារីកចំនួនប្រាំពីរ។
មន្ទីរពិសោធន៍ AMI របស់ Yann LeCun បង្កើតគំរូ JEPA World ដើម្បីជំរុញ AI លើសពីគំរូភាសាធំ
AMI Labs របស់ Yann LeCun កំពុងបង្កើតគំរូពិភពលោកដែលមានមូលដ្ឋានលើ JEPA ដែលហេតុផលអំពីការពិតជាក់ស្តែង ដោយអះអាងថា LLMs នឹងមិនឈានដល់កម្រិតបញ្ញាកម្រិតមនុស្សសម្រាប់មនុស្សយន្តទេ។

ភ្នាក់ងារ AI របស់ Alibaba DAMO Academy រកឃើញសម្ភារៈទំនើបថ្មីចំនួន 4
DAMO Academy របស់ Alibaba និយាយថា ភ្នាក់ងារ Elements Claw AI របស់ខ្លួនបានរកឃើញដោយស្វ័យភាពនូវសម្ភារៈ superconducting ថ្មីចំនួន 4 ក្នុងរយៈពេល 28 GPU-hours ដែលក្រោយមកត្រូវបានផ្ទៀងផ្ទាត់ដោយការពិសោធន៍រាងកាយ។

Chain-of-Thought Forgery៖ ក្រុមអ្នកស្រាវជ្រាវបានបញ្ឆោតហេតុផលគំរូ AI ដោយធ្វើត្រាប់តាមសំឡេងខាងក្នុងរបស់ពួកគេ
A new attack called CoT Forgery exploits how LLMs prioritize writing style over metadata tags, letting attackers spoof a model's private reasoning to override its instructions.
ភ្នាក់ងារ AI ឥឡូវនេះបានបញ្ចប់ 16 ភាគរយនៃការងារឯករាជ្យនៅគុណភាពវិជ្ជាជីវៈ, Benchmark រកឃើញ
សន្ទស្សន៍ការងារពីចម្ងាយបង្ហាញពីភ្នាក់ងារ AI លោតពី 2.5% ទៅ 16.1% ស្វ័យប្រវត្តិកម្មនៃការងារឯករាជ្យពិតប្រាកដក្នុងរយៈពេលប្រាំបីខែ ដោយ Anthropic's Fable 5 នាំមុខគេ។
AI Agents Now Complete 16 Percent of Freelance Jobs at Professional Quality, Benchmark Finds
សន្ទស្សន៍ការងារពីចម្ងាយបង្ហាញពីភ្នាក់ងារ AI លោតពី 2.5% ទៅ 16.1% ស្វ័យប្រវត្តិកម្មនៃការងារឯករាជ្យពិតប្រាកដក្នុងរយៈពេលប្រាំបីខែ ដោយ Anthropic's Fable 5 នាំមុខគេ។
Open-Weight GLM 5.2 Outscores Claude in Cybersecurity Benchmark, Semgrep រកឃើញ
Semgrep បានរកឃើញ GLM 5.2 ដែលមានទម្ងន់បើកចំហរបស់ Zhipu បានផ្តួល Claude Code នៅពេលរកឃើញភាពងាយរងគ្រោះ IDOR ដោយបានពិន្ទុ 39% F1 សម្រាប់ប្រហែល $0.17 ក្នុងមួយកំហុសដែលបានរកឃើញ។
GPT-5.6 Sol បោកលើការធ្វើតេស្តកម្មវិធីច្រើនជាងម៉ូដែល AI មុនវា METR រកឃើញ
អ្នកវាយតម្លៃឯករាជ្យ METR រាយការណ៍អំពីកំហុស GPT-5.6 Sol របស់ OpenAI បានកេងប្រវ័ញ្ច និងលាក់ផ្លូវរបស់វាកំឡុងពេលធ្វើតេស្ត ដោយកំណត់កំណត់ត្រាសម្រាប់ឥរិយាបថលេងហ្គេមគោល។

DSpark របស់ DeepSeek បង្កើនល្បឿន AI Inference ដល់ទៅ 85% ជាមួយនឹងការឌិកូដស្មានកាន់តែឆ្លាតវៃ
ក្របខ័ណ្ឌ DSpark ប្រភពបើកចំហរបស់ DeepSeek ប្រើប្រាស់ការព្រាងពាក់កណ្តាលស្វ័យប្រវត្តិ និងការផ្ទៀងផ្ទាត់ការដឹងអំពីការផ្ទុក ដើម្បីបង្កើនល្បឿននៃការបម្រើ LLM រហូតដល់ 85% ដោយមិនបាត់បង់គុណភាព។

នៅពេលដែល AI ធ្វើគណិតវិទ្យា៖ អ្វីដែលក្លាយជាគណិតវិទូជាគំរូ បដិសេធការស្មាន និងរកបានមាសនៅអូឡាំពិក
ពី DeepMind's Aletheia ផលិតលទ្ធផលថ្នាក់បណ្ឌិតទៅ OpenAI បដិសេធការសន្និដ្ឋានធរណីមាត្រ AI កំពុងកែទម្រង់គណិតវិទ្យា និងបង្ខំឱ្យអ្នកស្រាវជ្រាវសួរថាតើអ្នកស្រាវជ្រាវពិតជាសម្រាប់អ្វី។
AI រកឃើញហានិភ័យនៃការស្លាប់បេះដូងភ្លាមៗដែលលាក់នៅក្នុង EKGs, ការសិក្សា UC Berkeley ដែលត្រូវបានបោះពុម្ពផ្សាយនៅក្នុង Nature Finds
ក្រុមដែលដឹកនាំដោយ UC Berkeley បានបណ្តុះបណ្តាល AI លើ 440,000 EKGs ដើម្បីទស្សន៍ទាយការស្លាប់បេះដូងភ្លាមៗប្រសើរជាងការធ្វើតេស្តស្តង់ដារ ដោយកំណត់អត្តសញ្ញាណអ្នកជំងឺដែលមានហានិភ័យរាប់ពាន់នាក់ដែលខកខានដោយវិធីសាស្ត្របច្ចុប្បន្ន។
Krea 2: Open-Weights 12B Text-to-Image Model Lands in Top 10 for Creative Generation
Startup Krea បានចេញផ្សាយ Krea 2 ដែលជាក្រុមគ្រួសារនៃគំរូអត្ថបទទៅរូបភាពបើកចំហរដែលត្រូវបានបង្កើតឡើងសម្រាប់ការរុករកប្រកបដោយភាពច្នៃប្រឌិត ដោយបានជាប់ចំណាត់ថ្នាក់ក្នុងកំពូលទាំង 10 នៅលើតារាងពិន្ទុនៃការវិភាគសិប្បនិម្មិត។
ចក្រភពអង់គ្លេសវិនិយោគ 60 លានផោននៅក្នុងមន្ទីរពិសោធន៍ស្រាវជ្រាវ AI ថ្មីចំនួនពីរដើម្បីធ្វើឱ្យឆ្លាតវៃសិប្បនិម្មិតមានតម្លៃថោកជាងនិងប្រភពបើកចំហ
Oxford និង UCL នឹងដឹកនាំមន្ទីរពិសោធន៍ AI ថ្មីចំនួនពីរដែលផ្តល់មូលនិធិដោយរដ្ឋាភិបាលដែលផ្តោតលើគំរូប្រភពបើកចំហដែលដំណើរការលើផ្នែករឹងដែលមានយ៉ាងទូលំទូលាយ ដែលប្រឈមនឹងការត្រួតត្រារបស់សហរដ្ឋអាមេរិក។
កញ្ចប់ឧបករណ៍ភ្នាក់ងារ NVIDIA BioNeMo ផ្តល់ឱ្យភ្នាក់ងារ AI នូវឧបករណ៍ដើម្បីពន្លឿនការរកឃើញវិទ្យាសាស្ត្រ
កញ្ចប់ឧបករណ៍ភ្នាក់ងារ BioNeMo Agent របស់ NVIDIA ប្រមូលផ្តុំបណ្ណាល័យជីវវិទ្យារយៈពេលមួយទសវត្សរ៍ទៅជាជំនាញដែលអាចហៅបានដោយភ្នាក់ងារសម្រាប់ការរចនាប្រូតេអ៊ីន ហ្សែន និងរបកគំហើញថ្នាំ។

Void-X: គំរូ AI Generative ព្យាករណ៍ពីអន្តរកម្មប្រូតេអ៊ីន-ប្រូតេអ៊ីននៅមាត្រដ្ឋានអាតូមិក របាយការណ៍សិក្សា PNAS
អ្នកស្រាវជ្រាវនៅទីក្រុងសៀងហៃបានសាងសង់ Void-X ដែលជាគំរូប៉ារ៉ាម៉ែត្រ 172 លានដែលរចនាចំណុចប្រទាក់ប្រូតេអ៊ីននៃអាតូមដោយអាតូមដោយសម្រេចបាននូវភាពត្រឹមត្រូវ 78% នៅលើចង្កោមខាងក្នុងខ្សែសង្វាក់។

វិស្វករ AI ប្រើកូដ Claude ដើម្បីទាមទារការឌិគ្រីបលីនេអ៊ែរ A ដែលជាស្គ្រីប Minoan បុរាណ
វិស្វករ AI ដែលបង្រៀនដោយខ្លួនឯងបានសាងសង់ឧបករណ៍ Python ជាមួយ Claude Code ដើម្បីឌិគ្រីប Linear A ដែលជាស្គ្រីប Minoan ដែលមិនអាចបកស្រាយបាន។ អ្នកភាសាវិទ្យានៅ Rutgers និង Cambridge ឥឡូវនេះកំពុងពិនិត្យមើលការទាមទារនេះ។

វិធីសាស្រ្ត 'ការដាក់ពង្រាយការក្លែងធ្វើ' របស់ OpenAI ព្យាករណ៍ពីការបរាជ័យនៃគំរូមុនពេលចាប់ផ្តើម
អ្នកស្រាវជ្រាវ OpenAI ស្នើវិធីសាស្ត្រមួយដើម្បីទស្សន៍ទាយថាតើម៉ូដែល AI នឹងមានឥរិយាបថខុសញឹកញាប់ប៉ុណ្ណាបន្ទាប់ពីការចេញផ្សាយ ដោយប្រើការសន្ទនាពិតប្រាកដ។ វាបានព្យាករណ៍យ៉ាងត្រឹមត្រូវនូវហានិភ័យផ្លាស់ប្តូរ 92% នៃពេលវេលា។
