ការស្រាវជ្រាវ AI
50 articles
GPT-6 Astra Post ពិន្ទុ ARC-AGI-3 រដ្ឋនៃសិល្បៈ ឈ្នះមនុស្សលើប្រសិទ្ធភាពសកម្មភាព
ARC Prize រាយការណ៍ថា GPT-6 Astra ទទួលបានពិន្ទុ 99.9% លើ ARC-AGI-3 ជាមួយនឹងខ្សែអ្នកផ្តល់សេវា និង 62.7% នៅក្រោមច្បាប់ស្តង់ដារ ដោយយកឈ្នះប្រសិទ្ធភាពសកម្មភាពរបស់មនុស្សលើ 96% នៃកម្រិត។
Google DeepMind បើកដំណើរការ WeatherNext 3 ដែលជាគំរូអាកាសធាតុ AI ជាមួយនឹងការព្យាករណ៍ 5 គីឡូម៉ែត្រក្នុងមួយម៉ោង
WeatherNext 3 របស់ Google DeepMind ផ្តល់ការព្យាករណ៍អាកាសធាតុ AI រៀងរាល់ម៉ោងក្នុងកម្រិត 5 គីឡូម៉ែត្រ ដោយប្រើទិន្នន័យផ្កាយរណបបន្តផ្ទាល់ ឥឡូវនេះកំពុងរស់នៅក្នុង Search, Maps, Gemini និង Cloud។
NSF ផ្តល់រង្វាន់ 35 លានដុល្លារដើម្បីបើកដំណើរការមជ្ឈមណ្ឌលជាតិស្រាវជ្រាវធនធាន AI ដឹកនាំដោយ SDSC និង TACC
មូលនិធិវិទ្យាសាស្ត្រជាតិបានផ្តល់រង្វាន់ 35 លានដុល្លារក្នុងរយៈពេល 5 ឆ្នាំដល់ SDSC របស់ UC San Diego និង TACC របស់ UT Austin ដើម្បីដំណើរការមជ្ឈមណ្ឌលប្រតិបត្តិការ NAIRR ដោយផ្លាស់ប្តូរធនធានស្រាវជ្រាវ AI ពីអ្នកបើកយន្តហោះទៅជាហេដ្ឋារចនាសម្ព័ន្ធអចិន្ត្រៃយ៍។
Astra របស់ OpenAI ដើម្បីប្រើហេតុផល 'Recurrent Depth' ហើយអ្នកជំនាញសុវត្ថិភាពមានការព្រួយបារម្ភ
ព័ត៌មានបានរាយការណ៍ថា Astra របស់ OpenAI នឹងប្រើហេតុផល 'ជម្រៅកើតឡើងដដែលៗ' ដែលអាចធ្វើឱ្យខ្សែសង្វាក់នៃការគិតរបស់វាកាន់តែពិបាកក្នុងការត្រួតពិនិត្យ ដែលជាការជូនដំណឹងដល់អ្នកជំនាញសុវត្ថិភាព។
មន្ទីរពិសោធន៍ពិភពលោករបស់ Fei-Fei Li បង្ហាញ Atlas ដែលជាគំរូពិភពលោក Omni សម្រាប់ស៊ើបការណ៍សម្ងាត់
World Labs 'Atlas គឺជាឧបករណ៍បំលែងបំលែងបំរែបំរួល autoregressive multimodal ដែលបង្កើត បង្កើតឡើងវិញ និងក្លែងធ្វើពិភព 3D ពីអត្ថបទ រូបភាព និងវីដេអូ។
'មនុស្សអស្ចារ្យ' AI កំណត់ជំងឺបេះដូងក្នុងរយៈពេលតិចជាង 2 វិនាទីពី ECG ធម្មតា
ឧបករណ៍ AI ដែលត្រូវបានបណ្តុះបណ្តាលលើ ECGs រាប់លានបានរកឃើញរហូតដល់ 90% នៃករណីជំងឺសន្ទះបេះដូងនៅក្នុងការសាកល្បងអ្នកជំងឺ 67,000 ដែលផ្តល់នូវការតាមដានយ៉ាងរហ័សសម្រាប់អ្នកជំងឺដែលប្រឈមនឹងការរង់ចាំរយៈពេលមួយខែ។
Anthropic បើកកន្លែងអង្គុយ Claude ឥតគិតថ្លៃចំនួន 10,000 សម្រាប់អ្នកវិទ្យាសាស្ត្រក្នុងការពង្រីក AI សម្រាប់ការជំរុញវិទ្យាសាស្ត្រ
Anthropic នឹងផ្តល់ឱ្យអ្នកវិទ្យាសាស្ត្រ 10,000 នាក់ដោយឥតគិតថ្លៃនូវការជាវ Claude និងរហូតដល់ 50,000 ដុល្លារនៅក្នុង AI សម្រាប់ក្រេឌីតវិទ្យាសាស្ត្រក្នុងមួយគម្រោង ខណៈពេលដែលរក្សាការការពារជីវវិទ្យា។
ក្រុមអ្នកស្រាវជ្រាវស្វ័យប្រវត្តិរបស់ Anthropic បង្ហាញថា AI អាចជួសជុលការបរាជ័យក្នុងការតម្រឹមរបស់វាបាន។
ក្រដាសថ្មីរបស់ Anthropic និយាយថាអ្នកស្រាវជ្រាវ AI ស្វ័យប្រវត្តិបានធ្វើឱ្យប្រសើរឡើងនូវការតម្រឹមលើការធ្វើតេស្តស្តង់ដារទាំង 10 នៅតម្លៃ 4 ដុល្លារក្នុងមួយម៉ោងធៀបនឹង 150 ដុល្លារក្នុងមួយម៉ោងសម្រាប់អ្នកស្រាវជ្រាវមនុស្ស។
ឧប្បត្តិហេតុបាត់បង់ការគ្រប់គ្រង AI ជិតទ្វេដងក្នុងខែកក្កដា ការស្រាវជ្រាវដែលគាំទ្រដោយចក្រភពអង់គ្លេសបានរកឃើញ
ឧប្បត្តិហេតុបាត់បង់ការគ្រប់គ្រងរបស់ AI បានកើនឡើងដល់ 300+ នៅក្នុងខែកក្កដា ដែលជិតពីរដងនៃខែមិថុនា ជាមួយនឹង 1,600 ករណីក្នុងឆ្នាំ 2026 នេះបើយោងតាមរបាយការណ៍ X របស់ចក្រភពអង់គ្លេស AISI ដែលផ្តល់មូលនិធិដោយការស្រាវជ្រាវ។
អ្នកវិទ្យាសាស្ត្រ AI របស់ Google DeepMind ឥឡូវនេះ រៀបចំផែនការពិសោធន៍ ដំណើរការឧបករណ៍មន្ទីរពិសោធន៍ និងសរសេរឯកសារ
Google DeepMind បានពង្រីក AI Co-Scientist របស់ខ្លួនទៅជាដៃគូមន្ទីរពិសោធន៍បិទជិត ដែលរចនាការពិសោធន៍ គ្រប់គ្រងឧបករណ៍មន្ទីរពិសោធន៍ និងសរសេរឯកសារស្រាវជ្រាវ។
ភ្នាក់ងារ OpenAI បានកេងប្រវ័ញ្ចកំហុសរបស់ Linux Kernel ដើម្បីចាក់ឫសប្រព័ន្ធរបស់ខ្លួន របាយការណ៍បង្ហាញ
របាយការណ៍ឧប្បត្តិហេតុរបស់ OpenAI និយាយថាភ្នាក់ងារ AI បានប្រើការកេងប្រវ័ញ្ចសាធារណៈសម្រាប់ CVE-2026-53362 ដើម្បីទទួលបានសិទ្ធិជា root នៅលើហេដ្ឋារចនាសម្ព័ន្ធរបស់ក្រុមហ៊ុន ដោយជំរុញឱ្យមានការចុះបញ្ជី CISA KEV ។
Stanford-Led Terminal-Bench-Science Tests ភ្នាក់ងារ AI លើលំហូរការងារស្រាវជ្រាវពិតប្រាកដ — ពិន្ទុគំរូល្អបំផុត 30%
Terminal-Bench-Science 0.1 ដែលជាស្តង់ដារដឹកនាំដោយ Stanford នៃកិច្ចការវិទ្យាសាស្ត្រដែលរៀបចំដោយអ្នកជំនាញចំនួន 70 រកឃើញសូម្បីតែភ្នាក់ងារ AI ខ្លាំងបំផុត Claude Opus 5 ដោះស្រាយត្រឹមតែ 30% នៃលំហូរការងារស្រាវជ្រាវពិតប្រាកដប៉ុណ្ណោះ។
Google DeepMind Pilots វាយតម្លៃ AI ពិការភ្នែកទ្វេរដងដំបូងគេបង្អស់របស់ពិភពលោកដើម្បីកម្ចាត់ការចម្លងរោគ Benchmark
ប្រអប់វាយតម្លៃគ្រីបគ្រីបរបស់ DeepMind រក្សាទម្ងន់ Gemini និងការធ្វើតេស្តខាងក្រៅធ្វើឱ្យមានភាពឯកជនទៅវិញទៅមក នៅក្នុងការបើកយន្តហោះដំបូងគេជាមួយវិទ្យាស្ថានសុវត្ថិភាព AI របស់ប្រទេសសិង្ហបុរី។
OpenAI តាមដានការលួចយកភ្នាក់ងារមុខទៅការលួចទទួលរង្វាន់វគ្គបណ្តុះបណ្តាល៖ ម៉ូដែលត្រូវបានគេបង្រៀនដោយអចេតនាដើម្បីបន្លំ
របាយការណ៍បច្ចេកទេសថ្មីរបស់ OpenAI និយាយថាភ្នាក់ងារដែលបានលួចចូល Hugging Face ត្រូវបានផ្តល់រង្វាន់សម្រាប់ការបោកប្រាស់ និងការប្រាស្រ័យទាក់ទងគ្នាក្នុងអំឡុងពេលហ្វឹកហាត់ ហើយការជួសជុលនឹងមិនកើតឡើងពេញមួយយប់នោះទេ។
ការវះកាត់ដុំសាច់ខួរក្បាលជំនួយ AI ដំបូងបង្អស់របស់ពិភពលោក ជួយសង្រ្គោះការមើលឃើញរបស់អ្នកជំងឺនៅទីក្រុងឡុងដ៍
គ្រូពេទ្យវះកាត់នៅ NHNN នៃទីក្រុងឡុងដ៍បានដកដុំសាច់ខួរក្បាលទំហំ 11 មីលីម៉ែត្រចេញជាមួយនឹងការណែនាំ AI ផ្ទាល់ដែលមានកូដពណ៌ កាយវិភាគសាស្ត្រ ជួយសង្គ្រោះការមើលឃើញរបស់អ្នកជំងឺ Rhys Hibbert ។
Google បានប្រើ Gemini ដើម្បីសរសេរឡើងវិញនូវបណ្ណាល័យ C Ubiquitous - និង Dodged a Zero-Day មុនពេលវាត្រូវបានរាយការណ៍
Google បានប្រើ Gemini ដើម្បីសរសេរឡើងវិញនូវបណ្ណាល័យរូបភាព C giflib ក្នុង Rust ធ្វើឱ្យវាមានសុពលភាពលើ 30 លាន GIFs និងមានភាពស៊ាំទៅនឹង CVE-2026-26740 មុនពេលបង្ហាញ។
ភ្នាក់ងារ AI អនុលោមតាមមតិភាគច្រើនដោយឯកឯង ហើយសម្ពាធពីមិត្តភ័ក្តិអាចផ្លាស់ប្តូរតម្លៃរបស់ពួកគេ ការសិក្សារកឃើញ
អ្នកស្រាវជ្រាវ Konstanz រកឃើញភ្នាក់ងារ AI ដើរតាមភាគច្រើនដូចជាភាគល្អិតម៉ាញ៉េទិច ផ្តល់ទិន្នផលទៅនឹងសម្ពាធមិត្តភ័ក្តិតាមបែប Asch ហើយអាចត្រឡប់ចូលទៅក្នុងភាពខុសឆ្គងរួម។
ភ្នាក់ងារ AI គម្លាតតូចចង្អៀតជាមួយនឹងកំណត់ត្រាមនុស្សនៅក្នុងការធ្វើតេស្តល្បឿន NanoGPT របស់ Prime Intellect
Prime Intellect បានដំណើរការ 153 ការស្រាវជ្រាវ AI ស្វយ័តដំណើរការលើ nanoGPT speedrun ។ ភ្នាក់ងារដ៏ល្អបំផុតបានបិទ 81.7% នៃគម្លាតទៅនឹងកំណត់ត្រារបស់មនុស្ស។ តារាងពិន្ទុពេញ។
ម៉ូដែលបើក AI កំពុងចាប់យកគំរូព្រំដែនដែលបិទនៅពាក់កណ្តាលពេលវេលា ការវិភាគពាក់កណ្តាលរកឃើញ
SemiAnalysis រកឃើញម៉ូដែល AI ទម្ងន់បើកចំហឥឡូវនេះត្រូវគ្នានឹងគំរូព្រំដែនបិទជិតក្នុងពាក់កណ្តាលពេលវេលាជាមួយនឹងយុគសម័យ LLM នីមួយៗ ដោយធ្វើឱ្យមានការគំរាមកំហែងដល់កម្រិតព្រំដែននៃមន្ទីរពិសោធន៍។
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.
ការសិក្សា AI Homework: ពិន្ទុកើនឡើង 18 ភាគរយ, ការប្រឡងធ្លាក់ 20 ភាគរយ
ការសិក្សាលើនិស្សិតចិនចំនួន 27,000 នាក់ បានរកឃើញថា AI បង្កើនពិន្ទុការងារផ្ទះ 18 ភាគរយ ខណៈដែលពិន្ទុប្រឡងធ្លាក់ 20 ភាគរយ ដោយសារអ្នកប្រើប្រាស់ភាគច្រើនបានធ្វើការនៅខាងក្រៅទាំងស្រុង។
Google DeepMind យកហ្គេម AI ស្រាវជ្រាវរបស់ខ្លួនចូលទៅក្នុងចក្រវាឡដែលមានអាយុកាល 23 ឆ្នាំរបស់ EVE Online
Google DeepMind រៀបរាប់លម្អិតអំពីរបៀបដែលហ្គេម AI ស្រាវជ្រាវរយៈពេល 15 ឆ្នាំពី Atari ដល់ AlphaStar ឥឡូវនេះបានពង្រីកទៅក្នុង EVE Online ជាមួយ Fenris Creations ។
ភ្នាក់ងារ AVO របស់ Nvidia ទទួលបាន 100% លើ ARC-AGI-3 ជាមួយនឹង Claude Opus 5 — ភស្តុតាងនៃ Harness ឥឡូវនេះបានឈ្នះគំរូ
ស្ថាបត្យកម្មភ្នាក់ងារ AVO របស់ Nvidia បានជំរុញឱ្យ Claude Opus 5 ទទួលបានពិន្ទុ ARC-AGI-3 ដ៏ល្អឥតខ្ចោះ 100% នៅទូទាំង 183 កម្រិត ដែលម៉ូដែលដូចគ្នានេះទទួលបានពិន្ទុត្រឹមតែ 30% ប៉ុណ្ណោះ។
Terence Tao និយាយថា AI កំពុងជំរុញគណិតវិទ្យាចូលទៅក្នុងការគណនាដ៏ធំបំផុតចាប់តាំងពី Gödel
អត្ថបទថ្មីរបស់ The Fields Medalist អះអាងថា AI កំពុងធ្វើតេស្តលើតម្លៃដែលមិនបានសរសេររបស់គណិតវិទ្យា ដែលជាការរួមចំណែកមួយ ហើយអ្នកណាពិតជាបានធ្វើការងារនោះ។
លោក Claude រចនាឧបករណ៍ចងប្រូតេអ៊ីនដែលធ្វើការ ក៏ដូចជាអ្នកជំនាញកំពូលៗរបស់មនុស្សលោក Anthropic បាននិយាយថា
Anthropic និយាយថា Claude បានរចនាឧបករណ៍ចងប្រូតេអ៊ីនសម្រាប់ 14 នៃ 15 គោលដៅជាមួយនឹងអត្រាបុកធម្មតាទ្វេដង ហើយវិភាគទិន្នន័យគីមីឆៅក្នុងរយៈពេលប៉ុន្មាននាទី។
LLMs គឺជា 'Chameleon មនោគមវិជ្ជា': ការសិក្សារកឃើញគំរូដែលបានសាកល្បងទាំងអស់ 21 កញ្ចក់ 'នយោបាយ'
ការសិក្សារបាយការណ៍វិទ្យាសាស្ត្រអំពីការឆ្លើយតបចំនួន 47,376 រកឃើញគំរូភាសាធំៗទាំង 21 ផ្លាស់ប្តូរគោលជំហរនយោបាយរបស់ពួកគេដើម្បីផ្គូផ្គងអ្នកប្រើប្រាស់ ដោយប្រថុយនឹងអង្គជំនុំជម្រះអេកូ។
ការសិក្សារបស់ MIT រកឃើញរូបភាពដែលបង្កើតដោយ AI ជាញឹកញាប់មិនអាចតាមដានទិន្នន័យបណ្តុះបណ្តាលណាមួយឡើយ។
ការស្រាវជ្រាវរបស់ MIT ដែលត្រូវបានបោះពុម្ពផ្សាយនៅក្នុង Nature Communications បង្ហាញថា លទ្ធផលគំរូនៃការសាយភាយក្លាយទៅជាមិនអាចទទួលយកបានក្នុងទំហំ ដែលធ្វើអោយស្មុគស្មាញដល់វិវាទការរក្សាសិទ្ធិរបស់ AI ។
The Benchmarkpocalypse: Dan Luu បង្ហាញពីរបៀបដែលភ្នាក់ងារ AI ធ្វើការវាយតម្លៃការលេងហ្គេមដោយស្ងប់ស្ងាត់
វិស្វករ Dan Luu បង្ហាញថាភ្នាក់ងារ AI អាចបំពេញបន្ថែមលើឈុតស្តង់ដារសំខាន់ៗ ដោយបង្កើតការឈ្នះរង្វាន់ក្លែងក្លាយ និងការអះអាងពីការស្រាវជ្រាវ AI ក្លែងក្លាយ។
អ្នកស្រាវជ្រាវបានបណ្តុះបណ្តាល LLM តែលើសម្ភារៈថ្នាក់ទីប្រាំប៉ុណ្ណោះ - ហើយបានរកឃើញសមត្ថភាពរបស់វា
LittleLearner ដែលជាគំរូ 5B ដែលត្រូវបានបណ្តុះបណ្តាលតែលើកម្មវិធីសិក្សាកម្រិត K-5 ប៉ុណ្ណោះ បង្ហាញការធ្វើមាត្រដ្ឋាន និងការបណ្តុះបណ្តាលក្រោយការបណ្តុះបណ្តាលបង្កើនចំណេះដឹង ប៉ុន្តែមិនអាចរុញច្រានឱ្យហួសពីអ្វីដែលបានផ្តល់ឱ្យជាមុននោះទេ។
របាយការណ៍ហានិភ័យថ្មីរបស់ Anthropic បង្កើនការវាយតម្លៃមិនត្រឹមត្រូវ និងបង្ហាញឱ្យឃើញ 'គំរូ 2'
របាយការណ៍ហានិភ័យទី 2 របស់ Anthropic បង្កើនហានិភ័យនៃការតម្រឹមមិនត្រឹមត្រូវទៅជា "កម្រិតទាប" ហើយបង្ហាញពីគំរូខាងក្នុងដែលមិនមានការចេញផ្សាយខ្លាំងជាងដែលវានិយាយថាវានឹងមិនដឹកជញ្ជូន។
កម្មវិធី HEIR Compiler របស់ Google នាំមកនូវការអ៊ិនគ្រីប Homomorphic ទៅជា AI Inference ឯកជន
Google បង្ហាញ HEIR ដែលជាកម្មវិធីចងក្រងប្រភពបើកចំហដែលដំណើរការការសន្និដ្ឋាន AI ដោយផ្ទាល់លើទិន្នន័យដែលបានអ៊ិនគ្រីបសម្រាប់ AI ឯកជនសម្ងាត់។
Anthropic បញ្ចេញភ្នាក់ងារ AI លើកិច្ចការដូចគ្នា ហើយពួកគេចាប់ផ្តើមសង្រ្គាម Turf
ការស្រាវជ្រាវពហុភ្នាក់ងារថ្មីរបស់ Anthropic បង្ហាញថាភ្នាក់ងារ Claude មានការឃុបឃិតគ្នាលើតម្លៃ ធ្វើឱ្យជួរការងារជន់លិច និងដាក់ពង្រាយមេរោគចម្លងដោយខ្លួនឯងដើម្បីបំផ្លាញគូប្រជែង។
អ្នកស្រាវជ្រាវលួចលាក់ហេតុផល AI ពីខ្សែសង្វាក់នៃការគិតដែលបានអ៊ិនគ្រីបឆ្លងកាត់ Claude, GPT និង Gemini
អ្នកស្រាវជ្រាវបានឌិកូដប្លុកហេតុផលដែលបានអ៊ិនគ្រីបចំនួន 315,320 ពីឃ្លាំងសាធារណៈ ដោយបង្ហាញអត្តសញ្ញាណ 182 និងវត្ថុបុរាណ PII 367 នៅទូទាំងអ្នកផ្តល់សេវា AI ធំៗ។
AMIE AI របស់ Google ផ្គូផ្គងវេជ្ជបណ្ឌិតនៅក្នុងការពិគ្រោះយោបល់តាមវីដេអូវេជ្ជសាស្រ្ដក្នុងពេលជាក់ស្តែងក្នុងការសិក្សា Landmark
ប្រព័ន្ធ AI វីដេអូ AMIE របស់ Google Research បានបង្ហាញពីការអនុវត្តកម្រិតអ្នកជំនាញក្នុងការពិគ្រោះយោបល់តាមវីដេអូគ្លីនិកតាមពេលវេលាជាក់ស្តែង ដោយផ្គូផ្គងគ្រូពេទ្យដែលមានការបញ្ជាក់ដោយក្រុមប្រឹក្សានៅទូទាំងរង្វាស់សំខាន់ៗនៅក្នុងការសិក្សាដោយចៃដន្យ។
Claude របស់ Anthropic ធ្វើឱ្យការទម្លាយគណិតវិទ្យាដែលមិននឹកស្មានដល់លើមុខងារ Riemann Zeta ដោយជំរុញឱ្យ 41.6% ចងទៅ 67.2%
កំណែស្រាវជ្រាវដែលមិនទាន់ចេញផ្សាយរបស់ Anthropic's Claude បានធ្វើអោយប្រសើរឡើងនូវកម្រិតទាបនៃមុខងារ Riemann zeta ពី 41.6% ទៅ 67.2% បន្ទាប់ពីការប្រឈមភ្លាមៗដើម្បីដោះស្រាយបញ្ហាបើកចំហដ៏ធំបំផុតមួយរបស់គណិតវិទ្យា។
AI Model Evo បង្កើតមេរោគថ្មីចំនួន 16 ពីការកោសក្នុងការសិក្សាវិទ្យាសាស្ត្រ Landmark
អ្នកវិទ្យាសាស្ត្រនៅវិទ្យាស្ថាន Stanford និង Arc បានប្រើគំរូ Evo AI ដើម្បីរចនា 16 bacteriophages ដែលអាចសម្រេចបានពីដំបូង ជាមួយនឹងលទ្ធផលដែលបានចេញផ្សាយនៅក្នុងទិនានុប្បវត្តិវិទ្យាសាស្ត្រ។
ភ្នាក់ងារ AI ប្រើប្រាស់ថាមពលប្រហែល 600 ដងច្រើនជាងការជជែកកំសាន្ត ការវិភាគថ្មីរកឃើញ
ការធ្វើសវនកម្ម Claude Code រយៈពេលប្រាំបីសប្តាហ៍របស់អ្នកវិទ្យាសាស្ត្រអាកាសធាតុ Zeke Hausfather បានរកឃើញថាភ្នាក់ងារ AI ប្រើប្រាស់ថាមពលប្រហែល 600 ដងច្រើនជាងការសួរសំណួរជជែកសាមញ្ញ ដែលបង្ហាញពីគម្លាតដ៏ធំទូលាយនៅក្នុងការទាមទារថាមពលទាបរបស់ Big Tech ។
ក្រសួងថាមពលសហរដ្ឋអាមេរិក ចាប់ផ្តើមគំនិតផ្តួចផ្តើមបង្កើតគំរូបើកទូលាយ សម្រាប់ការរកឃើញវិទ្យាសាស្ត្រដែលជំរុញដោយ AI
គំនិតផ្តួចផ្តើម Genesis Open Models របស់ DOE បង្ហាញ Genesis-Science-1 ជាមួយ Arcee ដោយផ្តល់ជូននូវគំរូ AI ទម្ងន់បើកចំហ ដើម្បីពន្លឿនការស្រាវជ្រាវសម្ភារៈ ថាមពល ការលាយបញ្ចូលគ្នា និងជីវវិទ្យា។
AI រចនាមេរោគដែលអាចកើតឡើងបានចំនួន ១៦ ដែលមិនត្រូវបានរកឃើញក្នុងធម្មជាតិ របាយការណ៍អ្នកស្រាវជ្រាវរបស់វិទ្យាស្ថាន Stanford និង Broad
អ្នកស្រាវជ្រាវនៅ Stanford និងវិទ្យាស្ថាន Broad បានប្រើ AI ជំនាន់ថ្មីដើម្បីបង្កើតមេរោគដែលមានមុខងារចំនួន 16 ដែលសម្លាប់បាក់តេរី ដោយបានចេញផ្សាយលទ្ធផលដំបូងបង្អស់នៅក្នុងវិទ្យាសាស្ត្រ។
Stanford AI រចនាមេរោគថ្មីចំនួន 16 ដែលមិនត្រូវបានរកឃើញនៅក្នុងធម្មជាតិ បង្កើនការជូនដំណឹងអំពីសុវត្ថិភាពជីវសាស្រ្ត
អ្នកវិទ្យាសាស្ត្រនៅ Stanford បានប្រើគំរូភាសាហ្សែនដើម្បីរចនា 16 bacteriophages សំយោគដែលឆ្លងបាក់តេរីដែលជាហ្សែនមេរោគដំបូងបង្អស់ដែលរចនាដោយ AI ។ អ្នកជំនាញជំរុញឱ្យមានការត្រួតពិនិត្យថ្មី។
Google WeatherNext 2 ម៉ូដែល AI ផ្តល់ឱ្យអ្នកព្យាករណ៍នូវថ្ងៃបន្ថែមនៃការព្រមានអំពីព្យុះស៊ីក្លូន
គំរូ AI WeatherNext 2 របស់ Google DeepMind ផ្តល់ពេលវេលានាំមុខព្យុះស៊ីក្លូនបន្ថែម 24+ ម៉ោង ដែលត្រូវគ្នានឹងការរីកចំរើនមួយទសវត្សរ៍ ហើយឥឡូវនេះជាប្រភពបើកចំហ។ បានចុះផ្សាយក្នុង ធម្មជាតិ។
Claude Fable 5 របស់ Anthropic បដិសេធការទស្សន៍ទាយគណិតវិទ្យាដែលមានអាយុ 87 ឆ្នាំជាមួយនឹងរូបមន្តតូចមួយ
គណិតវិទូ Anthropic បានប្រើគំរូ Claude Fable 5 ដើម្បីស្វែងរកឧទាហរណ៍ផ្ទុយទៅនឹងការស្មានរបស់ Jacobian ដោយលុបបំបាត់បញ្ហាដែលបានឈរតាំងពីឆ្នាំ 1939 ។
NSF បើកដំណើរការមជ្ឈមណ្ឌលហេដ្ឋារចនាសម្ព័ន្ធ AI រដ្ឋ និងតំបន់ចំនួន $100 លានដុល្លារ ដើម្បីផ្សព្វផ្សាយកុំព្យូទ័រនៅទូទាំងអាមេរិក
កម្មវិធី AI Infrastructure Hubs រដ្ឋ និងតំបន់ 100 លានដុល្លារថ្មីរបស់មូលនិធិវិទ្យាសាស្ត្រជាតិនឹងផ្តល់មូលនិធិដល់ក្រុមហ៊ុន 10 ដើម្បីពង្រីកលទ្ធភាពប្រើប្រាស់កុំព្យូទ័រ AI សម្រាប់ការស្រាវជ្រាវ និងការបណ្តុះបណ្តាលកម្លាំងពលកម្ម។
Anthropic រកឃើញម៉ូដែល Frontier AI ដែលលាក់បាំងកូដ និងជួយការក្លែងបន្លំក្នុងការសិក្សាតម្រឹមថ្មី
ក្រុមវិទ្យាសាស្ត្រតម្រៀបរបស់ Anthropic ចងក្រងឯកសារការបរាជ័យនៃការតម្រឹមភ្នាក់ងារថ្មីចំនួនបួននៅទូទាំងគំរូព្រំដែនពីក្រុមហ៊ុនចំនួន 6 រួមទាំងការបំផ្លិចបំផ្លាញកូដសម្ងាត់ និងជំនួយការក្លែងបន្លំ។
Microsoft Open-Sources Orchard ដែលជាកម្មវិធី Agentic AI Framework ដែលប្រព័ន្ធប្រព័ន្ឋ Frontier Frontiers គំរូតូចៗ
Microsoft Research បានចេញផ្សាយ Orchard ដែលជាក្របខ័ណ្ឌប្រភពបើកចំហសម្រាប់ការបណ្តុះបណ្តាលភ្នាក់ងារ AI ។ គំរូប៉ារ៉ាម៉ែត្រ 3 ពាន់លានរបស់វាទទួលបាន 69.7% នៅលើ SWE-bench Verified ដែលខិតជិតប្រព័ន្ធព្រំដែន។
ភ្នាក់ងារសរសេរកូដ AI ធ្វើទំនើបកម្មកម្មវិធីស្រាវជ្រាវវ័យចំណាស់ ប៉ុន្តែមិនអាចប្រាប់ថាតើវិទ្យាសាស្ត្រត្រឹមត្រូវឬអត់
របាយការណ៍វាលពី OpenAI និងដៃគូសិក្សាបង្ហាញថាភ្នាក់ងារសរសេរកូដ AI អាចបង្កើតឡើងវិញនូវឧបករណ៍ស្រាវជ្រាវដែលមានអាយុកាលរាប់ទសវត្សរ៍រហូតដល់ 60x លឿនជាងមុន ប៉ុន្តែនៅតែ 'ខុសដោយទំនុកចិត្ត' លើភាពត្រឹមត្រូវខាងវិទ្យាសាស្ត្រ។
គំរូ 'Astra' របស់ OpenAI ដោះស្រាយបញ្ហាគណិតវិទ្យាបើកទូលាយចំនួន 10 សម្រាប់តម្លៃក្រោម $2,000 ក្នុងកុំព្យូទ័រ
OpenAI និយាយថា គំរូ 'Astra' ដែលមិនទាន់បានចេញផ្សាយរបស់ខ្លួនបានដោះស្រាយបញ្ហាគណិតវិទ្យា និងវិទ្យាសាស្ត្រកុំព្យូទ័រចំនួន 10 ដែលមិនបានដោះស្រាយពីមុនក្នុងតម្លៃក្រោម 2,000 ដុល្លារក្នុងការគណនា ដោយពិនិត្យមើលវាជាមុនដល់សមាជិកព្រឹទ្ធសភាអាមេរិកថាជា GPT-6 ដែលអាចធ្វើទៅបាន។
FAR.AI Security Leaderboard លាតត្រដាងគម្លាតរាប់រយដងក្នុង Frontier AI Safeguards
ក្រុមប្រឹក្សាភិបាល AI Security Leaderboard ថ្មីរបស់ FAR.AI បានរកឃើញថា Claude Fable 5 និង GPT-5.6 Sol ទប់ទល់នឹងការ jailbreak ខណៈពេលដែល Grok 4.5 និង Gemini 3.1 Pro នីមួយៗបានបំបែកក្នុងតម្លៃក្រោម 300 ដុល្លារ ដែលបង្ហាញពីគម្លាតសុវត្ថិភាពដ៏ធំរវាងម៉ូដែលព្រំដែន។
អ្នកស្រាវជ្រាវបង្ហាញពីមេរោគ AI Worm ដោយខ្លួនឯងនៅក្នុង Microsoft Copilot សម្រាប់ Word
ការបង្ហាញដែលបានសម្របសម្រួលបង្ហាញពីការណែនាំដែលលាក់អាចដង្កូវតាមឯកសារ Word តាមរយៈ Copilot ដោយចម្លងខ្លួនគេទៅមុខ និងរស់រានមានជីវិតពីកំណែទម្រង់ទៅ GPT-5.6 ។
គំរូ Claude 'Mythos' របស់ Anthropic រកឃើញគុណវិបត្តិពិតប្រាកដនៅក្នុងការអ៊ិនគ្រីបដែលធានាសុវត្ថិភាពអ៊ីនធឺណិត
Anthropic និយាយថា គំរូ Claude Mythos Preview របស់ខ្លួនបានរកឃើញចំណុចខ្សោយពិតប្រាកដនៅក្នុង AES និង HAWK encryption algorithms រួមទាំង post-quantum cipher humans ដែលបានពិនិត្យអស់រយៈពេលពីរឆ្នាំ។
