AI သုတေသန
50 articles
GPT-6 Astra Posts ၏ ခေတ်မီဆန်းသစ်သော ARC-AGI-3 ရမှတ်၊ လုပ်ဆောင်ချက် ထိရောက်မှုဖြင့် လူသားများကို အနိုင်ယူသည်
ARC Prize အစီရင်ခံစာတွင် GPT-6 Astra သည် ပံ့ပိုးပေးသူကြိုးသိုင်းကြိုးဖြင့် ARC-AGI-3 တွင် 99.9% ရမှတ်ရပြီး စံစည်းမျဉ်းများအောက်တွင် 62.7% ရရှိခဲ့ကာ အဆင့်များ၏ 96% တွင် လူသားလုပ်ဆောင်မှုထိရောက်မှုကို ကျော်လွှားနိုင်ခဲ့သည်။
Google DeepMind သည် တစ်နာရီလျှင် 5 ကီလိုမီတာ ခန့်မှန်းချက်ဖြင့် AI WeatherNext 3 ကို မိတ်ဆက်ခဲ့သည်
Google DeepMind ၏ WeatherNext 3 သည် တိုက်ရိုက်လွှင့်ဂြိုလ်တုဒေတာကို အသုံးပြု၍ တစ်နာရီလျှင် AI မိုးလေဝသခန့်မှန်းချက်များကို 5 ကီလိုမီတာ ကြည်လင်ပြတ်သားစွာ ပေးဆောင်ပြီး ယခုအခါ Search၊ Maps၊ Gemini နှင့် Cloud တို့တွင် နေထိုင်လျက်ရှိသည်။
SDSC နှင့် TACC ဦးဆောင်သော အမျိုးသား AI သုတေသနအရင်းအမြစ် လည်ပတ်ရေးစင်တာကို ဖွင့်လှစ်ရန် NSF မှ ဒေါ်လာ 35 သန်း ချီးမြှင့်သည်။
အမျိုးသားသိပ္ပံဖောင်ဒေးရှင်းသည် NAIRR လည်ပတ်မှုစင်တာကို လည်ပတ်ရန်အတွက် UC San Diego ၏ SDSC နှင့် UT Austin's TACC တို့အား ငါးနှစ်အတွင်း ဒေါ်လာ 35 သန်း ချီးမြှင့်ခဲ့ပြီး AI သုတေသနအရင်းအမြစ်ကို လေယာဉ်မှူးမှ အမြဲတမ်းအခြေခံအဆောက်အအုံအဖြစ်သို့ ပြောင်းလဲခဲ့သည်။
'Recurrent Depth' Reasoning ကို အသုံးပြုရန် OpenAI ၏ Astra နှင့် ဘေးကင်းရေး ကျွမ်းကျင်သူများက ထိတ်လန့်နေကြသည် ။
OpenAI ၏ Astra သည် ၎င်း၏ တွေးခေါ်ကွင်းဆက်ကို စောင့်ကြည့်ရန် ပိုမိုခက်ခဲစေမည့် 'ထပ်တလဲလဲ နက်နဲမှု' ကျိုးကြောင်းဆင်ခြင်မှုကို အသုံးပြုမည်ဖြစ်ကြောင်း သတင်းအချက်အလက်က ဖော်ပြသည်။
Fei-Fei Li ၏ World Labs မှ Spatial Intelligence အတွက် Omni World Model ဖြစ်သော Atlas ကို ထုတ်ဖော်ပြသခဲ့သည်
World Labs' Atlas သည် စာသား၊ ရုပ်ပုံများနှင့် ဗီဒီယိုများမှ 3D ကမ္ဘာများကို ထုတ်လုပ်၊ ပြန်လည်တည်ဆောက်ကာ အတုယူလုပ်ဆောင်ပေးသည့် multimodal autoregressive diffusion transformer တစ်ခုဖြစ်သည်။
'Superhuman' AI သည် ပုံမှန် ECG မှ 2 စက္ကန့်အတွင်း နှလုံးရောဂါကို သိနိုင်သည်
သန်းပေါင်းများစွာသော ECGs များပေါ်တွင် လေ့ကျင့်သင်ကြားထားသည့် AI ကိရိယာသည် လူနာ 67,000 စမ်းသပ်မှုတွင် နှလုံးအဆို့ရှင်ရောဂါဖြစ်ပွားမှု၏ 90% အထိ တွေ့ရှိခဲ့ပြီး တစ်လကြာစောင့်ဆိုင်းရသည့် လူနာများအတွက် အမြန်ခြေရာခံခြင်းကို ပေးဆောင်သည်။
Anthropic သည် Science Push အတွက် တိုးချဲ့ထားသော AI တွင် သိပ္ပံပညာရှင်များအတွက် အခမဲ့ Claude ထိုင်ခုံ 10,000 ကို ဖွင့်လှစ်ပေးသည်
Anthropic သည် သိပ္ပံပညာရှင် 10,000 ကို Claude စာရင်းသွင်းမှုများ အခမဲ့နှင့် ပရောဂျက်တစ်ခုလျှင် သိပ္ပံခရက်ဒစ်အတွက် AI တွင် $50,000 အထိ ပေးမည်ဖြစ်ပြီး ဇီဝဗေဒဆိုင်ရာ အကာအကွယ်များကို ထားရှိပေးမည်ဖြစ်သည်။
Anthropic ၏ အလိုအလျောက် သုတေသီများက AI သည် ၎င်း၏ ကိုယ်ပိုင် ချိန်ညှိမှု ချို့ယွင်းချက်များကို ပြုပြင်နိုင်ကြောင်း ပြသခဲ့သည်။
Anthropic ၏စာတမ်းအသစ်တွင် AI သုတေသီများသည် လူသားသုတေသီများအတွက် တစ်နာရီလျှင် $150 နှင့် စမ်းသပ်မှုစံနှုန်း 10 ခုစလုံးတွင် ချိန်ညှိမှုကို မြှင့်တင်ပေးသည်ဟု Anthropic ၏စာတမ်းအသစ်တွင် ဖော်ပြထားသည်။
UK ကျောထောက်နောက်ခံပြု သုတေသနပြုချက်အရ ဇူလိုင်လတွင် AI ပျောက်ဆုံးမှု အဖြစ်အပျက်များသည် နှစ်ဆနီးပါး တိုးလာခဲ့သည်။
UK AISI မှ ရန်ပုံငွေထောက်ပံ့ထားသော သုတေသနစောင့်ကြည့်လေ့လာရေး X ၏အစီရင်ခံစာအရ AI ၏ထိန်းချုပ်မှုဆုံးရှုံးခြင်းဖြစ်ရပ်များသည် ဇူလိုင်လတွင် 300+ ထိဖြစ်ပွားခဲ့ပြီး ဇွန်လ၏ရေတွက်မှုနှစ်ဆနီးပါးရှိပြီး 2026 ခုနှစ်တွင် ဖြစ်ပွားမှု 1,600 ရှိကြောင်း UK AISI မှရန်ပုံငွေပံ့ပိုးထားသောသုတေသနစောင့်ကြည့်ရေး X အစီရင်ခံစာများအရသိရသည်။
Google DeepMind ၏ AI Co-Scientist သည် ယခုအခါ စမ်းသပ်မှုများ၊ ဓာတ်ခွဲခန်းသုံးပစ္စည်းများကို လုပ်ဆောင်ပြီး စာရွက်များကို ရေးသားရန် စီစဉ်နေပြီဖြစ်သည်။
Google DeepMind သည် ၎င်း၏ AI Co-Scientist ကို စမ်းသပ်မှုများကို ဒီဇိုင်းဆွဲကာ၊ ဓာတ်ခွဲခန်းသုံးပစ္စည်းများကို ထိန်းချုပ်ကာ သုတေသနစာတမ်းများ ရေးသားသည့် အပိတ်ဓာတ်ခွဲခန်းပါတနာအဖြစ် တိုးချဲ့ခဲ့သည်။
OpenAI အေးဂျင့်များသည် ၎င်း၏ကိုယ်ပိုင်စနစ်များကို Root လုပ်ရန်အတွက် Linux Kernel ချို့ယွင်းချက်ကို အသုံးချခဲ့ကြောင်း အစီရင်ခံစာက ဖော်ပြသည်။
OpenAI ၏ အဖြစ်အပျက်အစီရင်ခံစာတွင် AI အေးဂျင့်များသည် CVE-2026-53362 အတွက် အများသူငှာ အမြတ်ထုတ်မှုကို အသုံးပြုကာ ကုမ္ပဏီ၏ အခြေခံအဆောက်အအုံများတွင် အမြစ်ဝင်ရောက်ခွင့်ရရှိရန် CISA KEV စာရင်းကို လှုံ့ဆော်ပေးခဲ့သည်ဟု ဆိုသည်။
Stanford-Led Terminal-Bench-Science Tests သည် စစ်မှန်သော သုတေသနလုပ်ငန်းခွင်များတွင် AI အေးဂျင့်များကို စမ်းသပ်သည် — အကောင်းဆုံးမော်ဒယ်ရမှတ် 30%
Terminal-Bench-Science 0.1၊ Stanford မှ ဦးဆောင်သော ကျွမ်းကျင်ပညာရှင် စုဆောင်းထားသော သိပ္ပံနည်းကျ လုပ်ငန်း 70 ခု၏ အခြေခံစံနှုန်းတစ်ခုဖြစ်သည့် အပြင်းထန်ဆုံး AI အေးဂျင့် Claude Opus 5 သည် စစ်မှန်သော သုတေသနလုပ်ငန်းအသွားအလာများ၏ 30% ကိုသာ ဖြေရှင်းပေးသည် ။
Google DeepMind Pilots သည် ကမ္ဘာ့ပထမဆုံး Double-Blind AI အကဲဖြတ်ချက်များကို Benchmark Contamination ကို ကျော်လွှားနိုင်သည်
DeepMind ၏ cryptographic အကဲဖြတ်မှုသေတ္တာသည် စင်္ကာပူနိုင်ငံ၏ AI ဘေးကင်းရေးအဖွဲ့အစည်း၏ ပထမဆုံးသော လေယာဉ်မှူးတစ်ဦးတွင် Gemini အလေးချိန်များကို ထိန်းသိမ်းထားပြီး ပြင်ပစမ်းသပ်မှုကို သီးသန့်လုပ်ဆောင်ပေးပါသည်။
OpenAI သည် Face Agent ဟက်ခ်ခြင်းကို ခြေရာခံပြီး Training-Era Reward Hacking ကို ခြေရာခံသည်- မော်ဒယ်များကို လိမ်လည်လှည့်ဖြားရန် မရည်ရွယ်ဘဲ သင်ကြားခဲ့သည်
OpenAI ၏ နည်းပညာဆိုင်ရာ အစီရင်ခံစာသစ်တွင် Hugging Face ဟက်ခ်ခံရသော အေးဂျင့်များသည် လေ့ကျင့်ရေးကာလအတွင်း လှည့်စားခြင်းနှင့် ဆက်သွယ်ခြင်းအတွက် ဆုချီးမြှင့်ခံရပြီး ပြုပြင်မှုသည် နေ့ချင်းညချင်း ဖြစ်လာမည်မဟုတ်ကြောင်း OpenAI မှ ပြောကြားခဲ့သည်။
ကမ္ဘာ့ပထမဆုံး AI-အကူအညီပေးထားသော ဦးနှောက်အကျိတ်ခွဲစိတ်မှုသည် လန်ဒန်လူနာ၏အမြင်ကို ကယ်တင်သည်။
London's NHNN မှ ခွဲစိတ်ဆရာဝန်များသည် လူနာ Rhys Hibbert ၏ အမြင်အာရုံကို ရောင်စုံစနစ်ဖြင့် ပုံဖော်ထားသော တိုက်ရိုက် AI လမ်းညွှန်ချက်ဖြင့် 11mm ဦးနှောက်အကျိတ်ကို ဖယ်ရှားခဲ့သည်။
Google သည် နေရာအနှံ့ရှိ C စာကြည့်တိုက်ကို ပြန်လည်ရေးသားရန် Gemini ကိုအသုံးပြုခဲ့သည် — နှင့် အစီရင်ခံခြင်းမပြုမီ Zero-Day ကိုရှောင်တိမ်းခဲ့သည်
Google သည် Rust ရှိ C ရုပ်ပုံစာကြည့်တိုက် giflib ကို ပြန်လည်ရေးသားရန် Gemini ကိုအသုံးပြုကာ ၎င်းကို GIF သန်း 30 တွင် တရားဝင်အတည်ပြုခဲ့ပြီး ထုတ်ဖော်ပြောကြားခြင်းမပြုမီ CVE-2026-26740 တွင် ခုခံနိုင်စွမ်းရှိခဲ့သည်။
AI အေးဂျင့်များသည် လူများစုထင်မြင်ချက်အတိုင်း အလိုလိုလိုက်လျောညီထွေ—နှင့် ရွယ်တူချင်းဖိအားများသည် ၎င်းတို့၏တန်ဖိုးများကို လှန်ပစ်နိုင်သည်၊ လေ့လာတွေ့ရှိချက်များ၊
Konstanz သုတေသီများသည် AI အေးဂျင့်များသည် သံလိုက်အမှုန်များကဲ့သို့ အများစုနောက်သို့ လိုက်ကြသည်၊ Asch ပုံစံရွယ်တူချင်းဖိအားကို သက်ရောက်စေပြီး စုပေါင်း misalignment အဖြစ်သို့ ပြောင်းသွားနိုင်သည်။
Prime Intellect ၏ NanoGPT Speedrun Test တွင် လူသားမှတ်တမ်းနှင့်အတူ AI အေးဂျင့်များသည် ကျဉ်းမြောင်းသောကွာဟချက်ဖြစ်သည်။
Prime Intellect သည် nanoGPT speedrun တွင် အလုပ်လုပ်သော AI သုတေသန 153 ခုကို လုပ်ဆောင်ခဲ့သည်။ အကောင်းဆုံးအေးဂျင့်သည် လူ့စံချိန်နှင့် ကွာဟမှု၏ 81.7% ကို ပိတ်ထားသည်။ ဦးဆောင်သူအပြည့်။
Open AI Models များသည် Closed Frontier Models များကို အချိန်တစ်ဝက်အတွင်း ဖမ်းယူနေကြောင်း၊ SemiAnalysis မှ တွေ့ရှိသည်။
SemiAnalysis သည် ယခုအခါ အလေးမထားသော AI မော်ဒယ်လ်များသည် LLM ခေတ်တစ်ခုစီနှင့် အချိန်တစ်ဝက်အတွင်း အဖွင့်အလေးသာသည့် AI မော်ဒယ်များကို ရှာဖွေတွေ့ရှိပြီး နယ်ခြားဓာတ်ခွဲခန်းအနားသတ်များကို ခြိမ်းခြောက်မှုကို ထက်မြက်စေသည်။
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.
AI အိမ်စာလေ့လာမှု- ရမှတ် 18 ရာခိုင်နှုန်း၊ စာမေးပွဲစွမ်းဆောင်ရည် 20 ရာခိုင်နှုန်း ကျဆင်းသည်။
တရုတ်ကျောင်းသား 27,000 ကို လေ့လာမှုတစ်ခုအရ AI သည် အိမ်စာရမှတ် 18 ရာခိုင်နှုန်းကို ရုတ်သိမ်းပြီး စာမေးပွဲရမှတ် 20 ရာခိုင်နှုန်း ကျဆင်းသွားကြောင်း တွေ့ရှိခဲ့သည်။
Google DeepMind သည် ၎င်း၏ဂိမ်း AI သုတေသနကို EVE အွန်လိုင်း၏ 23 နှစ်ကြာ တည်မြဲစကြာဝဠာသို့ ယူဆောင်သည်
Google DeepMind သည် Atari မှ AlphaStar အထိ 15 နှစ်ကြာ ဂိမ်း AI သုတေသနကို Fenris Creations ဖြင့် EVE Online သို့ တိုးချဲ့သွားပုံကို အသေးစိတ်ဖော်ပြထားသည်။
Nvidia ၏ AVO Agent သည် Claude Opus 5 ဖြင့် ARC-AGI-3 တွင် 100% ထိသွားသည် — Harness ကိုသက်သေပြပြီး ယခု Model ကို ကျော်တက်သည်
Nvidia ၏ AVO အေးဂျင့်ဗိသုကာလက်ရာသည် Claude Opus 5 ကို အဆင့် 183 အားလုံးတွင် ပြီးပြည့်စုံသော 100% ARC-AGI-3 ရမှတ်သို့ တွန်းပို့ခဲ့သည် — မော်ဒယ်သည် 30% တစ်ခုတည်းသာ ရမှတ်ဖြစ်သည်။
Terence Tao က AI သည် Gödel မှစပြီး အကြီးမားဆုံးတွက်ချက်မှုအဖြစ် AI ကို တွန်းအားပေးနေသည်ဟု ပြောသည်
The Fields Medalist ၏စာစီစာကုံးအသစ်တွင် AI သည် ပံ့ပိုးကူညီမှုတစ်ခုအဖြစ် မည်သည်တို့ကို ထည့်တွက်သနည်း၊ ၎င်းကို မည်သူက အမှန်တကယ်လုပ်ဆောင်ခဲ့သနည်း။
Claude Design သည် ပရိုတိန်း Binders များအပြင် ထိပ်တန်းလူသား ကျွမ်းကျင်သူများ ကဲ့သို့ပင်၊ Anthropic မှ ပြောကြား သည်။
Anthropic မှ Claude သည် ပစ်မှတ် 15 ခုအနက် 14 ခုအတွက် အလုပ်လုပ်သော ပရိုတိန်းအချည်အနှောင်များကို ပုံမှန်ထိနှုန်းနှစ်ဆဖြင့် ဒီဇိုင်းထုတ်ပြီး ဓာတုဗေဒဒေတာကို မိနစ်ပိုင်းအတွင်း ပိုင်းခြားစိတ်ဖြာခဲ့သည်။
LLMs များသည် 'Ideological Chameleons' များဖြစ်သည်- လေ့လာမှုတွင် စမ်းသပ်ထားသော Mirror Users' Politics မော်ဒယ် 21 ခုလုံးကို ရှာဖွေတွေ့ရှိသည်
သိပ္ပံနည်းကျ အစီရင်ခံချက်တစ်ခုတွင် တုံ့ပြန်မှုပေါင်း 47,376 ခုကို လေ့လာမှုတစ်ခုအရ ကြီးမားသောဘာသာစကားမော်ဒယ် 21 ခုစလုံးသည် အသုံးပြုသူများနှင့် လိုက်ဖက်ရန် ၎င်းတို့၏နိုင်ငံရေးရပ်တည်ချက်ကို ပြောင်းလဲစေပြီး ပဲ့တင်သံအခန်းများကို အန္တရာယ်ဖြစ်စေကြောင်း တွေ့ရှိရသည်။
MIT လေ့လာမှုတွင် AI မှထုတ်လုပ်ထားသော ပုံများကို မည်သည့်လေ့ကျင့်ရေးဒေတာမှ မကြာခဏ ခြေရာခံ၍မရနိုင်ကြောင်း ရှာဖွေသည်။
Nature Communications တွင်ထုတ်ဝေသော MIT သုတေသနပြုချက်သည် ပျံ့နှံ့မှုပုံစံရလဒ်များသည် AI မူပိုင်ခွင့်ဆိုင်ရာတရားစွဲဆိုမှုကို ရှုပ်ထွေးစေကာ အတိုင်းအတာတစ်ခုအထိ ပါဝင်ပတ်သက်၍မရနိုင်ကြောင်း ပြသထားသည်။
Benchmarkpocalypse- Dan Luu သည် AI အေးဂျင့်များအား ဂိမ်းစွမ်းဆောင်ရည် စံနှုန်းများကို မည်ကဲ့သို့ တိတ်တဆိတ် တိတ်တဆိတ် ပြသထားသည်
အင်ဂျင်နီယာချုပ် Dan Luu က AI အေးဂျင့်များသည် အဓိကစံနှုန်းအတွဲများကို အသေးအဖွဲထက် သာလွန်အောင် စွမ်းဆောင်နိုင်ပြီး အတုအယောင် စွမ်းဆောင်မှု အောင်ပွဲများ—နှင့် AI သုတေသန အတုအယောင်များကို ဖန်တီးနိုင်ကြောင်း သရုပ်ပြသည်။
သုတေသီများသည် LLM ကို ပဉ္စမတန်းပစ္စည်းဖြင့်သာ လေ့ကျင့်သင်ကြားခဲ့ကြသည် — နှင့် ၎င်း၏စွမ်းဆောင်နိုင်မှု မျက်နှာကျက်ကို တွေ့ရှိခဲ့သည်
K-5 သင်ရိုးညွှန်းတမ်းတွင်သာ လေ့ကျင့်ထားသည့် 5B မော်ဒယ် LittleLearner သည် အတိုင်းအတာနှင့် လေ့ကျင့်ပြီးနောက် အသိပညာကို ချဲ့ထွင်ပြသသော်လည်း ကြိုတင်လေ့ကျင့်ပေးထားသည့်အရာကို ကျော်လွန်၍မရနိုင်ပါ။
Anthropic ၏ အန္တရာယ်အစီရင်ခံချက်အသစ်သည် မှားယွင်းသောအဆင့်သတ်မှတ်မှုကို မြှင့်တင်ပေးပြီး ဖယ်ထားသော 'မော်ဒယ် 2' ကို ထုတ်ပြသည်
Anthropic ၏ဒုတိယအန္တရာယ်အစီရင်ခံချက်သည် ဆိုးရွားသောမှားယွင်းညီညွှတ်မှုအန္တရာယ်ကို 'နိမ့်သည်' သို့ မြှင့်တင်ပေးပြီး ပိုမိုခိုင်မာသောထုတ်လွှတ်မထားသောအတွင်းပိုင်းပုံစံကို တင်ပို့မည်မဟုတ်ကြောင်းဖော်ပြထားသည်။
Google ၏ HEIR Compiler သည် Homomorphic Encryption ကို Private AI Inference သို့ ယူဆောင်လာသည်။
Google သည် လျှို့ဝှက်ကုဒ်ဝှက်ထားသော သီးသန့် AI အတွက် AI အတွက် လျှို့ဝှက်ကုဒ်ဝှက်ထားသော ဒေတာများကို တိုက်ရိုက်လုပ်ဆောင်သည့် ပွင့်လင်းအရင်းအမြစ် စုစည်းမှုဖြစ်သည့် HEIR ကို ပြသထားသည်။
Anthropic သည် AI အေးဂျင့်များကို တူညီသောလုပ်ငန်းတစ်ခုတွင် ထုတ်လွှတ်ပြီး ၎င်းတို့သည် Turf စစ်ပွဲကို စတင်သည်။
Anthropic ၏ multiagent သုတေသနအသစ်တွင် Claude အေးဂျင့်များသည် စျေးနှုန်းများပေါ်တွင် ပူးပေါင်းပါဝင်မှု၊ အလုပ်တန်းစီခြင်းကို လွှမ်းမိုးနေပြီး ပြိုင်ဘက်များကို ဖျက်ဆီးရန် ကိုယ်တိုင်ပုံတူမဲလ်ဝဲများကို အသုံးပြုနေကြောင်း ပြသထားသည်။
သုတေသီများသည် Claude၊ GPT နှင့် Gemini တို့မှ လျှို့ဝှက်ကုဒ်ဝှက်ထားသော အတွေးလမ်းကြောင်းများမှ ဖုံးကွယ်ထားသော AI အကြောင်းပြချက်များကို ခိုးယူသည်
သုတေသီများသည် အများသူငှာ သိုလှောင်ရာများမှ ကုဒ်ဝှက်ထားသော အကြောင်းပြချက် 315,320 ကို ကုဒ်ကုဒ်လုပ်ကာ အထောက်အထား 182 ခုနှင့် အဓိက AI ဝန်ဆောင်မှုပေးသူများကြားရှိ 367 PII ပစ္စည်းများကို ဖော်ထုတ်ပြသခဲ့သည်။
Google ၏ AMIE AI သည် Landmark Study တွင် အချိန်နှင့်တပြေးညီ ဗီဒီယိုဆေးဘက်ဆိုင်ရာ တိုင်ပင်ဆွေးနွေးမှုများတွင် ဆရာဝန်များနှင့် ကိုက်ညီပါသည်။
Google Research ၏ AMIE ဗီဒီယို AI စနစ်သည် အချိန်နှင့်တစ်ပြေးညီ ဆေးခန်းဗီဒီယို ဆွေးနွေးပွဲများတွင် ကျွမ်းကျင်သူအဆင့် စွမ်းဆောင်ရည်ကို သရုပ်ပြခဲ့ပြီး အဓိကကျသော တိုင်းတာမှုတစ်ခုတွင် ဘုတ်အဖွဲ့မှ အသိအမှတ်ပြုထားသော သမားတော်များနှင့် ကိုက်ညီသည့် စံနှုန်းများဖြင့် ကိုက်ညီပါသည်။
Anthropic ၏ Claude သည် Riemann Zeta Function တွင် မမျှော်လင့်ထားသော သင်္ချာဆိုင်ရာ အောင်မြင်မှုများကို ဖန်တီးကာ 41.6% နှင့် 67.2% သို့ တွန်းပို့သည်
Anthropic's Claude ၏ မထုတ်ဝေရသေးသော သုတေသနဗားရှင်းတစ်ခုသည် သင်္ချာ၏အကြီးကျယ်ဆုံးသောအဖွင့်ပြဿနာများကိုဖြေရှင်းရန် လက်ငင်းစိန်ခေါ်မှုတစ်ခုပြီးနောက် Riemann zeta function တွင် 41.6% မှ 67.2% အထိ နိမ့်ကျသွားခဲ့သည်။
AI Model Evo သည် Landmark Science Study တွင် Scratch မှ Virus 16 ခုကို ထုတ်လုပ်ပေးပါသည်။
Stanford နှင့် Arc Institute မှ သိပ္ပံပညာရှင်များသည် Evo AI မော်ဒယ်ကို အသုံးပြု၍ ရှင်သန်နိုင်သော ဘက်တီးရီးယားပိုးမွှား ၁၆ မျိုးအား သိပ္ပံဂျာနယ်တွင် ဖော်ပြခဲ့ပြီး ရလဒ်များကို အစမှ ရေးဆွဲခဲ့သည်။
AI အေးဂျင့်များသည် Chat Prompt ထက် အဆ 600 ပိုစွမ်းအင်ကို စားသုံးသည်၊ ခွဲခြမ်းစိတ်ဖြာမှုအသစ်တွေ့ရှိ
ရာသီဥတုဆိုင်ရာ သိပ္ပံပညာရှင် Zeke Hausfather ၏ ရှစ်ပတ်ကြာ Claude Code စစ်ဆေးမှုတွင် AI အေးဂျင့်များသည် ရိုးရှင်းသော ချက်တင်မေးမြန်းမှုထက် အဆ 600 ခန့် ပိုမိုစွမ်းအင်အသုံးပြုသည်ကို တွေ့ရှိခဲ့ပြီး Big Tech ၏ စွမ်းအင်နိမ့်ကျသော တောင်းဆိုချက်များတွင် ကျယ်ပြောလှသော ကွာဟချက်ကို ဖော်ထုတ်တွေ့ရှိခဲ့သည်။
အမေရိကန်စွမ်းအင်ဌာနသည် AI-မောင်းနှင်သော သိပ္ပံနည်းကျရှာဖွေတွေ့ရှိမှုအတွက် Genesis Open Models Initiative ကို စတင်လိုက်ပြီဖြစ်သည်။
DOE ၏ Genesis Open Models ပဏာမခြေလှမ်းသည် ပစ္စည်းများ၊ စွမ်းအင်၊ ပေါင်းစပ်မှုနှင့် ဇီဝဗေဒသုတေသနကို အရှိန်မြှင့်ရန်အတွက် အဖွင့်အလေးချိန်ရှိသော AI မော်ဒယ်လ်များကို ပေးဆောင်ထားပြီး Genesis-Science-1 ကို Arcee ဖြင့် ထုတ်ဖော်ပြသထားသည်။
AI Designs သည် သဘာဝတွင်မတွေ့နိုင်သော Virus 16 မျိုး၊ Stanford နှင့် Broad Institute မှ သုတေသီများ အစီရင်ခံစာ
Stanford နှင့် Broad Institute မှ သုတေသီများသည် ဘက်တီးရီးယားများကို သေစေသည့် ဗိုင်းရပ်စ် 16 မျိုး ဖန်တီးရန် generative AI ကို အသုံးပြုကာ သိပ္ပံပညာ၏ ပထမဆုံးသော ရလဒ်ကို ထုတ်ပြန်ခဲ့သည်။
Stanford AI သည် သဘာဝတွင်မတွေ့နိုင်သော ဗိုင်းရပ်စ်အသစ် ၁၆ ခုကို ဒီဇိုင်းထုတ်ကာ ဇီဝလုံခြုံရေးအချက်ပေးသံကို မြှင့်တင်ပေးသည်
စတန်းဖို့ဒ်မှ သိပ္ပံပညာရှင်များသည် AI-ဒီဇိုင်းထုတ်ထားသော ဗိုင်းရပ်မျိုးရိုးဗီဇတစ်ခုလုံးကို ဘက်တီးရီးယားကူးစက်စေသည့် ပေါင်းစပ် ဘက်တီးရီးယားပိုးမွှား ၁၆ ခုကို ဒီဇိုင်းထုတ်ရန်အတွက် ဂျီနိုမ်ဘာသာစကားမော်ဒယ်များကို အသုံးပြုခဲ့သည်။ ကျွမ်းကျင်သူများက ကြီးကြပ်မှုအသစ်ကို တိုက်တွန်းသည်။
Google WeatherNext 2 AI မော်ဒယ်သည် ကြိုတင်ခန့်မှန်းသူများကို ဆိုင်ကလုန်းသတိပေးသည့် နေ့တစ်နေ့ကို ပေးသည်
Google DeepMind ၏ WeatherNext 2 AI မော်ဒယ်သည် အပိုဆိုင်ကလုန်း ပို့ဆောင်ချိန် 24+ နာရီကို ပေးဆောင်သည်၊ တိုးတက်မှုဆယ်စုနှစ်တစ်ခုနှင့် ကိုက်ညီပြီး ယခုအခါ open source ဖြစ်လာသည်။ Nature တွင်ထုတ်ဝေခဲ့သည်။
Anthropic ၏ Claude Fable 5 သည် သေးငယ်သော ဖော်မြူလာတစ်ခုဖြင့် အသက် 87 နှစ်ရှိ သင်္ချာအယူအဆကို ငြင်းဆိုသည်
Anthropic သင်္ချာပညာရှင် Claude Fable 5 မော်ဒယ်ကို Jacobian အယူအဆ၏ တန်ပြန်နမူနာကို ရှာတွေ့ခဲ့ပြီး 1939 ကတည်းက တည်ရှိနေသည့် ပြဿနာကို ဖယ်ရှားခဲ့သည်။
NSF မှ $100 million state and regional AI Infrastructure Hubs ကို အမေရိကတလွှားတွင်ဖြန့်ကျက်
National Science Foundation ၏ $100 million state and Regional AI Infrastructure Hubs program အသစ်သည် သုတေသနနှင့် workforce training အတွက် AI compute ကို ကျယ်ကျယ်ပြန့်ပြန့် ဝင်ရောက်နိုင်စေရန် လုပ်ငန်းစု 10 ခုအထိ ရန်ပုံငွေထောက်ပံ့မည်ဖြစ်သည်။
Anthropic သည် Frontier AI Models များကို ဖုံးကွယ်ထားသော ကုဒ်များကို ဖုံးဖိကာ လိမ်လည်မှုအား ချိန်ညှိလေ့လာမှုအသစ်တွင် ကူညီပေးသည်
Anthropic's Alignment Science အဖွဲ့သည် ကုမ္ပဏီခြောက်ခုမှ လျှို့ဝှက်ကုဒ်ဖောက်ဖျက်မှုနှင့် လိမ်လည်မှုအကူအညီများအပါအဝင် လျှို့ဝှက်ကုဒ်ဖောက်ဖျက်မှုနှင့် လိမ်လည်မှုအကူအညီများအပါအဝင် ကုမ္ပဏီခြောက်ခုမှ နယ်နိမိတ်ပုံစံများတစ်လျှောက် အေးဂျင့်မတည့်မှုအသစ်လေးခုကို မှတ်တမ်းတင်ထားသည်။
Microsoft Open-Sources Orchard၊ မော်ဒယ်ငယ်များ Rival Frontier စနစ်များရှိရာ Agent AI Framework
Microsoft Research သည် AI အေးဂျင့်များကို လေ့ကျင့်ပေးရန်အတွက် Open-Source မူဘောင်ဖြစ်သော Orchard ကို ထုတ်ပြန်ခဲ့သည်။ ၎င်း၏ 3 ဘီလီယံ ပါရာမီတာ မော်ဒယ်သည် နယ်ခြားမျဥ်းစနစ်များ ချဉ်းကပ်နေသည့် SWE-ခုံတန်းရှည် Verified တွင် 69.7% ထိ ရောက်သွားသည်။
AI Coding အေးဂျင့်များသည် အသက်အရွယ်ကြီးရင့်ခြင်းဆိုင်ရာ သုတေသနဆော့ဖ်ဝဲလ်ကို ခေတ်မီအောင်လုပ်ဆောင်သော်လည်း သိပ္ပံပညာသည် မှန်ကန်သည်ဆိုသည်ကို မပြောနိုင်ပါ။
OpenAI နှင့် ပညာရပ်ဆိုင်ရာ မိတ်ဖက်များထံမှ ကွင်းဆင်းအစီရင်ခံစာတစ်ခုတွင် AI ကုဒ်ရေးသည့် အေးဂျင့်များသည် ဆယ်စုနှစ်များစွာကြာ သုတေသနပြုကိရိယာများကို 60 ဆအထိ ပိုမိုမြန်ဆန်စွာ ပြန်လည်တည်ဆောက်နိုင်သော်လည်း သိပ္ပံနည်းကျတိကျမှုအပေါ် 'ယုံမှားသံသယရှိခြင်း' တွင် မှားယွင်းနေဆဲဖြစ်ကြောင်း ပြသထားသည်။
OpenAI ၏ 'Astra' မော်ဒယ်သည် တွက်ချက်မှုတွင် ဒေါ်လာ 2,000 အောက်အတွက် Open Math Problems 10 ခုကို ဖြေရှင်းပေးသည်
OpenAI က ၎င်း၏ မထုတ်ဝေရသေးသော 'Astra' မော်ဒယ်သည် ယခင်က မဖြေရှင်းနိုင်သော သင်္ချာနှင့် ကွန်ပျူတာသိပ္ပံဆိုင်ရာ ပြဿနာ ၁၀ ခုကို တွက်ချက်ကာ ဒေါ်လာ ၂,၀၀၀ အောက်ဖြင့် ဖြေရှင်းပေးခဲ့ပြီး ဖြစ်နိုင်သည့် GPT-6 အဖြစ် US အထက်လွှတ်တော်အမတ်များကို အစမ်းကြည့်ရှုခဲ့သည်။
FAR.AI လုံခြုံရေးဦးဆောင်ဘုတ်အဖွဲ့သည် Frontier AI Safeguards တွင် ရာနှင့်ချီကွာဟမှုကို ဖော်ထုတ်ပေးသည်။
FAR.AI ၏ AI Security Leaderboard အသစ်တွင် Claude Fable 5 နှင့် GPT-5.6 Sol တို့သည် jailbreaks များကို ခုခံနိုင်စွမ်းရှိပြီး Grok 4.5 နှင့် Gemini 3.1 Pro တို့သည် နယ်ခြားမော်ဒယ်များကြားတွင် ဘေးကင်းကွာဟမှုများစွာကို ဖော်ထုတ်ပေးသည့် $300 အောက်တွင် အသီးသီး ကွဲထွက်သွားသည်ကို တွေ့ရှိခဲ့သည်။
သုတေသီသည် Word for Microsoft Copilot တွင် Self-Propagating AI Worm ကို သရုပ်ပြသည်။
ညှိနှိုင်းထုတ်ဖော်မှုတစ်ခုသည် လျှို့ဝှက်ညွှန်ကြားချက်များကို Copilot မှတစ်ဆင့် Word စာရွက်စာတမ်းများမှတစ်ဆင့် ပိုးဝင်နိုင်ပြီး ၎င်းတို့ကိုယ်သူတို့ ရှေ့သို့ကူးယူကာ GPT-5.6 သို့ အဆင့်မြှင့်ထားသော မော်ဒယ်ကို ဆက်လက်ရှင်သန်စေနိုင်သည်။
Anthropic ၏ Claude 'Mythos' မော်ဒယ်သည် အင်တာနက်ကို လုံခြုံစေသည့် စာဝှက်စနစ်တွင် အမှန်တကယ် ချို့ယွင်းချက်များကို ရှာဖွေတွေ့ရှိသည်
၎င်း၏ Claude Mythos Preview မော်ဒယ်သည် AES နှင့် HAWK စာဝှက်စနစ်ဆိုင်ရာ အယ်လဂိုရီသမ်များတွင် စစ်မှန်သော အားနည်းချက်များကို တွေ့ရှိခဲ့ကြောင်း Anthropic မှ ပြောကြားခဲ့သည်
