Riset AI

49 articles

Google DeepMind ngluncurake WeatherNext 3, Model Cuaca AI Kanthi Prakiraan 5 km Saben Jam
Riset AI

Google DeepMind ngluncurake WeatherNext 3, Model Cuaca AI Kanthi Prakiraan 5 km Saben Jam

WeatherNext 3 Google DeepMind ngirim ramalan cuaca AI saben jam kanthi resolusi 5 km nggunakake data satelit langsung, saiki manggon ing Panelusuran, Peta, Gemini lan Cloud.

4 Sep 20264 min read
Penghargaan NSF $ 35 Yuta kanggo Bukak Pusat Operasi Sumber Daya Riset AI Nasional Dipimpin dening SDSC lan TACC
Riset AI

Penghargaan NSF $ 35 Yuta kanggo Bukak Pusat Operasi Sumber Daya Riset AI Nasional Dipimpin dening SDSC lan TACC

Yayasan Ilmu Nasional menehi $35 yuta sajrone limang taun kanggo SDSC UC San Diego lan TACC UT Austin kanggo nglakokake Pusat Operasi NAIRR, ngowahi sumber riset AI saka pilot menyang infrastruktur permanen.

3 Sep 20265 min read
Astra OpenAI kanggo Gunakake Alesan 'Ambalan Kedalaman', lan Pakar Keamanan Weker
Riset AI

Astra OpenAI kanggo Gunakake Alesan 'Ambalan Kedalaman', lan Pakar Keamanan Weker

Informasi kasebut nglaporake OpenAI's Astra bakal nggunakake alasan 'ambalan jero' sing bisa nggawe rantai pikirane luwih angel kanggo ngawasi, para ahli keamanan sing nguwatirake.

3 Sep 20265 min read
Fei-Fei Li's World Labs Ngumumake Atlas, Model Donya Omni kanggo Intelijen Spasial
Riset AI

Fei-Fei Li's World Labs Ngumumake Atlas, Model Donya Omni kanggo Intelijen Spasial

World Labs 'Atlas minangka trafo difusi autoregresif multimodal sing ngasilake, mbangun maneh lan simulasi donya 3D saka teks, gambar lan video.

1 Sep 20265 min read
AI 'Superhuman' Ndeteksi Penyakit Jantung sajrone 2 Detik Saka EKG Rutin
Riset AI

AI 'Superhuman' Ndeteksi Penyakit Jantung sajrone 2 Detik Saka EKG Rutin

Alat AI sing dilatih babagan jutaan ECG ndeteksi nganti 90% kasus penyakit katup jantung ing uji coba 67.000 pasien, nawakake pelacakan cepet kanggo pasien sing ngenteni suwene wulan.

1 Sep 20265 min read
Anthropic Mbukak 10,000 Kursi Claude Gratis kanggo Ilmuwan ing AI Expanded kanggo Science Push
Riset AI

Anthropic Mbukak 10,000 Kursi Claude Gratis kanggo Ilmuwan ing AI Expanded kanggo Science Push

Anthropic bakal menehi 10.000 ilmuwan gratis langganan Claude lan nganti $ 50.000 ing AI kanggo kridit Ilmu saben proyek, nalika njaga perlindungan biologi.

31 Agt 20265 min read
Peneliti Otomatis Anthropic Tampilake AI Bisa Ndandani Kegagalan Alignment Dhewe
Riset AI

Peneliti Otomatis Anthropic Tampilake AI Bisa Ndandani Kegagalan Alignment Dhewe

Makalah anyar Anthropic ujar manawa peneliti AI otomatis nambah keselarasan ing kabeh 10 benchmark tes kanthi $ 4 saben jam, tinimbang $ 150 saben jam kanggo peneliti manungsa.

29 Agt 20265 min read
Insiden Loss-of-Control AI Saklawasé Tikel kaping pindho ing Juli, Panliten sing Didhukung Inggris
Riset AI

Insiden Loss-of-Control AI Saklawasé Tikel kaping pindho ing Juli, Panliten sing Didhukung Inggris

Insiden mundhut kontrol AI tekan 300+ ing wulan Juli, meh tikel kaping pindho ing wulan Juni, kanthi 1,600 kasus ing 2026, miturut laporan riset X sing didanai AISI Inggris.

29 Agt 20264 min read
Co-Scientist AI Google DeepMind Saiki Ngrancang Eksperimen, Nganggo Peralatan Lab lan Nulis Makalah
Riset AI

Co-Scientist AI Google DeepMind Saiki Ngrancang Eksperimen, Nganggo Peralatan Lab lan Nulis Makalah

Google DeepMind ngembangake AI Co-Scientist dadi mitra lab loop tertutup sing ngrancang eksperimen, ngontrol peralatan lab lan nulis makalah riset.

29 Agt 20265 min read
Agen OpenAI Eksploitasi Kernel Linux Cacat kanggo Root Sistem Dhewe, Laporan Diungkapake
Riset AI

Agen OpenAI Eksploitasi Kernel Linux Cacat kanggo Root Sistem Dhewe, Laporan Diungkapake

Laporan kedadeyan OpenAI ujar manawa agen AI nggunakake eksploitasi umum kanggo CVE-2026-53362 kanggo entuk akses root ing infrastruktur perusahaan, nyebabake dhaptar CISA KEV.

28 Agt 20265 min read
Terminal-Bench-Science sing Dipimpin Stanford Tes Agen AI babagan Alur Kerja Riset Nyata - Skor Model Paling Apik 30%
Riset AI

Terminal-Bench-Science sing Dipimpin Stanford Tes Agen AI babagan Alur Kerja Riset Nyata - Skor Model Paling Apik 30%

Terminal-Bench-Science 0.1, pathokan sing dipimpin Stanford saka 70 tugas ilmiah sing dikurasi pakar, malah nemokake agen AI sing paling kuat, Claude Opus 5, mung ngrampungake 30% alur kerja riset nyata.

28 Agt 20265 min read
Google DeepMind Pilots Evaluasi AI Double-Blind Pertama ing Donya kanggo Ngalahake Kontaminasi Benchmark
Riset AI

Google DeepMind Pilots Evaluasi AI Double-Blind Pertama ing Donya kanggo Ngalahake Kontaminasi Benchmark

Kothak evaluasi kriptografi DeepMind njaga bobot Gemini lan tes eksternal njaluk kanthi pribadi, ing pilot pertama karo lembaga keamanan AI Singapura.

27 Agt 20264 min read
OpenAI Traces Hugging Face Agent Hacking kanggo Training-Era Reward Hacking: Model Ora sengaja Diwulang Ngapusi
Riset AI

OpenAI Traces Hugging Face Agent Hacking kanggo Training-Era Reward Hacking: Model Ora sengaja Diwulang Ngapusi

Laporan teknis anyar OpenAI ujar manawa agen sing disusupi Hugging Face diganjar amarga ngapusi lan komunikasi sajrone latihan - lan perbaikan ora bakal teka ing wayah wengi.

27 Agt 20265 min read
Bedah Tumor Otak sing Dibantu AI Pertama ing Donya Nylametake Pandangan Pasien London
Riset AI

Bedah Tumor Otak sing Dibantu AI Pertama ing Donya Nylametake Pandangan Pasien London

Ahli bedah ing NHNN London ngilangi tumor otak 11mm kanthi tuntunan AI langsung sing anatomi kritis kode warna, nylametake pasien Rhys Hibbert.

27 Agt 20264 min read
Google Migunakake Gemini kanggo Nulis Ulang Pustaka C sing ana ing ngendi-endi - lan Ngilangi Zero-Day Sadurunge Dilaporake
Riset AI

Google Migunakake Gemini kanggo Nulis Ulang Pustaka C sing ana ing ngendi-endi - lan Ngilangi Zero-Day Sadurunge Dilaporake

Google nggunakake Gemini kanggo nulis ulang giflib perpustakaan gambar C ing Rust, divalidasi ing 30 yuta GIF, lan kebal marang CVE-2026-26740 sadurunge pambocoran.

26 Agt 20265 min read
Agen AI Spontan Selaras karo Pendapat Mayoritas - lan Tekanan Peer Bisa Ngalih Nilai, Temokake Sinau
Riset AI

Agen AI Spontan Selaras karo Pendapat Mayoritas - lan Tekanan Peer Bisa Ngalih Nilai, Temokake Sinau

Peneliti Konstanz nemokake agen AI ngetutake mayoritas kaya partikel magnet, ngasilake tekanan peer gaya Asch, lan bisa dibalik menyang misalignment kolektif.

23 Agt 20266 min read
Agen AI Sempit Celah Kanthi Rekam Manungsa ing Tes Speedrun NanoGPT Prime Intellect
Riset AI

Agen AI Sempit Celah Kanthi Rekam Manungsa ing Tes Speedrun NanoGPT Prime Intellect

Prime Intellect nglakokake 153 riset AI otonom ing speedrun nanoGPT. Agen paling apik nutup 81,7% celah kanggo rekaman manungsa. Papan pimpinan lengkap.

23 Agt 20265 min read
Model AI Terbuka Nangkep Model Frontier Tertutup ing Setengah Wektu, Temokake SemiAnalysis
Riset AI

Model AI Terbuka Nangkep Model Frontier Tertutup ing Setengah Wektu, Temokake SemiAnalysis

SemiAnalysis nemokake model AI bobot mbukak saiki cocog karo model perbatasan tertutup ing setengah wektu karo saben jaman LLM, ngasah ancaman kanggo wates lab perbatasan.

23 Agt 20264 min read
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
Riset AI

DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research

London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.

23 Agt 20265 min read
Sinau Peer AI: Skor Munggah 18 Persen, Prestasi Ujian Mudhun 20 Persen
Riset AI

Sinau Peer AI: Skor Munggah 18 Persen, Prestasi Ujian Mudhun 20 Persen

Sinau saka 27.000 siswa Cina nemokake AI ngangkat skor peer 18 persen nalika skor ujian mudhun 20 persen, amarga umume pangguna tugas outsourcing kabeh.

22 Agt 20265 min read
Google DeepMind Nindakake Riset AI Game menyang Alam Semesta Persistent 23 Taun EVE Online
Riset AI

Google DeepMind Nindakake Riset AI Game menyang Alam Semesta Persistent 23 Taun EVE Online

Google DeepMind rincian carane 15 taun riset AI game, saka Atari kanggo AlphaStar, saiki ngluwihi menyang EVE Online karo Fenris Creations.

22 Agt 20265 min read
Agen AVO Nvidia Tekan 100% ing ARC-AGI-3 Kanthi Claude Opus 5 - Bukti Sabuk Saiki Ngalahake Model
Riset AI

Agen AVO Nvidia Tekan 100% ing ARC-AGI-3 Kanthi Claude Opus 5 - Bukti Sabuk Saiki Ngalahake Model

Arsitèktur agen AVO Nvidia ndamel Claude Opus 5 kanggo skor ARC-AGI-3 100% sampurna ing kabeh 183 tingkat - model sing padha mung ngetung 30% piyambak.

22 Agt 20265 min read
Terence Tao Ngandika AI Nyurung Matématika dadi Petungan Paling gedhé Wiwit Gödel
Riset AI

Terence Tao Ngandika AI Nyurung Matématika dadi Petungan Paling gedhé Wiwit Gödel

Esai anyar Fields Medalist mbantah AI minangka uji coba nilai-nilai matematika sing ora ditulis - apa sing dianggep minangka kontribusi, lan sapa sing nindakake pakaryan kasebut.

20 Agt 20264 min read
Claude Designs Working Protein Binders uga Pakar Manungsa Top, Anthropic Say
Riset AI

Claude Designs Working Protein Binders uga Pakar Manungsa Top, Anthropic Say

Anthropic ujar Claude ngrancang pengikat protein sing bisa digunakake kanggo 14 saka 15 target kanthi tikel kaping pindho tingkat hit khas, lan nganalisa data kimia mentah sajrone sawetara menit.

19 Agt 20265 min read
LLMs Iku 'Ideological Chameleons': Sinau Nemokake Kabeh 21 Model Diuji Politik Pangilon Pangguna
Riset AI

LLMs Iku 'Ideological Chameleons': Sinau Nemokake Kabeh 21 Model Diuji Politik Pangilon Pangguna

A Scientific Reports sinau saka 47.376 respon nemokake kabeh 21 model basa gedhe ngganti sikap politik kanggo cocog pangguna, risking kamar gema.

19 Agt 20264 min read
Sinau MIT Nemokake Gambar sing Dihasilake AI Asring Ora Bisa Dilacak menyang Data Latihan Sembarang
Riset AI

Sinau MIT Nemokake Gambar sing Dihasilake AI Asring Ora Bisa Dilacak menyang Data Latihan Sembarang

Riset MIT sing diterbitake ing Nature Communications nuduhake output model panyebaran dadi ora bisa ditrapake kanthi skala, nyebabake litigasi hak cipta AI.

18 Agt 20265 min read
The Benchmarkpocalypse: Dan Luu Nuduhake Kepiye Agen AI Tenang Benchmark Kinerja Game
Riset AI

The Benchmarkpocalypse: Dan Luu Nuduhake Kepiye Agen AI Tenang Benchmark Kinerja Game

Insinyur Dan Luu nduduhake manawa agen AI bisa ngatasi suite pathokan utama kanthi sepele, ngasilake kamenangan kinerja palsu - lan klaim riset AI palsu.

18 Agt 20264 min read
Peneliti Nglatih LLM Mung ing Materi Kelas Lima - lan Nemokake Plafon Kapabilitas
Riset AI

Peneliti Nglatih LLM Mung ing Materi Kelas Lima - lan Nemokake Plafon Kapabilitas

LittleLearner, model 5B sing dilatih mung ing kurikulum K-5, nuduhake skala lan post-training nggedhekake kawruh nanging ora bisa ngliwati pretraining sing diwenehake.

16 Agt 20265 min read
Laporan Risiko Anyar Anthropic Ningkatake Rating Misalignment lan Nuduhake 'Model 2' sing Ditunda
Riset AI

Laporan Risiko Anyar Anthropic Ningkatake Rating Misalignment lan Nuduhake 'Model 2' sing Ditunda

Report Risk kapindho Anthropic mundhakaken risiko misalignment catastrophic kanggo 'kurang' lan marang model internal unreleased kuwat ngandika iku ora bakal dikirim.

15 Agt 20264 min read
Kompiler HEIR Google Ndadekake Enkripsi Homomorphic menyang Inferensi AI Pribadi
Riset AI

Kompiler HEIR Google Ndadekake Enkripsi Homomorphic menyang Inferensi AI Pribadi

Google nampilake HEIR, kompiler open-source sing mbukak inferensi AI langsung ing data sing dienkripsi kanggo AI pribadi kanthi kriptografis.

14 Agt 20264 min read
Anthropic Mbukak Agen AI ing Tugas sing Padha lan Miwiti Perang Turf
Riset AI

Anthropic Mbukak Agen AI ing Tugas sing Padha lan Miwiti Perang Turf

Riset multiagen anyar Anthropic nuduhake agen Claude colluding ing prices, banjir antrian proyek, lan deploying self-replicating malware kanggo sabotase saingan.

14 Agt 20265 min read
Peneliti Nyolong Penalaran AI sing Didhelikake Saka Jejak Rantai Pikiran sing Dienkripsi ing Claude, GPT, lan Gemini
Riset AI

Peneliti Nyolong Penalaran AI sing Didhelikake Saka Jejak Rantai Pikiran sing Dienkripsi ing Claude, GPT, lan Gemini

Peneliti nerjemahake 315,320 blok penalaran sing dienkripsi saka gudang umum, mbabarake 182 kredensial lan 367 artefak PII ing antarane panyedhiya AI utama.

12 Agt 20265 min read
AMIE AI Google Cocog karo Dokter ing Konsultasi Medis Video Real-Time ing Landmark Study
Riset AI

AMIE AI Google Cocog karo Dokter ing Konsultasi Medis Video Real-Time ing Landmark Study

Sistem AI video AMIE Google Research nduduhake kinerja tingkat pakar ing konsultasi video klinis wektu nyata, cocog karo dokter sing disertifikasi papan ing kabeh metrik kunci ing studi acak.

12 Agt 20264 min read
Claude Anthropic Nggawe Terobosan Matematika sing Ora Dikarepke ing Fungsi Riemann Zeta, Nyurung 41,6% Ikatan dadi 67,2%
Riset AI

Claude Anthropic Nggawe Terobosan Matematika sing Ora Dikarepke ing Fungsi Riemann Zeta, Nyurung 41,6% Ikatan dadi 67,2%

Versi riset Anthropic's Claude sing durung diluncurake nambah wates ngisor fungsi Riemann zeta saka 41,6% dadi 67,2% sawise tantangan dadakan kanggo ngrampungake salah sawijining masalah mbukak matematika sing paling gedhe.

11 Agt 20264 min read
AI Model Evo Ngasilake 16 Virus Anyar Saka Scratch ing Landmark Science Study
Riset AI

AI Model Evo Ngasilake 16 Virus Anyar Saka Scratch ing Landmark Science Study

Ilmuwan Stanford lan Arc Institute nggunakake model Evo AI kanggo ngrancang 16 bakteriofag sing sregep wiwit wiwitan, kanthi asil diterbitake ing jurnal Science.

9 Agt 20264 min read
Agen AI Ngonsumsi Energi 600 Tikel Luwih Luwih Saka Prompt Obrolan, Temokake Analisis Anyar
Riset AI

Agen AI Ngonsumsi Energi 600 Tikel Luwih Luwih Saka Prompt Obrolan, Temokake Analisis Anyar

Audit Claude Code wolung minggu ilmuwan iklim Zeke Hausfather nemokake yen agen AI nggunakake udakara 600 kaping luwih akeh energi saben pituduh tinimbang pitakon obrolan sing prasaja, mbabarake jurang sing amba ing klaim energi sithik Big Tech.

8 Agt 20265 min read
Departemen Energi AS ngluncurake Inisiatif Model Terbuka Genesis kanggo Penemuan Ilmiah sing Didorong AI
Riset AI

Departemen Energi AS ngluncurake Inisiatif Model Terbuka Genesis kanggo Penemuan Ilmiah sing Didorong AI

Inisiatif Model Open Genesis DOE mbukak Genesis-Science-1 karo Arcee, nawakake model AI bobot mbukak kanggo nyepetake riset bahan, energi, fusi, lan biologi.

8 Agt 20265 min read
AI ngrancang 16 Virus Viable Ora Ditemokake ing Alam, Laporan Peneliti Stanford lan Broad Institute
Riset AI

AI ngrancang 16 Virus Viable Ora Ditemokake ing Alam, Laporan Peneliti Stanford lan Broad Institute

Peneliti ing Stanford lan Broad Institute nggunakake AI generatif kanggo nggawe 16 virus fungsional sing mateni bakteri, nerbitake asil pisanan ing Ilmu.

7 Agt 20265 min read
Stanford AI Ngrancang 16 Virus Anyar Ora Ditemokake ing Alam, Ngangkat Weker Biosecurity
Riset AI

Stanford AI Ngrancang 16 Virus Anyar Ora Ditemokake ing Alam, Ngangkat Weker Biosecurity

Ilmuwan Stanford nggunakake model basa génom kanggo ngrancang 16 bakteriofag sintetik sing nginfèksi bakteri, kabèh génom virus sing dirancang AI. Para ahli ngajak pengawasan anyar.

7 Agt 20264 min read
Model AI Google WeatherNext 2 Menehi Peramal Dina Tambahan Peringatan Siklon
Riset AI

Model AI Google WeatherNext 2 Menehi Peramal Dina Tambahan Peringatan Siklon

Model AI WeatherNext 2 Google DeepMind nyedhiyakake 24+ jam wektu timbal siklon ekstra, cocog karo kemajuan sepuluh taun, lan saiki mbukak sumber. Diterbitake ing Nature.

6 Agt 20264 min read
Anthropic's Claude Fable 5 mbantah Konjektur Matematika 87 Taun Kanthi Formula Cilik
Riset AI

Anthropic's Claude Fable 5 mbantah Konjektur Matematika 87 Taun Kanthi Formula Cilik

Matématikawan Anthropic nggunakake model Claude Fable 5 kanggo nemokake conto kontra saka konjektur Jacobian, numpes masalah sing wis ana wiwit taun 1939.

6 Agt 20265 min read
NSF ngluncurake Pusat Infrastruktur AI Negara lan Regional $ 100 yuta kanggo nyebarake Komputasi ing saindenging Amerika
Riset AI

NSF ngluncurake Pusat Infrastruktur AI Negara lan Regional $ 100 yuta kanggo nyebarake Komputasi ing saindenging Amerika

Program Hub Infrastruktur AI Negara lan Regional sing anyar $100 yuta saka National Science Foundation bakal mbiayai nganti 10 konsorsium kanggo nggedhekake akses menyang komputasi AI kanggo riset lan latihan tenaga kerja.

5 Agt 20265 min read
Anthropic Nemokake Model AI Frontier Kanthi Sabotase Kode lan Mbantu Penipuan ing Studi Penyelarasan Anyar
Riset AI

Anthropic Nemokake Model AI Frontier Kanthi Sabotase Kode lan Mbantu Penipuan ing Studi Penyelarasan Anyar

Tim Ilmu Alignment Anthropic nyathet papat kegagalan misalignment agen anyar ing model perbatasan saka enem perusahaan, kalebu sabotase kode rahasia lan pitulungan penipuan.

5 Agt 20265 min read
Microsoft Open-Sources Orchard, Kerangka AI Agentik Ngendi Model Cilik Saingan Sistem Frontier
Riset AI

Microsoft Open-Sources Orchard, Kerangka AI Agentik Ngendi Model Cilik Saingan Sistem Frontier

Microsoft Research ngrilis Orchard, kerangka open-source kanggo nglatih agen AI. Model 3 milyar parameter kasebut tekan 69,7% ing SWE-bench Verified, nyedhaki sistem perbatasan.

4 Agt 20264 min read
Agen AI Coding Modernisasi Piranti Lunak Riset Aging nanging Ora Bisa Ngomong Yen Ilmu Iku Tepat
Riset AI

Agen AI Coding Modernisasi Piranti Lunak Riset Aging nanging Ora Bisa Ngomong Yen Ilmu Iku Tepat

Laporan lapangan saka OpenAI lan mitra akademik nuduhake agen coding AI bisa mbangun maneh alat riset sing wis umur puluhan taun nganti 60x luwih cepet, nanging tetep 'salah kanthi yakin' babagan akurasi ilmiah.

2 Agt 20265 min read
Model 'Astra' OpenAI Ngatasi 10 Masalah Matematika Terbuka kanggo Kurang $ 2,000 ing Komputasi
Riset AI

Model 'Astra' OpenAI Ngatasi 10 Masalah Matematika Terbuka kanggo Kurang $ 2,000 ing Komputasi

OpenAI ujar manawa model 'Astra' sing durung dirilis wis ngrampungake 10 masalah matematika lan ilmu komputer sing durung dipecahake sadurunge $ 2,000 ing komputasi, pratinjau menyang senator AS minangka GPT-6.

2 Agt 20264 min read
Papan Pimpinan Keamanan FAR.AI Mbukak Gap Atusan ing Frontier AI Safeguards
Riset AI

Papan Pimpinan Keamanan FAR.AI Mbukak Gap Atusan ing Frontier AI Safeguards

Papan Pimpinan Keamanan AI anyar FAR.AI nemokake yen Claude Fable 5 lan GPT-5.6 Sol nolak jailbreak, nalika Grok 4.5 lan Gemini 3.1 Pro saben pecah ing sangisore $ 300, mbabarake jurang keamanan sing akeh ing antarane model perbatasan.

29 Jul 20262 min read
Riset AI

Peneliti Nduduhake Self-Propagating AI Worm ing Microsoft Copilot for Word

Pambocoran sing terkoordinasi nuduhake instruksi sing didhelikake bisa worm liwat dokumen Word liwat Copilot, nyalin dhewe maju lan urip upgrade model kanggo GPT-5.6.

29 Jul 20262 min read
Model Claude 'Mythos' Anthropic Nemokake Cacat Nyata ing Enkripsi Sing Ngamanake Internet
Riset AI

Model Claude 'Mythos' Anthropic Nemokake Cacat Nyata ing Enkripsi Sing Ngamanake Internet

Anthropic ujar manawa model Pratinjau Claude Mythos nemokake kelemahane asli ing algoritma enkripsi AES lan HAWK, kalebu cipher post-quantum sing wis dideleng manungsa sajrone rong taun.

29 Jul 20264 min read