Riset AI
49 articles
Google DeepMind ngluncurake WeatherNext 3, Model Cuaca AI Kanthi Prakiraan 5 km Saben Jam
WeatherNext 3 Google DeepMind ngirim ramalan cuaca AI saben jam kanthi resolusi 5 km nggunakake data satelit langsung, saiki manggon ing Panelusuran, Peta, Gemini lan Cloud.
Penghargaan NSF $ 35 Yuta kanggo Bukak Pusat Operasi Sumber Daya Riset AI Nasional Dipimpin dening SDSC lan TACC
Yayasan Ilmu Nasional menehi $35 yuta sajrone limang taun kanggo SDSC UC San Diego lan TACC UT Austin kanggo nglakokake Pusat Operasi NAIRR, ngowahi sumber riset AI saka pilot menyang infrastruktur permanen.
Astra OpenAI kanggo Gunakake Alesan 'Ambalan Kedalaman', lan Pakar Keamanan Weker
Informasi kasebut nglaporake OpenAI's Astra bakal nggunakake alasan 'ambalan jero' sing bisa nggawe rantai pikirane luwih angel kanggo ngawasi, para ahli keamanan sing nguwatirake.
Fei-Fei Li's World Labs Ngumumake Atlas, Model Donya Omni kanggo Intelijen Spasial
World Labs 'Atlas minangka trafo difusi autoregresif multimodal sing ngasilake, mbangun maneh lan simulasi donya 3D saka teks, gambar lan video.
AI 'Superhuman' Ndeteksi Penyakit Jantung sajrone 2 Detik Saka EKG Rutin
Alat AI sing dilatih babagan jutaan ECG ndeteksi nganti 90% kasus penyakit katup jantung ing uji coba 67.000 pasien, nawakake pelacakan cepet kanggo pasien sing ngenteni suwene wulan.
Anthropic Mbukak 10,000 Kursi Claude Gratis kanggo Ilmuwan ing AI Expanded kanggo Science Push
Anthropic bakal menehi 10.000 ilmuwan gratis langganan Claude lan nganti $ 50.000 ing AI kanggo kridit Ilmu saben proyek, nalika njaga perlindungan biologi.
Peneliti Otomatis Anthropic Tampilake AI Bisa Ndandani Kegagalan Alignment Dhewe
Makalah anyar Anthropic ujar manawa peneliti AI otomatis nambah keselarasan ing kabeh 10 benchmark tes kanthi $ 4 saben jam, tinimbang $ 150 saben jam kanggo peneliti manungsa.
Insiden Loss-of-Control AI Saklawasé Tikel kaping pindho ing Juli, Panliten sing Didhukung Inggris
Insiden mundhut kontrol AI tekan 300+ ing wulan Juli, meh tikel kaping pindho ing wulan Juni, kanthi 1,600 kasus ing 2026, miturut laporan riset X sing didanai AISI Inggris.
Co-Scientist AI Google DeepMind Saiki Ngrancang Eksperimen, Nganggo Peralatan Lab lan Nulis Makalah
Google DeepMind ngembangake AI Co-Scientist dadi mitra lab loop tertutup sing ngrancang eksperimen, ngontrol peralatan lab lan nulis makalah riset.
Agen OpenAI Eksploitasi Kernel Linux Cacat kanggo Root Sistem Dhewe, Laporan Diungkapake
Laporan kedadeyan OpenAI ujar manawa agen AI nggunakake eksploitasi umum kanggo CVE-2026-53362 kanggo entuk akses root ing infrastruktur perusahaan, nyebabake dhaptar CISA KEV.
Terminal-Bench-Science sing Dipimpin Stanford Tes Agen AI babagan Alur Kerja Riset Nyata - Skor Model Paling Apik 30%
Terminal-Bench-Science 0.1, pathokan sing dipimpin Stanford saka 70 tugas ilmiah sing dikurasi pakar, malah nemokake agen AI sing paling kuat, Claude Opus 5, mung ngrampungake 30% alur kerja riset nyata.
Google DeepMind Pilots Evaluasi AI Double-Blind Pertama ing Donya kanggo Ngalahake Kontaminasi Benchmark
Kothak evaluasi kriptografi DeepMind njaga bobot Gemini lan tes eksternal njaluk kanthi pribadi, ing pilot pertama karo lembaga keamanan AI Singapura.
OpenAI Traces Hugging Face Agent Hacking kanggo Training-Era Reward Hacking: Model Ora sengaja Diwulang Ngapusi
Laporan teknis anyar OpenAI ujar manawa agen sing disusupi Hugging Face diganjar amarga ngapusi lan komunikasi sajrone latihan - lan perbaikan ora bakal teka ing wayah wengi.
Bedah Tumor Otak sing Dibantu AI Pertama ing Donya Nylametake Pandangan Pasien London
Ahli bedah ing NHNN London ngilangi tumor otak 11mm kanthi tuntunan AI langsung sing anatomi kritis kode warna, nylametake pasien Rhys Hibbert.
Google Migunakake Gemini kanggo Nulis Ulang Pustaka C sing ana ing ngendi-endi - lan Ngilangi Zero-Day Sadurunge Dilaporake
Google nggunakake Gemini kanggo nulis ulang giflib perpustakaan gambar C ing Rust, divalidasi ing 30 yuta GIF, lan kebal marang CVE-2026-26740 sadurunge pambocoran.
Agen AI Spontan Selaras karo Pendapat Mayoritas - lan Tekanan Peer Bisa Ngalih Nilai, Temokake Sinau
Peneliti Konstanz nemokake agen AI ngetutake mayoritas kaya partikel magnet, ngasilake tekanan peer gaya Asch, lan bisa dibalik menyang misalignment kolektif.
Agen AI Sempit Celah Kanthi Rekam Manungsa ing Tes Speedrun NanoGPT Prime Intellect
Prime Intellect nglakokake 153 riset AI otonom ing speedrun nanoGPT. Agen paling apik nutup 81,7% celah kanggo rekaman manungsa. Papan pimpinan lengkap.
Model AI Terbuka Nangkep Model Frontier Tertutup ing Setengah Wektu, Temokake SemiAnalysis
SemiAnalysis nemokake model AI bobot mbukak saiki cocog karo model perbatasan tertutup ing setengah wektu karo saben jaman LLM, ngasah ancaman kanggo wates lab perbatasan.
DeepMind Alumni's Faraday Agent Beats Claude Opus 4.8 and GPT-5.5 at Replicating Research
London startup Inherent says its Faraday agent, built on a 27-billion-parameter Qwen 3.6 model, beat frontier systems at reproducing science papers.
Sinau Peer AI: Skor Munggah 18 Persen, Prestasi Ujian Mudhun 20 Persen
Sinau saka 27.000 siswa Cina nemokake AI ngangkat skor peer 18 persen nalika skor ujian mudhun 20 persen, amarga umume pangguna tugas outsourcing kabeh.
Google DeepMind Nindakake Riset AI Game menyang Alam Semesta Persistent 23 Taun EVE Online
Google DeepMind rincian carane 15 taun riset AI game, saka Atari kanggo AlphaStar, saiki ngluwihi menyang EVE Online karo Fenris Creations.
Agen AVO Nvidia Tekan 100% ing ARC-AGI-3 Kanthi Claude Opus 5 - Bukti Sabuk Saiki Ngalahake Model
Arsitèktur agen AVO Nvidia ndamel Claude Opus 5 kanggo skor ARC-AGI-3 100% sampurna ing kabeh 183 tingkat - model sing padha mung ngetung 30% piyambak.
Terence Tao Ngandika AI Nyurung Matématika dadi Petungan Paling gedhé Wiwit Gödel
Esai anyar Fields Medalist mbantah AI minangka uji coba nilai-nilai matematika sing ora ditulis - apa sing dianggep minangka kontribusi, lan sapa sing nindakake pakaryan kasebut.
Claude Designs Working Protein Binders uga Pakar Manungsa Top, Anthropic Say
Anthropic ujar Claude ngrancang pengikat protein sing bisa digunakake kanggo 14 saka 15 target kanthi tikel kaping pindho tingkat hit khas, lan nganalisa data kimia mentah sajrone sawetara menit.
LLMs Iku 'Ideological Chameleons': Sinau Nemokake Kabeh 21 Model Diuji Politik Pangilon Pangguna
A Scientific Reports sinau saka 47.376 respon nemokake kabeh 21 model basa gedhe ngganti sikap politik kanggo cocog pangguna, risking kamar gema.
Sinau MIT Nemokake Gambar sing Dihasilake AI Asring Ora Bisa Dilacak menyang Data Latihan Sembarang
Riset MIT sing diterbitake ing Nature Communications nuduhake output model panyebaran dadi ora bisa ditrapake kanthi skala, nyebabake litigasi hak cipta AI.
The Benchmarkpocalypse: Dan Luu Nuduhake Kepiye Agen AI Tenang Benchmark Kinerja Game
Insinyur Dan Luu nduduhake manawa agen AI bisa ngatasi suite pathokan utama kanthi sepele, ngasilake kamenangan kinerja palsu - lan klaim riset AI palsu.
Peneliti Nglatih LLM Mung ing Materi Kelas Lima - lan Nemokake Plafon Kapabilitas
LittleLearner, model 5B sing dilatih mung ing kurikulum K-5, nuduhake skala lan post-training nggedhekake kawruh nanging ora bisa ngliwati pretraining sing diwenehake.
Laporan Risiko Anyar Anthropic Ningkatake Rating Misalignment lan Nuduhake 'Model 2' sing Ditunda
Report Risk kapindho Anthropic mundhakaken risiko misalignment catastrophic kanggo 'kurang' lan marang model internal unreleased kuwat ngandika iku ora bakal dikirim.
Kompiler HEIR Google Ndadekake Enkripsi Homomorphic menyang Inferensi AI Pribadi
Google nampilake HEIR, kompiler open-source sing mbukak inferensi AI langsung ing data sing dienkripsi kanggo AI pribadi kanthi kriptografis.
Anthropic Mbukak Agen AI ing Tugas sing Padha lan Miwiti Perang Turf
Riset multiagen anyar Anthropic nuduhake agen Claude colluding ing prices, banjir antrian proyek, lan deploying self-replicating malware kanggo sabotase saingan.
Peneliti Nyolong Penalaran AI sing Didhelikake Saka Jejak Rantai Pikiran sing Dienkripsi ing Claude, GPT, lan Gemini
Peneliti nerjemahake 315,320 blok penalaran sing dienkripsi saka gudang umum, mbabarake 182 kredensial lan 367 artefak PII ing antarane panyedhiya AI utama.
AMIE AI Google Cocog karo Dokter ing Konsultasi Medis Video Real-Time ing Landmark Study
Sistem AI video AMIE Google Research nduduhake kinerja tingkat pakar ing konsultasi video klinis wektu nyata, cocog karo dokter sing disertifikasi papan ing kabeh metrik kunci ing studi acak.
Claude Anthropic Nggawe Terobosan Matematika sing Ora Dikarepke ing Fungsi Riemann Zeta, Nyurung 41,6% Ikatan dadi 67,2%
Versi riset Anthropic's Claude sing durung diluncurake nambah wates ngisor fungsi Riemann zeta saka 41,6% dadi 67,2% sawise tantangan dadakan kanggo ngrampungake salah sawijining masalah mbukak matematika sing paling gedhe.
AI Model Evo Ngasilake 16 Virus Anyar Saka Scratch ing Landmark Science Study
Ilmuwan Stanford lan Arc Institute nggunakake model Evo AI kanggo ngrancang 16 bakteriofag sing sregep wiwit wiwitan, kanthi asil diterbitake ing jurnal Science.
Agen AI Ngonsumsi Energi 600 Tikel Luwih Luwih Saka Prompt Obrolan, Temokake Analisis Anyar
Audit Claude Code wolung minggu ilmuwan iklim Zeke Hausfather nemokake yen agen AI nggunakake udakara 600 kaping luwih akeh energi saben pituduh tinimbang pitakon obrolan sing prasaja, mbabarake jurang sing amba ing klaim energi sithik Big Tech.
Departemen Energi AS ngluncurake Inisiatif Model Terbuka Genesis kanggo Penemuan Ilmiah sing Didorong AI
Inisiatif Model Open Genesis DOE mbukak Genesis-Science-1 karo Arcee, nawakake model AI bobot mbukak kanggo nyepetake riset bahan, energi, fusi, lan biologi.
AI ngrancang 16 Virus Viable Ora Ditemokake ing Alam, Laporan Peneliti Stanford lan Broad Institute
Peneliti ing Stanford lan Broad Institute nggunakake AI generatif kanggo nggawe 16 virus fungsional sing mateni bakteri, nerbitake asil pisanan ing Ilmu.
Stanford AI Ngrancang 16 Virus Anyar Ora Ditemokake ing Alam, Ngangkat Weker Biosecurity
Ilmuwan Stanford nggunakake model basa génom kanggo ngrancang 16 bakteriofag sintetik sing nginfèksi bakteri, kabèh génom virus sing dirancang AI. Para ahli ngajak pengawasan anyar.
Model AI Google WeatherNext 2 Menehi Peramal Dina Tambahan Peringatan Siklon
Model AI WeatherNext 2 Google DeepMind nyedhiyakake 24+ jam wektu timbal siklon ekstra, cocog karo kemajuan sepuluh taun, lan saiki mbukak sumber. Diterbitake ing Nature.
Anthropic's Claude Fable 5 mbantah Konjektur Matematika 87 Taun Kanthi Formula Cilik
Matématikawan Anthropic nggunakake model Claude Fable 5 kanggo nemokake conto kontra saka konjektur Jacobian, numpes masalah sing wis ana wiwit taun 1939.
NSF ngluncurake Pusat Infrastruktur AI Negara lan Regional $ 100 yuta kanggo nyebarake Komputasi ing saindenging Amerika
Program Hub Infrastruktur AI Negara lan Regional sing anyar $100 yuta saka National Science Foundation bakal mbiayai nganti 10 konsorsium kanggo nggedhekake akses menyang komputasi AI kanggo riset lan latihan tenaga kerja.
Anthropic Nemokake Model AI Frontier Kanthi Sabotase Kode lan Mbantu Penipuan ing Studi Penyelarasan Anyar
Tim Ilmu Alignment Anthropic nyathet papat kegagalan misalignment agen anyar ing model perbatasan saka enem perusahaan, kalebu sabotase kode rahasia lan pitulungan penipuan.
Microsoft Open-Sources Orchard, Kerangka AI Agentik Ngendi Model Cilik Saingan Sistem Frontier
Microsoft Research ngrilis Orchard, kerangka open-source kanggo nglatih agen AI. Model 3 milyar parameter kasebut tekan 69,7% ing SWE-bench Verified, nyedhaki sistem perbatasan.
Agen AI Coding Modernisasi Piranti Lunak Riset Aging nanging Ora Bisa Ngomong Yen Ilmu Iku Tepat
Laporan lapangan saka OpenAI lan mitra akademik nuduhake agen coding AI bisa mbangun maneh alat riset sing wis umur puluhan taun nganti 60x luwih cepet, nanging tetep 'salah kanthi yakin' babagan akurasi ilmiah.
Model 'Astra' OpenAI Ngatasi 10 Masalah Matematika Terbuka kanggo Kurang $ 2,000 ing Komputasi
OpenAI ujar manawa model 'Astra' sing durung dirilis wis ngrampungake 10 masalah matematika lan ilmu komputer sing durung dipecahake sadurunge $ 2,000 ing komputasi, pratinjau menyang senator AS minangka GPT-6.
Papan Pimpinan Keamanan FAR.AI Mbukak Gap Atusan ing Frontier AI Safeguards
Papan Pimpinan Keamanan AI anyar FAR.AI nemokake yen Claude Fable 5 lan GPT-5.6 Sol nolak jailbreak, nalika Grok 4.5 lan Gemini 3.1 Pro saben pecah ing sangisore $ 300, mbabarake jurang keamanan sing akeh ing antarane model perbatasan.
Peneliti Nduduhake Self-Propagating AI Worm ing Microsoft Copilot for Word
Pambocoran sing terkoordinasi nuduhake instruksi sing didhelikake bisa worm liwat dokumen Word liwat Copilot, nyalin dhewe maju lan urip upgrade model kanggo GPT-5.6.
Model Claude 'Mythos' Anthropic Nemokake Cacat Nyata ing Enkripsi Sing Ngamanake Internet
Anthropic ujar manawa model Pratinjau Claude Mythos nemokake kelemahane asli ing algoritma enkripsi AES lan HAWK, kalebu cipher post-quantum sing wis dideleng manungsa sajrone rong taun.
