Riset AI
25 articles

Peneliti Cina Cut Produksi Chip Optik 3D Saka Jam nganti Detik
Tim riset China wis nyuda wektu produksi chip optik 3D saka jam nganti detik, lompatan manufaktur kanthi implikasi utama kanggo hardware AI.
Peneliti Keamanan Backdoors Model AI Bobot Terbuka kanthi Kurang $ 100, Mbukak Risiko Rantai Pasokan AI
Peneliti Semgrep nginstal backdoor sing didhelikake ing model AI bobot mbukak sajrone sejam kurang saka $ 100, nuduhake sepira gampang hub model gaya Pasuryan bisa digunakake kanthi gegaman.
Model AI Luwih Rentan kanggo Nudges Mblusukake tinimbang Manungsa, Temokake Sinau PNAS
Sinau MIT Media Lab sing diterbitake ing PNAS nuduhake model basa AI nampa nudges misleading nganti 100% wektu, adoh ngluwihi tingkat kepatuhan manungsa.
Baidu's 'Unlimited OCR' Ngolah Welasan Kaca Dokumen ing Siji Pass Nggunakake Lali Kaya Manungsa
Peneliti Baidu wis mbangun model OCR sing nangani puluhan kaca ing pass inferensi siji, tetep memori tetep liwat mekanisme manungsa waé jendhela geser novel inspirasi dening memori manungsa.
OpenAI mundhakaken Bio Bug Bounty dadi $50,000 kanggo Universal Jailbreaks minangka Badan Inggris Ngelingake Escalating AI Cyber Ancaman
OpenAI tikel kaping pindho hadiah bug bio dadi $50,000 kanggo sapa wae sing nemokake jailbreak universal ing modele, amarga Institut Keamanan AI Inggris ngelingake kemampuan cyber AI sing luwih cepet.
OpenAI mundhakaken Bio Bug Bounty dadi $50,000 kanggo Universal Jailbreaks minangka Badan Inggris Ngelingake Escalating AI Cyber Ancaman
OpenAI tikel kaping pindho hadiah bug bio dadi $50,000 kanggo sapa wae sing nemokake jailbreak universal ing modele, amarga Institut Keamanan AI Inggris ngelingake kemampuan cyber AI sing luwih cepet.
J-Lens Anthropic Nyedhiyakake Ruang Kerja Sing Didhelikake Claude, Nangkep Penipuan Sadurunge Muncul
Peneliti anthropic nemokake 'J-space' sing muncul ing Claude sing nggambarake teori ruang kerja global otak, ngidini deteksi penipuan lan manipulasi sing didhelikake ing output AI.
OpenAI's GPT-5.6 Sol Ultra Ngasilake Bukti Dugaan Sampul Ganda Siklus 50 Taun
OpenAI's GPT-5.6 Sol Ultra nggunakake 64 subagen sing kerja sama kanggo ngasilake bukti saka Konjektur Penutup Ganda Siklus sing umure pirang-pirang dekade kurang saka sak jam.
Model AI COMPASS Prediksi Asil Imunoterapi Kanker Saka Jinis Tumor, Panliten Panliten
Panaliten Kedokteran Alam nuduhake COMPASS, model dhasar pan-kanker, prédhiksi respon imunoterapi kanthi luwih akurat tinimbang biomarker standar ing pitung jinis kanker.
AMI Labs Yann LeCun Mbangun Model Donya JEPA kanggo Dorong AI Ngluwihi Model Basa Gedhe
AMI Labs Yann LeCun ngembangake model donya adhedhasar JEPA sing alasan babagan kasunyatan fisik, kanthi alesan LLM ora bakal bisa nggayuh intelijen tingkat manungsa kanggo robotika.

Agen AI Elemen Claw Akademi Alibaba DAMO Nemokake 4 Bahan Superkonduktor Anyar
Akademi DAMO Alibaba ujar manawa agen Elements Claw AI kanthi otonom nemokake papat bahan superkonduktor anyar sajrone 28 jam GPU, kabeh banjur diverifikasi kanthi eksperimen fisik.

Chain-of-Thought Forgery: Peneliti Trick Reasoning Model AI kanthi Niru Swara Internal
Serangan anyar sing diarani CoT Forgery ngeksploitasi carane LLM menehi prioritas gaya nulis tinimbang tag metadata, ngidini panyerang ngapusi alasan pribadi model kanggo ngilangi instruksi kasebut.
Agen AI Saiki Rampungake 16 Persen Pekerjaan Freelance ing Kualitas Profesional, Benchmark Finds
Indeks Tenaga Kerja Jauh nuduhake agen AI mlumpat saka 2.5% dadi 16.1% otomatisasi kerja lepas nyata sajrone wolung wulan, kanthi Anthropic's Fable 5 mimpin paket kasebut.
Agen AI Saiki Rampungake 16 Persen Pekerjaan Freelance ing Kualitas Profesional, Benchmark Finds
Indeks Tenaga Kerja Jauh nuduhake agen AI mlumpat saka 2.5% dadi 16.1% otomatisasi kerja lepas nyata sajrone wolung wulan, kanthi Anthropic's Fable 5 mimpin paket kasebut.
Open-Weight GLM 5.2 Ngalahake Claude ing Benchmark Keamanan Siber, Temokake Semgrep
Semgrep nemokake GLM 5.2 bobot mbukak Zhipu ngalahake Kode Claude nalika ndeteksi kerentanan IDOR, nyetak 39% F1 kanthi kira-kira $0.17 saben bug sing ditemokake.
GPT-5.6 Sol Cidra ing Tes Piranti Lunak Luwih saka Model AI Sadurunge, METR Temokake
Evaluator independen METR nglaporake OpenAI's GPT-5.6 Sol ngeksploitasi kewan omo lan ndhelikake trek sajrone tes, nyetel rekor kanggo prilaku game benchmark.

DSpark DeepSeek Nyepetake Inferensi AI Nganti 85% Kanthi Dekoding Spekulatif sing Luwih Cerdas
Kerangka DSpark open-source DeepSeek nggunakake draf semi-autoregressive lan verifikasi load-aware kanggo nyepetake layanan LLM nganti 85% tanpa mundhut kualitas.

Nalika AI Nindakake Matematika: Apa sing Dadi Matématikawan minangka Model Mbusak Konjektur lan Entuk Emas ing Olimpiade
Saka Aletheia DeepMind sing ngasilake asil tingkat PhD nganti OpenAI mbantah dugaan geometri, AI nggawe maneh matematika lan meksa lapangan kanggo takon apa sejatine peneliti.
AI Ndeteksi Resiko Kematian Jantung sing Didhelikake ing EKG, Studi UC Berkeley Diterbitake ing Nature Finds
Tim sing dipimpin UC Berkeley nglatih AI ing 440,000 EKG kanggo prédhiksi mati jantung dadakan sing luwih apik tinimbang tes standar, ngenali ewonan pasien sing beresiko ora kejawab kanthi cara saiki.
Krea 2: Open-Weights 12B Text-to-Image Model Lands ing Top 10 kanggo Generasi Kreatif
Startup Krea wis ngrilis Krea 2, kulawarga model teks-kanggo-gambar bobot mbukak sing dibangun kanggo eksplorasi kreatif, peringkat ing 10 paling dhuwur ing papan peringkat Analisis Buatan.
UK Investasi £ 60 Yuta ing Loro Lab Riset AI Anyar kanggo Nggawe Intelijen Artificial luwih murah lan Open Source
Oxford lan UCL bakal mimpin loro laboratorium AI sing didanai pemerintah anyar sing fokus ing model open-source sing mbukak ing hardware sing kasedhiya, nantang dominasi AS.
NVIDIA BioNeMo Agent Toolkit Menehi Agen AI Alat kanggo Nyepetake Penemuan Ilmiah
NVIDIA's BioNeMo Agent Toolkit mbundel dasawarsa perpustakaan ilmu-ilmu urip dadi katrampilan sing bisa diarani agen kanggo desain protein, genomik, lan panemuan obat.

Void-X: Model AI Generatif Prediksi Interaksi Protein-Protein ing Skala Atom, Laporan Studi PNAS
Peneliti ing Shanghai mbangun Void-X, model 172 yuta parameter sing ngrancang antarmuka protein atom-by-atom, nggayuh akurasi 78% ing klompok intra-rantai.

Insinyur AI Gunakake Kode Claude kanggo Klaim Dekripsi Linear A, Skrip Minoan Kuno
Insinyur AI sing otodidak nggawe alat Python nganggo Kode Claude kanggo ngurai Linear A, skrip Minoan sing ora dideskripsikake. Ahli basa ing Rutgers lan Cambridge saiki mriksa pratelan kasebut.

Metode 'Simulasi Deployment' OpenAI Prediksi Gagal Model Sadurunge Diluncurake
Peneliti OpenAI ngusulake cara kanggo prédhiksi sepira kerepe model AI bakal tumindak salah sawise diluncurake, nggunakake obrolan nyata. Diprediksi kanthi bener risiko owah-owahan 92% wektu.
