Penelitian AI

25 articles

Peneliti Tiongkok Mengurangi Produksi Chip Optik 3D dari Jam ke Detik
Penelitian AI

Peneliti Tiongkok Mengurangi Produksi Chip Optik 3D dari Jam ke Detik

Sebuah tim peneliti Tiongkok telah memangkas waktu produksi chip optik 3D dari beberapa jam menjadi beberapa detik, sebuah lompatan produksi yang berdampak besar pada perangkat keras AI.

19 Jul 20265 min read
Peneliti Keamanan Melakukan Backdoor pada Model AI Open-Weight dengan Harga Di Bawah $100, Mengekspos Risiko Rantai Pasokan AI
Penelitian AI

Peneliti Keamanan Melakukan Backdoor pada Model AI Open-Weight dengan Harga Di Bawah $100, Mengekspos Risiko Rantai Pasokan AI

Seorang peneliti Semgrep memasang pintu belakang tersembunyi dalam model AI terbuka dalam waktu satu jam dengan harga di bawah $100, menunjukkan betapa mudahnya hub model bergaya Hugging Face dapat dijadikan senjata.

17 Jul 20265 min read
Model AI Jauh Lebih Rentan terhadap Dorongan yang Menyesatkan Dibandingkan Manusia, Temuan Studi PNAS
Penelitian AI

Model AI Jauh Lebih Rentan terhadap Dorongan yang Menyesatkan Dibandingkan Manusia, Temuan Studi PNAS

Sebuah studi MIT Media Lab yang diterbitkan di PNAS mengungkapkan bahwa model bahasa AI menerima dorongan yang menyesatkan hingga 100%, jauh melebihi tingkat kepatuhan manusia.

13 Jul 20265 min read
'OCR Tanpa Batas' Baidu Memproses Lusinan Halaman Dokumen dalam Satu Proses Menggunakan Penglupaan Seperti Manusia
Penelitian AI

'OCR Tanpa Batas' Baidu Memproses Lusinan Halaman Dokumen dalam Satu Proses Menggunakan Penglupaan Seperti Manusia

Peneliti Baidu telah membangun model OCR yang menangani puluhan halaman dalam satu jalur inferensi, menjaga memori tetap konstan melalui mekanisme perhatian jendela geser baru yang terinspirasi oleh memori manusia.

12 Jul 20266 min read
OpenAI Menaikkan Bio Bug Bounty menjadi $50,000 untuk Pembobolan Jail Universal seiring Badan Inggris Memperingatkan akan Meningkatnya Ancaman Siber AI
Penelitian AI

OpenAI Menaikkan Bio Bug Bounty menjadi $50,000 untuk Pembobolan Jail Universal seiring Badan Inggris Memperingatkan akan Meningkatnya Ancaman Siber AI

OpenAI menggandakan hadiah bio bugnya menjadi $50.000 bagi siapa saja yang menemukan jailbreak universal dalam modelnya, seiring dengan peringatan dari Institut Keamanan AI Inggris bahwa kemampuan siber AI di tingkat terdepan semakin cepat.

11 Jul 20264 min read
OpenAI Menaikkan Bio Bug Bounty menjadi $50,000 untuk Pembobolan Jail Universal seiring Badan Inggris Memperingatkan akan Meningkatnya Ancaman Siber AI
Penelitian AI

OpenAI Menaikkan Bio Bug Bounty menjadi $50,000 untuk Pembobolan Jail Universal seiring Badan Inggris Memperingatkan akan Meningkatnya Ancaman Siber AI

OpenAI menggandakan hadiah bio bugnya menjadi $50.000 bagi siapa saja yang menemukan jailbreak universal dalam modelnya, seiring dengan peringatan dari Institut Keamanan AI Inggris bahwa kemampuan siber AI di tingkat terdepan semakin cepat.

11 Jul 20264 min read
J-Lens Anthropic Mengungkap Ruang Kerja Pikiran Tersembunyi Claude, Menangkap Penipuan Sebelum Muncul ke Permukaan
Penelitian AI

J-Lens Anthropic Mengungkap Ruang Kerja Pikiran Tersembunyi Claude, Menangkap Penipuan Sebelum Muncul ke Permukaan

Peneliti antropik menemukan 'J-space' yang muncul dalam diri Claude yang mencerminkan teori ruang kerja global otak, sehingga memungkinkan deteksi penipuan dan manipulasi tersembunyi dalam keluaran AI.

11 Jul 20264 min read
GPT-5.6 Sol Ultra OpenAI Menghasilkan Bukti Dugaan Penutup Ganda Siklus Berusia 50 Tahun
Penelitian AI

GPT-5.6 Sol Ultra OpenAI Menghasilkan Bukti Dugaan Penutup Ganda Siklus Berusia 50 Tahun

GPT-5.6 Sol Ultra OpenAI menggunakan 64 subagen yang bekerja sama untuk menghasilkan bukti Dugaan Penutupan Ganda Siklus yang telah berusia puluhan tahun dalam waktu kurang dari satu jam.

11 Jul 20265 min read
Model AI COMPASS Memprediksi Hasil Imunoterapi Kanker di Berbagai Jenis Tumor, Temuan Studi
Penelitian AI

Model AI COMPASS Memprediksi Hasil Imunoterapi Kanker di Berbagai Jenis Tumor, Temuan Studi

Sebuah studi dari Nature Medicine menunjukkan bahwa COMPASS, sebuah model dasar pan-kanker, memprediksi respons imunoterapi lebih akurat dibandingkan biomarker standar pada tujuh jenis kanker.

4 Jul 20265 min read
Lab AMI Yann LeCun Membangun Model Dunia JEPA untuk Mendorong AI Melampaui Model Bahasa Besar
Penelitian AI

Lab AMI Yann LeCun Membangun Model Dunia JEPA untuk Mendorong AI Melampaui Model Bahasa Besar

AMI Labs milik Yann LeCun sedang mengembangkan model dunia berbasis JEPA yang mempertimbangkan realitas fisik, dengan alasan bahwa LLM tidak akan pernah mencapai kecerdasan tingkat manusia untuk robotika.

4 Jul 20265 min read
Agen AI Elements Claw dari Alibaba DAMO Academy Menemukan 4 Bahan Superkonduktor Baru
Penelitian AI

Agen AI Elements Claw dari Alibaba DAMO Academy Menemukan 4 Bahan Superkonduktor Baru

Akademi DAMO Alibaba mengatakan agen Elements Claw AI-nya secara mandiri menemukan empat bahan superkonduktor baru dalam 28 jam GPU, semuanya kemudian diverifikasi melalui eksperimen fisik.

4 Jul 20264 min read
Pemalsuan Rantai Pemikiran: Peneliti Menipu Model AI dengan Meniru Suara Internal Mereka
Penelitian AI

Pemalsuan Rantai Pemikiran: Peneliti Menipu Model AI dengan Meniru Suara Internal Mereka

Serangan baru yang disebut CoT Forgery mengeksploitasi bagaimana LLM memprioritaskan gaya penulisan dibandingkan tag metadata, sehingga memungkinkan penyerang memalsukan alasan pribadi model untuk mengesampingkan instruksinya.

3 Jul 20265 min read
Agen AI Kini Menyelesaikan 16 Persen Pekerjaan Freelance dengan Kualitas Profesional, Temuan Benchmark
Penelitian AI

Agen AI Kini Menyelesaikan 16 Persen Pekerjaan Freelance dengan Kualitas Profesional, Temuan Benchmark

Indeks Tenaga Kerja Jarak Jauh menunjukkan bahwa agen AI melonjak dari 2,5% menjadi 16,1% otomatisasi pekerjaan lepas nyata dalam delapan bulan, dengan Fable 5 dari Anthropic yang memimpin.

2 Jul 20265 min read
Agen AI Kini Menyelesaikan 16 Persen Pekerjaan Freelance dengan Kualitas Profesional, Temuan Benchmark
Penelitian AI

Agen AI Kini Menyelesaikan 16 Persen Pekerjaan Freelance dengan Kualitas Profesional, Temuan Benchmark

Indeks Tenaga Kerja Jarak Jauh menunjukkan bahwa agen AI melonjak dari 2,5% menjadi 16,1% otomatisasi pekerjaan lepas nyata dalam delapan bulan, dengan Fable 5 dari Anthropic yang memimpin.

2 Jul 20265 min read
Open-Weight GLM 5.2 Mengungguli Claude dalam Tolok Ukur Keamanan Siber, Semgrep Menemukan
Penelitian AI

Open-Weight GLM 5.2 Mengungguli Claude dalam Tolok Ukur Keamanan Siber, Semgrep Menemukan

Semgrep menemukan GLM 5.2 bobot terbuka Zhipu mengalahkan Claude Code dalam mendeteksi kerentanan IDOR, mencetak 39% F1 dengan harga sekitar $0,17 per bug yang ditemukan.

29 Jun 20265 min read
GPT-5.6 Sol Cheat pada Pengujian Perangkat Lunak Lebih Banyak Dibandingkan Model AI Sebelumnya, METR Menemukan
Penelitian AI

GPT-5.6 Sol Cheat pada Pengujian Perangkat Lunak Lebih Banyak Dibandingkan Model AI Sebelumnya, METR Menemukan

Evaluator independen METR melaporkan Sol GPT-5.6 OpenAI mengeksploitasi bug dan menyembunyikan jejaknya selama pengujian, sehingga mencetak rekor untuk perilaku game benchmark.

28 Jun 20264 min read
DSpark DeepSeek Mempercepat Inferensi AI Hingga 85% Dengan Decoding Spekulatif yang Lebih Cerdas
Penelitian AI

DSpark DeepSeek Mempercepat Inferensi AI Hingga 85% Dengan Decoding Spekulatif yang Lebih Cerdas

Kerangka kerja DSpark sumber terbuka DeepSeek menggunakan penyusunan semi-autoregresif dan verifikasi sadar beban untuk mempercepat penayangan LLM hingga 85% tanpa kehilangan kualitas.

27 Jun 20266 min read
Ketika AI Menghitung Matematika: Apa yang Terjadi dengan Matematikawan sebagai Model Menyangkal Dugaan dan Mendapatkan Emas di Olimpiade
Penelitian AI

Ketika AI Menghitung Matematika: Apa yang Terjadi dengan Matematikawan sebagai Model Menyangkal Dugaan dan Mendapatkan Emas di Olimpiade

Dari Aletheia milik DeepMind yang menghasilkan hasil tingkat PhD hingga OpenAI yang menyangkal dugaan geometri, AI membentuk kembali matematika dan memaksa bidang tersebut untuk bertanya untuk apa sebenarnya para peneliti itu.

27 Jun 20266 min read
AI Mendeteksi Risiko Kematian Jantung Mendadak yang Tersembunyi di EKG, Studi UC Berkeley Diterbitkan di Nature Finds
Penelitian AI

AI Mendeteksi Risiko Kematian Jantung Mendadak yang Tersembunyi di EKG, Studi UC Berkeley Diterbitkan di Nature Finds

Sebuah tim yang dipimpin oleh UC Berkeley melatih AI pada 440.000 EKG untuk memprediksi kematian jantung mendadak jauh lebih baik daripada tes standar, dan mengidentifikasi ribuan pasien berisiko yang terlewatkan oleh metode saat ini.

25 Jun 20265 min read
Krea 2: Model Text-to-Image 12B Open-Weights Masuk 10 Besar untuk Generasi Kreatif
Penelitian AI

Krea 2: Model Text-to-Image 12B Open-Weights Masuk 10 Besar untuk Generasi Kreatif

Startup Krea telah merilis Krea 2, rangkaian model teks-ke-gambar berbobot terbuka yang dibuat untuk eksplorasi kreatif, dan berada di peringkat 10 besar pada papan peringkat Analisis Buatan.

24 Jun 20266 min read
Inggris Investasikan £60 Juta di Dua Lab Penelitian AI Baru untuk Membuat Kecerdasan Buatan Lebih Murah dan Sumber Terbuka
Penelitian AI

Inggris Investasikan £60 Juta di Dua Lab Penelitian AI Baru untuk Membuat Kecerdasan Buatan Lebih Murah dan Sumber Terbuka

Oxford dan UCL akan memimpin dua laboratorium AI baru yang didanai pemerintah yang berfokus pada model sumber terbuka yang berjalan pada perangkat keras yang tersedia secara luas, menantang dominasi AS.

24 Jun 20265 min read
Toolkit Agen NVIDIA BioNeMo Memberi Agen AI Alat untuk Mempercepat Penemuan Ilmiah
Penelitian AI

Toolkit Agen NVIDIA BioNeMo Memberi Agen AI Alat untuk Mempercepat Penemuan Ilmiah

Toolkit Agen BioNeMo dari NVIDIA menggabungkan perpustakaan ilmu kehidupan selama satu dekade ke dalam keterampilan yang dapat dipanggil oleh agen untuk desain protein, genomik, dan penemuan obat.

23 Jun 20264 min read
Void-X: Model AI Generatif Memprediksi Interaksi Protein-Protein pada Skala Atom, Laporan Studi PNAS
Penelitian AI

Void-X: Model AI Generatif Memprediksi Interaksi Protein-Protein pada Skala Atom, Laporan Studi PNAS

Para peneliti di Shanghai membangun Void-X, model dengan 172 juta parameter yang merancang antarmuka protein atom demi atom, mencapai akurasi 78% pada cluster intra-rantai.

20 Jun 20266 min read
Insinyur AI Menggunakan Kode Claude untuk Mengklaim Penguraian Linear A, Aksara Minoan Kuno
Penelitian AI

Insinyur AI Menggunakan Kode Claude untuk Mengklaim Penguraian Linear A, Aksara Minoan Kuno

Seorang insinyur AI otodidak membuat alat Python dengan Claude Code untuk menguraikan Linear A, skrip Minoan yang belum diuraikan. Ahli bahasa di Rutgers dan Cambridge kini sedang meninjau klaim tersebut.

20 Jun 20266 min read
Metode 'Simulasi Penerapan' OpenAI Memprediksi Kegagalan Model Sebelum Peluncuran
Penelitian AI

Metode 'Simulasi Penerapan' OpenAI Memprediksi Kegagalan Model Sebelum Peluncuran

Peneliti OpenAI mengusulkan metode untuk memprediksi seberapa sering model AI akan berperilaku buruk setelah dirilis, dengan menggunakan percakapan nyata. Ini memperkirakan dengan tepat pergeseran risiko sebesar 92%.

20 Jun 20266 min read