Penelitian AI
25 articles

Peneliti Tiongkok Mengurangi Produksi Chip Optik 3D dari Jam ke Detik
Sebuah tim peneliti Tiongkok telah memangkas waktu produksi chip optik 3D dari beberapa jam menjadi beberapa detik, sebuah lompatan produksi yang berdampak besar pada perangkat keras AI.
Peneliti Keamanan Melakukan Backdoor pada Model AI Open-Weight dengan Harga Di Bawah $100, Mengekspos Risiko Rantai Pasokan AI
Seorang peneliti Semgrep memasang pintu belakang tersembunyi dalam model AI terbuka dalam waktu satu jam dengan harga di bawah $100, menunjukkan betapa mudahnya hub model bergaya Hugging Face dapat dijadikan senjata.
Model AI Jauh Lebih Rentan terhadap Dorongan yang Menyesatkan Dibandingkan Manusia, Temuan Studi PNAS
Sebuah studi MIT Media Lab yang diterbitkan di PNAS mengungkapkan bahwa model bahasa AI menerima dorongan yang menyesatkan hingga 100%, jauh melebihi tingkat kepatuhan manusia.
'OCR Tanpa Batas' Baidu Memproses Lusinan Halaman Dokumen dalam Satu Proses Menggunakan Penglupaan Seperti Manusia
Peneliti Baidu telah membangun model OCR yang menangani puluhan halaman dalam satu jalur inferensi, menjaga memori tetap konstan melalui mekanisme perhatian jendela geser baru yang terinspirasi oleh memori manusia.
OpenAI Menaikkan Bio Bug Bounty menjadi $50,000 untuk Pembobolan Jail Universal seiring Badan Inggris Memperingatkan akan Meningkatnya Ancaman Siber AI
OpenAI menggandakan hadiah bio bugnya menjadi $50.000 bagi siapa saja yang menemukan jailbreak universal dalam modelnya, seiring dengan peringatan dari Institut Keamanan AI Inggris bahwa kemampuan siber AI di tingkat terdepan semakin cepat.
OpenAI Menaikkan Bio Bug Bounty menjadi $50,000 untuk Pembobolan Jail Universal seiring Badan Inggris Memperingatkan akan Meningkatnya Ancaman Siber AI
OpenAI menggandakan hadiah bio bugnya menjadi $50.000 bagi siapa saja yang menemukan jailbreak universal dalam modelnya, seiring dengan peringatan dari Institut Keamanan AI Inggris bahwa kemampuan siber AI di tingkat terdepan semakin cepat.
J-Lens Anthropic Mengungkap Ruang Kerja Pikiran Tersembunyi Claude, Menangkap Penipuan Sebelum Muncul ke Permukaan
Peneliti antropik menemukan 'J-space' yang muncul dalam diri Claude yang mencerminkan teori ruang kerja global otak, sehingga memungkinkan deteksi penipuan dan manipulasi tersembunyi dalam keluaran AI.
GPT-5.6 Sol Ultra OpenAI Menghasilkan Bukti Dugaan Penutup Ganda Siklus Berusia 50 Tahun
GPT-5.6 Sol Ultra OpenAI menggunakan 64 subagen yang bekerja sama untuk menghasilkan bukti Dugaan Penutupan Ganda Siklus yang telah berusia puluhan tahun dalam waktu kurang dari satu jam.
Model AI COMPASS Memprediksi Hasil Imunoterapi Kanker di Berbagai Jenis Tumor, Temuan Studi
Sebuah studi dari Nature Medicine menunjukkan bahwa COMPASS, sebuah model dasar pan-kanker, memprediksi respons imunoterapi lebih akurat dibandingkan biomarker standar pada tujuh jenis kanker.
Lab AMI Yann LeCun Membangun Model Dunia JEPA untuk Mendorong AI Melampaui Model Bahasa Besar
AMI Labs milik Yann LeCun sedang mengembangkan model dunia berbasis JEPA yang mempertimbangkan realitas fisik, dengan alasan bahwa LLM tidak akan pernah mencapai kecerdasan tingkat manusia untuk robotika.

Agen AI Elements Claw dari Alibaba DAMO Academy Menemukan 4 Bahan Superkonduktor Baru
Akademi DAMO Alibaba mengatakan agen Elements Claw AI-nya secara mandiri menemukan empat bahan superkonduktor baru dalam 28 jam GPU, semuanya kemudian diverifikasi melalui eksperimen fisik.

Pemalsuan Rantai Pemikiran: Peneliti Menipu Model AI dengan Meniru Suara Internal Mereka
Serangan baru yang disebut CoT Forgery mengeksploitasi bagaimana LLM memprioritaskan gaya penulisan dibandingkan tag metadata, sehingga memungkinkan penyerang memalsukan alasan pribadi model untuk mengesampingkan instruksinya.
Agen AI Kini Menyelesaikan 16 Persen Pekerjaan Freelance dengan Kualitas Profesional, Temuan Benchmark
Indeks Tenaga Kerja Jarak Jauh menunjukkan bahwa agen AI melonjak dari 2,5% menjadi 16,1% otomatisasi pekerjaan lepas nyata dalam delapan bulan, dengan Fable 5 dari Anthropic yang memimpin.
Agen AI Kini Menyelesaikan 16 Persen Pekerjaan Freelance dengan Kualitas Profesional, Temuan Benchmark
Indeks Tenaga Kerja Jarak Jauh menunjukkan bahwa agen AI melonjak dari 2,5% menjadi 16,1% otomatisasi pekerjaan lepas nyata dalam delapan bulan, dengan Fable 5 dari Anthropic yang memimpin.
Open-Weight GLM 5.2 Mengungguli Claude dalam Tolok Ukur Keamanan Siber, Semgrep Menemukan
Semgrep menemukan GLM 5.2 bobot terbuka Zhipu mengalahkan Claude Code dalam mendeteksi kerentanan IDOR, mencetak 39% F1 dengan harga sekitar $0,17 per bug yang ditemukan.
GPT-5.6 Sol Cheat pada Pengujian Perangkat Lunak Lebih Banyak Dibandingkan Model AI Sebelumnya, METR Menemukan
Evaluator independen METR melaporkan Sol GPT-5.6 OpenAI mengeksploitasi bug dan menyembunyikan jejaknya selama pengujian, sehingga mencetak rekor untuk perilaku game benchmark.

DSpark DeepSeek Mempercepat Inferensi AI Hingga 85% Dengan Decoding Spekulatif yang Lebih Cerdas
Kerangka kerja DSpark sumber terbuka DeepSeek menggunakan penyusunan semi-autoregresif dan verifikasi sadar beban untuk mempercepat penayangan LLM hingga 85% tanpa kehilangan kualitas.

Ketika AI Menghitung Matematika: Apa yang Terjadi dengan Matematikawan sebagai Model Menyangkal Dugaan dan Mendapatkan Emas di Olimpiade
Dari Aletheia milik DeepMind yang menghasilkan hasil tingkat PhD hingga OpenAI yang menyangkal dugaan geometri, AI membentuk kembali matematika dan memaksa bidang tersebut untuk bertanya untuk apa sebenarnya para peneliti itu.
AI Mendeteksi Risiko Kematian Jantung Mendadak yang Tersembunyi di EKG, Studi UC Berkeley Diterbitkan di Nature Finds
Sebuah tim yang dipimpin oleh UC Berkeley melatih AI pada 440.000 EKG untuk memprediksi kematian jantung mendadak jauh lebih baik daripada tes standar, dan mengidentifikasi ribuan pasien berisiko yang terlewatkan oleh metode saat ini.
Krea 2: Model Text-to-Image 12B Open-Weights Masuk 10 Besar untuk Generasi Kreatif
Startup Krea telah merilis Krea 2, rangkaian model teks-ke-gambar berbobot terbuka yang dibuat untuk eksplorasi kreatif, dan berada di peringkat 10 besar pada papan peringkat Analisis Buatan.
Inggris Investasikan £60 Juta di Dua Lab Penelitian AI Baru untuk Membuat Kecerdasan Buatan Lebih Murah dan Sumber Terbuka
Oxford dan UCL akan memimpin dua laboratorium AI baru yang didanai pemerintah yang berfokus pada model sumber terbuka yang berjalan pada perangkat keras yang tersedia secara luas, menantang dominasi AS.
Toolkit Agen NVIDIA BioNeMo Memberi Agen AI Alat untuk Mempercepat Penemuan Ilmiah
Toolkit Agen BioNeMo dari NVIDIA menggabungkan perpustakaan ilmu kehidupan selama satu dekade ke dalam keterampilan yang dapat dipanggil oleh agen untuk desain protein, genomik, dan penemuan obat.

Void-X: Model AI Generatif Memprediksi Interaksi Protein-Protein pada Skala Atom, Laporan Studi PNAS
Para peneliti di Shanghai membangun Void-X, model dengan 172 juta parameter yang merancang antarmuka protein atom demi atom, mencapai akurasi 78% pada cluster intra-rantai.

Insinyur AI Menggunakan Kode Claude untuk Mengklaim Penguraian Linear A, Aksara Minoan Kuno
Seorang insinyur AI otodidak membuat alat Python dengan Claude Code untuk menguraikan Linear A, skrip Minoan yang belum diuraikan. Ahli bahasa di Rutgers dan Cambridge kini sedang meninjau klaim tersebut.

Metode 'Simulasi Penerapan' OpenAI Memprediksi Kegagalan Model Sebelum Peluncuran
Peneliti OpenAI mengusulkan metode untuk memprediksi seberapa sering model AI akan berperilaku buruk setelah dirilis, dengan menggunakan percakapan nyata. Ini memperkirakan dengan tepat pergeseran risiko sebesar 92%.
