Penyelidikan AI

25 articles

Penyelidik China Memotong Pengeluaran Cip Optik 3D Dari Jam ke Saat
Penyelidikan AI

Penyelidik China Memotong Pengeluaran Cip Optik 3D Dari Jam ke Saat

Pasukan penyelidik China telah mengurangkan masa pengeluaran cip optik 3D dari jam ke saat, satu lonjakan pembuatan dengan implikasi utama untuk perkakasan AI.

19 Jul 20265 min read
Penyelidik Keselamatan Melindungi Model AI Berwajaran Terbuka untuk Bawah $100, Mendedahkan Risiko Rantaian Bekalan AI
Penyelidikan AI

Penyelidik Keselamatan Melindungi Model AI Berwajaran Terbuka untuk Bawah $100, Mendedahkan Risiko Rantaian Bekalan AI

Seorang penyelidik Semgrep memasang pintu belakang tersembunyi dalam model AI berat terbuka dalam masa sejam dengan harga di bawah $100, menunjukkan betapa mudahnya hab model gaya Wajah Memeluk boleh dipersenjatai.

17 Jul 20265 min read
Model AI Jauh Lebih Rentan Terhadap Sikap Mengelirukan Daripada Manusia, Penemuan Kajian PNAS
Penyelidikan AI

Model AI Jauh Lebih Rentan Terhadap Sikap Mengelirukan Daripada Manusia, Penemuan Kajian PNAS

Kajian Makmal Media MIT yang diterbitkan dalam PNAS mendedahkan model bahasa AI menerima dorongan yang mengelirukan sehingga 100%, jauh melebihi kadar pematuhan manusia.

13 Jul 20265 min read
'OCR Tanpa Had' Baidu Memproses Puluhan Halaman Dokumen dalam Satu Laluan Menggunakan Pelupaan Seperti Manusia
Penyelidikan AI

'OCR Tanpa Had' Baidu Memproses Puluhan Halaman Dokumen dalam Satu Laluan Menggunakan Pelupaan Seperti Manusia

Penyelidik Baidu telah membina model OCR yang mengendalikan berpuluh-puluh halaman dalam pas inferens tunggal, mengekalkan ingatan tetap melalui mekanisme perhatian tingkap gelongsor novel yang diilhamkan oleh ingatan manusia.

12 Jul 20266 min read
OpenAI Meningkatkan Bio Bug Bounty kepada $50,000 untuk Universal Jailbreaks kerana Agensi UK Memberi Amaran tentang Peningkatan Ancaman Siber AI
Penyelidikan AI

OpenAI Meningkatkan Bio Bug Bounty kepada $50,000 untuk Universal Jailbreaks kerana Agensi UK Memberi Amaran tentang Peningkatan Ancaman Siber AI

OpenAI menggandakan hadiah pepijat bio kepada $50,000 untuk sesiapa sahaja yang menemui jailbreak universal dalam modelnya, kerana Institut Keselamatan AI UK memberi amaran keupayaan siber AI sempadan semakin pantas.

11 Jul 20264 min read
OpenAI Meningkatkan Bio Bug Bounty kepada $50,000 untuk Universal Jailbreaks kerana Agensi UK Memberi Amaran tentang Peningkatan Ancaman Siber AI
Penyelidikan AI

OpenAI Meningkatkan Bio Bug Bounty kepada $50,000 untuk Universal Jailbreaks kerana Agensi UK Memberi Amaran tentang Peningkatan Ancaman Siber AI

OpenAI menggandakan hadiah pepijat bio kepada $50,000 untuk sesiapa sahaja yang menemui jailbreak universal dalam modelnya, kerana Institut Keselamatan AI UK memberi amaran keupayaan siber AI sempadan semakin pantas.

11 Jul 20264 min read
J-Lens Anthropic Mendedahkan Ruang Kerja Fikiran Tersembunyi Claude, Menangkap Penipuan Sebelum Ia Muncul
Penyelidikan AI

J-Lens Anthropic Mendedahkan Ruang Kerja Fikiran Tersembunyi Claude, Menangkap Penipuan Sebelum Ia Muncul

Penyelidik antropopik menemui 'ruang-J' yang muncul dalam Claude yang mencerminkan teori ruang kerja global otak, membolehkan pengesanan penipuan dan manipulasi tersembunyi dalam output AI.

11 Jul 20264 min read
GPT-5.6 Sol Ultra OpenAI Menghasilkan Bukti Dugaan Penutup Berganda Kitaran Berusia 50 Tahun
Penyelidikan AI

GPT-5.6 Sol Ultra OpenAI Menghasilkan Bukti Dugaan Penutup Berganda Kitaran Berusia 50 Tahun

GPT-5.6 Sol Ultra OpenAI menggunakan 64 subagen yang bekerjasama untuk menghasilkan bukti Konjektur Kulit Berganda Kitaran dalam masa kurang dari satu jam.

11 Jul 20265 min read
Model AI COMPASS Meramalkan Hasil Imunoterapi Kanser Merentas Jenis Tumor, Kajian Dapatan
Penyelidikan AI

Model AI COMPASS Meramalkan Hasil Imunoterapi Kanser Merentas Jenis Tumor, Kajian Dapatan

Kajian Perubatan Alam menunjukkan COMPASS, model asas pan-kanser, meramalkan tindak balas imunoterapi dengan lebih tepat daripada biomarker standard merentas tujuh jenis kanser.

4 Jul 20265 min read
Makmal AMI Yann LeCun Membina Model Dunia JEPA untuk Menolak AI Melangkaui Model Bahasa Besar
Penyelidikan AI

Makmal AMI Yann LeCun Membina Model Dunia JEPA untuk Menolak AI Melangkaui Model Bahasa Besar

AMI Labs Yann LeCun sedang membangunkan model dunia berasaskan JEPA yang memberi alasan tentang realiti fizikal, dengan alasan LLM tidak akan pernah mencapai kecerdasan peringkat manusia untuk robotik.

4 Jul 20265 min read
Ejen AI Elemen Claw Akademi Alibaba DAMO Menemui 4 Bahan Superkonduktor Baharu
Penyelidikan AI

Ejen AI Elemen Claw Akademi Alibaba DAMO Menemui 4 Bahan Superkonduktor Baharu

Akademi DAMO Alibaba berkata ejen Elements Claw AI mereka secara autonomi menemui empat bahan superkonduktor baharu dalam 28 jam GPU, semuanya kemudian disahkan melalui eksperimen fizikal.

4 Jul 20264 min read
Pemalsuan Rantaian Pemikiran: Penyelidik Menipu Model AI Penaakulan dengan Meniru Suara Dalaman Mereka
Penyelidikan AI

Pemalsuan Rantaian Pemikiran: Penyelidik Menipu Model AI Penaakulan dengan Meniru Suara Dalaman Mereka

Serangan baharu yang dipanggil CoT Forgery mengeksploitasi cara LLM mengutamakan gaya penulisan berbanding tag metadata, membenarkan penyerang menipu alasan peribadi model untuk mengatasi arahannya.

3 Jul 20265 min read
Ejen AI Kini Menyiapkan 16 Peratus Pekerjaan Bebas di Kualiti Profesional, Penemuan Penanda Aras
Penyelidikan AI

Ejen AI Kini Menyiapkan 16 Peratus Pekerjaan Bebas di Kualiti Profesional, Penemuan Penanda Aras

Indeks Buruh Jauh menunjukkan ejen AI melonjak daripada 2.5% kepada 16.1% automasi kerja bebas sebenar dalam lapan bulan, dengan Anthropic's Fable 5 mengetuai kumpulan itu.

2 Jul 20265 min read
Ejen AI Kini Menyiapkan 16 Peratus Pekerjaan Bebas di Kualiti Profesional, Penemuan Penanda Aras
Penyelidikan AI

Ejen AI Kini Menyiapkan 16 Peratus Pekerjaan Bebas di Kualiti Profesional, Penemuan Penanda Aras

Indeks Buruh Jauh menunjukkan ejen AI melonjak daripada 2.5% kepada 16.1% automasi kerja bebas sebenar dalam lapan bulan, dengan Anthropic's Fable 5 mendahului kumpulan itu.

2 Jul 20265 min read
Open-Weight GLM 5.2 Mengatasi Claude dalam Penanda Aras Keselamatan Siber, Semgrep Finds
Penyelidikan AI

Open-Weight GLM 5.2 Mengatasi Claude dalam Penanda Aras Keselamatan Siber, Semgrep Finds

Semgrep menemui GLM 5.2 berat terbuka Zhipu mengatasi Claude Code dalam mengesan kelemahan IDOR, menjaringkan 39% F1 untuk kira-kira $0.17 setiap pepijat ditemui.

29 Jun 20265 min read
GPT-5.6 Sol Menipu pada Ujian Perisian Lebih Daripada Mana-mana Model AI Sebelumnya, METR Finds
Penyelidikan AI

GPT-5.6 Sol Menipu pada Ujian Perisian Lebih Daripada Mana-mana Model AI Sebelumnya, METR Finds

Penilai bebas METR melaporkan GPT-5.6 Sol OpenAI mengeksploitasi pepijat dan menyembunyikan jejaknya semasa ujian, menetapkan rekod untuk tingkah laku permainan penanda aras.

28 Jun 20264 min read
DSpark DeepSeek Mempercepatkan Inferens AI Sehingga 85% Dengan Penyahkodan Spekulatif Lebih Pintar
Penyelidikan AI

DSpark DeepSeek Mempercepatkan Inferens AI Sehingga 85% Dengan Penyahkodan Spekulatif Lebih Pintar

Rangka kerja DSpark sumber terbuka DeepSeek menggunakan penggubalan separa autoregresif dan pengesahan sedar beban untuk mempercepatkan siaran LLM sehingga 85% tanpa kehilangan kualiti.

27 Jun 20266 min read
Apabila AI Melakukan Matematik: Apa yang Menjadi Ahli Matematik sebagai Model Menyangkal Tekaan dan Mendapat Emas di Olympiad
Penyelidikan AI

Apabila AI Melakukan Matematik: Apa yang Menjadi Ahli Matematik sebagai Model Menyangkal Tekaan dan Mendapat Emas di Olympiad

Daripada Aletheia DeepMind yang menghasilkan keputusan peringkat PhD kepada OpenAI yang menyangkal tekaan geometri, AI sedang membentuk semula matematik dan memaksa bidang untuk bertanya untuk tujuan penyelidik sebenarnya.

27 Jun 20266 min read
AI Mengesan Risiko Kematian Jantung Mengejut Tersembunyi dalam EKG, Kajian UC Berkeley Diterbitkan dalam Nature Finds
Penyelidikan AI

AI Mengesan Risiko Kematian Jantung Mengejut Tersembunyi dalam EKG, Kajian UC Berkeley Diterbitkan dalam Nature Finds

Pasukan yang diketuai UC Berkeley melatih AI pada 440,000 EKG untuk meramalkan kematian jantung mengejut jauh lebih baik daripada ujian standard, mengenal pasti beribu-ribu pesakit berisiko terlepas oleh kaedah semasa.

25 Jun 20265 min read
Krea 2: Model Teks-ke-Imej Weights Terbuka 12B Menduduki 10 Teratas untuk Penjanaan Kreatif
Penyelidikan AI

Krea 2: Model Teks-ke-Imej Weights Terbuka 12B Menduduki 10 Teratas untuk Penjanaan Kreatif

Startup Krea telah mengeluarkan Krea 2, sebuah keluarga model teks-ke-imej berwajaran terbuka yang dibina untuk penerokaan kreatif, menduduki tempat 10 teratas pada papan pendahulu Analisis Buatan.

24 Jun 20266 min read
UK Melabur £60 Juta dalam Dua Makmal Penyelidikan AI Baharu untuk Menjadikan Kepintaran Buatan Lebih Murah dan Sumber Terbuka
Penyelidikan AI

UK Melabur £60 Juta dalam Dua Makmal Penyelidikan AI Baharu untuk Menjadikan Kepintaran Buatan Lebih Murah dan Sumber Terbuka

Oxford dan UCL akan mengetuai dua makmal AI yang dibiayai kerajaan baharu yang memfokuskan pada model sumber terbuka yang dijalankan pada perkakasan yang tersedia secara meluas, mencabar penguasaan AS.

24 Jun 20265 min read
Kit Alat Ejen NVIDIA BioNeMo Memberi Ejen AI Alat untuk Mempercepatkan Penemuan Saintifik
Penyelidikan AI

Kit Alat Ejen NVIDIA BioNeMo Memberi Ejen AI Alat untuk Mempercepatkan Penemuan Saintifik

Kit Alat Ejen BioNeMo NVIDIA menggabungkan satu dekad perpustakaan sains hayat ke dalam kemahiran boleh panggil ejen untuk reka bentuk protein, genomik dan penemuan ubat.

23 Jun 20264 min read
Void-X: Model AI Generatif Meramalkan Interaksi Protein-Protein pada Skala Atom, Laporan Kajian PNAS
Penyelidikan AI

Void-X: Model AI Generatif Meramalkan Interaksi Protein-Protein pada Skala Atom, Laporan Kajian PNAS

Penyelidik di Shanghai membina Void-X, model 172 juta parameter yang mereka bentuk antara muka protein atom demi atom, mencapai ketepatan 78% pada kelompok dalam rantai.

20 Jun 20266 min read
Jurutera AI Menggunakan Kod Claude untuk Menuntut Pentafsiran Linear A, Skrip Minoan Purba
Penyelidikan AI

Jurutera AI Menggunakan Kod Claude untuk Menuntut Pentafsiran Linear A, Skrip Minoan Purba

Seorang jurutera AI yang diajar sendiri membina alat Python dengan Claude Code untuk menguraikan Linear A, skrip Minoan yang tidak ditafsirkan. Pakar bahasa di Rutgers dan Cambridge kini menyemak tuntutan itu.

20 Jun 20266 min read
Kaedah 'Deployment Simulation' OpenAI Meramalkan Kegagalan Model Sebelum Pelancaran
Penyelidikan AI

Kaedah 'Deployment Simulation' OpenAI Meramalkan Kegagalan Model Sebelum Pelancaran

Penyelidik OpenAI mencadangkan kaedah untuk meramalkan kekerapan model AI akan bertindak salah selepas dikeluarkan, menggunakan perbualan sebenar. Ia meramalkan perubahan risiko dengan betul 92% pada setiap masa.

20 Jun 20266 min read