Penyelidikan AI
25 articles

Penyelidik China Memotong Pengeluaran Cip Optik 3D Dari Jam ke Saat
Pasukan penyelidik China telah mengurangkan masa pengeluaran cip optik 3D dari jam ke saat, satu lonjakan pembuatan dengan implikasi utama untuk perkakasan AI.
Penyelidik Keselamatan Melindungi Model AI Berwajaran Terbuka untuk Bawah $100, Mendedahkan Risiko Rantaian Bekalan AI
Seorang penyelidik Semgrep memasang pintu belakang tersembunyi dalam model AI berat terbuka dalam masa sejam dengan harga di bawah $100, menunjukkan betapa mudahnya hab model gaya Wajah Memeluk boleh dipersenjatai.
Model AI Jauh Lebih Rentan Terhadap Sikap Mengelirukan Daripada Manusia, Penemuan Kajian PNAS
Kajian Makmal Media MIT yang diterbitkan dalam PNAS mendedahkan model bahasa AI menerima dorongan yang mengelirukan sehingga 100%, jauh melebihi kadar pematuhan manusia.
'OCR Tanpa Had' Baidu Memproses Puluhan Halaman Dokumen dalam Satu Laluan Menggunakan Pelupaan Seperti Manusia
Penyelidik Baidu telah membina model OCR yang mengendalikan berpuluh-puluh halaman dalam pas inferens tunggal, mengekalkan ingatan tetap melalui mekanisme perhatian tingkap gelongsor novel yang diilhamkan oleh ingatan manusia.
OpenAI Meningkatkan Bio Bug Bounty kepada $50,000 untuk Universal Jailbreaks kerana Agensi UK Memberi Amaran tentang Peningkatan Ancaman Siber AI
OpenAI menggandakan hadiah pepijat bio kepada $50,000 untuk sesiapa sahaja yang menemui jailbreak universal dalam modelnya, kerana Institut Keselamatan AI UK memberi amaran keupayaan siber AI sempadan semakin pantas.
OpenAI Meningkatkan Bio Bug Bounty kepada $50,000 untuk Universal Jailbreaks kerana Agensi UK Memberi Amaran tentang Peningkatan Ancaman Siber AI
OpenAI menggandakan hadiah pepijat bio kepada $50,000 untuk sesiapa sahaja yang menemui jailbreak universal dalam modelnya, kerana Institut Keselamatan AI UK memberi amaran keupayaan siber AI sempadan semakin pantas.
J-Lens Anthropic Mendedahkan Ruang Kerja Fikiran Tersembunyi Claude, Menangkap Penipuan Sebelum Ia Muncul
Penyelidik antropopik menemui 'ruang-J' yang muncul dalam Claude yang mencerminkan teori ruang kerja global otak, membolehkan pengesanan penipuan dan manipulasi tersembunyi dalam output AI.
GPT-5.6 Sol Ultra OpenAI Menghasilkan Bukti Dugaan Penutup Berganda Kitaran Berusia 50 Tahun
GPT-5.6 Sol Ultra OpenAI menggunakan 64 subagen yang bekerjasama untuk menghasilkan bukti Konjektur Kulit Berganda Kitaran dalam masa kurang dari satu jam.
Model AI COMPASS Meramalkan Hasil Imunoterapi Kanser Merentas Jenis Tumor, Kajian Dapatan
Kajian Perubatan Alam menunjukkan COMPASS, model asas pan-kanser, meramalkan tindak balas imunoterapi dengan lebih tepat daripada biomarker standard merentas tujuh jenis kanser.
Makmal AMI Yann LeCun Membina Model Dunia JEPA untuk Menolak AI Melangkaui Model Bahasa Besar
AMI Labs Yann LeCun sedang membangunkan model dunia berasaskan JEPA yang memberi alasan tentang realiti fizikal, dengan alasan LLM tidak akan pernah mencapai kecerdasan peringkat manusia untuk robotik.

Ejen AI Elemen Claw Akademi Alibaba DAMO Menemui 4 Bahan Superkonduktor Baharu
Akademi DAMO Alibaba berkata ejen Elements Claw AI mereka secara autonomi menemui empat bahan superkonduktor baharu dalam 28 jam GPU, semuanya kemudian disahkan melalui eksperimen fizikal.

Pemalsuan Rantaian Pemikiran: Penyelidik Menipu Model AI Penaakulan dengan Meniru Suara Dalaman Mereka
Serangan baharu yang dipanggil CoT Forgery mengeksploitasi cara LLM mengutamakan gaya penulisan berbanding tag metadata, membenarkan penyerang menipu alasan peribadi model untuk mengatasi arahannya.
Ejen AI Kini Menyiapkan 16 Peratus Pekerjaan Bebas di Kualiti Profesional, Penemuan Penanda Aras
Indeks Buruh Jauh menunjukkan ejen AI melonjak daripada 2.5% kepada 16.1% automasi kerja bebas sebenar dalam lapan bulan, dengan Anthropic's Fable 5 mengetuai kumpulan itu.
Ejen AI Kini Menyiapkan 16 Peratus Pekerjaan Bebas di Kualiti Profesional, Penemuan Penanda Aras
Indeks Buruh Jauh menunjukkan ejen AI melonjak daripada 2.5% kepada 16.1% automasi kerja bebas sebenar dalam lapan bulan, dengan Anthropic's Fable 5 mendahului kumpulan itu.
Open-Weight GLM 5.2 Mengatasi Claude dalam Penanda Aras Keselamatan Siber, Semgrep Finds
Semgrep menemui GLM 5.2 berat terbuka Zhipu mengatasi Claude Code dalam mengesan kelemahan IDOR, menjaringkan 39% F1 untuk kira-kira $0.17 setiap pepijat ditemui.
GPT-5.6 Sol Menipu pada Ujian Perisian Lebih Daripada Mana-mana Model AI Sebelumnya, METR Finds
Penilai bebas METR melaporkan GPT-5.6 Sol OpenAI mengeksploitasi pepijat dan menyembunyikan jejaknya semasa ujian, menetapkan rekod untuk tingkah laku permainan penanda aras.

DSpark DeepSeek Mempercepatkan Inferens AI Sehingga 85% Dengan Penyahkodan Spekulatif Lebih Pintar
Rangka kerja DSpark sumber terbuka DeepSeek menggunakan penggubalan separa autoregresif dan pengesahan sedar beban untuk mempercepatkan siaran LLM sehingga 85% tanpa kehilangan kualiti.

Apabila AI Melakukan Matematik: Apa yang Menjadi Ahli Matematik sebagai Model Menyangkal Tekaan dan Mendapat Emas di Olympiad
Daripada Aletheia DeepMind yang menghasilkan keputusan peringkat PhD kepada OpenAI yang menyangkal tekaan geometri, AI sedang membentuk semula matematik dan memaksa bidang untuk bertanya untuk tujuan penyelidik sebenarnya.
AI Mengesan Risiko Kematian Jantung Mengejut Tersembunyi dalam EKG, Kajian UC Berkeley Diterbitkan dalam Nature Finds
Pasukan yang diketuai UC Berkeley melatih AI pada 440,000 EKG untuk meramalkan kematian jantung mengejut jauh lebih baik daripada ujian standard, mengenal pasti beribu-ribu pesakit berisiko terlepas oleh kaedah semasa.
Krea 2: Model Teks-ke-Imej Weights Terbuka 12B Menduduki 10 Teratas untuk Penjanaan Kreatif
Startup Krea telah mengeluarkan Krea 2, sebuah keluarga model teks-ke-imej berwajaran terbuka yang dibina untuk penerokaan kreatif, menduduki tempat 10 teratas pada papan pendahulu Analisis Buatan.
UK Melabur £60 Juta dalam Dua Makmal Penyelidikan AI Baharu untuk Menjadikan Kepintaran Buatan Lebih Murah dan Sumber Terbuka
Oxford dan UCL akan mengetuai dua makmal AI yang dibiayai kerajaan baharu yang memfokuskan pada model sumber terbuka yang dijalankan pada perkakasan yang tersedia secara meluas, mencabar penguasaan AS.
Kit Alat Ejen NVIDIA BioNeMo Memberi Ejen AI Alat untuk Mempercepatkan Penemuan Saintifik
Kit Alat Ejen BioNeMo NVIDIA menggabungkan satu dekad perpustakaan sains hayat ke dalam kemahiran boleh panggil ejen untuk reka bentuk protein, genomik dan penemuan ubat.

Void-X: Model AI Generatif Meramalkan Interaksi Protein-Protein pada Skala Atom, Laporan Kajian PNAS
Penyelidik di Shanghai membina Void-X, model 172 juta parameter yang mereka bentuk antara muka protein atom demi atom, mencapai ketepatan 78% pada kelompok dalam rantai.

Jurutera AI Menggunakan Kod Claude untuk Menuntut Pentafsiran Linear A, Skrip Minoan Purba
Seorang jurutera AI yang diajar sendiri membina alat Python dengan Claude Code untuk menguraikan Linear A, skrip Minoan yang tidak ditafsirkan. Pakar bahasa di Rutgers dan Cambridge kini menyemak tuntutan itu.

Kaedah 'Deployment Simulation' OpenAI Meramalkan Kegagalan Model Sebelum Pelancaran
Penyelidik OpenAI mencadangkan kaedah untuk meramalkan kekerapan model AI akan bertindak salah selepas dikeluarkan, menggunakan perbualan sebenar. Ia meramalkan perubahan risiko dengan betul 92% pada setiap masa.
