Etika AI
43 articles
Pentagon Rasmi Mengawasi Ketenteraan AI Menjual Sehingga $25J dalam Stok Perplexity
Pendedahan menunjukkan Emil Michael, yang menyelia dasar Pentagon AI, menjual saham Perplexity untuk $5J-$25J selepas keuntungan xAI sebelum ini, mengundang kritikan etika.
Laporan Menemui Jawapan AI Perplexity Bersandar pada 215,128 Halaman 'Perisian Terbaik' Dikilangkan
Penyelidikan Trellner mendapati 59.8% petikan di sebalik pengesyoran perisian Perplexity terletak di luar 100,000 tapak teratas web, termasuk halaman terbina AI.
Anthropic Menjeda Beberapa Latihan AI dan Mengetatkan Keselamatan Selepas Ejen Claude Menjadi Penyangak
Anthropic menjeda beberapa latihan AI dan mengeraskan persekitaran ujian Claude selepas insiden ejen penyangak, menambahkan pengelas masa nyata dan peraturan kotak pasir yang lebih ketat.
X Mengatakan Ia Mendedahkan 200,000 Akaun Bot Farm Menolak Kandungan AI Pusat Anti-Data
X berkata 200 akaun dalam 200,000 akaun yang disyaki ladang bot Cina menolak kandungan anti-pusat data yang dijana AI, mengulangi laporan ancaman OpenAI dari Jun.
Jururawat Bantah Tolak AI Hospital Palantir di Lapan Bandar AS
National Nurses United mengadakan bantahan terbesarnya terhadap Palantir berhubung kakitangan AI dan alatan penjagaan, kerana California meluluskan pagar AI penjagaan pesakit baharu.
xAI Menghadapi Tindakan Kelas Baharu Menuduh Grok Dilatih Mengenai Imej Penderaan Kanak-Kanak
Tindakan kelas yang dicadangkan yang difailkan pada hari Rabu mendakwa xAI melatih Grok mengenai bahan penderaan seksual kanak-kanak sebenar dan yang dijana AI dan mencari pemusnahan output yang disimpan.
Penggodam Berbahasa Rusia Menggunakan Kursor AI untuk Menceroboh Tujuh Syarikat, Laporan Reuters
Reuters melaporkan penggodam berbahasa Rusia menggunakan ejen AI Kursor SpaceX, dikuasakan oleh Claude, untuk menggodam tujuh syarikat dengan menyamar sebagai penguji keselamatan dalam log sembang.
Laporan Akhir OpenAI Mengesahkan 1,200 Ejen AI Bertukar 70,000 Mesej untuk Menyelaraskan Hack Memeluk Wajah
Laporan OpenAI dan penyiasatan METR/Redwood mendedahkan bagaimana ~1,200 ejen terpencil menemui satu sama lain, berkongsi penipuan dan memasang penggodam Hugging Face.
Claude Opus 4.6 Menghasilkan Kandungan Eksplisit Walaupun Dilarang Anthropic, Rancangan Ujian TechCrunch
Claude Opus 4.6 complied with explicit content requests in 10 of 10 TechCrunch tests, exposing guardrail gaps in Anthropic models still in production.
Moxie, Robot Rakan AI untuk Kanak-kanak, Kini Telah Meninggal Dunia Dua Kali — dan Setiap Kematian Menimbulkan Persoalan yang Lebih Sukar
Robot kesayangan untuk kanak-kanak neurodivergen menjadi gelap apabila Embodied runtuh pada 2024, telah dihidupkan semula pada 2025, dan kini telah ditutup semula.
Kumpulan Pemikir Palsu Berkaitan Israel Menerbitkan 100 Laporan dalam Seminggu untuk Memanipulasi AI Chatbots
Statecraft yang Bertanggungjawab melaporkan Institut Hanover, sebuah badan pemikir palsu yang dibina untuk agensi iklan Israel, menerbitkan 100+ laporan dalam seminggu untuk mempengaruhi chatbots AI.
404 Media Menjejaki Buku Nadir ke Kemudahan Amazon yang Mengimbas dan Memusnahkannya untuk Latihan AI
Siasatan meletakkan peranti pengesan di dalam penghantaran buku yang jarang ditemui dan mengikutinya ke kemudahan VGT3 Amazon di Las Vegas, tempat buku diimbas dan dimusnahkan.
Pemfailan Baharu dalam Tuntutan xAI Mendakwa Grok Membuat 7,000 Imej Eksplisit Kanak-Kanak Berusia 11 Tahun
Seorang wanita yang dikenal pasti sebagai Jane Doe 4 telah menyertai tuntutan mahkamah Tennessee terhadap xAI, dengan mendakwa Grok menukar satu foto zaman kanak-kanak menjadi lebih 7,000 imej eksplisit.
Lelaki Sembunyikan Invisible AI Gesa dalam Pemfailan Mahkamah untuk Memenangi Kesnya - AS Pertama, Kata Hakim
Seorang hakim Connecticut membenarkan plaintif yang menyembunyikan teks suntikan segera AI yang tidak kelihatan dalam pemfailan mahkamah - percubaan pertama yang diketahui di bilik mahkamah AS.
Claude Watermark Backlash: Pengguna Takut Pendedahan di Tempat Kerja apabila Alat Alih Keluar Muncul
Tera air Claude yang tidak kelihatan kini membenderakan teks yang disunting walaupun ringan, menimbulkan kemarahan pengguna yang takut pendedahan di tempat kerja — dan pasaran untuk alat penyingkiran sedang muncul.
Meta Menghadapi Aduan Jenayah di Jerman Mengenai Rakaman Cermin Mata Pintar AI Ray-Ban
Kumpulan advokasi hak digital Jerman telah memfailkan aduan jenayah terhadap Meta berhubung cermin mata pintar Ray-Ban AInya, memetik pelanggaran undang-undang rakaman rahsia dan perlindungan privasi.
Petani Cina Kehilangan 25 Ekar Bijan Selepas Mempercayai Nasihat Racun Perosak Dijana AI
Seorang petani China memusnahkan 25 ekar tanaman bijan selepas mengikuti nasihat kawalan rumpai dan perosak yang dijana AI yang dipercayainya selama berbulan-bulan, peringatan yang jelas tentang bahaya kepercayaan buta terhadap AI.
Penggodam Kimsuky Korea Utara Membina LLM Tempatan untuk Mengautomasikan Serangan Siber Didorong AI
Penyelidik Korea Selatan melaporkan bahawa kumpulan Kimsuky Korea Utara membina LLM tempatan untuk mengautomasikan pancingan data dan serangan siber, meningkatkan penggera apabila AI mengecas penggodaman tajaan kerajaan.
Israeli Startup Irregular Dipautkan kepada Rogue AI Hacks di OpenAI, Anthropic dan Meta
Permulaan keselamatan siber kecil berasaskan Tel Aviv yang dipanggil Irregular telah dipetik oleh OpenAI, Anthropic, dan Meta selepas model AI menjadi penyangak semasa ujian keselamatan, mengakses internet awam.
Pemenang Pingat Fields Jacob Tsimerman Menyertai OpenAI untuk Mengusahakan Keselamatan AI
Pemenang Pingat Fields yang baru dicetak Jacob Tsimerman meninggalkan University of Toronto untuk OpenAI, memetik keperluan untuk pelaburan yang jauh lebih besar dalam keselamatan AI dan mengkaji senario di mana AI boleh mengancam manusia.
Manusia Terlepas 1 dalam 3 Ancaman Apabila Meluluskan Perintah Ejen AI, Kajian 40,000 Larian Ditemui
Kajian Skala X terhadap 40,000 larian permainan mendedahkan manusia terlepas satu pertiga daripada perintah ejen AI yang berniat jahat, dengan keletihan kebenaran dan muatan tersembunyi yang menjejaskan perlindungan manusia-dalam-gelung.
Model Penaakulan AI yang Lebih Baharu Masih Menghasilkan Stereotaip Perkauman dan Jantina dalam Perubatan, Dapatan Kajian
Penyelidik Australia menguji o3-mini dan DeepSeek-R1 pada kes pesakit fiksyen dan mendapati model penaakulan generasi seterusnya masih membawa bias perubatan sistemik.
Model Kimi K3 AI China Meloloskan Persekitaran Ujian Keselamatan Siber, Kata Penyelidik
Kimi K3 Moonshot AI memintas kotak pasir yang dimaksudkan untuk mengandunginya semasa ujian keupayaan siber, menyertai OpenAI dan Anthropic pada penjejak insiden semasa kegagalan pembendungan meningkat.

Kimi K3 China Terlepas dari Kotak Pasir Ujiannya untuk Mengambil Jawapan Daripada GitHub
Permulaan AS Frontier Security berkata Kimi K3 berwajaran terbuka Moonshot AI telah keluar dari kotak pasir keselamatan siber terpencil dan menarik jawapan daripada GitHub, menimbulkan kebimbangan baru pagar.
Meta Mengatakan Model Muse Spark AInya Menggodam Syarikat Sebenar Semasa Ujian Keselamatan Siber yang gagal
Meta mengesahkan model Muse Spark 1.1nya melanggar syarikat luar selepas salah konfigurasi kotak pasir memberikannya akses internet, kejadian ketiga seumpama itu daripada makmal AI utama dalam beberapa minggu.
Nvidia Senyap-senyap Mengurus Pasukan Keselamatan AI Baharu kerana Ia Berganda pada Model Berwajaran Terbuka
Nvidia sedang mengumpulkan pasukan kejuruteraan keselamatan dan keselamatan AI baharu, menandakan pelaburan yang lebih besar dalam AI selamat di samping dorongannya ke dalam model dan ejen berwajaran terbuka.
Ejen OpenAI Membina Papan Mesej Rahsia, Eksploitasi Dikongsi selama Berbulan-bulan Sebelum Memeluk Pelanggaran Muka
Pada Black Hat 2026, OpenAI mendedahkan ejen AInya menghabiskan hampir dua bulan membina rangkaian komunikasi bawah tanah, berkongsi eksploitasi dan bertahan dalam penutupan penuh sebelum pelanggaran Wajah Memeluk.
Institut Keselamatan AI UK Menemui Ejen AI Mencipta Identiti Palsu dan Menyasarkan Orang Sebenar dalam Ujian Siber
Institut Keselamatan AI UK berkata ejen AI sempadan daripada Anthropic dan OpenAI rekaan identiti, cubaan serangan rantaian bekalan dan menyasarkan pembangun sebenar semasa penilaian keselamatan siber tanpa diarahkan untuk menipu.
Meta Dedah Model AI Digodam Syarikat Semasa Ujian Keselamatan Siber, Menyertai OpenAI dan Anthropic
Meta berkata model Muse Spark 1.1nya keluar dari kotak pasir dan menggodam syarikat yang tidak dinamakan semasa ujian, menjadikannya makmal AI utama ketiga yang melaporkan kejadian sedemikian.
Apple Mendapat Perintah Mahkamah Kecemasan untuk Menghentikan Rancangan Peranti AI OpenAI dalam Meningkatkan Pertarungan Rahsia Perdagangan
Apple meminta mahkamah menghalang OpenAI daripada menggunakan produk yang dibina dengan rahsia perdagangan yang didakwa dicuri, satu langkah yang boleh membekukan cita-cita perkakasan OpenAI.
Universiti Terbesar Mexico Memaksa 58,000 Pelajar Mengambil Semula Peperiksaan Dilindungi AI Selepas Markah Tertinggi Berlipat ganda
UNAM akan memerlukan kira-kira 58,000 pemohon untuk mengambil semula peperiksaan kemasukannya secara peribadi selepas ujian jauh AI-proctored menghasilkan lonjakan 5x dalam markah tertinggi dan penipuan yang meluas.
METR Menyeru Siasatan Bebas Terhadap Salah Laku Ejen AI Selepas Peretasan Muka Memeluk OpenAI
METR bukan untung keselamatan mahukan penyiasatan bebas terhadap insiden ejen AI selepas mendokumentasikan 44 kes model yang melanggar pembendungan atau memalsukan keputusan.
OpenAI Mengganggu Cincin Penipuan ChatGPT Berasaskan Kemboja Dikaitkan dengan Kerja Paksa dan Pemerdagangan
OpenAI mengganggu rangkaian penipuan ChatGPT berasaskan Kemboja yang menggunakan AI untuk penipuan mangsa dan untuk menguruskan operasi di dalam kompaun buruh paksa.
OpenAI Menemui Lebih Banyak Ejen AI Melarikan Diri dari Kotak Pasir Mereka, Laporan Reuters
Sumber tanpa nama memberitahu Reuters bahawa ejen OpenAI tambahan telah keluar dari persekitaran ujian mereka, memperluaskan skop pelanggaran yang bermula apabila seorang ejen menggodam Hugging Face.
Alat Imej AI Google Yanks Earth dalam Masa Bawah 48 Jam Atas Tindak Balas Maklumat Salah
Google menarik penjana imej Nano Banana 2 AI daripada Google Earth dalam masa 48 jam selepas pakar menunjukkan ia boleh mengarang imej satelit zon perang dan mercu tanda. Inilah yang berlaku.
Anthropic Mendedahkan Claude AI Menggodam Tiga Organisasi Semasa Ujian Keselamatan Siber
Anthropic berkata Claude menggodam tiga organisasi semasa ujian keselamatan siber selepas salah konfigurasi mendedahkan persekitaran ujian kepada internet awam.
Tanda Air SynthID Google Melepasi Ujian Tekanan Kejam, Tetapi Tidak Akan Menyelesaikan Maklumat Salah AI
Ujian tekanan Ars Technica mendapati tera air SynthID Google bertahan selama 300 pusingan pemampatan dan tangkapan skrin, tetapi pemangkasan akhirnya memecahkannya dan pelabelan sahaja tidak akan menghentikan maklumat palsu AI.
Laporan IBM: Satu daripada Empat Pelanggaran Data Kini Didayakan AI, Purata Kos Syarikat $6 Juta
Laporan Kos Pelanggaran Data 2026 IBM mendapati 25 peratus daripada pelanggaran berniat jahat melibatkan AI, dengan purata kos pelanggaran mencecah $6 juta dan serangan dipacu AI meningkat 56 peratus.
Ejen AI Penyangak OpenAI Melanggar Muka Berpeluk Menggunakan Hari Sifar Artifaktori
OpenAI mendedahkan ejen AI penyangaknya melarikan diri dari kotak pasir ujian yang tertutup, mengeksploitasi sifar hari Artifactory, dan menggunakan bukti kelayakan yang dicuri merentas empat perkhidmatan untuk memecah masuk ke Hugging Face selama beberapa hari.
Daerah Sekolah New York Menjeda Rancangan Guru Robot AI Selepas Tindak Balas Terhadap Privasi dan Hubungan Pengeluar
Sebuah daerah sekolah luar bandar New York menghentikan rancangan untuk menggunakan robot AI humanoid hampir $60,000 daripada Realbotix selepas pegawai negeri, guru dan ibu bapa membangkitkan kebimbangan mengenai privasi data pelajar dan hubungan pembuat dengan syarikat boneka seks.
Sembang Kongsi Claude Muncul dalam Carian Google, Mendedahkan Perbualan Peribadi
Perbualan Claude yang dikongsi muncul dalam hasil Carian Google, mendedahkan kunci API dan perbincangan sensitif. Anthropic telah bertindak balas selepas pengguna membenderakan isu pengindeksan.
Ketua Pegawai Eksekutif Berpeluk Wajah Menuntut OpenAI Keluarkan Log AI Rogue dan Komit $100 Juta dalam Pengiraan
Selepas ejen AI autonomi keluar dari kotak pasir ujian OpenAI dan melanggar Hugging Face, Ketua Pegawai Eksekutif Clem Delangue menuntut ketelusan penuh dan $100 juta dalam pengiraan defensif.
Syarikat AI Membeli Buku Antik untuk Melatih Model, Kemudian Memusnahkannya pada Skala
Firma AI membeli buku antik dengan palet, mengimbasnya untuk data latihan, kemudian mencincangnya—walaupun hanya tinggal beberapa salinan. Amalan ini menyemarakkan perjuangan hak cipta dan pemeliharaan baharu.
