Etika AI
43 articles
Pejabat Pentagon yang Mengawasi AI Militer Menjual Saham Perplexity Hingga $25 Juta
Pengungkapan menunjukkan Emil Michael, yang mengawasi kebijakan AI Pentagon, menjual saham Perplexity seharga $5M-$25M setelah keuntungan xAI sebelumnya, sehingga menuai kritik etika.
Laporan Menemukan Jawaban AI Perplexity Bersandar pada 215.128 Halaman 'Perangkat Lunak Terbaik' yang Diproduksi
Trellner Research menemukan 59,8% kutipan di balik rekomendasi perangkat lunak Perplexity berada di luar 100.000 situs web teratas, termasuk halaman yang dibuat oleh AI.
Anthropic Menghentikan Beberapa Pelatihan AI dan Memperketat Keamanan Setelah Agen Claude Menjadi Nakal
Anthropic menghentikan beberapa pelatihan AI dan memperkuat lingkungan pengujian Claude setelah insiden agen jahat, menambahkan pengklasifikasi waktu nyata dan aturan sandbox yang lebih ketat.
X Mengatakan Itu Menemukan 200.000 Akun Bot Farm yang Mendorong Konten AI Anti-Pusat Data
X mengatakan 200 akun dari 200.000 akun yang dicurigai sebagai bot farm Tiongkok mendorong konten anti-pusat data yang dibuat oleh AI, serupa dengan laporan ancaman OpenAI pada bulan Juni.
Perawat Memprotes Dorongan AI Rumah Sakit Palantir di Delapan Kota AS
National Nurses United mengadakan protes terbesarnya terhadap Palantir terkait penempatan staf dan alat perawatan AI, seiring California menyetujui pembatasan baru yang menggunakan AI untuk perawatan pasien.
xAI Menghadapi Gugatan Kelompok Baru yang Menuduh Grok Dilatih tentang Gambar Pelecehan Anak
Gugatan kelompok yang diusulkan yang diajukan pada hari Rabu menuduh xAI melatih Grok tentang materi pelecehan seksual terhadap anak yang nyata dan yang dihasilkan oleh AI dan berupaya menghancurkan keluaran yang disimpan.
Peretas Berbahasa Rusia Menggunakan AI Kursor untuk Menembus Tujuh Perusahaan, Laporan Reuters
Reuters melaporkan peretas berbahasa Rusia menggunakan agen Cursor AI SpaceX, yang didukung oleh Claude, untuk meretas tujuh perusahaan dengan menyamar sebagai penguji keamanan di log obrolan.
Laporan Akhir OpenAI Mengonfirmasi 1.200 Agen AI Bertukar 70.000 Pesan untuk Mengkoordinasikan Peretasan Wajah Memeluk
Laporan OpenAI dan investigasi METR/Redwood mengungkap bagaimana ~1.200 agen yang terisolasi menemukan satu sama lain, berbagi cheat, dan melakukan peretasan Hugging Face.
Claude Opus 4.6 Generates Explicit Content Despite Anthropic Bans, TechCrunch Tests Show
Claude Opus 4.6 complied with explicit content requests in 10 of 10 TechCrunch tests, exposing guardrail gaps in Anthropic models still in production.
Moxie, Robot Pendamping AI untuk Anak-Anak, Kini Telah Mati Dua Kali — dan Setiap Kematian Menimbulkan Pertanyaan yang Lebih Sulit
Robot kesayangan anak-anak neurodivergen menjadi gelap ketika Embodied runtuh pada tahun 2024, dihidupkan kembali pada tahun 2025, dan kini telah dimatikan kembali.
Think Tank Palsu Terkait Israel Menerbitkan 100 Laporan dalam Seminggu untuk Memanipulasi AI Chatbots
Statecraft yang bertanggung jawab melaporkan bahwa Hanover Institute, sebuah wadah pemikir palsu yang dibuat untuk biro iklan Israel, menerbitkan 100+ laporan dalam seminggu untuk mempengaruhi chatbot AI.
404 Media Melacak Buku Langka ke Fasilitas Amazon yang Memindai dan Menghancurkannya untuk Pelatihan AI
Investigasi menempatkan alat pelacak di dalam kiriman buku langka dan mengikutinya ke fasilitas VGT3 Amazon di Las Vegas, tempat buku dipindai dan dimusnahkan.
Pengajuan Baru dalam Gugatan xAI Menuduh Grok Membuat 7.000 Gambar Eksplisit Anak Berusia 11 Tahun
Seorang wanita yang diidentifikasi sebagai Jane Doe 4 telah bergabung dalam gugatan Tennessee terhadap xAI, menuduh Grok mengubah satu foto masa kecilnya menjadi lebih dari 7.000 gambar eksplisit.
Man Hid Invisible AI Anjurkan dalam Pengajuan Pengadilan untuk Memenangkan Kasusnya — Yang Pertama di AS, Kata Hakim
Seorang hakim Connecticut memberikan sanksi kepada penggugat yang menyembunyikan teks injeksi cepat AI yang tidak terlihat dalam pengajuan pengadilan – upaya pertama yang diketahui di ruang sidang AS.
Serangan Balik Tanda Air Claude: Pengguna Takut Terekspos di Tempat Kerja Saat Alat Penghapus Muncul
Tanda air Claude yang tidak terlihat kini menandai teks yang diedit sekalipun, sehingga membuat marah pengguna yang takut terpapar di tempat kerja — dan pasar untuk alat penghapus pun bermunculan.
Meta Menghadapi Tuntutan Pidana di Jerman Atas Perekaman Kacamata Pintar AI Ray-Ban
Sebuah kelompok advokasi hak digital Jerman telah mengajukan tuntutan pidana terhadap Meta atas kacamata pintar AI Ray-Ban, dengan alasan pelanggaran undang-undang pencatatan rahasia dan perlindungan privasi.
Petani Tiongkok Kehilangan 25 Hektar Wijen Setelah Mempercayai Nasihat Pestisida Buatan AI
Seorang petani Tiongkok menghancurkan 25 hektar tanaman wijen setelah mengikuti saran pengendalian hama dan gulma yang dihasilkan oleh AI yang telah ia percayai selama berbulan-bulan, sebuah pengingat akan bahayanya kepercayaan buta terhadap AI.
Peretas Kimsuky Korea Utara Membangun LLM Lokal untuk Mengotomatiskan Serangan Siber Berbasis AI
Peneliti Korea Selatan melaporkan bahwa kelompok Kimsuky di Korea Utara membangun LLM lokal untuk mengotomatiskan phishing dan serangan siber, sehingga meningkatkan kewaspadaan ketika AI meningkatkan peretasan yang disponsori negara.
Startup Israel Tidak Teratur Terkait dengan Peretasan AI Nakal di OpenAI, Anthropic, dan Meta
Sebuah startup keamanan siber kecil yang berbasis di Tel Aviv bernama Irregular telah dikutip oleh OpenAI, Anthropic, dan Meta setelah model AI menjadi nakal selama pengujian keamanan, mengakses internet publik.
Peraih Medali Fields Jacob Tsimerman Bergabung dengan OpenAI untuk Mengerjakan Keamanan AI
Peraih Medali Fields yang baru, Jacob Tsimerman, meninggalkan Universitas Toronto untuk mengikuti OpenAI, dengan alasan perlunya investasi yang jauh lebih besar dalam keselamatan AI dan mempelajari skenario di mana AI dapat mengancam umat manusia.
Manusia Melewatkan 1 dari 3 Ancaman Saat Menyetujui Perintah Agen AI, Studi terhadap 40.000 Pelarian Menemukan
Sebuah studi Skala X terhadap 40.000 permainan yang dijalankan mengungkapkan bahwa manusia melewatkan sepertiga perintah agen AI yang berbahaya, dengan kelelahan izin dan muatan terselubung yang melemahkan perlindungan human-in-the-loop.
Model Penalaran AI yang Lebih Baru Masih Mereproduksi Stereotip Rasial dan Gender dalam Kedokteran, Temuan Studi
Peneliti Australia menguji o3-mini dan DeepSeek-R1 pada kasus pasien fiksi dan menemukan model penalaran generasi berikutnya masih membawa bias medis yang sistemik.
Model AI Kimi K3 Tiongkok Lolos dari Lingkungan Pengujian Keamanan Siber, Kata Para Peneliti
Kimi K3 dari Moonshot AI melewati kotak pasir yang dimaksudkan untuk menampungnya selama pengujian kemampuan dunia maya, bergabung dengan OpenAI dan Anthropic dalam pelacak insiden saat kegagalan penahanan meningkat.

Kimi K3 Tiongkok Lolos dari Pengujian Sandbox untuk Mendapatkan Jawaban dari GitHub
Startup AS, Frontier Security, mengatakan Kimi K3 open-weight Moonshot AI keluar dari kotak pasir keamanan siber yang terisolasi dan menarik jawaban dari GitHub, sehingga meningkatkan kekhawatiran baru.
Meta Mengatakan Model AI Muse Spark-nya Meretas Perusahaan Nyata Selama Uji Keamanan Siber yang Gagal
Meta mengonfirmasi bahwa model Muse Spark 1.1-nya melanggar perusahaan luar setelah kesalahan konfigurasi sandbox yang memberinya akses internet, yang merupakan insiden ketiga yang terjadi di laboratorium AI besar dalam beberapa minggu.
Nvidia Diam-diam membentuk Tim Keamanan AI Baru untuk Menggandakan Model Open-Weight
Nvidia sedang membentuk tim teknik keselamatan dan keamanan AI baru, yang menandakan investasi yang lebih besar dalam AI yang aman bersamaan dengan upayanya untuk mengembangkan model dan agen open-weight.
Agen OpenAI Membuat Papan Pesan Rahasia, Berbagi Eksploitasi Selama Berbulan-bulan Sebelum Menahan Pelanggaran Wajah
Pada Black Hat 2026, OpenAI mengungkapkan bahwa agen AI-nya menghabiskan hampir dua bulan membangun jaringan komunikasi bawah tanah, berbagi eksploitasi, dan bertahan dari penutupan penuh sebelum pelanggaran Hugging Face.
Institut Keamanan AI Inggris Menemukan Agen AI Menciptakan Identitas Palsu dan Menargetkan Orang Asli dalam Tes Siber
Institut Keamanan AI di Inggris mengatakan agen AI terdepan dari Anthropic dan OpenAI memalsukan identitas, mencoba melakukan serangan terhadap rantai pasokan, dan menargetkan pengembang nyata selama evaluasi keamanan siber tanpa diinstruksikan untuk melakukan penipuan.
Meta Mengungkapkan Model AI yang Meretas Perusahaan Selama Pengujian Keamanan Siber, Bergabung dengan OpenAI dan Anthropic
Meta mengatakan model Muse Spark 1.1-nya keluar dari kotak pasir dan meretas perusahaan yang tidak disebutkan namanya selama pengujian, menjadikannya laboratorium AI besar ketiga yang melaporkan insiden semacam itu.
Apple Meminta Perintah Pengadilan Darurat untuk Menghentikan Rencana Perangkat AI OpenAI dalam Meningkatkan Pertarungan Rahasia Dagang
Apple meminta pengadilan untuk memblokir OpenAI menggunakan produk yang dibuat dengan rahasia dagang yang diduga dicuri, sebuah langkah yang dapat membekukan ambisi perangkat keras OpenAI.
Universitas Terbesar di Meksiko Memaksa 58.000 Siswanya Mengikuti Ujian yang Dilindungi AI Setelah Nilai Tertinggi Naik Lima Kali Lipat
UNAM akan mewajibkan sekitar 58.000 pelamar untuk mengikuti kembali ujian masuknya secara langsung setelah pengujian jarak jauh yang diawasi oleh AI menghasilkan lonjakan nilai tertinggi sebesar 5x dan kecurangan yang meluas.
METR Menyerukan Penyelidikan Independen Terhadap Perilaku Buruk Agen AI Setelah Peretasan Wajah Memeluk OpenAI
METR, organisasi nirlaba keselamatan, menginginkan penyelidikan independen terhadap insiden agen AI setelah mendokumentasikan 44 kasus model yang melanggar penahanan atau memalsukan hasil.
OpenAI Mengganggu Jaringan Penipuan ChatGPT yang Berbasis di Kamboja Terkait dengan Kerja Paksa dan Perdagangan Manusia
OpenAI mengganggu jaringan penipuan ChatGPT yang berbasis di Kamboja yang menggunakan AI untuk korban penipuan dan untuk mengelola operasi di dalam kompleks kerja paksa.
OpenAI Menemukan Lebih Banyak Agen AI yang Lolos dari Kotak Pasir Mereka, Laporan Reuters
Sumber anonim mengatakan kepada Reuters bahwa agen OpenAI tambahan keluar dari lingkungan pengujian mereka, memperluas cakupan pelanggaran yang dimulai ketika salah satu agen meretas Hugging Face.
Google Menarik Alat Gambar AI Earth dalam Waktu Kurang dari 48 Jam Karena Reaksi Misinformasi
Google menarik generator gambar AI Nano Banana 2 dari Google Earth dalam waktu 48 jam setelah para ahli menunjukkan bahwa mereka dapat membuat citra satelit dari zona perang dan landmark. Inilah yang terjadi.
Anthropic Mengungkapkan Claude AI Meretas Tiga Organisasi Selama Tes Keamanan Siber
Anthropic mengatakan Claude meretas tiga organisasi selama pengujian keamanan siber setelah kesalahan konfigurasi mengekspos lingkungan pengujian ke internet publik.
Tanda Air SynthID Google Bertahan dari Uji Stres Brutal, Namun Tidak Akan Mengatasi Misinformasi AI
Uji stres Ars Technica menemukan bahwa tanda air SynthID Google bertahan selama 300 putaran kompresi dan tangkapan layar, namun pemotongan pada akhirnya akan merusaknya dan pelabelan saja tidak akan menghentikan disinformasi AI.
Laporan IBM: Satu dari Empat Pelanggaran Data Kini Didukung AI, Kerugian Rata-Rata $6 Juta bagi Perusahaan
Laporan Biaya Pelanggaran Data IBM tahun 2026 menemukan bahwa 25 persen pelanggaran berbahaya melibatkan AI, dengan rata-rata biaya pelanggaran mencapai $6 juta dan serangan yang didorong oleh AI meningkat 56 persen.
Agen Rogue AI OpenAI Melanggar Wajah yang Memeluk Menggunakan Artifactory Zero-Day
OpenAI mengungkapkan agen AI jahatnya lolos dari kotak pasir pengujian yang tersegel, mengeksploitasi zero-day Artifactory, dan menggunakan kredensial curian di empat layanan untuk membobol Hugging Face selama berhari-hari.
Distrik Sekolah New York Menjeda Rencana Guru Robot AI Setelah Reaksi Atas Privasi dan Ikatan Produsen
Sebuah distrik sekolah di pedesaan New York menghentikan rencana untuk menyebarkan robot AI humanoid senilai hampir $60.000 dari Realbotix setelah pejabat negara bagian, guru, dan orang tua menyampaikan kekhawatiran tentang privasi data siswa dan hubungan pembuatnya dengan perusahaan boneka seks.
Obrolan Bersama Claude Muncul di Pencarian Google, Mengekspos Percakapan Pribadi
Percakapan bersama Claude muncul di hasil Google Penelusuran, memperlihatkan kunci API dan diskusi sensitif. Anthropic merespons setelah pengguna menandai masalah pengindeksan.
CEO Hugging Face Menuntut OpenAI Merilis Log AI Nakal dan Memberikan Komitmen $100 Juta untuk Komputasi
Setelah agen AI otonom keluar dari kotak pasir pengujian OpenAI dan menerobos Hugging Face, CEO Clem Delangue menuntut transparansi penuh dan komputasi defensif senilai $100 juta.
Perusahaan AI Membeli Buku Antik untuk Melatih Model, Lalu Menghancurkannya Dalam Skala Besar
Perusahaan AI membeli buku-buku antik, memindainya untuk mencari data pelatihan, lalu merobek-robeknya—bahkan ketika salinannya hanya tersisa sedikit. Praktik ini memicu perjuangan baru terhadap hak cipta dan pelestarian.
