Anthropic pada hari Khamis menerbitkan laporan risikan ancaman September 2026, "Mengesan dan menentang penyalahgunaan AI," yang menerangkan cara pasukan Perisikan Ancamannya mengenal pasti dan mengganggu pelakon ancaman yang menyalahgunakan Claude antara Disember 2025 dan Ogos 2026. Kes-kes itu merangkumi tujuh bidang bahaya yang berbeza: operasi siber, operasi pengaruh, pengawasan dan penipuan, penipuan dan model senjata illiologikal. penyulingan. Menurut syarikat itu, setiap kempen yang diterangkannya telah terganggu, dan risikan telah dikongsi dengan pihak berkuasa dan rakan kongsi industri jika sesuai.

Laporan itu tiba pada saat penelitian yang sengit untuk industri AI, dan untuk Anthropic khususnya, kerana berita terbaharu AI minggu ini telah dikuasai oleh pendedahan keselamatan, akaun pemberi maklumat dan tekanan yang semakin meningkat daripada penggubal undang-undang. Ia juga tiba bersama laporan dari The New York Times dan Politico yang menonjolkan percubaan untuk mempersenjatai model sempadan - termasuk usaha yang disekat berkaitan dengan pembangunan senjata biologi.

Cara Anthropic Menjejaki Pelakon Ancaman Didayakan AI

Anthropic menjejaki pelakon dalam laporannya di bawah penentu dalaman yang dikenali sebagai Kumpulan Ancaman Generatif, atau GTG. Setiap kajian kes mengukur apa yang syarikat panggil peningkatan — rangsangan keupayaan yang diberikan AI untuk operasi merentas tiga dimensi: kelajuan, skala dan kedalaman. Kes penyalahgunaan melibatkan model Claude Haiku, Sonnet, dan Opus. Tiada yang melibatkan model kelas Fable atau Mythos syarikat, kecuali satu kes penyulingan haram.

Anthropic merangka kesanggupannya untuk menerbitkan sebagai kewajipan dan bukannya latihan pemasaran, dengan menyatakan dalam laporan bahawa "kami percaya kami mempunyai tanggungjawab untuk mendedahkan penyalahgunaan perkhidmatan kami secara berniat jahat."

Operasi Berkaitan Blizzard Tengah Malam Yang Membina Semula Perisian Hasadnya Sendiri

Kes siber paling meluas dalam laporan itu, yang dijejaki sebagai GTG-20006, menggambarkan seorang pelakon yang atribusinya menurut Anthropic konsisten dengan laporan awam yang mengaitkannya dengan Midnight Blizzard, kumpulan penggodam sejajar negara Rusia yang dahulunya dikenali sebagai Nobelium atau APT29. Salah seorang pengendalinya, individu yang menggunakan pemegang "JackPoterz," ialah seorang penceramah Rusia.

Menurut laporan itu, kumpulan itu menyasarkan lebih daripada 20 organisasi, tertumpu di kalangan kerajaan, tentera, dan badan diplomatik Ukraine. Ia menjejaskan sekurang-kurangnya tiga vendor WiFi hotel untuk merampas rekod DNS, mengambil alih akaun WhatsApp sekurang-kurangnya dua bekas pegawai peringkat tinggi Ukraine, dan mencuri lebih daripada 300,000 rekod identiti negara bersama dengan data pendaftaran komersial yang meliputi lebih daripada setengah juta syarikat daripada pihak berkuasa teknologi kerajaan Afrika Utara.

Perincian yang paling menarik ialah penyesuaian autonomi: Anthropic melaporkan bahawa ejen AI pelakon itu mengubah suai dan membina semula perisian hasad kumpulan apabila produk keselamatan mengesannya — gelung yang sebelum ini memerlukan pembangun mahir atas permintaan.

Penuaian Tauliah pada Skala dan Pemburuan Sifar Hari Autonomi

Kes kedua, GTG-50014, meliputi pengendali yang disyaki mempunyai kaitan dengan kolektif ShinyHunters. Talian paip penuaian kelayakan mereka memuat turun 1.8 juta APK Android dan mengimbasnya untuk mencari rahsia berkod keras. Dalam satu kompromi penyedia teknologi, lebih daripada satu terabait data telah diasingkan, termasuk berjuta-juta rekod kad pembayaran. Ahli gabungan lain mengekstrak data daripada kira-kira 200 pelanggan hiliran penyedia perisian-sebagai-perkhidmatan yang dilanggar dan membuang lebih daripada 2,100 set token Azure AD yang merangkumi lebih 40 penyewa korporat dalam masa kira-kira 34 jam — dengan ejen AI melaksanakan hampir semua kerja, mengikut laporan itu.

GTG-10007 lebih menyedihkan untuk pemain pertahanan. Anthropic mengaitkan kluster ini kepada pengendali berbahasa Cina yang berkemungkinan berpangkalan di Changsha, Hunan — dua daripadanya dikenal pasti sebagai pelajar sarjana muda — yang menyasarkan kira-kira lima puluh organisasi dan menjalankan program penyelidikan kelemahan autonomi. Satu aliran kerja, berulang pada peralatan rangkaian, menghasilkan lebih daripada sedozen kemungkinan penemuan sifar hari dalam sebulan.

Peras ugut, Penggodam Keseorangan dan Serbuan Gagal ke atas Makmal AI

Ciri penyalahgunaan yang bermotifkan kewangan dengan ketara. GTG-50020, seorang pelakon berbahasa Rusia, mengeluarkan kira-kira 26 gigabait daripada seorang mangsa dan mencari antara $1.5 juta dan $2.5 juta dalam pemerasan. Kumpulan yang sama kemudian menyerang kira-kira tiga puluh syarikat AI dalam masa kira-kira empat hari dengan matlamat yang dinyatakan untuk mengakses model Claude pra-keluaran. Anthropic berkata setiap laluan percubaan gagal dan sistemnya sendiri tidak pernah terjejas.

Di hujung spektrum yang lain, GTG-50029 ialah seorang penggodam berbahasa Perancis tunggal yang mengeksploitasi syarat perlumbaan pemasangan semula WordPress yang tidak didokumenkan sebelum ini terhadap sekurang-kurangnya empat tapak, memperoleh akses dalaman kepada sekurang-kurangnya 14 daripada 42 sasaran yang dijejaki dan mengeksploit kira-kira 140,000 rekod — termasuk pendapat politik platform kempen pengguna. Pelakon itu kemudian membina platform doxxing, fafsearch, sarat dengan berpuluh-puluh juta baris.

Mempengaruhi Operasi Dari Republik Afrika Tengah ke Malaysia

Sembilan kes operasi pengaruh dalam laporan itu berasal dari Rusia, Iran, Turki, Teluk, Asia Selatan, Afrika dan Eropah, dengan jangkauan diukur pada Skala Pelarian Institusi Brookings. Dalam satu kes, GTG-04001, seorang pelakon berbahasa Rusia yang berpangkalan di Bangui menghasilkan kandungan harian untuk Radio Lengo Songo, stesen Anthropic yang dikaitkan dengan Politology — cabang pengaruh Kor Afrika dan Wagner yang dinilainya berada di bawah kawalan Perkhidmatan Perisikan Asing Rusia pada akhir 2023. Operasi yang menghasilkan dokumen palsu kerajaan Republik Afrika Tengah dan kontrak pekerjaan yang mewajibkan kesetiaan Rusia kepada Rusia dan kontrak pekerjaan yang diwajibkan oleh Catgo. pada skala.

Rangkaian lain, GTG-54002, telah dikesan kepada Syarikat LKM, sebuah agensi pengiklanan digital yang berpangkalan di Perancis yang mengendalikan kira-kira 70 laman web berita rekaan, 70 akaun X yang sepadan dan lebih daripada 250 akaun pengulas yang tidak sahih. Rangkaian itu menerbitkan sekurang-kurangnya 8,913 artikel dalam kira-kira 20 bahasa, 318 daripadanya memfokuskan pada Republik Demokratik Congo.

Pilihan raya juga menjadi sasaran. GTG-84005, platform manipulasi pilihan raya komersial yang menyasarkan Malaysia yang dikaitkan dengan Anthropic dengan BBS Bilisim Teknolojileri yang berpangkalan di Istanbul, menguruskan kira-kira 1,000 akaun X palsu merentasi semua 222 kawasan parlimen Malaysia dan dokumen palsu terhadap seorang ahli politik pembangkang. Kluster berasingan, GTG-24015, menggunakan empat akaun sebagai meja editorial berbantukan AI yang memberi makan kepada media negara Rusia.

Mengapa Pendedahan Penting

Anthropic berkata ia mengganggu aktiviti dalam setiap kes, menggunakan penemuan itu untuk mengukuhkan perlindungannya, dan berkongsi risikan dengan pihak berkuasa dan rakan kongsi industri jika sesuai. Menerbitkan kajian kes terperinci — lengkap dengan analisis kegagalan pengesanannya sendiri — masih jarang berlaku di kalangan makmal sempadan, dan syarikat itu berpendapat bahawa ketelusan meningkatkan garis dasar untuk keseluruhan industri.

Laporan itu juga menggariskan peralihan yang tidak boleh diabaikan oleh pasukan keselamatan: operasi yang didayakan AI paling berbahaya yang diterangkan di sini bukanlah demonstrasi hipotesis tetapi kempen secara langsung terhadap kerajaan, syarikat dan pilihan raya. Apabila model berkembang dengan lebih berkebolehan, data Anthropic mencadangkan peningkatan yang mereka berikan kepada musuh yang ditentukan semakin bertambah — dan jawapan terbaik yang tersedia bagi pembela, buat masa ini, ialah keterlihatan, pendedahan dan lelaran yang lebih pantas pada perlindungan.

---

Kekal Mendahului AI

Dapatkan berita, analisis dan penemuan terkini AI — semuanya di satu tempat.

Baca lebih banyak berita AI →