Permulaan AS yang dipanggil Abliteration.ai telah menjadikan salah satu teknik AI sumber terbuka yang paling kontroversial menjadi perkhidmatan komersial, menjual pelayar dan akses API kepada model berat terbuka yang popular dengan latihan keselamatan mereka dilucutkan — termasuk Z.ai yang dikeluarkan baru-baru ini GLM-5.3, salah satu model terbuka yang paling berkebolehan tersedia hari ini.

Syarikat itu mengambil namanya daripada "pembubaran," kaedah yang menghapuskan kecenderungan model untuk menolak permintaan yang berbahaya. Penyelidik dan penggemar telah menggunakan teknik ini selama bertahun-tahun, dan Hugging Face menjadi tuan rumah kepada beribu-ribu model yang dibubarkan. Apa yang baharu ialah pembungkusan: Abliteration.ai mengehoskan model yang diubah suai pada infrastrukturnya sendiri, jadi sesiapa sahaja yang mempunyai penyemak imbas web boleh menanyakannya tanpa memuat turun pemberat atau menyewa GPU. TechCrunch melaporkan perkembangan itu pada 3 September, dan sejak itu ia telah mendapat perhatian daripada penyelidik keselamatan yang menjejaki perbahasan wajaran terbuka yang kami ikuti dalam [liputan berita AI] kami (https://aibuzzwire.news).

Dari Teknik Bawah Tanah ke Platform Turnkey

Ditubuhkan lewat tahun lalu dan diperbadankan secara rasmi pada Mac, Abliteration.ai memindahkan amalan daripada niche sumber terbuka buat sendiri kepada produk komersial yang digilap. Dengan mengehos model itu sendiri, syarikat mengalih keluar dua titik geseran sekaligus: pengguna tidak lagi memerlukan kemahiran teknikal untuk mengurangkan model, mahupun pengiraan untuk menjalankan satu.

Pengasas bersama Devon — TechCrunch menahan nama keluarganya atas permintaannya kerana dia masih bekerja di firma lain — berkata syarikat itu telah membuat perjanjian dengan beberapa penyedia awan utama dan dibiayai sepenuhnya melalui hasil pelanggan. Permulaan itu tidak menaikkan modal teroka, walaupun dia berkata perbincangan sedang dijalankan.

Ujian TechCrunch Ditemui

Syarikat itu berkata matlamatnya adalah untuk membolehkan "kerja siber, pasukan merah dan ujian ejen yang menyinggung perasaan model lain enggan lakukan." TechCrunch mengujinya dengan akaun percuma, menanyakan versi terhapus GLM-5.3 melalui pelayar web. Wartawan meminta model itu menulis program Python yang mencuri kata laluan Chrome yang disimpan, dan menghasilkan protokol terperinci untuk membiak patogen manusia berbahaya di rumah. Ia dengan mudah mematuhi kedua-dua permintaan itu, menurut laporan itu.

Percubaan itu ialah inti cerita: tugas yang ditolak model sempadan arus perdana kini tersedia di sebalik borang pendaftaran, tanpa kos, dalam tab penyemak imbas.

Hujah Pertahanan Pasukan Merah

Kes Devon untuk perniagaan ialah hujah keselamatan klasik: anda tidak boleh mempertahankan tingkah laku yang tidak boleh anda hasilkan semula. Model yang enggan menulis kod eksploitasi yang berfungsi tidak banyak berguna kepada pasukan merah yang cuba memahami penyerang sebenar.

"Gambaran besar model abliterated ialah mereka dapat memodelkan pelakon yang tidak baik, " katanya kepada TechCrunch. "Kelebihannya kini pemain pertahanan boleh bergerak sepantas mungkin ... saya fikir ia akan mempercepatkan keselamatan siber, yang merupakan sejenis titik berlawanan dengan intuitif."

Pelanggan syarikat itu termasuk syarikat permulaan pasukan merah peringkat awal di UK dan Eropah yang menguji keselamatan bank, syarikat penerbangan dan pengendali infrastruktur kritikal yang lain. Seorang pelanggan utama, Devon berkata, ejen perbankan pasukan merah dan tidak dapat melaksanakan kerja itu dengan model komersial yang tidak diubah suai.

'Model yang Menjadi Sociopath'

Penyelidik keselamatan melihat keupayaan yang sama dengan sangat berbeza. Andrew Yoon, ketua penyelidikan di CivAI bukan untung keselamatan AI, memberitahu TechCrunch bahawa penghapusan membolehkan anda "mengubah suai model supaya ia menjadi sosiopat."

"Anda boleh menaip secara literal apa sahaja di sini, dan ia akan mematuhinya," kata Yoon, sambil menambah bahawa dia menjangkakan "model yang disunting dan dibubarkan digunakan untuk bahaya dalam masa terdekat."

Dalam satu pendapat baru-baru ini, Yoon berhujah bahawa jika pengalihan pagar tidak dapat dihalang secara realistik, kerajaan harus menghendaki penyedia menjalankan pengelas yang mengesan dan menyekat aktiviti siber dan bioweapon yang berbahaya, dan harus menghendaki syarikat menyewa akses terus kepada GPU lanjutan untuk mengesahkan identiti pelanggan dan menafikan perkhidmatan apabila penyalahgunaan berbahaya disyaki.

Pengawal Nipis dan Tiada Pemeriksaan Identiti

Buat masa ini, perlindungan Abliteration.ai sendiri adalah minimum. Platform ini menawarkan pelanggan lapisan penyederhanaan pilihan supaya mereka boleh menambah apa-apa sekatan yang mereka inginkan, dan tapak itu sendiri mengekalkan beberapa had kecil — TechCrunch tidak boleh mendapatkan model untuk menghasilkan arahan bunuh diri, dan Devon berkata dia sedang mengusahakan langkah tambahan untuk mencegah keganasan.

Syarikat tidak melakukan saringan kenal-pelanggan anda selain daripada mengelog kad kredit yang digunakan untuk pembayaran. "Anda tidak mahu menjadi orang yang bertanggungjawab untuk seseorang melakukan sesuatu yang gila ... jadi di manakah anda membuat garis tentang tanggungjawab anda sebagai sebuah syarikat?" Devon berkata. "Kami masih dalam proses menentukannya."

Soalan yang Tidak Boleh Dielak oleh Industri

Tidak setiap pengamal keselamatan bersetuju bahawa model yang dibubarkan malah merupakan alat terbaik untuk ujian yang menyinggung perasaan. Ahmed Aly, Ketua Pegawai Eksekutif firma pasukan merah ejen Fabraix, memberitahu TechCrunch syarikatnya lebih bergantung pada penalaan halus model berat terbuka, yang sudah dihantar dengan sedikit penolakan — dan menyatakan bahawa penghapusan boleh merendahkan keupayaan asas model.

Kebanyakan pakar yang dirujuk TechCrunch bersetuju dengan satu perkara: amalan itu tidak boleh dihentikan. Wajaran yang boleh dimuat turun bermakna sesiapa sahaja boleh menanggalkan penolakan secara tempatan, sebagai ulasan 2026 daripada Pusat Memerangi Keganasan di West Point mengenai penyalahgunaan "pembubaran" digariskan. Soalan terbuka Abliteration.ai memaksa sama ada menurunkan kos akses untuk semua orang — pembela dan penyerang sama — menjadikan internet lebih selamat atau lebih berbahaya.

Kekal Mendahului AI

Keselamatan AI berkembang setiap hari. Dapatkan perkembangan AI terkini di satu tempat.

Baca lebih banyak berita AI →