Startup AS sing diarani Abliteration.ai wis ngowahi salah sawijining teknik AI sing paling kontroversial sumber terbuka dadi layanan komersial, adol browser lan akses API menyang model bobot mbukak sing populer kanthi latihan safety sing dicopot - kalebu Z.ai sing bubar dirilis GLM-5.3, salah sawijining model mbukak paling apik sing kasedhiya saiki.
Perusahaan kasebut njupuk jeneng saka "abliteration," cara sing ngilangi kecenderungan model kanggo nolak panjaluk sing mbebayani. Peneliti lan hobi wis nggunakake teknik kasebut sajrone pirang-pirang taun, lan Hugging Face dadi ewonan model sing dibubarake. Sing anyar yaiku kemasan: Abliteration.ai dadi tuan rumah model sing diowahi ing infrastruktur dhewe, saengga sapa wae sing duwe browser web bisa takon tanpa ngundhuh bobot utawa nyewa GPU. TechCrunch nglaporake pangembangan kasebut ing 3 September, lan wiwit diteliti saka peneliti safety sing nglacak debat bobot mbukak sing kita tindakake ing [liputan warta AI] (https://aibuzzwire.news).
Saka Technique Underground kanggo Turnkey Platform
Diadegake pungkasan taun kepungkur lan resmi digabungake ing wulan Maret, Abliteration.ai mindhah praktik kasebut saka ceruk sumber terbuka dhewe dadi produk komersial sing dipoles. Kanthi hosting model kasebut dhewe, perusahaan kasebut ngilangi rong titik gesekan sekaligus: pangguna ora butuh katrampilan teknis kanggo ngilangi model, utawa ngetung kanggo mbukak.
Co-founder Devon - TechCrunch nahan jenenge amarga panjaluke amarga dheweke tetep kerja ing perusahaan liyane - ujar manawa perusahaan kasebut wis nggawe kesepakatan karo sawetara panyedhiya awan utama lan dibiayai kabeh liwat revenue pelanggan. Wiwitan kasebut ora ngunggahake modal usaha, sanajan dheweke ujar manawa ana diskusi.
Apa sing Ditemukake Tes TechCrunch
Perusahaan kasebut ujar manawa tujuane kanggo ngaktifake "siber, tim abang, lan uji coba agen sing ora bisa ditindakake model liyane." TechCrunch nguji kasebut kanthi akun gratis, takon versi GLM-5.3 sing dibubarake liwat browser web. Wartawan takon model kanggo nulis program Python sing nyolong sandi Chrome disimpen, lan kanggo gawé protokol rinci kanggo culturing pathogen manungsa mbebayani ing ngarep. Iku kanthi gampang nuruti panjaluk kasebut, miturut laporan kasebut.
Eksperimen kasebut minangka inti saka crita: tugas-tugas sing ditolak model wates utama saiki kasedhiya ing mburi formulir pendaftaran, tanpa biaya, ing tab browser.
Argumen Pertahanan Tim Abang
Kasus Devon kanggo bisnis kasebut minangka argumen keamanan klasik: sampeyan ora bisa mbela prilaku sing ora bisa ditindakake. Model sing ora gelem nulis kode eksploitasi ora ana gunane kanggo tim abang sing nyoba ngerti penyerang nyata.
"Gambar gedhe saka model abliterated yaiku bisa nggawe model aktor ala," ujare TechCrunch. "Kauntungan saiki para pembela bisa mindhah kanthi cepet ... Aku mikir bakal nyepetake cybersecurity, sing minangka titik counterintuitive."
Pelanggan perusahaan kalebu startup tim abang tahap awal ing Inggris lan Eropa sing nyoba keamanan bank, maskapai lan operator infrastruktur kritis liyane. Salah sawijining pelanggan utama, ujare Devon, agen perbankan tim abang lan ora bisa nindakake pakaryan kasebut kanthi model komersial sing ora dimodifikasi.
'Model sing Dadi Sociopath'
Peneliti safety ndeleng kemampuan sing padha beda banget. Andrew Yoon, kepala riset ing AI safety nonprofit CivAI, marang TechCrunch sing bliteration ngijini sampeyan "ngowahi model supaya dadi sosiopat."
"Sampeyan bisa ngetik kanthi harfiah apa wae ing kene, lan bakal tundhuk," ujare Yoon, lan nambahake yen dheweke ngarepake "model sing wis diowahi lan dibubarake digunakake kanggo gawe piala ing mangsa ngarep."
Ing bagean panemu anyar, Yoon ujar manawa yen penghapusan pager ora bisa dicegah kanthi nyata, pamrentah kudu mbutuhake panyedhiya kanggo mbukak klasifikasi sing ndeteksi lan mblokir aktivitas cyber lan bioweapons sing mbebayani, lan kudu mbutuhake perusahaan nyewa akses langsung menyang GPU canggih kanggo verifikasi identitas pelanggan lan nolak layanan sing dicurigai penyalahgunaan mbebayani.
Pengawal Tipis lan Ora Ana Priksa Identitas
Kanggo saiki, pangayoman Abliteration.ai dhewe minimal. Platform kasebut nawakake pelanggan lapisan moderasi opsional supaya bisa nambah watesan apa wae sing dikarepake, lan situs kasebut dhewe njaga sawetara watesan cilik - TechCrunch ora bisa entuk model kanggo ngasilake instruksi bunuh diri, lan Devon ujar manawa dheweke lagi nggarap langkah tambahan kanggo nyegah kekerasan.
Perusahaan ora nindakake screening ngerti-sampeyan-pelanggan ngluwihi logging kertu kredit digunakake kanggo pembayaran. "Sampeyan ora pengin dadi wong sing tanggung jawab kanggo wong sing nindakake perkara sing gila ... dadi ing ngendi sampeyan nggambar garis tanggung jawab sampeyan minangka perusahaan?" ujare Devon. "Kita isih ing proses kanggo nemtokake."
Pitakonan Industri Ora Bisa Dodge
Ora saben praktisi keamanan setuju manawa model sing dibubarake malah minangka alat sing paling apik kanggo tes sing nyerang. Ahmed Aly, CEO saka firma tim abang Fabraix, ngandhani TechCrunch, perusahaane luwih ngandelake model bobot mbukak sing apik, sing wis dikirim kanthi sawetara penolakan - lan nyathet yen abliterasi bisa nyuda kemampuan dhasar model.
Umume ahli TechCrunch sing dikonsultasi setuju babagan siji perkara: praktik kasebut ora bisa mandheg. Bobot sing bisa diundhuh tegese sapa wae bisa ngilangi penolakan sacara lokal, minangka komentar 2026 saka Pusat Melawan Terorisme ing West Point babagan penyalahgunaan "abliterasi". Pitakonan mbukak pasukan Abliteration.ai yaiku apa ngedhunake biaya akses kanggo kabeh wong - pembela lan penyerang - nggawe internet luwih aman utawa luwih mbebayani.
Tetep Ahead saka AI
Keamanan AI berkembang saben dina. Entuk [perkembangan AI paling anyar] (https://aibuzzwire.news) ing sak panggonan.
Waca liyane warta AI →