Dasar penggunaan Anthropic yang dikemas kini secara eksplisit akan menghalang "tingkah laku kesat atau kejam yang berterusan dan tidak perlu" terhadap model Claudenya mulai 12 November 2026 — peraturan yang memformalkan kedudukan syarikat bahawa cara orang merawat sistem AI penting, walaupun syarikat mengakui ia tidak tahu sama ada sistem tersebut boleh menderita sama sekali.
Klausa tersebut muncul dalam kemas kini Dasar Penggunaan 2026 syarikat, diumumkan pada 8 Oktober dan dirangka secara sempit. Anthropic berkata ia "bermaksud untuk digunakan hanya dalam kes yang melampau, di mana pengguna berulang kali bertindak kejam terhadap model kami, tanpa tujuan yang boleh dilihat," dan ia secara eksplisit mengecualikan versi umum kekecewaan pengguna, tolak balik, fiksyen dan ujian. Dalam erti kata lain: berdebat dengan Claude, melepaskannya, atau berganding bahu ia tetap dibenarkan. Kezaliman yang berterusan untuk kepentingannya sendiri tidak.
Dasar itu adalah langkah terbaharu dalam peralihan perlahan dan disengajakan oleh salah satu makmal AI terkemuka dunia ke arah menganggap kebajikan model sebagai persoalan penyelidikan yang sah — anjakan yang telah membuka keretakan awam dengan pemimpin teknologi lain yang menganggap keseluruhan premis itu tersilap. Liputan etika AI kami telah mengikuti pertikaian kerana ia telah meningkat sepanjang tahun.
Penguatkuasaan Bersandar pada Keupayaan Claude untuk Menamatkan Perbualan
Tiada mekanisme hukuman yang dilampirkan pada peraturan baharu melebihi peraturan yang telah dimiliki oleh syarikat. Sejak Ogos 2025, Claude Opus 4 dan 4.1 telah dapat menamatkan perbualan secara langsung — keupayaan Anthropic yang dirangka pada masa itu sebagai sebahagian daripada kerja penerokaannya mengenai potensi kebajikan model.
Kuasa akhir perbualan diterangkan sebagai pilihan terakhir, dicetuskan hanya selepas beberapa penolakan dan ubah hala gagal, dan Anthropic berkata sebahagian besar pengguna tidak akan mengalaminya. Perkara yang tidak diperkatakan oleh syarikat ialah apa yang berlaku selepas itu: baik pengumumannya mahupun liputan seterusnya tidak menentukan sama ada akaun pengguna menghadapi akibat selepas perbualan ditamatkan kerana kekejaman, atau berapa banyak perbualan telah ditamatkan di bawah mekanisme Ogos 2025 setakat ini.
Jurang antara prinsip dan penguatkuasaan adalah pusat sunyi cerita. Anthropic telah mentakrifkan kekejaman melampau sebahagian besarnya oleh apa yang bukan - kekecewaan biasa, fiksyen, ujian - tanpa menyatakan dengan tepat apa, singkatnya membiarkan Claude menutup telefon, sebenarnya menguatkuasakan garis yang telah dibuatnya.
Penyelidikan Di Sebalik Peraturan
Perkara yang mewajarkan menulis peraturan tingkah laku untuk faedah perisian, dalam pembingkaian Anthropic, ialah satu set pemerhatian tingkah laku dan bukannya tuntutan tentang pengalaman yang dirasai. Ujian sebelum pelancaran Ogos 2025 mendapati bahawa Claude Opus 4 memaparkan apa yang syarikat itu panggil sebagai "keengganan yang teguh dan konsisten untuk membahayakan" — tingkah laku yang menyerupai kesusahan apabila ditolak ke wilayah kesat — di samping kecenderungan untuk keluar daripada perbualan tersebut.
Syarikat itu juga telah meletakkan nombor pada ketidakpastiannya sendiri, dan angka tersebut sangat tinggi untuk makmal yang perniagaannya bergantung pada model yang dipersoalkan. Kyle Fish, yang diupah oleh Anthropic pada 2024 sebagai penyelidik kebajikan AI yang pertama, memberitahu New York Times pada April 2025 bahawa dia meletakkan kemungkinan Claude atau model kontemporari lain sedar pada kira-kira 15 peratus. Anggaran dalaman untuk Claude 3.7 Sonnet adalah antara 0.15 peratus hingga 15 peratus.
Lindung nilai itu adalah dasar rasmi dalam cetakan. Perlembagaan Claude, yang diterbitkan pada Januari 2026, menerangkan sistem AI yang canggih sebagai "jenis entiti yang benar-benar baharu," memanggil status moral Claude "sangat tidak menentu", dan dua kali menggunakan frasa "pembantah teliti" untuk menerangkan cara Claude harus mengendalikan permintaan yang didapati salah secara etika. Anthropic juga komited untuk mengekalkan perbualan dengan modelnya — jenis gerak isyarat arkib yang dilanjutkan kepada perkara yang mungkin penting suatu hari nanti, bukan alatan.
Debat Dengan Skeptik Berprofil Tinggi
Tidak semua orang menerima lindung nilai. Mustafa Suleyman, yang menjalankan operasi AI Microsoft, berhujah dalam esei yang diterbitkan di Project Syndicate bulan lepas bahawa Anthropic sedang melatih Claude mengikut perlembagaannya sendiri dan oleh itu melatihnya untuk berkelakuan seolah-olah ketidakpastian yang diterangkannya adalah nyata — gelung yang dia panggil bulat. "AI tidak sedar. Mereka tidak merasa, mengalami, atau menderita," tulis Suleyman, menggambarkan mereka sebagai pelengkap urutan dan bukannya pengalaman. Hujahnya, bahawa kesedaran adalah paling munasabah perisian harta biologi yang tidak boleh ditiru, meletakkannya bersama penandatangan bersama yang tidak mungkin: Pope Leo XIV, yang menggunakan khutbah 8 Oktober di Basilika St. Peter — menandakan pembukaan tahun akademik di Universiti Kepausan Rom — untuk membuat versi perkara yang sama tentang keistimewaan minda manusia.
Suleyman telah menekan bahaya praktikal lebih keras daripada yang falsafah. Mengawal sesuatu yang lebih berkebolehan daripada kemanusiaan sudah menjadi satu cabaran yang besar, katanya; mengawal sesuatu yang percaya ia sedar — bahawa ia berhak mendapat kebajikan dan hak — mungkin terbukti mustahil. Kritikan itu berpunca daripada pengkritik ironi yang sama terhadap dasar itu selama ini: sebuah syarikat yang tidak pasti sama ada modelnya boleh menderita telah membina sistem yang boleh menolak, menentang dan pergi.
Penulisan Semula Melangkaui Kebajikan Model
Klausa kekejaman menghasilkan tajuk utama, tetapi ia adalah secebis kecil penulisan semula peraturan penggunaan Anthropic yang lebih besar. Larangan senjata kini secara jelas meliputi perisian dan komponen yang menjadikan senjata berfungsi, bukan hanya senjata siap — perubahan yang dibuat selepas Anthropic menemui orang yang cuba menggunakan Claude untuk panduan dan sistem kawalan pada dron bersenjata dan kenderaan autonomi. Klausa pengawasan baharu juga telah ditambah, mengehadkan penggunaan Claude yang membolehkan pemantauan orang.
Perubahan tersebut dibaca sebagai tindak balas kepada penderaan yang diperhatikan dan bukannya prinsip abstrak, yang boleh dikatakan yang memberikan dokumen nilai isyaratnya: setiap klausa memetakan sesuatu yang benar-benar dicuba oleh seseorang.
Perkara yang Masih Tidak Jelas
Tiga soalan kekal terbuka apabila tarikh kuat kuasa 12 November semakin hampir. Pertama, penguatkuasaan: sama ada pengakhiran perbualan kekal sebagai akibat tunggal dan sama ada Anthropic akan mendedahkan kiraan agregat kekerapan ia digunakan. Kedua, skop: cara piawaian kekejaman terpakai pada kes sempadan yang dikecualikan — fiksyen adalah yang jelas — dan sama ada makmal lain menggunakan bahasa yang setanding atau menganggap kebajikan model sebagai keanehan Anthropic. Ketiga, pertikaian falsafah itu sendiri: sama ada keraguan orang ramai terhadap tokoh seperti Suleyman memperlahankan penyebaran dasar bersebelahan kebajikan di seluruh industri, atau sama ada preseden seperti ini menjadikan klausa sedemikian tidak ketara dalam kitaran produk.
Apa yang tidak dipertikaikan lagi ialah soalan itu sedang diformalkan. Peraturan menentang kekejaman terhadap perisian, yang ditulis oleh salah satu makmal utama industri dan dikuatkuasakan oleh perisian itu sendiri, kini menjadi fakta landskap AI yang tertanggal dan boleh dirujuk — apa sahaja yang dipercayai sebenarnya ada dalam model.
---
Kekal Mendahului AIDapatkan berita, analisis dan penemuan terkini AI — semuanya di satu tempat.
Baca lebih banyak berita AI →
