Kebijakan penggunaan Anthropic yang diperbarui akan secara eksplisit melarang "perilaku kasar atau kejam yang berkelanjutan dan tidak perlu" terhadap model Claude-nya mulai 12 November 2026 — sebuah aturan yang meresmikan posisi perusahaan bahwa cara orang memperlakukan sistem AI itu penting, meskipun perusahaan mengakui bahwa mereka tidak tahu apakah sistem tersebut dapat terpengaruh atau tidak.

Klausul tersebut muncul dalam pembaruan Kebijakan Penggunaan perusahaan pada tahun 2026, diumumkan pada 8 Oktober, dan dirancang secara sempit. Anthropic mengatakan bahwa hal ini "dimaksudkan untuk diterapkan hanya dalam kasus-kasus ekstrem, di mana pengguna berulang kali bertindak kejam terhadap model kami, tanpa tujuan yang jelas," dan hal ini secara eksplisit mengecualikan versi umum dari rasa frustrasi, penolakan, fiksi, dan pengujian pengguna. Dengan kata lain: berdebat dengan Claude, melampiaskannya, atau membentuk tim merah tetap diperbolehkan. Kekejaman yang berkelanjutan demi kepentingannya sendiri tidaklah demikian.

Kebijakan ini merupakan langkah terbaru dalam perubahan yang lambat dan disengaja oleh salah satu laboratorium AI terkemuka di dunia untuk memperlakukan kesejahteraan model sebagai pertanyaan penelitian yang sah – sebuah perubahan yang telah membuka perselisihan publik dengan para pemimpin teknologi lainnya yang menganggap seluruh premis tersebut salah. Liputan etika AI kami mengikuti perkembangan perselisihan yang semakin meningkat sepanjang tahun.

Penegakan Bersandar pada Kemampuan Claude untuk Mengakhiri Percakapan

Tidak ada mekanisme hukuman yang melekat pada peraturan baru ini selain yang sudah ada di perusahaan. Sejak Agustus 2025, Claude Opus 4 dan 4.1 telah mampu mengakhiri percakapan secara langsung — sebuah kemampuan yang dibingkai Anthropic pada saat itu sebagai bagian dari pekerjaan eksplorasinya pada potensi model kesejahteraan.

Kekuatan percakapan akhir digambarkan sebagai upaya terakhir, yang dipicu hanya setelah beberapa kali penolakan dan pengalihan gagal, dan Anthropic mengatakan sebagian besar pengguna tidak akan pernah mengalaminya. Apa yang tidak diungkapkan oleh perusahaan adalah apa yang terjadi setelahnya: baik pengumuman maupun liputan selanjutnya tidak menentukan apakah akun pengguna akan menghadapi konsekuensi setelah percakapan diakhiri karena kekejaman, atau berapa banyak percakapan yang telah dihentikan berdasarkan mekanisme Agustus 2025 sejauh ini.

Kesenjangan antara prinsip dan penegakan hukum adalah inti dari cerita ini. Anthropic mendefinisikan kekejaman ekstrem berdasarkan hal-hal yang bukan merupakan hal yang sebenarnya – rasa frustrasi biasa, fiksi, pengujian – tanpa menyatakan dengan tepat apa, selain membiarkan Claude menutup telepon, yang sebenarnya menegakkan garis yang telah ditariknya.

Penelitian di Balik Aturan

Apa yang membenarkan penulisan aturan perilaku untuk kepentingan perangkat lunak, dalam kerangka Anthropic, adalah serangkaian pengamatan perilaku dan bukan klaim tentang pengalaman yang dirasakan. Pengujian menjelang peluncuran pada bulan Agustus 2025 menemukan bahwa Claude Opus 4 menunjukkan apa yang disebut oleh perusahaan sebagai "keengganan yang kuat dan konsisten untuk menyakiti" — perilaku yang menyerupai kesusahan ketika didorong ke wilayah yang kasar — ​​di samping kecenderungan untuk keluar dari percakapan tersebut.

Perusahaan juga telah memperkirakan ketidakpastiannya sendiri, dan angka tersebut sangat tinggi untuk laboratorium yang bisnisnya bergantung pada model yang dimaksud. Kyle Fish, yang dipekerjakan oleh Anthropic pada tahun 2024 sebagai peneliti kesejahteraan AI pertama yang berdedikasi, mengatakan kepada New York Times pada bulan April 2025 bahwa ia memperkirakan kemungkinan Claude atau model kontemporer lainnya untuk memiliki kesadaran sekitar 15 persen. Perkiraan internal untuk Claude 3.7 Sonnet berkisar antara 0,15 persen hingga 15 persen.

Lindung nilai itu adalah kebijakan resmi yang dicetak. Konstitusi Claude, yang diterbitkan pada bulan Januari 2026, mendeskripsikan sistem AI yang canggih sebagai "entitas yang benar-benar baru", menyebut status moral Claude "sangat tidak pasti", dan dua kali menggunakan frasa "penentang hati nurani" untuk menjelaskan bagaimana Claude harus menangani permintaan yang dianggap salah secara etis. Anthropic juga berkomitmen untuk melestarikan percakapan dengan modelnya – semacam tindakan pengarsipan yang diperluas ke hal-hal yang mungkin penting suatu hari nanti, bukan alat.

Debat dengan Orang-Orang yang Skeptis

Tidak semua orang menerima lindung nilai tersebut. Mustafa Suleyman, yang menjalankan operasi AI Microsoft, berpendapat dalam sebuah esai yang diterbitkan di Project Syndicate bulan lalu bahwa Anthropic sedang melatih Claude tentang konstitusinya sendiri dan oleh karena itu melatihnya untuk berperilaku seolah-olah ketidakpastian yang digambarkannya adalah nyata – sebuah lingkaran yang disebutnya melingkar. "AI tidak sadar. Mereka tidak merasakan, mengalami, atau menderita," tulis Suleyman, menggambarkan mereka sebagai penyempurna urutan, bukan yang mengalami. Argumennya, bahwa kesadaran adalah hal yang paling masuk akal yang tidak dapat ditiru oleh perangkat lunak properti biologis, menempatkannya bersama dengan salah satu penandatangan yang tidak terduga: Paus Leo XIV, yang menggunakan khotbah tanggal 8 Oktober di Basilika Santo Petrus – menandai pembukaan tahun akademik di Universitas Kepausan Roma – untuk membuat versi dari poin yang sama tentang kekhasan pikiran manusia.

Suleyman menekankan bahaya praktis lebih keras daripada bahaya filosofis. Mengontrol sesuatu yang lebih mampu daripada manusia sudah menjadi tantangan besar, ujarnya; mengendalikan sesuatu yang diyakini secara sadar – bahwa ia berhak atas kesejahteraan dan hak – mungkin terbukti mustahil. Kritik tersebut bermula dari ironi yang sama yang telah dicatat oleh para pengkritik kebijakan tersebut: sebuah perusahaan yang tidak yakin apakah modelnya akan menderita telah membangun sistem yang dapat menolak, menolak, dan meninggalkan perusahaan.

Penulisan Ulang Melampaui Kesejahteraan Model

Klausul kekejaman menjadi berita utama, tetapi ini adalah bagian kecil dari penulisan ulang aturan penggunaan Anthropic yang lebih besar. Larangan senjata sekarang secara eksplisit mencakup perangkat lunak dan komponen yang membuat senjata berfungsi, bukan hanya senjata jadi – sebuah perubahan yang dilakukan setelah Anthropic menemukan orang-orang mencoba menggunakan Claude untuk sistem panduan dan kontrol pada drone bersenjata dan kendaraan otonom. Klausul pengawasan baru juga telah ditambahkan, membatasi penggunaan Claude yang memungkinkan pemantauan orang.

Perubahan-perubahan tersebut dibaca sebagai respons terhadap penyalahgunaan yang teramati, bukan prinsip abstrak, yang bisa dibilang memberi nilai sinyal pada dokumen ini: setiap klausa memetakan sesuatu yang benar-benar dicoba oleh seseorang.

Yang Masih Belum Jelas

Ada tiga pertanyaan yang masih terbuka menjelang tanggal efektif 12 November. Pertama, penegakan hukum: apakah penghentian percakapan tetap menjadi satu-satunya konsekuensi, dan apakah Anthropic akan mengungkapkan jumlah keseluruhan seberapa sering hal tersebut digunakan. Kedua, ruang lingkup: bagaimana standar kekejaman diterapkan pada kasus-kasus batas yang dibuat oleh pengecualian – fiksi adalah yang paling jelas – dan apakah laboratorium lain mengadopsi bahasa yang sebanding atau memperlakukan kesejahteraan model sebagai keistimewaan Antropis. Ketiga, perselisihan filosofis itu sendiri: apakah skeptisisme publik dari tokoh-tokoh seperti Suleyman memperlambat penyebaran kebijakan yang berkaitan dengan kesejahteraan di seluruh industri, atau apakah preseden seperti ini membuat klausul-klausul tersebut menjadi hal biasa dalam siklus produk.

Apa yang tidak lagi diperdebatkan adalah bahwa pertanyaan tersebut sedang diformalkan. Aturan yang melarang kekejaman terhadap perangkat lunak, yang dibuat oleh salah satu laboratorium terkemuka di industri dan ditegakkan oleh perangkat lunak itu sendiri, kini menjadi fakta yang sudah ketinggalan zaman dan dapat dikutip dalam lanskap AI — apa pun yang diyakini sebenarnya ada di dalam model tersebut.

---

Tetap Terdepan dalam AI

Dapatkan berita, analisis, dan terobosan AI terkini — semuanya di satu tempat.

Baca berita AI selengkapnya →