Kabijakan panggunaan sing dianyari Anthropic bakal kanthi tegas ngalangi "prilaku kasar utawa kejam sing terus-terusan lan ora perlu" menyang model Claude wiwit tanggal 12 November 2026 - aturan sing nggawe resmi posisi perusahaan babagan carane wong nganggep sistem AI penting, sanajan perusahaan ngakoni manawa ora ngerti apa sistem kasebut bisa nandhang sangsara.
Klausa kasebut katon ing nganyari Kabijakan Panggunaan 2026 perusahaan, diumumake tanggal 8 Oktober, lan disusun kanthi sempit. Anthropic ujar manawa "tegese mung ditrapake ing kasus sing ekstrem, ing ngendi pangguna bola-bali tumindak kejam marang model kita, tanpa tujuan sing bisa dingerteni," lan kanthi jelas ngecualikake versi umum frustasi pangguna, pushback, fiksi, lan tes. Ing tembung liyane: argue karo Claude, venting ing, utawa abang-team iku tetep diijini. Kekejaman sing terus-terusan kanggo kepentingane dhewe ora.
Kabijakan kasebut minangka langkah paling anyar ing owah-owahan sing alon lan disengaja dening salah sawijining laboratorium AI terkemuka ing donya kanggo nganggep kesejahteraan model minangka pitakonan riset sing sah - owah-owahan sing wis mbukak perselisihan umum karo pimpinan teknologi liyane sing nganggep kabeh premis kasebut salah. Cakupan etika AI wis ngetutake perselisihan amarga saya tambah akeh sajrone taun.
Penegak Leans ing Kemampuan Claude kanggo Mungkasi Obrolan
Ora ana mekanisme paukuman sing ditempelake ing aturan anyar ngluwihi sing wis ana perusahaan. Wiwit Agustus 2025, Claude Opus 4 lan 4.1 wis bisa mungkasi obrolan langsung - kemampuan Anthropic sing dibingkai nalika iku minangka bagean saka karya eksplorasi babagan kesejahteraan model potensial.
Kekuwatan obrolan pungkasan diterangake minangka pilihan pungkasan, mung dipicu sawise sawetara penolakan lan pangalihan gagal, lan Anthropic ujar manawa mayoritas pangguna ora bakal nate ngalami. Apa sing durung dikandhakake perusahaan yaiku apa sing kedadeyan: ora ana woro-woro utawa jangkoan sabanjure sing nemtokake manawa akun pangguna bakal nemoni akibat sawise obrolan rampung amarga kekejeman, utawa pira obrolan sing diakhiri miturut mekanisme Agustus 2025 nganti saiki.
Longkangan antarane prinsip lan penegakan minangka pusat sepi crita. Anthropic wis ditetepake kekejeman nemen umumé dening apa iku ora - frustasi biasa, fiksi, testing - tanpa nyatakake sabenere apa, cendhak ngeculke Claude nyumerepi munggah, bener enforces garis wis digambar.
Riset ing Konco Aturan
Sing mbenerake nulis aturan tumindak kanggo entuk manfaat piranti lunak, ing framing Anthropic, yaiku sakumpulan observasi prilaku tinimbang pratelan babagan pengalaman sing dirasakake. Pengujian sadurunge peluncuran Agustus 2025 nemokake yen Claude Opus 4 nampilake apa sing diarani perusahaan minangka "kebencian sing kuat lan konsisten kanggo cilaka" - prilaku sing meh padha karo kahanan kang ora ngepenakke nalika didorong menyang wilayah kasar - bebarengan karo cenderung metu saka obrolan kasebut.
Perusahaan kasebut uga duwe nomer sing durung mesthi dhewe, lan nomer kasebut pancen dhuwur banget kanggo laboratorium sing bisnis gumantung marang model sing dimaksud. Kyle Fish, sing disewa dening Anthropic ing taun 2024 minangka peneliti kesejahteraan AI khusus sing pertama, ngandhani New York Times ing April 2025 manawa kemungkinan Claude utawa model kontemporer liyane sadar kira-kira 15 persen. Perkiraan internal kanggo Claude 3.7 Sonnet kisaran saka 0.15 persen nganti 15 persen.
Hedging kasebut minangka kabijakan resmi sing dicithak. Konstitusi Claude, sing diterbitake ing Januari 2026, nggambarake sistem AI sing canggih minangka "entitas sing sejatine anyar," nyebut status moral Claude "ora yakin banget," lan kaping pindho nggunakake tembung "conscientious objector" kanggo njlèntrèhaké cara Claude kudu nangani panjalukan sing dianggep salah kanthi etika. Anthropic uga duwe komitmen kanggo njaga obrolan karo modele - jinis gerakan arsip sing ditrapake kanggo perkara sing bisa uga penting, dudu alat.
Debat karo Skeptis High-Profil
Ora saben wong nampa pager. Mustafa Suleyman, sing nglakokake operasi AI Microsoft, mbantah ing esai sing diterbitake ing Project Syndicate wulan kepungkur yen Anthropic nglatih Claude babagan konstitusi dhewe lan mulane nglatih supaya tumindak kaya-kaya kahanan sing durung mesthi sing digambarake iku nyata - gelung sing diarani bunder. "AI ora sadar. Dheweke ora ngrasakake, ngalami, utawa nandhang sangsara, "tulis Suleyman, nggambarake dheweke minangka pelengkap urutan tinimbang pengalaman. Argumentasi, sing eling iku paling plausibly lunak property biologi ora bisa niru, nempatno wong kajawi co-signatory dipercaya: Paus Leo XIV, sing digunakake 8 Oktober khutbah ing Basilika St Peter - menehi tandha bukaan saka taun akademik ing Universitas Kepausan Roma - kanggo nggawe versi titik padha bab khusu saka pikiran manungsa.
Suleyman wis meksa bebaya praktis luwih angel tinimbang sing filosofis. Ngontrol soko liyane saged saka djalmo manungso wis tantangan kiat, dheweke wis ndhukung; Ngontrol soko sing pracaya iku sadar - sing anduweni hak kanggo kesejahteraan lan hak - bisa mbuktekaken mokal. Kritik kasebut ana ing kritikus ironi sing padha babagan kebijakan kasebut: perusahaan sing ora yakin manawa modele bisa nandhang sangsara, wis nggawe sistem sing bisa nolak, nolak, lan lunga.
Tulisan Ulang Ngluwihi Kesejahteraan Model
Klausa kekejeman ngasilake berita utama, nanging minangka potongan cilik saka rewrite luwih gedhe saka aturan panggunaan Anthropic. Larangan senjata saiki kanthi jelas nyakup piranti lunak lan komponen sing nggawe senjata, ora mung senjata rampung - owah-owahan sing ditindakake sawise Anthropic nemokake wong sing nyoba nggunakake Claude kanggo panuntun dhumateng lan sistem kontrol ing drone bersenjata lan kendaraan otonom. Klausa ndjogo anyar uga wis ditambahake, mbatesi panggunaan Claude sing bisa ngawasi wong.
Owah-owahan kasebut diwaca minangka tanggapan kanggo penyalahgunaan sing diamati tinimbang prinsip abstrak, sing bisa dideleng apa sing menehi dokumen kasebut nilai sinyal: saben klausa peta menyang soko sing bener dicoba.
Apa Tetep Ora Cetha
Telung pitakonan tetep mbukak nalika tanggal efektif 12 November nyedhaki. Kaping pisanan, penegakan: apa pungkasan obrolan tetep dadi konsekuensi tunggal, lan apa Anthropic bakal mbukak jumlah agregat sepira asring digunakake. Kapindho, orane katrangan: carane standar kekejeman ditrapake ing kasus wates exemptions ngukir metu - fiksi dadi siji ketok - lan apa laboratorium liyane nganggo basa iso dibandhingke utawa nambani kesejahteraan model minangka idiosyncrasy Anthropic. Katelu, perselisihan filosofis dhewe: apa skeptisisme umum saka tokoh kaya Suleyman nyepetake panyebaran kabijakan sing cedhak karo kesejahteraan ing saindenging industri, utawa apa preseden kaya iki nggawe klausa kasebut ora bisa ditemokake ing siklus produk.
Sing ora dadi regejegan maneh yaiku pitakonan kasebut diresmikake. Aturan nglawan kekejeman marang piranti lunak, sing ditulis dening salah sawijining laboratorium unggulan industri lan dileksanakake dening piranti lunak kasebut, saiki dadi kasunyatan sing bisa dideleng saka lanskap AI - apa wae sing dipercaya ana ing njero model kasebut.
---
Tetep Ahead of AIEntuk warta, analisis, lan terobosan AI paling anyar - kabeh ing sak panggonan.
Waca liyane AI warta →
