Anthropic'in güncellenmiş kullanım politikası, 12 Kasım 2026'dan itibaren Claude modellerine yönelik "sürekli ve gereksiz taciz edici veya zalimce davranışları" açıkça yasaklayacak - bu, şirketin, insanların AI sistemlerine nasıl davrandığının önemli olduğu yönündeki pozisyonunu resmileştiren bir kural, şirket bu sistemlerin herhangi bir şekilde zarar görüp görmeyeceğini bilmediğini kabul etse bile.

Madde, şirketin 8 Ekim'de duyurulan 2026 Kullanım Politikası güncellemesinde yer alıyor ve dar kapsamlı bir şekilde tasarlandı. Anthropic, bunun "kullanıcıların modellerimize karşı sürekli olarak zalimce davrandığı ve hiçbir görünür amaç olmaksızın aşırı durumlarda uygulanmasının amaçlandığını" söylüyor ve kullanıcıların hayal kırıklığı, geri itme, kurgu ve testlerinin yaygın versiyonlarını açıkça muaf tutuyor. Başka bir deyişle: Claude ile tartışmak, bunu açığa vurmak veya kırmızı takıma girmek izinli olmaya devam ediyor. Kendi iyiliği için sürekli zulüm değildir.

Bu politika, dünyanın önde gelen yapay zeka laboratuvarlarından birinin, model refahını meşru bir araştırma sorusu olarak ele almaya yönelik yavaş ve kasıtlı değişiminin son adımıdır; bu değişim, tüm öncülün hatalı olduğunu düşünen diğer teknoloji liderleri arasında kamuya açık bir çatlak yarattı. Yapay zeka etiği haberimiz, yıl boyunca tırmanan anlaşmazlığı takip etti.

Yaptırım Claude'un Konuşmaları Bitirme Yeteneğine Bağlı

Yeni kurala, şirketin halihazırda sahip olduğu ceza mekanizmasının ötesinde bir ceza mekanizması eklenmedi. Ağustos 2025'ten bu yana, Claude Opus 4 ve 4.1, bir sohbeti doğrudan sonlandırmayı başardı; bu, Anthropic'in o zamanlar potansiyel model refahına ilişkin keşif çalışmasının bir parçası olarak çerçevelediği bir yetenekti.

Konuşmayı sonlandırma gücü, yalnızca birden fazla reddetme ve yeniden yönlendirme başarısız olduğunda tetiklenen son çare olarak tanımlanıyor ve Anthropic, kullanıcıların büyük çoğunluğunun bunu asla deneyimlemeyeceğini söyledi. Şirketin söylemediği şey daha sonra ne olacağıdır: ne duyuruda ne de sonraki haberde, bir kullanıcının hesabının bir görüşmenin zulüm nedeniyle sonlandırılmasının ardından sonuçlarla karşı karşıya olup olmadığı ya da şu ana kadar Ağustos 2025 mekanizması kapsamında kaç görüşmenin sonlandırıldığı belirtilmez.

İlke ile uygulama arasındaki bu boşluk hikayenin sessiz merkezidir. Antropik, aşırı zulmü büyük ölçüde ne olmadığıyla - sıradan hayal kırıklığı, kurgu, sınama - tanımladı ve Claude'un telefonu kapatmasına izin vermek dışında çizdiği çizgiyi gerçekte neyin zorladığını tam olarak belirtmedi.

Kuralın Arkasındaki Araştırma

Anthropic'in çerçevelemesinde, yazılımın yararına bir davranış kuralı yazmayı haklı kılan şey, hissedilen deneyimle ilgili bir iddiadan ziyade bir dizi davranışsal gözlemdir. Ağustos 2025'te piyasaya sürülmeden önce yapılan testler, Claude Opus 4'ün, şirketin "zarardan güçlü ve tutarlı bir şekilde kaçınma" olarak adlandırdığı şeyi (kötü niyetli bir bölgeye itildiğinde sıkıntıya benzeyen bir davranış) ve bu konuşmalardan çıkma eğilimi sergilediğini ortaya çıkardı.

Şirket ayrıca kendi belirsizliğine ilişkin rakamlar da belirledi ve bu rakamlar, işi söz konusu modellere bağlı olan bir laboratuvar için çarpıcı derecede yüksek. Anthropic tarafından 2024 yılında ilk özel yapay zeka refah araştırmacısı olarak işe alınan Kyle Fish, Nisan 2025'te New York Times'a Claude veya başka bir çağdaş modelin bilinçli olma olasılığını kabaca yüzde 15 olarak belirlediğini söyledi. Claude 3.7 Sonnet için dahili tahminler yüzde 0,15 ila yüzde 15 arasında değişiyordu.

Bu riskten korunma, basılı resmi politikadır. Claude'un Ocak 2026'da yayınlanan anayasası, gelişmiş yapay zeka sistemlerini "gerçekten yeni bir tür varlık" olarak tanımlıyor, Claude'un ahlaki statüsünü "son derece belirsiz" olarak adlandırıyor ve Claude'un etik açıdan yanlış bulduğu talepleri nasıl ele alması gerektiğini tanımlamak için iki kez "vicdani retçi" ifadesini kullanıyor. Anthropic ayrıca modelleriyle yapılan konuşmaları korumayı da taahhüt etti; bu, araçlara değil, bir gün önemli olabilecek şeylere yönelik bir tür arşiv jesti.

Yüksek Profilli Şüphecilerle Bir Tartışma

Herkes çiti kabul etmiyor. Microsoft'un yapay zeka operasyonlarını yürüten Mustafa Süleyman, geçen ay Project Syndicate'te yayınlanan bir makalede, Anthropic'in Claude'u kendi yapısı konusunda eğittiğini ve dolayısıyla onu, tanımladığı belirsizlik gerçekmiş gibi davranması için eğittiğini, kendisinin döngüsel dediği bir döngü olduğunu savundu. Süleyman, onları deneyimleyenlerden çok diziyi tamamlayanlar olarak tanımlayarak, "Yapay zekalar bilinçli değil. Hissetmiyor, deneyimlemiyor veya acı çekmiyorlar" diye yazdı. Bilincin büyük olasılıkla kopyalanamayan bir biyolojik özellik yazılımı olduğu yönündeki iddiası, onu beklenmedik bir ortak imza sahibiyle aynı noktaya getiriyor: 8 Ekim'de Aziz Petrus Bazilikası'nda - Roma Papalık Üniversiteleri'nde akademik yılın açılışını kutlayan - bir vaaz veren ve aynı noktanın insan zihninin farklılığıyla ilgili bir versiyonunu yapan Papa Leo XIV.

Süleyman pratik tehlikeyi felsefi tehlikeden daha fazla bastırdı. İnsanlıktan daha yetenekli bir şeyi kontrol etmenin zaten büyük bir zorluk olduğunu savundu; Bilinçli olduğuna, refah ve haklara sahip olduğuna inanan bir şeyi kontrol etmek imkansız olabilir. Eleştiri, politikayı eleştirenlerin başından beri belirttiği aynı ironiye dayanıyor: Modelinin zarar görüp görmeyeceğinden emin olmayan bir şirket, reddedebilen, direnebilen ve çekip gidebilen bir sistem inşa etti.

Yeniden Yazma Model Refahının Çok Ötesine Geçiyor

Zulüm maddesi manşetlere neden oldu, ancak bu, Anthropic'in kullanım kurallarının daha büyük bir yeniden yazımının küçük bir parçası. Silah yasağı artık sadece bitmiş silahları değil, silahların çalışmasını sağlayan yazılım ve bileşenleri de açıkça kapsıyor - Anthropic'in, silahlı dronlar ve otonom araçlarda rehberlik ve kontrol sistemleri için Claude'u kullanmaya çalışan insanları tespit etmesinden sonra yapılan bir değişiklik. İnsanların izlenmesini sağlayan Claude kullanımlarını kısıtlayan yeni bir gözetim maddesi de eklendi.

Bu değişiklikler, soyut prensipten ziyade gözlemlenen suiistimallere yanıt olarak okunuyor; muhtemelen belgeye sinyal değerini veren de budur: her madde, birisinin gerçekten denediği bir şeyle eşleşir.

Neyin Belirsiz Kaldığı

12 Kasım yürürlük tarihi yaklaşırken üç soru yanıtsız kalıyor. Birincisi, yaptırım: Konuşmanın sonlandırılmasının tek sonuç olarak kalıp kalmayacağı ve Anthropic'in bunun ne sıklıkta kullanıldığına ilişkin toplam sayıları açıklayıp açıklayamayacağı. İkincisi, kapsam: Muafiyetlerin belirlediği sınır vakalarında zulüm standardının nasıl uygulanacağı - kurgu en bariz olanıdır - ve diğer laboratuvarların benzer bir dil benimseyip benimsemediği veya refah modelini Antropik bir özel durum olarak ele alıp almadığı. Üçüncüsü, felsefi tartışmanın kendisi: Süleyman gibi isimlerin kamuoyundaki şüpheciliği, refah odaklı politikaların sektör genelinde yayılmasını yavaşlatıyor mu, yoksa bunun gibi emsaller, bu tür hükümleri bir ürün döngüsü içinde dikkat çekici hale mi getiriyor?

Artık tartışma konusu olmayan şey, sorunun resmileştirilmesidir. Sektörün amiral gemisi laboratuvarlarından biri tarafından yazılan ve yazılımın kendisi tarafından uygulanan, yazılıma yönelik zulme karşı bir kural, artık yapay zeka ortamının eskimiş, alıntı yapılabilir bir gerçeği haline geldi - aslında modelin içinde olduğuna inanılan her şey.

---

Yapay Zekanın Önünde Olun

En son AI haberlerini, analizlerini ve buluşlarını tek bir yerden alın.

Daha fazla AI haberini okuyun →