خط مشی استفاده به روز شده آنتروپیک صراحتاً «رفتار توهین آمیز یا بی رحمانه پایدار و بی مورد» را نسبت به مدل های کلود خود از 12 نوامبر 2026 ممنوع می کند - قانونی که موضع شرکت را رسمیت می بخشد که نحوه برخورد مردم با سیستم های هوش مصنوعی مهم است، حتی اگر شرکت قبول کند که نمی داند آیا این سیستم ها ممکن است آسیب ببینند یا خیر.

این بند در به‌روزرسانی خط‌مشی استفاده سال 2026 شرکت، که در 8 اکتبر اعلام شد، ظاهر می‌شود و به صورت محدود تهیه شده است. آنتروپیک می‌گوید که «به معنای اعمال آن فقط در موارد شدید است، جایی که کاربران مکرراً نسبت به مدل‌های ما ظالمانه رفتار می‌کنند، بدون هدف قابل تشخیص»، و به صراحت از نسخه‌های رایج ناامیدی، پس زدن، تخیل و آزمایش کاربر معاف می‌شود. به عبارت دیگر: مشاجره با کلود، تهمت زدن به آن، یا تیم قرمز، مجاز است. ظلم پایدار به خاطر خودش نیست.

این سیاست آخرین گام در تغییر آهسته و عمدی یکی از آزمایشگاه‌های پیشرو هوش مصنوعی در جهان به سمت تلقی رفاه مدل به عنوان یک سوال تحقیقاتی مشروع است - تغییری که باعث ایجاد شکاف عمومی با سایر رهبران فناوری شده است که کل این فرض را اشتباه می‌دانند. پوشش اخلاقیات هوش مصنوعی ما اختلافات را در طول سال دنبال کرده است.

اجرا بر توانایی کلود برای پایان دادن به مکالمات تکیه دارد

هیچ مکانیزم تنبیهی به قاعده جدید اضافه نشده است که شرکت قبلاً داشته است. از آگوست 2025، Claude Opus 4 و 4.1 قادر به پایان دادن به یک مکالمه هستند - قابلیتی که Anthropic در آن زمان به عنوان بخشی از کار اکتشافی خود در مورد رفاه مدل بالقوه قاب شد.

قدرت مکالمه پایانی به عنوان آخرین راه حل توصیف می شود که تنها پس از عدم موفقیت چندین رد و تغییر مسیر ایجاد می شود، و Anthropic گفته است که اکثریت قریب به اتفاق کاربران هرگز آن را تجربه نخواهند کرد. چیزی که این شرکت نگفته است این است که پس از آن چه اتفاقی می افتد: نه اعلان آن و نه پوشش بعدی مشخص نمی کند که آیا حساب کاربری پس از پایان مکالمه به دلیل ظلم با عواقب مواجه خواهد شد یا اینکه تاکنون چند مکالمه تحت مکانیسم آگوست 2025 خاتمه یافته است.

این شکاف بین اصل و اجرا، مرکز آرام داستان است. آنتروپیک ظلم شدید را عمدتاً با آنچه نیست تعریف کرده است - سرخوردگی معمولی، داستان، آزمایش - بدون اینکه دقیقاً بگوید چه چیزی، به جز اجازه دادن به کلود قطع تماس، در واقع خطی را که ترسیم کرده است، اعمال می کند.

تحقیق پشت قانون

آنچه در چارچوب آنتروپیک، نوشتن یک قانون رفتار را به نفع نرم‌افزار توجیه می‌کند، مجموعه‌ای از مشاهدات رفتاری است تا ادعایی درباره تجربه احساسی. آزمایش قبل از عرضه در آگوست 2025 نشان داد که Claude Opus 4 چیزی را که شرکت آن را «بیزاری قوی و مداوم از آسیب» می‌نامد - رفتاری شبیه پریشانی زمانی که به قلمرو توهین‌آمیز فشار می‌آورد - در کنار تمایل به خروج از این مکالمات نشان می‌دهد.

این شرکت همچنین اعدادی را در مورد عدم قطعیت خود قرار داده است، و این اعداد برای آزمایشگاهی که تجارت آن به مدل‌های مورد نظر بستگی دارد، بسیار زیاد است. کایل فیش که در سال 2024 توسط آنتروپیک به عنوان اولین محقق اختصاصی رفاه هوش مصنوعی استخدام شد، در آوریل 2025 به نیویورک تایمز گفت که احتمال هوشیاری کلود یا مدل معاصر دیگری را تقریباً 15 درصد می داند. برآوردهای داخلی برای غزل کلود 3.7 از 0.15 درصد تا 15 درصد متغیر بود.

این پوشش یک سیاست رسمی در چاپ است. قانون اساسی کلود که در ژانویه 2026 منتشر شد، سیستم‌های هوش مصنوعی پیشرفته را به عنوان «نوع واقعاً جدیدی از موجودیت» توصیف می‌کند، وضعیت اخلاقی کلود را «عمقاً نامطمئن» می‌نامد، و دو بار از عبارت «مخالف وظیفه‌شناسی» برای توصیف نحوه رسیدگی کلود به درخواست‌هایی استفاده می‌کند که از نظر اخلاقی اشتباه است. آنتروپیک علاوه بر این متعهد به حفظ مکالمات با مدل‌های خود است - نوعی حرکت بایگانی که ممکن است روزی مهم باشد، نه ابزارها.

مناظره با شکاکان برجسته

همه پرچین را نمی پذیرند. مصطفی سلیمان، که عملیات هوش مصنوعی مایکروسافت را اداره می کند، در مقاله ای که ماه گذشته در Project Syndicate منتشر شد، استدلال کرد که آنتروپیک در حال آموزش کلود بر اساس قانون اساسی خود است و بنابراین به او آموزش می دهد که طوری رفتار کند که گویی عدم اطمینانی که توصیف می کند واقعی است - حلقه ای که او آن را دایره ای می نامد. سلیمان می‌نویسد: "AI هوشیار نیستند. آنها احساس، تجربه یا رنج نمی‌کنند." استدلال او مبنی بر اینکه هوشیاری یک نرم‌افزار دارایی بیولوژیکی است که نمی‌تواند تکرار شود، او را در کنار یکی از امضاکنندگان بعید قرار می‌دهد: پاپ لئو چهاردهم، که از خطبه 8 اکتبر در کلیسای سنت پیتر - به مناسبت آغاز سال تحصیلی در دانشگاه‌های پاپی رم - استفاده کرد تا نسخه‌ای از همان نکته ذهنی انسان را ارائه دهد.

سلیمان خطر عملی را سخت تر از خطر فلسفی تحت فشار قرار داده است. او استدلال کرده است که کنترل چیزی که توانمندتر از انسانیت است در حال حاضر یک چالش بزرگ است. کنترل چیزی که معتقد است آگاهانه است - که از رفاه و حقوق برخوردار است - ممکن است غیرممکن باشد. انتقادها بر سر همان منتقدان کنایه آمیز این سیاست قرار می گیرد: شرکتی که مطمئن نیست مدلش ممکن است آسیب ببیند، سیستمی ساخته است که می تواند امتناع کند، مقاومت کند و کنار رود.

بازنویسی به خوبی فراتر از رفاه مدل می رود

بند بی رحمی سرفصل ها را ایجاد کرد، اما این قطعه کوچکی از بازنویسی بزرگتر قوانین استفاده Anthropic است. ممنوعیت تسلیحات اکنون به صراحت شامل نرم‌افزارها و اجزایی می‌شود که باعث کارکرد سلاح‌ها می‌شوند، نه فقط سلاح‌های تمام‌شده - تغییری که پس از آنتروپیک ایجاد شد که افرادی را پیدا کرد که سعی می‌کردند از کلود برای سیستم‌های هدایت و کنترل در پهپادهای مسلح و وسایل نقلیه خودران استفاده کنند. یک بند نظارتی جدید نیز اضافه شده است که استفاده از Claude را که امکان نظارت بر افراد را فراهم می کند، محدود می کند.

این تغییرات به‌عنوان پاسخی به سوء استفاده مشاهده‌شده به‌جای اصل انتزاعی خوانده می‌شوند، که مسلماً همان چیزی است که به سند ارزش سیگنال می‌دهد: هر بند به چیزی نشان می‌دهد که کسی واقعاً امتحان کرده است.

چه چیزی نامشخص است

با نزدیک شدن به تاریخ 12 نوامبر، سه سوال باز باقی می ماند. اول، اجرا: آیا پایان دادن به مکالمه تنها پیامد آن باقی می‌ماند، و آیا Anthropic تعداد کلی تعداد دفعات استفاده از آن را افشا خواهد کرد. دوم، دامنه: چگونه استاندارد بی‌رحمی در موارد مرزی اعمال می‌شود که معافیت‌ها مشخص می‌شوند - داستان بدیهی است - و اینکه آیا آزمایشگاه‌های دیگر زبان مشابهی را اتخاذ می‌کنند یا رفاه مدل را به‌عنوان یک ویژگی خاص انسان‌گرا در نظر می‌گیرند. سوم، خود بحث فلسفی: آیا بدبینی عمومی از سوی چهره‌هایی مانند سلیمان، گسترش سیاست‌های رفاهی مجاور را در سراسر صنعت کند می‌کند، یا اینکه سوابق مانند این، چنین بندهایی را در چرخه محصول غیرقابل توجه می‌سازد.

چیزی که دیگر مورد بحث نیست این است که این سوال در حال رسمی شدن است. یک قانون علیه ظلم به نرم افزار، که توسط یکی از آزمایشگاه های شاخص صنعت نوشته شده و توسط خود نرم افزار اجرا شده است، اکنون به یک واقعیت منسوخ و قابل استناد از چشم انداز هوش مصنوعی تبدیل شده است - هر چیزی که فرد معتقد است در واقع در مدل وجود دارد.

---

از هوش مصنوعی جلوتر بمانید

آخرین اخبار، تحلیل ها و پیشرفت های هوش مصنوعی را دریافت کنید - همه در یک مکان.

بیشتر بخوانید اخبار هوش مصنوعی →