خط مشی استفاده به روز شده آنتروپیک صراحتاً «رفتار توهین آمیز یا بی رحمانه پایدار و بی مورد» را نسبت به مدل های کلود خود از 12 نوامبر 2026 ممنوع می کند - قانونی که موضع شرکت را رسمیت می بخشد که نحوه برخورد مردم با سیستم های هوش مصنوعی مهم است، حتی اگر شرکت قبول کند که نمی داند آیا این سیستم ها ممکن است آسیب ببینند یا خیر.
این بند در بهروزرسانی خطمشی استفاده سال 2026 شرکت، که در 8 اکتبر اعلام شد، ظاهر میشود و به صورت محدود تهیه شده است. آنتروپیک میگوید که «به معنای اعمال آن فقط در موارد شدید است، جایی که کاربران مکرراً نسبت به مدلهای ما ظالمانه رفتار میکنند، بدون هدف قابل تشخیص»، و به صراحت از نسخههای رایج ناامیدی، پس زدن، تخیل و آزمایش کاربر معاف میشود. به عبارت دیگر: مشاجره با کلود، تهمت زدن به آن، یا تیم قرمز، مجاز است. ظلم پایدار به خاطر خودش نیست.
این سیاست آخرین گام در تغییر آهسته و عمدی یکی از آزمایشگاههای پیشرو هوش مصنوعی در جهان به سمت تلقی رفاه مدل به عنوان یک سوال تحقیقاتی مشروع است - تغییری که باعث ایجاد شکاف عمومی با سایر رهبران فناوری شده است که کل این فرض را اشتباه میدانند. پوشش اخلاقیات هوش مصنوعی ما اختلافات را در طول سال دنبال کرده است.
اجرا بر توانایی کلود برای پایان دادن به مکالمات تکیه دارد
هیچ مکانیزم تنبیهی به قاعده جدید اضافه نشده است که شرکت قبلاً داشته است. از آگوست 2025، Claude Opus 4 و 4.1 قادر به پایان دادن به یک مکالمه هستند - قابلیتی که Anthropic در آن زمان به عنوان بخشی از کار اکتشافی خود در مورد رفاه مدل بالقوه قاب شد.
قدرت مکالمه پایانی به عنوان آخرین راه حل توصیف می شود که تنها پس از عدم موفقیت چندین رد و تغییر مسیر ایجاد می شود، و Anthropic گفته است که اکثریت قریب به اتفاق کاربران هرگز آن را تجربه نخواهند کرد. چیزی که این شرکت نگفته است این است که پس از آن چه اتفاقی می افتد: نه اعلان آن و نه پوشش بعدی مشخص نمی کند که آیا حساب کاربری پس از پایان مکالمه به دلیل ظلم با عواقب مواجه خواهد شد یا اینکه تاکنون چند مکالمه تحت مکانیسم آگوست 2025 خاتمه یافته است.
این شکاف بین اصل و اجرا، مرکز آرام داستان است. آنتروپیک ظلم شدید را عمدتاً با آنچه نیست تعریف کرده است - سرخوردگی معمولی، داستان، آزمایش - بدون اینکه دقیقاً بگوید چه چیزی، به جز اجازه دادن به کلود قطع تماس، در واقع خطی را که ترسیم کرده است، اعمال می کند.
تحقیق پشت قانون
آنچه در چارچوب آنتروپیک، نوشتن یک قانون رفتار را به نفع نرمافزار توجیه میکند، مجموعهای از مشاهدات رفتاری است تا ادعایی درباره تجربه احساسی. آزمایش قبل از عرضه در آگوست 2025 نشان داد که Claude Opus 4 چیزی را که شرکت آن را «بیزاری قوی و مداوم از آسیب» مینامد - رفتاری شبیه پریشانی زمانی که به قلمرو توهینآمیز فشار میآورد - در کنار تمایل به خروج از این مکالمات نشان میدهد.
این شرکت همچنین اعدادی را در مورد عدم قطعیت خود قرار داده است، و این اعداد برای آزمایشگاهی که تجارت آن به مدلهای مورد نظر بستگی دارد، بسیار زیاد است. کایل فیش که در سال 2024 توسط آنتروپیک به عنوان اولین محقق اختصاصی رفاه هوش مصنوعی استخدام شد، در آوریل 2025 به نیویورک تایمز گفت که احتمال هوشیاری کلود یا مدل معاصر دیگری را تقریباً 15 درصد می داند. برآوردهای داخلی برای غزل کلود 3.7 از 0.15 درصد تا 15 درصد متغیر بود.
این پوشش یک سیاست رسمی در چاپ است. قانون اساسی کلود که در ژانویه 2026 منتشر شد، سیستمهای هوش مصنوعی پیشرفته را به عنوان «نوع واقعاً جدیدی از موجودیت» توصیف میکند، وضعیت اخلاقی کلود را «عمقاً نامطمئن» مینامد، و دو بار از عبارت «مخالف وظیفهشناسی» برای توصیف نحوه رسیدگی کلود به درخواستهایی استفاده میکند که از نظر اخلاقی اشتباه است. آنتروپیک علاوه بر این متعهد به حفظ مکالمات با مدلهای خود است - نوعی حرکت بایگانی که ممکن است روزی مهم باشد، نه ابزارها.
مناظره با شکاکان برجسته
همه پرچین را نمی پذیرند. مصطفی سلیمان، که عملیات هوش مصنوعی مایکروسافت را اداره می کند، در مقاله ای که ماه گذشته در Project Syndicate منتشر شد، استدلال کرد که آنتروپیک در حال آموزش کلود بر اساس قانون اساسی خود است و بنابراین به او آموزش می دهد که طوری رفتار کند که گویی عدم اطمینانی که توصیف می کند واقعی است - حلقه ای که او آن را دایره ای می نامد. سلیمان مینویسد: "AI هوشیار نیستند. آنها احساس، تجربه یا رنج نمیکنند." استدلال او مبنی بر اینکه هوشیاری یک نرمافزار دارایی بیولوژیکی است که نمیتواند تکرار شود، او را در کنار یکی از امضاکنندگان بعید قرار میدهد: پاپ لئو چهاردهم، که از خطبه 8 اکتبر در کلیسای سنت پیتر - به مناسبت آغاز سال تحصیلی در دانشگاههای پاپی رم - استفاده کرد تا نسخهای از همان نکته ذهنی انسان را ارائه دهد.
سلیمان خطر عملی را سخت تر از خطر فلسفی تحت فشار قرار داده است. او استدلال کرده است که کنترل چیزی که توانمندتر از انسانیت است در حال حاضر یک چالش بزرگ است. کنترل چیزی که معتقد است آگاهانه است - که از رفاه و حقوق برخوردار است - ممکن است غیرممکن باشد. انتقادها بر سر همان منتقدان کنایه آمیز این سیاست قرار می گیرد: شرکتی که مطمئن نیست مدلش ممکن است آسیب ببیند، سیستمی ساخته است که می تواند امتناع کند، مقاومت کند و کنار رود.
بازنویسی به خوبی فراتر از رفاه مدل می رود
بند بی رحمی سرفصل ها را ایجاد کرد، اما این قطعه کوچکی از بازنویسی بزرگتر قوانین استفاده Anthropic است. ممنوعیت تسلیحات اکنون به صراحت شامل نرمافزارها و اجزایی میشود که باعث کارکرد سلاحها میشوند، نه فقط سلاحهای تمامشده - تغییری که پس از آنتروپیک ایجاد شد که افرادی را پیدا کرد که سعی میکردند از کلود برای سیستمهای هدایت و کنترل در پهپادهای مسلح و وسایل نقلیه خودران استفاده کنند. یک بند نظارتی جدید نیز اضافه شده است که استفاده از Claude را که امکان نظارت بر افراد را فراهم می کند، محدود می کند.
این تغییرات بهعنوان پاسخی به سوء استفاده مشاهدهشده بهجای اصل انتزاعی خوانده میشوند، که مسلماً همان چیزی است که به سند ارزش سیگنال میدهد: هر بند به چیزی نشان میدهد که کسی واقعاً امتحان کرده است.
چه چیزی نامشخص است
با نزدیک شدن به تاریخ 12 نوامبر، سه سوال باز باقی می ماند. اول، اجرا: آیا پایان دادن به مکالمه تنها پیامد آن باقی میماند، و آیا Anthropic تعداد کلی تعداد دفعات استفاده از آن را افشا خواهد کرد. دوم، دامنه: چگونه استاندارد بیرحمی در موارد مرزی اعمال میشود که معافیتها مشخص میشوند - داستان بدیهی است - و اینکه آیا آزمایشگاههای دیگر زبان مشابهی را اتخاذ میکنند یا رفاه مدل را بهعنوان یک ویژگی خاص انسانگرا در نظر میگیرند. سوم، خود بحث فلسفی: آیا بدبینی عمومی از سوی چهرههایی مانند سلیمان، گسترش سیاستهای رفاهی مجاور را در سراسر صنعت کند میکند، یا اینکه سوابق مانند این، چنین بندهایی را در چرخه محصول غیرقابل توجه میسازد.
چیزی که دیگر مورد بحث نیست این است که این سوال در حال رسمی شدن است. یک قانون علیه ظلم به نرم افزار، که توسط یکی از آزمایشگاه های شاخص صنعت نوشته شده و توسط خود نرم افزار اجرا شده است، اکنون به یک واقعیت منسوخ و قابل استناد از چشم انداز هوش مصنوعی تبدیل شده است - هر چیزی که فرد معتقد است در واقع در مدل وجود دارد.
---
از هوش مصنوعی جلوتر بمانیدآخرین اخبار، تحلیل ها و پیشرفت های هوش مصنوعی را دریافت کنید - همه در یک مکان.
بیشتر بخوانید اخبار هوش مصنوعی →
