چند روز پس از اینکه Anthropic شروع به انتشار واترمارک های نامرئی بر روی خروجی های متن و تصویر کلود کرد، این ویژگی دقیقاً همان نوع اصطکاک را ایجاد می کند که منتقدان پیش بینی کرده بودند: کاربران نگران هستند که علائم آنها را برای استفاده از هوش مصنوعی در محل کار یا کلاس در معرض نمایش قرار دهد، توسعه دهندگان نحوه رفتار واترمارک را در جریان های کاری کدنویسی واقعی مستند می کنند، و یک ابزار کوچک اما قابل مشاهده برای بازار.
Anthropic می گوید این تغییر کلود را با قانون هوش مصنوعی اتحادیه اروپا مطابقت می دهد، قوانین شفافیت آن پس از 2 اوت 2026 برای مدل های جدید قابل اجرا شد. ماده 50 این قانون از ارائه دهندگان سیستم هوش مصنوعی می خواهد که خروجی های تولید شده توسط ماشین را "قابل تشخیص به صورت مصنوعی تولید کنند." آنتروپیک تأیید کرد که تمام مدلهای جدید ارائه شده در سطح جهانی - نه تنها در اتحادیه اروپا - محتوای تولید شده توسط هوش مصنوعی را «از روز اول» با مهلتی تا دسامبر 2026 برای بهروزرسانی مدلهای منتشر شده قبلی مشخص میکنند. For more context on this story, see our ongoing artificial intelligence updates.
خود علائم نامرئی هستند. بر اساس یک مقاله پشتیبانی آنتروپیک، متن خروجی «دارای واترمارک جاسازی شده» است، در حالی که فایلهای تولید شده شامل ابردادههای منشأ امضا شده دیجیتالی است که قالب آن را پشتیبانی میکند. مدلهای قبلی کلود بهروزرسانی خواهند شد تا متن را نیز علامتگذاری کنند، به این معنی که کل ناوگان در نهایت خروجی خود را نشان خواهد داد.
واترمارک متن ویرایش شده را پوشش می دهد، نه فقط متن تولید شده را
جزئیاتی که کنجکاوی فنی را به واکنش متقابل تبدیل کرد توسط Ars Technica در 13 آگوست فاش شد: واترمارک برای محتوای فرایندهای کلود اعمال می شود، نه تنها محتوایی که از ابتدا تولید می کند. Ars این رویکرد را بهعنوان «nuke it from orbit» توصیف کرد، زیرا Anthropic تمام محتوای پردازششده را در جایی که پشتیبانی میشود علامتگذاری میکند، حتی اگر راهنمایی اتحادیه اروپا به آن نیازی نداشته باشد در جایی که یک سیستم هوش مصنوعی «یک عملکرد کمکی برای ویرایش استاندارد» را انجام میدهد - مثال مقررات اصلاح دستوری است - یا جایی که متن کاربر را «تغییر اساسی» نمیکند.
این تمایز اهمیت دارد زیرا واترمارکی که در سطح مدل اعمال میشود، نمیتواند تولید عمدهفروشی را از یک اصلاح با کاما متمایز کند. اشلی بلنگر از Ars Technica خاطرنشان کرد که کلود ممکن است دقیقاً همان نوع نوشتههای انسانی را که به آرامی دستکاری شده بود، مهر بزند که قانون برای رها کردن آن نوشته شده است. در عمل، علامت هر چیزی را که کلود پردازش میکرد، نشان میدهد - حتی سندی که یک انسان نوشته و فقط از کلود خواسته است که صیقل دهد.
کاربران از گرفتار شدن در محل کار و مدرسه می ترسند
واکنش کاربر سریع بوده است. TechCrunch در 13 آگوست گزارش داد که برخی از کاربران کلود "از اینکه واترمارک های جدید Anthropic آنها را در محل کار و کلاس های خود استفاده می کنند عصبانی هستند." کارمندانی که برای پیشنویس ایمیلها، گزارشها یا اسلایدها به کلود تکیه میکنند - و دانشآموزانی که از آن در تکالیف استفاده میکنند - اکنون با این احتمال روبرو هستند که یک رئیس یا مربی بتواند دخالت هوش مصنوعی را با یک ابزار تشخیص تأیید کند.
Ars Technica پویایی را به عنوان یک "اسکارلت نامه" در نظر گرفت - نشانی نامرئی از استفاده از هوش مصنوعی که خواننده نمی تواند آن را ببیند اما به زودی موسسات ممکن است. از آنجایی که واترمارک با متن از طریق کپی پیست و تغییر قالب حرکت می کند، دفاع معمولی «من فقط کمی آن را ویرایش کردم» دیگر اثر انگشت هوش مصنوعی را پشت سر نمی گذارد.
بازار حذف از قبل در حال ظهور است
جایی که یک واترمارک وجود دارد، صنعت حذف دنبال میشود. SC Media گزارش داد که بازاری برای ابزارهای حذف واترمارک هوش مصنوعی در روزهای پس از بهروزرسانی Claude در حال ظهور است. رمزگشایی مستند کرد که سازندگان فعالانه در تلاش برای شکستن طرح علامتگذاری هستند و نحوه رفتار آن را تحت بازنویسی، ترجمه و قالببندی مجدد بررسی میکنند.
آزمایشهای اولیه نشان میدهد که واترمارک در برابر جابجایی معمولی محکم است اما در شرایط حرفهای نشتی دارد. پوشش New Stack به این نتیجه رسید که این علامت "با کپی پیست زنده می ماند، اما نه از جریان کار واقعی توسعه دهنده" - به این معنی که توسعه دهندگان نرم افزاری که به طور عمده کدهای پیشنهادی هوش مصنوعی را به عنوان بخشی از مهندسی معمولی دوباره کار می کنند، ممکن است علامت را بدون هیچ قصدی پاک کنند.
چگونه علامت در واقع کار می کند
یک توضیح تصویری به طور گسترده به اشتراک گذاشته شده در declaude.org مکانیسم را تجزیه می کند. متن هیچ پیکسلی برای پنهان کردن داده ها در آن ندارد و هیچ ابرداده ای از کپی پیست نمی ماند، بنابراین واترمارک در «انتخاب بین کلمات» زندگی می کند. همانطور که یک مدل می نویسد، به طور مکرر از بین چندین کلمه بعدی که به همان اندازه قابل قبول هستند، انتخاب می کند. یک کلید رمزنگاری مخفی، بی سر و صدا آن انتخاب ها را به سمت الگویی سوق می دهد که فقط دارنده کلید می تواند آن را تشخیص دهد.
این تکنیک به تحقیقات Kirchenbauer et al. از سال 2023، که کلمات نامزد را به لیست های "سبز" و "قرمز" تقسیم کرد و نسل را به سمت نشانه های سبز متمایل کرد. SynthID Google از طریق مسیری ظریفتر به مقصد مشابهی میرسد، و Google از سال 2024 متنی را از برنامه Gemini و تجربه وب علامت گذاری کرده است - API آن یک استثناء مستند بوده است. از آگوست 2026، مدلهای جدید کلود، متن را در سطح مدل علامتگذاری میکنند و مدلهای قبلی نیز قرار است دنبال شوند.
شکاکان می گویند که حذف بی اهمیت می ماند
همه متقاعد نشده اند که مسابقه تسلیحاتی به نفع آنتروپیک است. مهندس شان گودکه در مقالهای که به طور گسترده منتشر شد، استدلال کرد که حذف واترمارکهای متن «همیشه بیاهمیت خواهد بود» زیرا متن یک رسانه بسیار فشرده است – هر تغییری که به اندازه کافی قوی باشد که از حذف قطعی جان سالم به در ببرد، تغییری است که خواننده انسانی متوجه آن خواهد شد. ابزارهای بازنویسی، رفت و آمدهای ترجمه و بازنویسی عمدی، همگی الگوهای آماری را بدون تحقیر معنا تهدید می کنند.
این بحث در جوامع توسعهدهنده در حال انجام است: دو توضیحدهنده واترمارکینگ جداگانه در میان داستانهای مورد بحث در اخبار هکر این هفته قرار گرفتند و صدها نقطه تعامل را بین آنها جلب کردند.
بعد چه اتفاقی می افتد
Anthropic گفته است که در نهایت جزئیات مربوط به نحوه تشخیص علائم را به اشتراک می گذارد - پشتیبانی فنی که مقررات اتحادیه اروپا نیاز دارد - اما تا زمانی که یک ابزار تشخیص عمومی ارسال شود، طرف های خارجی نمی توانند تأیید کنند که واقعاً علامت گذاری چقدر دقیق است. این شرکت همچنین اذعان کرده است که واترمارکها روی «برخی پلتفرمها یا ویژگیهایی» که از آنها پشتیبانی نمیکنند، عمل نمیکنند.
با توجه به اینکه مدلهای قدیمیتر با ضربالاجل انطباق در دسامبر 2026 مواجه هستند و آزمایشگاههای رقیب در حال بررسی هستند تا ببینند آیا کاربران آنتروپیک را به دلیل شفافیت مجازات میکنند یا خیر، چند ماه آینده پیشنهادی را آزمایش خواهند کرد که صنعت سالها از آن اجتناب کرده است: اینکه آیا ارائهدهندگان هوش مصنوعی میتوانند خروجی خود را قابل ردیابی کنند بدون اینکه آن را برای افرادی که به آن متکی هستند سمی کنند.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →