چند روز پس از اینکه Anthropic شروع به انتشار واترمارک های نامرئی بر روی خروجی های متن و تصویر کلود کرد، این ویژگی دقیقاً همان نوع اصطکاک را ایجاد می کند که منتقدان پیش بینی کرده بودند: کاربران نگران هستند که علائم آنها را برای استفاده از هوش مصنوعی در محل کار یا کلاس در معرض نمایش قرار دهد، توسعه دهندگان نحوه رفتار واترمارک را در جریان های کاری کدنویسی واقعی مستند می کنند، و یک ابزار کوچک اما قابل مشاهده برای بازار.

Anthropic می گوید این تغییر کلود را با قانون هوش مصنوعی اتحادیه اروپا مطابقت می دهد، قوانین شفافیت آن پس از 2 اوت 2026 برای مدل های جدید قابل اجرا شد. ماده 50 این قانون از ارائه دهندگان سیستم هوش مصنوعی می خواهد که خروجی های تولید شده توسط ماشین را "قابل تشخیص به صورت مصنوعی تولید کنند." آنتروپیک تأیید کرد که تمام مدل‌های جدید ارائه شده در سطح جهانی - نه تنها در اتحادیه اروپا - محتوای تولید شده توسط هوش مصنوعی را «از روز اول» با مهلتی تا دسامبر 2026 برای به‌روزرسانی مدل‌های منتشر شده قبلی مشخص می‌کنند. For more context on this story, see our ongoing artificial intelligence updates.

خود علائم نامرئی هستند. بر اساس یک مقاله پشتیبانی آنتروپیک، متن خروجی «دارای واترمارک جاسازی شده» است، در حالی که فایل‌های تولید شده شامل ابرداده‌های منشأ امضا شده دیجیتالی است که قالب آن را پشتیبانی می‌کند. مدل‌های قبلی کلود به‌روزرسانی خواهند شد تا متن را نیز علامت‌گذاری کنند، به این معنی که کل ناوگان در نهایت خروجی خود را نشان خواهد داد.

واترمارک متن ویرایش شده را پوشش می دهد، نه فقط متن تولید شده را

جزئیاتی که کنجکاوی فنی را به واکنش متقابل تبدیل کرد توسط Ars Technica در 13 آگوست فاش شد: واترمارک برای محتوای فرایندهای کلود اعمال می شود، نه تنها محتوایی که از ابتدا تولید می کند. Ars این رویکرد را به‌عنوان «nuke it from orbit» توصیف کرد، زیرا Anthropic تمام محتوای پردازش‌شده را در جایی که پشتیبانی می‌شود علامت‌گذاری می‌کند، حتی اگر راهنمایی اتحادیه اروپا به آن نیازی نداشته باشد در جایی که یک سیستم هوش مصنوعی «یک عملکرد کمکی برای ویرایش استاندارد» را انجام می‌دهد - مثال مقررات اصلاح دستوری است - یا جایی که متن کاربر را «تغییر اساسی» نمی‌کند.

این تمایز اهمیت دارد زیرا واترمارکی که در سطح مدل اعمال می‌شود، نمی‌تواند تولید عمده‌فروشی را از یک اصلاح با کاما متمایز کند. اشلی بلنگر از Ars Technica خاطرنشان کرد که کلود ممکن است دقیقاً همان نوع نوشته‌های انسانی را که به آرامی دستکاری شده بود، مهر بزند که قانون برای رها کردن آن نوشته شده است. در عمل، علامت هر چیزی را که کلود پردازش می‌کرد، نشان می‌دهد - حتی سندی که یک انسان نوشته و فقط از کلود خواسته است که صیقل دهد.

کاربران از گرفتار شدن در محل کار و مدرسه می ترسند

واکنش کاربر سریع بوده است. TechCrunch در 13 آگوست گزارش داد که برخی از کاربران کلود "از اینکه واترمارک های جدید Anthropic آنها را در محل کار و کلاس های خود استفاده می کنند عصبانی هستند." کارمندانی که برای پیش‌نویس ایمیل‌ها، گزارش‌ها یا اسلایدها به کلود تکیه می‌کنند - و دانش‌آموزانی که از آن در تکالیف استفاده می‌کنند - اکنون با این احتمال روبرو هستند که یک رئیس یا مربی بتواند دخالت هوش مصنوعی را با یک ابزار تشخیص تأیید کند.

Ars Technica پویایی را به عنوان یک "اسکارلت نامه" در نظر گرفت - نشانی نامرئی از استفاده از هوش مصنوعی که خواننده نمی تواند آن را ببیند اما به زودی موسسات ممکن است. از آنجایی که واترمارک با متن از طریق کپی پیست و تغییر قالب حرکت می کند، دفاع معمولی «من فقط کمی آن را ویرایش کردم» دیگر اثر انگشت هوش مصنوعی را پشت سر نمی گذارد.

بازار حذف از قبل در حال ظهور است

جایی که یک واترمارک وجود دارد، صنعت حذف دنبال می‌شود. SC Media گزارش داد که بازاری برای ابزارهای حذف واترمارک هوش مصنوعی در روزهای پس از به‌روزرسانی Claude در حال ظهور است. رمزگشایی مستند کرد که سازندگان فعالانه در تلاش برای شکستن طرح علامت‌گذاری هستند و نحوه رفتار آن را تحت بازنویسی، ترجمه و قالب‌بندی مجدد بررسی می‌کنند.

آزمایش‌های اولیه نشان می‌دهد که واترمارک در برابر جابجایی معمولی محکم است اما در شرایط حرفه‌ای نشتی دارد. پوشش New Stack به این نتیجه رسید که این علامت "با کپی پیست زنده می ماند، اما نه از جریان کار واقعی توسعه دهنده" - به این معنی که توسعه دهندگان نرم افزاری که به طور عمده کدهای پیشنهادی هوش مصنوعی را به عنوان بخشی از مهندسی معمولی دوباره کار می کنند، ممکن است علامت را بدون هیچ قصدی پاک کنند.

چگونه علامت در واقع کار می کند

یک توضیح تصویری به طور گسترده به اشتراک گذاشته شده در declaude.org مکانیسم را تجزیه می کند. متن هیچ پیکسلی برای پنهان کردن داده ها در آن ندارد و هیچ ابرداده ای از کپی پیست نمی ماند، بنابراین واترمارک در «انتخاب بین کلمات» زندگی می کند. همانطور که یک مدل می نویسد، به طور مکرر از بین چندین کلمه بعدی که به همان اندازه قابل قبول هستند، انتخاب می کند. یک کلید رمزنگاری مخفی، بی سر و صدا آن انتخاب ها را به سمت الگویی سوق می دهد که فقط دارنده کلید می تواند آن را تشخیص دهد.

این تکنیک به تحقیقات Kirchenbauer et al. از سال 2023، که کلمات نامزد را به لیست های "سبز" و "قرمز" تقسیم کرد و نسل را به سمت نشانه های سبز متمایل کرد. SynthID Google از طریق مسیری ظریف‌تر به مقصد مشابهی می‌رسد، و Google از سال 2024 متنی را از برنامه Gemini و تجربه وب علامت گذاری کرده است - API آن یک استثناء مستند بوده است. از آگوست 2026، مدل‌های جدید کلود، متن را در سطح مدل علامت‌گذاری می‌کنند و مدل‌های قبلی نیز قرار است دنبال شوند.

شکاکان می گویند که حذف بی اهمیت می ماند

همه متقاعد نشده اند که مسابقه تسلیحاتی به نفع آنتروپیک است. مهندس شان گودکه در مقاله‌ای که به طور گسترده منتشر شد، استدلال کرد که حذف واترمارک‌های متن «همیشه بی‌اهمیت خواهد بود» زیرا متن یک رسانه بسیار فشرده است – هر تغییری که به اندازه کافی قوی باشد که از حذف قطعی جان سالم به در ببرد، تغییری است که خواننده انسانی متوجه آن خواهد شد. ابزارهای بازنویسی، رفت و آمدهای ترجمه و بازنویسی عمدی، همگی الگوهای آماری را بدون تحقیر معنا تهدید می کنند.

این بحث در جوامع توسعه‌دهنده در حال انجام است: دو توضیح‌دهنده واترمارکینگ جداگانه در میان داستان‌های مورد بحث در اخبار هکر این هفته قرار گرفتند و صدها نقطه تعامل را بین آنها جلب کردند.

بعد چه اتفاقی می افتد

Anthropic گفته است که در نهایت جزئیات مربوط به نحوه تشخیص علائم را به اشتراک می گذارد - پشتیبانی فنی که مقررات اتحادیه اروپا نیاز دارد - اما تا زمانی که یک ابزار تشخیص عمومی ارسال شود، طرف های خارجی نمی توانند تأیید کنند که واقعاً علامت گذاری چقدر دقیق است. این شرکت همچنین اذعان کرده است که واترمارک‌ها روی «برخی پلت‌فرم‌ها یا ویژگی‌هایی» که از آنها پشتیبانی نمی‌کنند، عمل نمی‌کنند.

با توجه به اینکه مدل‌های قدیمی‌تر با ضرب‌الاجل انطباق در دسامبر 2026 مواجه هستند و آزمایشگاه‌های رقیب در حال بررسی هستند تا ببینند آیا کاربران آنتروپیک را به دلیل شفافیت مجازات می‌کنند یا خیر، چند ماه آینده پیشنهادی را آزمایش خواهند کرد که صنعت سال‌ها از آن اجتناب کرده است: اینکه آیا ارائه‌دهندگان هوش مصنوعی می‌توانند خروجی خود را قابل ردیابی کنند بدون اینکه آن را برای افرادی که به آن متکی هستند سمی کنند.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →