OpenAI در 5 اکتبر اعلام کرد که شروع به اضافه کردن واترمارک های نامرئی به متن ایجاد شده توسط ChatGPT و Codex برای کاربران در اتحادیه اروپا می کند، که پاسخی مشخص به قوانین منشأ متن قانون هوش مصنوعی اتحادیه اروپا است. در یک پست وبلاگی با عنوان «رویکرد ما به قوانین منشأ متن اتحادیه اروپا»، این شرکت گفت که این واترمارکینگ «طی هفته‌های آینده» برای خروجی‌های واجد شرایط در بلوک اجرا خواهد شد، طرحی که در همان روز توسط TechCrunch، The Verge، BleepingComputer، Engadget و سایر رسانه‌ها گزارش شد.

فناوری پشت این تغییر textGrain نام دارد. textGrain به جای تعبیه یک علامت قابل مشاهده، با کنترل نامحسوس کلمات انتخاب مدل کار می کند تا متن حاصل دارای یک الگوی آماری باشد که می تواند بعداً شناسایی شود. خوانندگان هنگام مصرف یا کپی متن تولید شده توسط هوش مصنوعی متوجه هیچ چیز نمی شوند. تشخیص نیاز به دسترسی به آشکارساز OpenAI دارد که برای عموم در دسترس نیست. برای نگاهی گسترده به نحوه برخورد تنظیم‌کننده‌ها و آزمایشگاه‌ها بر سر قوانین هوش مصنوعی، پوشش خط‌مشی مداوم هوش مصنوعی ما را دنبال کنید.

نحوه کار واترمارکینگ textGrain

رویکرد OpenAI فرآیند انتخاب توکن را در طول تولید اصلاح می‌کند. طبق گزارش BleepingComputer، این شرکت می‌گوید textGrain «گزینه‌های کلمه مدل را کمی تغییر می‌دهد تا یک الگوی آماری ایجاد کند که بعداً قابل شناسایی باشد». هنگامی که متن خوانده می شود یا کپی می شود، واترمارک نامرئی است و OpenAI ادعا می کند که کیفیت خروجی را کاهش نمی دهد.

سمت تشخیص عمدا محدود شده است. در کنار راه‌اندازی واترمارک، OpenAI در حال باز کردن برنامه‌های کاربردی برای آشکارساز واترمارک خود است، اما دسترسی در ابتدا به محققان و سازمان‌های متخصص تایید شده محدود خواهد شد. این طراحی قابلیت تشخیص را از دست هر کسی که امیدوار به استفاده از آن است دور نگه می‌دارد، اما همچنین به این معنی است که ناشران، معلمان و کارفرمایان نمی‌توانند مستقلاً تأیید کنند که آیا یک قطعه متن واترمارک شده است یا خیر.

دسترسی به API در سراسر جهان انتخاب شده است

دستور اتحادیه اروپا برای خروجی ChatGPT و Codex در بلوک اعمال می شود، اما OpenAI به طور همزمان به توسعه دهندگان در همه جا حق انتخاب می دهد. از 5 اکتبر، توسعه‌دهندگان API در سراسر جهان می‌توانند واترمارک نوشتاری را برای مدل‌های پشتیبانی‌شده انتخاب کنند. این ویژگی به‌طور پیش‌فرض در API غیرفعال می‌ماند، تصمیمی که The New Stack به‌عنوان تضاد با رویکرد Anthropic برجسته می‌کند، که در اوایل امسال علامت‌گذاری منشأ را برای ترافیک اتحادیه اروپا در واکنش خود به قوانین مشابه روشن کرد.

این وضعیت انتخابی به توسعه دهندگانی که نگران عوارض جانبی پیش بینی نشده هستند اطمینان خاطر می دهد. واترمارکینگ آماری نحوه نمونه‌برداری توکن‌ها را تغییر می‌دهد، و هرگونه تغییر در تولید، حداقل خطر تئوری تغییر رفتار در موارد لبه را به همراه دارد. با قرار دادن واترمارکینگ به‌جای یک پرچم پیش‌فرض، OpenAI تصمیم انطباق را به شرکت‌هایی که بر اساس مدل‌های خود ساخته می‌شوند، منتقل می‌کند.

چرا قانون هوش مصنوعی اتحادیه اروپا این کار را مجبور کرد؟

مقررات شفافیت قانون هوش مصنوعی اتحادیه اروپا مستلزم آن است که متن تولید شده توسط هوش مصنوعی به عنوان تولید شده توسط ماشین قابل شناسایی باشد، تعهدی که هم OpenAI و هم Anthropic را به سمت طرح های واترمارک آماری سوق داد. پست وبلاگ OpenAI textGrain را به عنوان اجرای آن الزامات منشأ چارچوب بندی می کند، و PYMNTS انتشار را به عنوان ملاقات OpenAI با "اجبارات قانون هوش مصنوعی اتحادیه اروپا" به طور مستقیم گزارش داد.

زمان قابل توجه است. اعلام واترمارک در میان یک کشش غیرمعمول متلاطم برای وضعیت عمومی OpenAI قرار می‌گیرد: همان چرخه خبری خروج دیوید رابینسون، رهبر ایمنی، تحقیقات FTC در مورد خطرات مصرف‌کننده در آزمایشگاه‌های بزرگ هوش مصنوعی و جو شکایت سهامداران را به همراه داشت که شرکت را زیر ذره بین نگه داشته است. واترمارک یکی از معدود خواسته های نظارتی است که OpenAI می تواند به طور کامل با زیرساخت به جای تغییرات محصول برآورده کند، که ممکن است توضیح دهد که چرا ابتدا ارسال شد.

The Catch: Watermarks Break Under Editing

OpenAI خود محدودیت اساسی را پذیرفته است. این شرکت اعتراف می‌کند که واترمارک آن هنگام ویرایش متن ناپدید می‌شود، و دهه‌ها تحقیق در مورد استگانوگرافی زبانی این نگرانی را بازمی‌گرداند: بازنویسی، ترجمه یا حتی بازنویسی ساده می‌تواند واترمارک‌های آماری را از بین ببرد. هر کسی که مصمم به شستشوی متن هوش مصنوعی از طریق ابزار "humanizer" باشد، احتمالاً موفق خواهد شد.

این ضعف، تنظیم‌کننده‌ها را از درخواست واترمارک بازدارد و آزمایشگاه‌ها را از ارسال آن منع نکرده است. هدف واقع بینانه منشأ ضد دستکاری نیست، بلکه افزایش هزینه فریب تصادفی در مقیاس است، همان منطقی که بر واترمارک های ارز حاکم است. منتقدان، از جمله برخی گروه‌های ایمنی هوش مصنوعی که نسبت به اقدامات داوطلبانه صنعت بدبین بوده‌اند، استدلال می‌کنند که آشکارسازهایی که فقط برای سازمان‌های تایید شده قابل دسترسی هستند، برای معلمان، ویراستاران یا پلتفرم‌هایی که تلاش می‌کنند سیاست‌های محتوای هوش مصنوعی خود را اعمال کنند، کار چندانی نمی‌کنند.

چه معنایی برای کاربران و توسعه دهندگان دارد

برای کاربران ChatGPT و Codex در داخل اتحادیه اروپا، هیچ چیز به وضوح تغییر نخواهد کرد. متن یکسان به نظر می رسد و احساس می شود و هیچ برچسبی روی خروجی ها ظاهر نمی شود. واترمارک به سادگی وجود خواهد داشت و در اصل توسط شرکای تایید شده OpenAI قابل تشخیص است.

برای توسعه‌دهندگان، پرچم API فوراً به دست می‌آید و ارزش ارزیابی دقیق را دارد: روشن کردن آن به معنای پذیرش تغییرات جزئی در نمونه‌برداری رمز در تمام مراحل، حتی برای کاربران غیر اتحادیه اروپا است، زیرا تنظیمات API جهانی است. تیم‌هایی با تأخیر دقیق یا بودجه‌های کیفی ممکن است بخواهند قبل از تغییر سوئیچ، تولید واترمارک‌شده را در مقابل تنظیمات فعلی‌شان محک بزنند.

OpenAI می گوید جزئیات بیشتر در مورد مدل های واجد شرایط و فرآیند درخواست آشکارساز در هفته های آینده ارائه خواهد شد. از آنجایی که سایر آزمایشگاه‌ها با تعهدات اتحادیه اروپا روبرو هستند، بعید است که textGrain آخرین طرح واترمارکینگی باشد که صنعت در سال جاری به کار گرفته است.

از هوش مصنوعی جلوتر بمانید

مقررات در حال تغییر شکل دادن به نحوه عملکرد محصولات هوش مصنوعی در زیر پوشش است. [آخرین پیشرفت‌های هوش مصنوعی را در AI Buzz Wire دریافت کنید] (https://aibuzzwire.news)، با تجزیه و تحلیل خط‌مشی و اخبار مدل که در طول روز به‌روزرسانی می‌شوند.

[اخبار بیشتر هوش مصنوعی را اینجا بخوانید] (https://aibuzzwire.news).