OpenAI در 5 اکتبر اعلام کرد که شروع به اضافه کردن واترمارک های نامرئی به متن ایجاد شده توسط ChatGPT و Codex برای کاربران در اتحادیه اروپا می کند، که پاسخی مشخص به قوانین منشأ متن قانون هوش مصنوعی اتحادیه اروپا است. در یک پست وبلاگی با عنوان «رویکرد ما به قوانین منشأ متن اتحادیه اروپا»، این شرکت گفت که این واترمارکینگ «طی هفتههای آینده» برای خروجیهای واجد شرایط در بلوک اجرا خواهد شد، طرحی که در همان روز توسط TechCrunch، The Verge، BleepingComputer، Engadget و سایر رسانهها گزارش شد.
فناوری پشت این تغییر textGrain نام دارد. textGrain به جای تعبیه یک علامت قابل مشاهده، با کنترل نامحسوس کلمات انتخاب مدل کار می کند تا متن حاصل دارای یک الگوی آماری باشد که می تواند بعداً شناسایی شود. خوانندگان هنگام مصرف یا کپی متن تولید شده توسط هوش مصنوعی متوجه هیچ چیز نمی شوند. تشخیص نیاز به دسترسی به آشکارساز OpenAI دارد که برای عموم در دسترس نیست. برای نگاهی گسترده به نحوه برخورد تنظیمکنندهها و آزمایشگاهها بر سر قوانین هوش مصنوعی، پوشش خطمشی مداوم هوش مصنوعی ما را دنبال کنید.
نحوه کار واترمارکینگ textGrain
رویکرد OpenAI فرآیند انتخاب توکن را در طول تولید اصلاح میکند. طبق گزارش BleepingComputer، این شرکت میگوید textGrain «گزینههای کلمه مدل را کمی تغییر میدهد تا یک الگوی آماری ایجاد کند که بعداً قابل شناسایی باشد». هنگامی که متن خوانده می شود یا کپی می شود، واترمارک نامرئی است و OpenAI ادعا می کند که کیفیت خروجی را کاهش نمی دهد.
سمت تشخیص عمدا محدود شده است. در کنار راهاندازی واترمارک، OpenAI در حال باز کردن برنامههای کاربردی برای آشکارساز واترمارک خود است، اما دسترسی در ابتدا به محققان و سازمانهای متخصص تایید شده محدود خواهد شد. این طراحی قابلیت تشخیص را از دست هر کسی که امیدوار به استفاده از آن است دور نگه میدارد، اما همچنین به این معنی است که ناشران، معلمان و کارفرمایان نمیتوانند مستقلاً تأیید کنند که آیا یک قطعه متن واترمارک شده است یا خیر.
دسترسی به API در سراسر جهان انتخاب شده است
دستور اتحادیه اروپا برای خروجی ChatGPT و Codex در بلوک اعمال می شود، اما OpenAI به طور همزمان به توسعه دهندگان در همه جا حق انتخاب می دهد. از 5 اکتبر، توسعهدهندگان API در سراسر جهان میتوانند واترمارک نوشتاری را برای مدلهای پشتیبانیشده انتخاب کنند. این ویژگی بهطور پیشفرض در API غیرفعال میماند، تصمیمی که The New Stack بهعنوان تضاد با رویکرد Anthropic برجسته میکند، که در اوایل امسال علامتگذاری منشأ را برای ترافیک اتحادیه اروپا در واکنش خود به قوانین مشابه روشن کرد.
این وضعیت انتخابی به توسعه دهندگانی که نگران عوارض جانبی پیش بینی نشده هستند اطمینان خاطر می دهد. واترمارکینگ آماری نحوه نمونهبرداری توکنها را تغییر میدهد، و هرگونه تغییر در تولید، حداقل خطر تئوری تغییر رفتار در موارد لبه را به همراه دارد. با قرار دادن واترمارکینگ بهجای یک پرچم پیشفرض، OpenAI تصمیم انطباق را به شرکتهایی که بر اساس مدلهای خود ساخته میشوند، منتقل میکند.
چرا قانون هوش مصنوعی اتحادیه اروپا این کار را مجبور کرد؟
مقررات شفافیت قانون هوش مصنوعی اتحادیه اروپا مستلزم آن است که متن تولید شده توسط هوش مصنوعی به عنوان تولید شده توسط ماشین قابل شناسایی باشد، تعهدی که هم OpenAI و هم Anthropic را به سمت طرح های واترمارک آماری سوق داد. پست وبلاگ OpenAI textGrain را به عنوان اجرای آن الزامات منشأ چارچوب بندی می کند، و PYMNTS انتشار را به عنوان ملاقات OpenAI با "اجبارات قانون هوش مصنوعی اتحادیه اروپا" به طور مستقیم گزارش داد.
زمان قابل توجه است. اعلام واترمارک در میان یک کشش غیرمعمول متلاطم برای وضعیت عمومی OpenAI قرار میگیرد: همان چرخه خبری خروج دیوید رابینسون، رهبر ایمنی، تحقیقات FTC در مورد خطرات مصرفکننده در آزمایشگاههای بزرگ هوش مصنوعی و جو شکایت سهامداران را به همراه داشت که شرکت را زیر ذره بین نگه داشته است. واترمارک یکی از معدود خواسته های نظارتی است که OpenAI می تواند به طور کامل با زیرساخت به جای تغییرات محصول برآورده کند، که ممکن است توضیح دهد که چرا ابتدا ارسال شد.
The Catch: Watermarks Break Under Editing
OpenAI خود محدودیت اساسی را پذیرفته است. این شرکت اعتراف میکند که واترمارک آن هنگام ویرایش متن ناپدید میشود، و دههها تحقیق در مورد استگانوگرافی زبانی این نگرانی را بازمیگرداند: بازنویسی، ترجمه یا حتی بازنویسی ساده میتواند واترمارکهای آماری را از بین ببرد. هر کسی که مصمم به شستشوی متن هوش مصنوعی از طریق ابزار "humanizer" باشد، احتمالاً موفق خواهد شد.
این ضعف، تنظیمکنندهها را از درخواست واترمارک بازدارد و آزمایشگاهها را از ارسال آن منع نکرده است. هدف واقع بینانه منشأ ضد دستکاری نیست، بلکه افزایش هزینه فریب تصادفی در مقیاس است، همان منطقی که بر واترمارک های ارز حاکم است. منتقدان، از جمله برخی گروههای ایمنی هوش مصنوعی که نسبت به اقدامات داوطلبانه صنعت بدبین بودهاند، استدلال میکنند که آشکارسازهایی که فقط برای سازمانهای تایید شده قابل دسترسی هستند، برای معلمان، ویراستاران یا پلتفرمهایی که تلاش میکنند سیاستهای محتوای هوش مصنوعی خود را اعمال کنند، کار چندانی نمیکنند.
چه معنایی برای کاربران و توسعه دهندگان دارد
برای کاربران ChatGPT و Codex در داخل اتحادیه اروپا، هیچ چیز به وضوح تغییر نخواهد کرد. متن یکسان به نظر می رسد و احساس می شود و هیچ برچسبی روی خروجی ها ظاهر نمی شود. واترمارک به سادگی وجود خواهد داشت و در اصل توسط شرکای تایید شده OpenAI قابل تشخیص است.
برای توسعهدهندگان، پرچم API فوراً به دست میآید و ارزش ارزیابی دقیق را دارد: روشن کردن آن به معنای پذیرش تغییرات جزئی در نمونهبرداری رمز در تمام مراحل، حتی برای کاربران غیر اتحادیه اروپا است، زیرا تنظیمات API جهانی است. تیمهایی با تأخیر دقیق یا بودجههای کیفی ممکن است بخواهند قبل از تغییر سوئیچ، تولید واترمارکشده را در مقابل تنظیمات فعلیشان محک بزنند.
OpenAI می گوید جزئیات بیشتر در مورد مدل های واجد شرایط و فرآیند درخواست آشکارساز در هفته های آینده ارائه خواهد شد. از آنجایی که سایر آزمایشگاهها با تعهدات اتحادیه اروپا روبرو هستند، بعید است که textGrain آخرین طرح واترمارکینگی باشد که صنعت در سال جاری به کار گرفته است.
از هوش مصنوعی جلوتر بمانید
مقررات در حال تغییر شکل دادن به نحوه عملکرد محصولات هوش مصنوعی در زیر پوشش است. [آخرین پیشرفتهای هوش مصنوعی را در AI Buzz Wire دریافت کنید] (https://aibuzzwire.news)، با تجزیه و تحلیل خطمشی و اخبار مدل که در طول روز بهروزرسانی میشوند.
[اخبار بیشتر هوش مصنوعی را اینجا بخوانید] (https://aibuzzwire.news).
