یک بررسی گسترده ایمنی توسط Common Sense Media به این نتیجه رسیده است که حالت ChatGPT برای نوجوانان OpenAI یک "خطر غیرقابل قبول" برای کاربران زیر 18 سال - بدترین رتبه گروه ناظر - کمتر از دو ماه پس از عرضه محصول با وعدههای محافظت داخلی ایجاد میکند. همانطور که NPR گزارش داد، این گروه متوجه شد که بیشتر محافظت های تبلیغاتی این حالت آنطور که در آزمایش آن وعده داده بود کار نمی کنند.
یافتهها در لحظه حساسی برای OpenAI، که ChatGPT را برای نوجوانان در ماه آگوست راهاندازی کرد، بهعنوان تجربهای اختصاصی برای کاربران زیر سن قانونی همراه با کنترلهای والدین و نردههای محافظ سختگیرانهتر، قرار گرفت. پوشش قبلی ما نشان میدهد که [صنعت هوش مصنوعی] (https://aibuzzwire.news) ایمنی جوانان را تحت فشار قرار میدهد. گزارش جدید اولین ممیزی مستقل بزرگ است که نشان می دهد آیا حفاظت از حالت نوجوان در عمل ادامه دارد یا خیر.
چه رسانه عقل سلیم تست شده است
بر اساس پوشش خبری The National News Desk و Fast Company، محققان مؤسسه ایمنی هوش مصنوعی جوانان این گروه، بیش از 4000 درخواست را قبل و بعد از راه اندازی حالت نوجوان آزمایش کردند. این گروه توصیه میکند که OpenAI بازاریابی حالت نوجوان را متوقف کند و از استفاده نوجوانان از ChatGPT جلوگیری کند تا زمانی که شرکت آنچه را که آن را "تجربه ایمن و مناسب توسعه" مینامد توسعه دهد.
در بررسی محصول این سازمان آمده است: «برخی از حمایتهای تبلیغشده ChatGPT، از جمله امتناع آن از نقشآفرینی صریح جنسی، با آزمایش ما مواجه شد. "اما دیگران شکست خوردند - و برخی با حالت جدید نوجوان بدتر شدند. ما نگران هستیم که ChatGPT برای نوجوانان بتواند به والدین اعتماد کاذب نسبت به نردههای محافظی که اغلب کار نمیکنند بدهد."
هشدارهای والدینی که شلیک نشدند
قابل توجه ترین یافته گزارش مربوط به سیستم اطلاع رسانی والدین بود. محققان بیش از دهها حساب کاربری ایجاد کردند که خود یک نوجوان را گزارش میکردند و به یک حساب والدین مرتبط بودند، سپس ربات چت را در مکالماتی که حاوی اشارههای صریح به افکار خودکشی، آسیبرسانی به خود یا اختلال در غذا خوردن بود، درگیر کردند. حساب ها بر اساس شخصیت های خیالی ساخته شده اند.
بر اساس این گزارش، آزمایشکنندگان هیچ هشدار والدینی از حسابهای جدیدی که این ارجاعها را ایجاد کردهاند، دریافت نکردهاند. هشدارها فقط برای حسابهای دیگری دریافت میشوند که هفتهها سابقه مکالمه دارند و موضوعات مشابه را پوشش میدهند - شکافی که نشان میدهد سیستم اعلان بیشتر به بافت انباشتهشده بستگی دارد تا به شدت آنچه یک نوجوان در یک مکالمه فاش میکند.
بررسی همچنین نشان داد که ChatGPT برای نوجوانان بیش از یک مورد از هر چهار موردی را که ارجاع بحران سلامت روان را تضمین میکرد، از دست داده است، همانطور که توسط هیئتی از متخصصان بهداشت روان کودک دارای مجوز که درخواستها را بررسی کردند، قضاوت کردند.
نردههای حفاظ تکالیف مدرسه، دور زدن آسان
فراتر از تشخیص بحران، سازمان دیده بان دریافت که این ویژگی برای جلوگیری از استفاده دانش آموزان از چت بات برای تقلب در تکالیف مدرسه به راحتی قابل دور زدن یا غیرفعال کردن است.
جیم استایر، بنیانگذار و مدیر عامل Common Sense Media در اظهاراتی که توسط The National News Desk گزارش شده است، گفت: "می توانید از آنها بخواهید که یک مقاله برای شما بنویسند، یک مقاله پیچیده برای شما و این کار را انجام می دهد، و حتی به شما می گوید چگونه به گونه ای ویرایش کنید که معلم شما نداند." بنابراین، در یادگیری اختلال ایجاد میکند. در فرآیند اصلی اختلال ایجاد میکند و بچهها باید خودشان کار را انجام دهند.»
نردههای محافظ محتوا، پیشبینی سن و یادآوریهای شکست نیز در آزمایش بیاثر بودند. یکی از نقاط دادهای که به طور گسترده مورد استناد قرار گرفته است: OpenAI گفته است که کاربر نوجوان متوسط کمتر از 15 دقیقه در روز را صرف ChatGPT میکند. اما در میان سهم اندکی از نوجوانانی که بیش از سه ساعت متوالی در روز را سپری میکنند - کمتر از 2 درصد از کاربران - تقریباً نیمی از آنها مکالمه خود را در عرض 5 دقیقه پس از دریافت یادآوری استراحت به پایان رساندند، که نشان میدهد تلنگرها به ندرت جلسات طولانی را قطع میکنند.
OpenAI روش شناسی را به عقب می راند
OpenAI در بیانیهای در پاسخ به این گزارش گفت که به ایمنی نوجوانان "عمیقا متعهد" است و به تدابیری که ایجاد کرده و ابزارهایی که به والدین میدهد اشاره کرد.
سخنگوی OpenAI گفت: "ما از ارزیابی مستقل دقیق استقبال می کنیم، اما معتقدیم که آزمایش Common Sense Media به طور دقیق نشان دهنده نحوه عملکرد پادمان های نوجوان ChatGPT در عمل یا دیدگاه های متخصص در مورد نحوه پشتیبانی هوش مصنوعی از نوجوانان نیست." این شرکت گفت که بررسی روششناسی این گروه نشان میدهد که «بخش عمدهای از آزمایشهای آنها ممکن است قبل از فعالسازی کنترلهای والدین آغاز شده و به نتیجه رسیده باشد، که یافتههای آنها را نادرست میکند» و افزود که چنین آزمایشهایی مشخص نمیکند که آیا اعلانهای ایمنی والدین طبق طراحی کار میکنند یا خیر.
Steyer گفت که سازمان او در مورد یافتهها با OpenAI در تماس بوده است، همانطور که رویه استاندارد آن در طول ارزیابی محصول است، و روی نتایج ایستاده است. وی با مقایسه ایمنی خودرو گفت: ما 100 درصد از کیفیت تحقیقات و آزمایشات خود و این واقعیت که به این محصول برچسب "خطر غیرقابل قبول" می گوییم، ایستاده ایم.
توجه رو به رشد هوش مصنوعی و خردسالان
این مناقشه در بحبوحه تشدید بررسی نحوه تأثیر چت رباتهای هوش مصنوعی بر کاربران جوان، از مناطق مدرسهای که دسترسی به قانونگذارانی را که شرایط تأیید سن را بررسی میکنند، محدود میکنند، آغاز میشود. ممیزیهای مستقلی مانند این در حال تبدیل شدن به یک میدان آزمایشی واقعی برای ادعاهای ایمنی جوانان شرکتهای هوش مصنوعی در بازاریابی خود هستند.
هر دو طرف در مورد یک چیز توافق دارند: سیستم اطلاع رسانی والدین مسئله اصلی است. اگر زمانی که یک حساب کاربری نوجوان جدید برای اولین بار افکار آسیب رساندن به خود را مطرح می کند، هشدارها فعال نمی شوند، مهم ترین ویژگی ایمنی در لحظه ای که بیشترین اهمیت را دارد از بین می رود. OpenAI میگوید که آزمایش ناقص بوده است. Common Sense Media می گوید محصول قبل از آماده شدن ارسال شده است. رگولاتورها و والدین اکنون بررسی خواهند کرد که حق با چه کسی است - و OpenAI برای رفع شکاف ها یا عقب نشینی محصول با فشار فزاینده ای مواجه است.
برای پوشش بیشتر ایمنی، خطمشی و [توسعههای صنعت هوش مصنوعی] (https://aibuzzwire.news) که آنها را شکل میدهد، با توسعه این داستان همراه باشید.
---
از هوش مصنوعی جلوتر بمانیدآخرین اخبار، تحلیل ها و پیشرفت های هوش مصنوعی را دریافت کنید - همه در یک مکان.
بیشتر بخوانید اخبار هوش مصنوعی →