یک بررسی گسترده ایمنی توسط Common Sense Media به این نتیجه رسیده است که حالت ChatGPT برای نوجوانان OpenAI یک "خطر غیرقابل قبول" برای کاربران زیر 18 سال - بدترین رتبه گروه ناظر - کمتر از دو ماه پس از عرضه محصول با وعده‌های محافظت داخلی ایجاد می‌کند. همانطور که NPR گزارش داد، این گروه متوجه شد که بیشتر محافظت های تبلیغاتی این حالت آنطور که در آزمایش آن وعده داده بود کار نمی کنند.

یافته‌ها در لحظه حساسی برای OpenAI، که ChatGPT را برای نوجوانان در ماه آگوست راه‌اندازی کرد، به‌عنوان تجربه‌ای اختصاصی برای کاربران زیر سن قانونی همراه با کنترل‌های والدین و نرده‌های محافظ سخت‌گیرانه‌تر، قرار گرفت. پوشش قبلی ما نشان می‌دهد که [صنعت هوش مصنوعی] (https://aibuzzwire.news) ایمنی جوانان را تحت فشار قرار می‌دهد. گزارش جدید اولین ممیزی مستقل بزرگ است که نشان می دهد آیا حفاظت از حالت نوجوان در عمل ادامه دارد یا خیر.

چه رسانه عقل سلیم تست شده است

بر اساس پوشش خبری The National News Desk و Fast Company، محققان مؤسسه ایمنی هوش مصنوعی جوانان این گروه، بیش از 4000 درخواست را قبل و بعد از راه اندازی حالت نوجوان آزمایش کردند. این گروه توصیه می‌کند که OpenAI بازاریابی حالت نوجوان را متوقف کند و از استفاده نوجوانان از ChatGPT جلوگیری کند تا زمانی که شرکت آنچه را که آن را "تجربه ایمن و مناسب توسعه" می‌نامد توسعه دهد.

در بررسی محصول این سازمان آمده است: «برخی از حمایت‌های تبلیغ‌شده ChatGPT، از جمله امتناع آن از نقش‌آفرینی صریح جنسی، با آزمایش ما مواجه شد. "اما دیگران شکست خوردند - و برخی با حالت جدید نوجوان بدتر شدند. ما نگران هستیم که ChatGPT برای نوجوانان بتواند به والدین اعتماد کاذب نسبت به نرده‌های محافظی که اغلب کار نمی‌کنند بدهد."

هشدارهای والدینی که شلیک نشدند

قابل توجه ترین یافته گزارش مربوط به سیستم اطلاع رسانی والدین بود. محققان بیش از ده‌ها حساب کاربری ایجاد کردند که خود یک نوجوان را گزارش می‌کردند و به یک حساب والدین مرتبط بودند، سپس ربات چت را در مکالماتی که حاوی اشاره‌های صریح به افکار خودکشی، آسیب‌رسانی به خود یا اختلال در غذا خوردن بود، درگیر کردند. حساب ها بر اساس شخصیت های خیالی ساخته شده اند.

بر اساس این گزارش، آزمایش‌کنندگان هیچ هشدار والدینی از حساب‌های جدیدی که این ارجاع‌ها را ایجاد کرده‌اند، دریافت نکرده‌اند. هشدارها فقط برای حساب‌های دیگری دریافت می‌شوند که هفته‌ها سابقه مکالمه دارند و موضوعات مشابه را پوشش می‌دهند - شکافی که نشان می‌دهد سیستم اعلان بیشتر به بافت انباشته‌شده بستگی دارد تا به شدت آنچه یک نوجوان در یک مکالمه فاش می‌کند.

بررسی همچنین نشان داد که ChatGPT برای نوجوانان بیش از یک مورد از هر چهار موردی را که ارجاع بحران سلامت روان را تضمین می‌کرد، از دست داده است، همانطور که توسط هیئتی از متخصصان بهداشت روان کودک دارای مجوز که درخواست‌ها را بررسی کردند، قضاوت کردند.

نرده‌های حفاظ تکالیف مدرسه، دور زدن آسان

فراتر از تشخیص بحران، سازمان دیده بان دریافت که این ویژگی برای جلوگیری از استفاده دانش آموزان از چت بات برای تقلب در تکالیف مدرسه به راحتی قابل دور زدن یا غیرفعال کردن است.

جیم استایر، بنیانگذار و مدیر عامل Common Sense Media در اظهاراتی که توسط The National News Desk گزارش شده است، گفت: "می توانید از آنها بخواهید که یک مقاله برای شما بنویسند، یک مقاله پیچیده برای شما و این کار را انجام می دهد، و حتی به شما می گوید چگونه به گونه ای ویرایش کنید که معلم شما نداند." بنابراین، در یادگیری اختلال ایجاد می‌کند. در فرآیند اصلی اختلال ایجاد می‌کند و بچه‌ها باید خودشان کار را انجام دهند.»

نرده‌های محافظ محتوا، پیش‌بینی سن و یادآوری‌های شکست نیز در آزمایش بی‌اثر بودند. یکی از نقاط داده‌ای که به طور گسترده مورد استناد قرار گرفته است: OpenAI گفته است که کاربر نوجوان متوسط ​​کمتر از 15 دقیقه در روز را صرف ChatGPT می‌کند. اما در میان سهم اندکی از نوجوانانی که بیش از سه ساعت متوالی در روز را سپری می‌کنند - کمتر از 2 درصد از کاربران - تقریباً نیمی از آنها مکالمه خود را در عرض 5 دقیقه پس از دریافت یادآوری استراحت به پایان رساندند، که نشان می‌دهد تلنگرها به ندرت جلسات طولانی را قطع می‌کنند.

OpenAI روش شناسی را به عقب می راند

OpenAI در بیانیه‌ای در پاسخ به این گزارش گفت که به ایمنی نوجوانان "عمیقا متعهد" است و به تدابیری که ایجاد کرده و ابزارهایی که به والدین می‌دهد اشاره کرد.

سخنگوی OpenAI گفت: "ما از ارزیابی مستقل دقیق استقبال می کنیم، اما معتقدیم که آزمایش Common Sense Media به طور دقیق نشان دهنده نحوه عملکرد پادمان های نوجوان ChatGPT در عمل یا دیدگاه های متخصص در مورد نحوه پشتیبانی هوش مصنوعی از نوجوانان نیست." این شرکت گفت که بررسی روش‌شناسی این گروه نشان می‌دهد که «بخش عمده‌ای از آزمایش‌های آن‌ها ممکن است قبل از فعال‌سازی کنترل‌های والدین آغاز شده و به نتیجه رسیده باشد، که یافته‌های آن‌ها را نادرست می‌کند» و افزود که چنین آزمایش‌هایی مشخص نمی‌کند که آیا اعلان‌های ایمنی والدین طبق طراحی کار می‌کنند یا خیر.

Steyer گفت که سازمان او در مورد یافته‌ها با OpenAI در تماس بوده است، همانطور که رویه استاندارد آن در طول ارزیابی محصول است، و روی نتایج ایستاده است. وی با مقایسه ایمنی خودرو گفت: ما 100 درصد از کیفیت تحقیقات و آزمایشات خود و این واقعیت که به این محصول برچسب "خطر غیرقابل قبول" می گوییم، ایستاده ایم.

توجه رو به رشد هوش مصنوعی و خردسالان

این مناقشه در بحبوحه تشدید بررسی نحوه تأثیر چت ربات‌های هوش مصنوعی بر کاربران جوان، از مناطق مدرسه‌ای که دسترسی به قانون‌گذارانی را که شرایط تأیید سن را بررسی می‌کنند، محدود می‌کنند، آغاز می‌شود. ممیزی‌های مستقلی مانند این در حال تبدیل شدن به یک میدان آزمایشی واقعی برای ادعاهای ایمنی جوانان شرکت‌های هوش مصنوعی در بازاریابی خود هستند.

هر دو طرف در مورد یک چیز توافق دارند: سیستم اطلاع رسانی والدین مسئله اصلی است. اگر زمانی که یک حساب کاربری نوجوان جدید برای اولین بار افکار آسیب رساندن به خود را مطرح می کند، هشدارها فعال نمی شوند، مهم ترین ویژگی ایمنی در لحظه ای که بیشترین اهمیت را دارد از بین می رود. OpenAI می‌گوید که آزمایش ناقص بوده است. Common Sense Media می گوید محصول قبل از آماده شدن ارسال شده است. رگولاتورها و والدین اکنون بررسی خواهند کرد که حق با چه کسی است - و OpenAI برای رفع شکاف ها یا عقب نشینی محصول با فشار فزاینده ای مواجه است.

برای پوشش بیشتر ایمنی، خط‌مشی و [توسعه‌های صنعت هوش مصنوعی] (https://aibuzzwire.news) که آنها را شکل می‌دهد، با توسعه این داستان همراه باشید.

---

از هوش مصنوعی جلوتر بمانید

آخرین اخبار، تحلیل ها و پیشرفت های هوش مصنوعی را دریافت کنید - همه در یک مکان.

بیشتر بخوانید اخبار هوش مصنوعی →