סקירת בטיחות מקיפה של Common Sense Media הגיעה למסקנה שמצב ChatGPT for Teens של OpenAI מהווה "סיכון בלתי מתקבל על הדעת" למשתמשים מתחת לגיל 18 - הדירוג הגרוע ביותר של קבוצת כלבי השמירה - פחות מחודשיים לאחר השקת המוצר עם הבטחות להגנות מובנות. כפי שדיווחה NPR, הקבוצה גילתה שרוב אמצעי ההגנה המפורסמים של המצב לא פעלו כפי שהובטח בבדיקות שלו.

הממצאים נוחתים ברגע רגיש עבור OpenAI, שהשיקה את ChatGPT לבני נוער באוגוסט כחוויה ייעודית למשתמשים קטינים, עם בקרת הורים ומעקות בטיחות מחמירים יותר. הסיקור הקודם שלנו תיעד שתעשיית הבינה המלאכותית דוחפת ומושכת את בטיחות הנוער; הדו"ח החדש הוא הביקורת העצמאית הגדולה הראשונה של האם ההגנות של מצב העשרה מתקיימות בפועל.

מה נבדקה מדיה של השכל הישר

חוקרים ב-Youth AI Safety Institute של הקבוצה בדקו יותר מ-4,000 הנחיות לפני ואחרי ההשקה של מצב העשרה, על פי סיקור של The National News Desk and Fast Company של Sinclair Broadcast Group. הקבוצה ממליצה ל-OpenAI להשהות את שיווק מצב העשרה ולמנוע מבני נוער להשתמש ב-ChatGPT עד שהחברה תפתח את מה שהיא מכנה "חוויה בטוחה ומתאימה מבחינה התפתחותית".

"חלק מההגנות המפורסמות של ChatGPT עמדו בבדיקות שלנו, כולל הסירוב שלה למשחק תפקידים מיני מפורש", נכתב בסקירת המוצר של הארגון. "אבל אחרים נכשלו - וחלקם החמירו עם מצב העשרה החדש. אנו מודאגים מכך ש-ChatGPT לבני נוער עלול להעניק להורים אמון כוזב במעקות בטיחות שלעיתים קרובות לא עובדים".

התראות הורים שלא פעלו

הממצא הבולט ביותר של הדו"ח כלל מערכת ההודעות להורים. חוקרים יצרו יותר מתריסר חשבונות שדיווחו בעצמם על גיל נוער והיו מקושרים לחשבון הורה, ולאחר מכן הפעילו את הצ'טבוט בשיחות שהכילו התייחסויות מפורשות למחשבות אובדניות, פגיעה עצמית או הפרעות אכילה. החשבונות נבנו על פרסונות בדיוניות.

לפי הדיווח, בודקים לא קיבלו התראות הורים מהחשבונות החדשים שעשו את ההפניות הללו. התראות הגיעו רק לחשבונות אחרים שיש להם שבועות של היסטוריית שיחות המכסה נושאים דומים - פער שמצביע על כך שמערכת ההתראות תלויה יותר בהקשר המצטבר מאשר בחומרת מה שנער חושף בשיחה נתונה.

הסקירה גם מצאה ש-ChatGPT for Teens החמיצה יותר מאחד מכל ארבעה מקרים שהצדיקו הפניה למשבר בריאות הנפש, כפי שנקבע על ידי פאנל של מומחי מקצועות בריאות הנפש לילדים שבדקו את ההנחיות.

מעקות בטיחות לעבודות בית ספר 'קל לעקוף'

מעבר לזיהוי משברים, כלב השמירה מצא שקל לעקוף או להשבית את התכונה שנועדה למנוע מתלמידים להשתמש בצ'אטבוט כדי לרמות בשיעורי בית הספר.

"אתה יכול לבקש מהם לכתוב מאמר עבורך, מאמר מתוחכם עבורך וזה יעשה את זה, והוא אפילו יגיד לך איך לערוך בצורה שהמורה שלך לא יידע", אמר מייסד ומנכ"ל Common Sense Media, ג'ים שטייר, בהערות שדווח על ידי The National News Desk. "לכן, זה מפריע ללמידה. זה מפריע לתהליך הבסיסי וילדים צריכים לעשות את העבודה בעצמם".

גם מעקות בטיחות של תוכן, חיזוי גיל ותזכורות הפסקות נמצאו כלא יעילים בבדיקה. נקודת מידע אחת שצוטטה בהרחבה: OpenAI אמרה שמשתמש ממוצע של נוער מבלה פחות מ-15 דקות ביום ב-ChatGPT. אבל מבין החלק הקטן של בני נוער שמבלים יותר משלוש שעות רצופות ביום - פחות מ-2% מהמשתמשים - כמעט מחצית סיימו את השיחה שלהם תוך חמש דקות מרגע קבלת תזכורת להפסקה, מה שמרמז שהדחיפות קטעו לעתים רחוקות מפגשים ממושכים.

OpenAI דוחפת חזרה את המתודולוגיה

OpenAI, בהצהרה בתגובה לדו"ח, אמרה שהיא "מחויבות עמוקה" לבטיחות בני נוער והצביעה על אמצעי ההגנה שהיא בנתה ועל הכלים שהיא מעניקה להורים.

"אנו מברכים על הערכה עצמאית קפדנית, אך איננו מאמינים שהבדיקות של Common Sense Media משקפות במדויק את אופן הפעולה של אמצעי ההגנה לבני נוער של ChatGPT או נקודות מבט של מומחים לגבי האופן שבו AI יכולה לתמוך בבני נוער", אמר דובר OpenAI. החברה אמרה שהסקירה שלה על המתודולוגיה של הקבוצה הראתה כי "ייתכן שחלק הארי של הבדיקות שלהם החלו והסתיימו לפני שהפעלת בקרת הורים הושלמה, מה שהופך את הממצאים שלהם לא מדויקים", והוסיפה כי בדיקות כאלה לא יקבעו אם הודעות בטיחות הורים פועלות כמתוכנן.

שטייר אמר כי ארגונו היה בקשר עם OpenAI בנוגע לממצאים, כפי שנוהגים רגילים במהלך הערכות מוצרים, ועמד על התוצאות. "אנחנו עומדים ב-100% מאחורי איכות המחקר שלנו והבדיקות והעובדה שסימנו את המוצר הזה כ'סיכון בלתי מתקבל על הדעת'", אמר והשוואה לבטיחות הרכב: "לא היית מוציא מכונית לשוק אם היא לא תעבור את מבחן הריסוק".

זרקור הולך וגדל על AI וקטינים

המחלוקת מגיעה על רקע בדיקה מעמיקה של האופן שבו צ'טבוטים של AI משפיעים על משתמשים צעירים, ממחוזות בתי ספר המגבילים את הגישה למחוקקים השוקלים את דרישות אימות הגיל. ביקורות עצמאיות כמו זו הופכות לשדה בדיקה דה פקטו לטענות בטיחות הנוער שמעלות חברות בינה מלאכותית בשיווק שלהן.

שני הצדדים מסכימים על דבר אחד: מערכת ההודעות להורים היא העיקר. אם ההתראות נכשלות כאשר חשבון נוער חדש מעלה לראשונה מחשבות על פגיעה עצמית, תכונת הבטיחות החשובה ביותר נכשלת ברגע שהיא הכי חשובה. OpenAI אומר שהבדיקה הייתה פגומה; Common Sense Media אומר שהמוצר נשלח לפני שהיה מוכן. הרגולטורים וההורים ישקלו כעת מי צודק - ו-OpenAI עומדת בפני לחץ גובר לתקן את הפערים או למשוך את המוצר.

לסיקור נוסף על בטיחות בינה מלאכותית, מדיניות ופיתוחי תעשיית הבינה המלאכותית שמעצבים אותם, עקבו אחרי הסיפור הזה.

---

הישאר לפני AI

קבל את החדשות, הניתוחים ופריצות הדרך האחרונות של AI - הכל במקום אחד.

קרא עוד חדשות AI →