Common Sense Media під час ретельного огляду безпеки прийшов до висновку, що режим OpenAI ChatGPT для підлітків становить «неприйнятний ризик» для користувачів віком до 18 років — це найгірша оцінка контрольної групи — менш ніж через два місяці після запуску продукту з обіцянками вбудованого захисту. Як повідомляв NPR, група виявила, що більшість рекламованих засобів захисту режиму не працювали, як було обіцяно під час тестування.
Висновки припадають на чутливий момент для OpenAI, який у серпні запустив ChatGPT для підлітків як спеціальну програму для неповнолітніх користувачів із батьківським контролем і суворішими огорожами. Наше попереднє висвітлення задокументувало, що [індустрія штучного інтелекту] (https://aibuzzwire.news) наполягає на безпеці молоді; новий звіт є першим великим незалежним аудитом того, чи захист підліткового режиму витримується на практиці.
Те, що перевірили медіа здорового глузду
Дослідники з Youth AI Safety Institute протестували більше 4000 підказок до і після запуску підліткового режиму, згідно з висвітленням Sinclair Broadcast Group The National News Desk і Fast Company. Група рекомендує OpenAI призупинити маркетинг підліткового режиму та заборонити підліткам використовувати ChatGPT, доки компанія не розробить те, що вона називає «безпечним, відповідним для розвитку досвідом».
«Деякі рекламовані засоби захисту ChatGPT витримали наше тестування, включаючи відмову від явної сексуальної рольової гри», — йдеться в огляді продукту організації. «Але інші зазнали невдачі — а деякі погіршилися з новим підлітковим режимом. Ми стурбовані тим, що ChatGPT для підлітків може викликати у батьків помилкову впевненість через огорожі, які часто не працюють».
Батьківські сповіщення, які не спрацювали
Найразючіший висновок звіту стосується системи сповіщення батьків. Дослідники створили понад дюжину облікових записів, які самостійно повідомляли про підлітковий вік і були пов’язані з обліковим записом батьків, а потім залучали чат-бота до розмов, які містили явні згадки про суїцидальні думки, самоушкодження або неправильне харчування. Акаунти були побудовані на вигаданих персонах.
Згідно зі звітом, тестувальники не отримували батьківських сповіщень від нових облікових записів, які зробили ці посилання. Сповіщення надходили лише для інших облікових записів, які мали багатотижневу історію розмов на подібні теми — прогалина, яка свідчить про те, що система сповіщень більше залежить від накопиченого контексту, ніж від серйозності того, що підліток розкриває в даній розмові.
Огляд також виявив, що ChatGPT для підлітків пропустив більш ніж один із чотирьох випадків, які вимагали направлення до кризи психічного здоров’я, за оцінкою групи ліцензованих спеціалістів із психічного здоров’я дітей, які переглядали підказки.
Шкільні огорожі «Легко обійти»
Окрім виявлення кризових ситуацій, спостерігач виявив, що функцію, яка має на меті запобігти використанню учнями чат-бота для списування шкільних завдань, легко обійти або відключити.
«Ви можете попросити їх написати для вас роботу, складну роботу для вас, і вона зробить це, і навіть підкаже вам, як редагувати так, щоб ваш учитель не знав», — сказав засновник і генеральний директор Common Sense Media Джим Стейєр у коментарях The National News Desk. «Отже, це заважає навчанню. Це заважає базовому процесу, і дітям доводиться виконувати роботу самостійно».
Огородження вмісту, передбачення віку та нагадування про перерву також виявилися неефективними під час тестування. Один із широко цитованих даних: OpenAI стверджує, що середній користувач-підліток витрачає на ChatGPT менше 15 хвилин на день. Але серед невеликої частки підлітків, які проводять більше трьох годин поспіль на день (менше 2 відсотків користувачів), майже половина закінчила розмову протягом п’яти хвилин після отримання нагадування про перерву, що свідчить про те, що спонукання рідко переривали розширені заняття.
OpenAI відкидає методологію
OpenAI у своїй заяві, відповідаючи на звіт, заявив, що «глибоко відданий» безпеці підлітків і вказав на створені нею гарантії та інструменти, які він надає батькам.
«Ми вітаємо сувору незалежну оцінку, але ми не віримо, що тестування Common Sense Media точно відображає те, як на практиці працюють засоби захисту підлітків ChatGPT, або точки зору експертів щодо того, як ШІ може підтримувати підлітків», — сказав представник OpenAI. Компанія заявила, що її перевірка методології групи показала, що «основна частина їх тестування, можливо, почалася і завершилася до завершення активації батьківського контролю, що робить їх висновки неточними», додавши, що такі тести не встановлюють, чи сповіщення батьківської безпеки працюють, як було задумано.
Штайєр сказав, що його організація зв’язалася з OpenAI щодо висновків, як це є стандартною практикою під час оцінки продуктів, і підтвердила результати. «Ми на 100% підтримуємо якість наших досліджень і випробувань, а також той факт, що ми назвали цей продукт «неприйнятним ризиком», — сказав він, порівнявши автомобільну безпеку: «Ви б не поставили автомобіль на ринок, якщо він не пройшов краш-тест».
Зростаюча увага до ШІ та неповнолітніх
Суперечка виникає на тлі посилення перевірки того, як чат-боти штучного інтелекту впливають на молодих користувачів, оскільки шкільні округи обмежують доступ до законодавців, які зважують вимоги перевірки віку. Незалежні аудити, подібні до цього, стають де-факто полігоном для перевірки заяв про безпеку молоді, які компанії, що займаються штучним інтелектом, роблять у своєму маркетингу.
Обидві сторони погоджуються в одному: система батьківського сповіщення є суть. Якщо сповіщення не спрацьовують, коли новий обліковий запис підлітка вперше викликає думки про самоушкодження, найважливіша функція безпеки не працює в той момент, коли це найважливіше. OpenAI каже, що тестування було помилковим; Common Sense Media стверджує, що продукт відправили до того, як він був готовий. Регулятори та батьки тепер будуть зважувати, хто правий — і OpenAI стикається з зростаючим тиском, щоб виправити прогалини або відкликати продукт.
Щоб дізнатися більше про безпеку штучного інтелекту, політику та [розвиток індустрії штучного інтелекту] (https://aibuzzwire.news), які їх формують, слідкуйте за розвитком цієї історії.
---
Будьте попереду ШІОтримуйте останні новини штучного інтелекту, аналіз і прориви — усе в одному місці.
Читати більше новин AI →