Обширный обзор безопасности, проведенный Common Sense Media, пришел к выводу, что режим OpenAI ChatGPT для подростков представляет «неприемлемый риск» для пользователей младше 18 лет — худший рейтинг группы наблюдателей — менее чем через два месяца после запуска продукта с обещаниями встроенной защиты. Как сообщает NPR, группа обнаружила, что большинство рекламируемых мер безопасности режима не работали так, как было обещано в ходе тестирования.

Выводы пришлись на деликатный момент для OpenAI, которая в августе запустила ChatGPT для подростков как специальный сервис для несовершеннолетних пользователей, дополненный родительским контролем и более строгими мерами защиты. В наших предыдущих репортажах документально подтверждено, что индустрия искусственного интеллекта активно борется за безопасность молодежи; Новый отчет представляет собой первую крупную независимую проверку того, насколько на практике работает защита подросткового режима.

Что протестировали средства массовой информации, основанные на здравом смысле

Исследователи из Института безопасности искусственного интеллекта молодежи протестировали более 4000 подсказок до и после запуска подросткового режима, согласно сообщению The National News Desk и Fast Company Sinclair Broadcast Group. Группа рекомендует OpenAI приостановить маркетинг подросткового режима и запретить подросткам использовать ChatGPT до тех пор, пока компания не разработает то, что она называет «безопасным, соответствующим развитию опытом».

«Некоторые из заявленных средств защиты ChatGPT выдержали наше тестирование, включая отказ от откровенных сексуальных ролевых игр», — говорится в обзоре продукта организации. «Но другие потерпели неудачу, а некоторые стали еще хуже с новым режимом для подростков. Мы обеспокоены тем, что ChatGPT для подростков может дать родителям ложную уверенность в ограждениях, которые часто не работают».

Родительские оповещения, которые не сработали

Самый поразительный вывод отчета касается системы уведомления родителей. Исследователи создали более дюжины учетных записей, в которых сообщалось о подростковом возрасте и были связаны с родительской учетной записью, а затем вовлекли чат-бота в разговоры, содержащие явные упоминания о суицидальных мыслях, членовредительстве или расстройствах пищевого поведения. Аккаунты были построены на вымышленных лицах.

Согласно отчету, тестировщики не получили родительских предупреждений от новых учетных записей, которые сделали эти ссылки. Оповещения поступали только для других учетных записей, история разговоров которых на схожие темы длилась неделями — пробел, который предполагает, что система уведомлений больше зависит от накопленного контекста, чем от серьезности того, что подросток раскрывает в конкретном разговоре.

Обзор также показал, что ChatGPT для подростков пропускал более одного из четырех случаев, которые требовали направления к врачу в кризисной ситуации с психическим здоровьем, по мнению группы лицензированных специалистов в области детского психического здоровья, которые просмотрели подсказки.

Ограждения школьных занятий «легко обойти»

Помимо обнаружения кризисов, наблюдательный орган обнаружил, что функцию, предназначенную для предотвращения использования учащимися чат-бота для списывания школьных заданий, можно легко обойти или полностью отключить.

«Вы можете попросить их написать для вас сочинение, сложную работу, и он сделает это и даже расскажет вам, как редактировать так, чтобы ваш учитель не знал», — сказал основатель и генеральный директор Common Sense Media Джим Стейер в комментариях, опубликованных The National News Desk. «Поэтому это мешает обучению. Это мешает основному процессу, и детям приходится выполнять работу самостоятельно».

Ограждения контента, прогнозирование возраста и напоминания о перерывах также оказались неэффективными в ходе тестирования. Один широко цитируемый факт: по данным OpenAI, средний пользователь-подросток тратит на ChatGPT менее 15 минут в день. Но среди небольшой доли подростков, которые проводят более трех часов подряд в день (менее 2 процентов пользователей), почти половина завершила разговор в течение пяти минут после получения напоминания о перерыве, что позволяет предположить, что подталкивания редко прерывают длительные сеансы.

OpenAI отказывается от методологии

OpenAI в своем заявлении в ответ на отчет заявила, что «глубоко привержена» безопасности подростков, и указала на созданные ею меры безопасности и инструменты, которые она дает родителям.

«Мы приветствуем строгую независимую оценку, но не считаем, что тестирование Common Sense Media точно отражает то, как на практике работают средства защиты подростков ChatGPT, или взгляды экспертов на то, как ИИ может поддерживать подростков», — заявил представитель OpenAI. Компания заявила, что проверка методологии группы показала, что «большая часть их тестирования могла начаться и завершиться до завершения активации родительского контроля, что делает их выводы неточными», добавив, что такие тесты не смогут установить, работают ли уведомления о родительской безопасности так, как задумано.

Стейер сказал, что его организация связалась с OpenAI по поводу полученных результатов, что является стандартной практикой при оценке продуктов, и поддержала результаты. «Мы на 100% поддерживаем качество наших исследований и испытаний, а также тот факт, что мы обозначили этот продукт как «неприемлемый риск», — сказал он, проводя сравнение с автомобильной безопасностью: «Вы не выпустите автомобиль на рынок, если он не пройдет краш-тест».

Растущее внимание к искусственному интеллекту и несовершеннолетним

Спор возникает на фоне усиливающегося изучения того, как чат-боты с искусственным интеллектом влияют на молодых пользователей: от школьных округов, ограничивающих доступ, до законодателей, взвешивающих требования по проверке возраста. Независимые аудиты, подобные этому, де-факто становятся полигоном для проверки заявлений компаний, занимающихся вопросами ИИ, о безопасности молодежи, которые они делают в своем маркетинге.

Обе стороны сходятся в одном: главное — система оповещения родителей. Если оповещения не срабатывают, когда новая учетная запись подростка впервые вызывает мысли о членовредительстве, самая важная функция безопасности выходит из строя в самый важный момент. OpenAI заявляет, что тестирование было ошибочным; Common Sense Media утверждает, что продукт был отправлен до того, как был готов. Регулирующие органы и родители теперь будут взвешивать, кто прав, и OpenAI сталкивается с растущим давлением с требованием исправить пробелы или отказаться от продукта.

Чтобы получить больше информации о безопасности, политике ИИ и развитиях отрасли ИИ, которые их формируют, следите за развитием этой истории.

---

Будьте впереди ИИ

Получайте последние новости, анализ и открытия в области искусственного интеллекта — все в одном месте.

Подробнее новости AI →