Z obszernego przeglądu bezpieczeństwa przeprowadzonego przez Common Sense Media wynika, że tryb ChatGPT dla nastolatków OpenAI stwarza „niedopuszczalne ryzyko” dla użytkowników poniżej 18 roku życia – co jest najgorszą oceną grupy nadzorującej – niecałe dwa miesiące po wprowadzeniu produktu na rynek z obietnicą wbudowanych zabezpieczeń. Jak donosi NPR, grupa stwierdziła, że większość reklamowanych zabezpieczeń tego trybu nie działała zgodnie z obietnicami zawartymi w testach.
Odkrycia trafiają w newralgiczny moment dla OpenAI, które w sierpniu uruchomiło ChatGPT dla nastolatków jako rozwiązanie dedykowane dla nieletnich użytkowników, wyposażone w kontrolę rodzicielską i bardziej rygorystyczne zabezpieczenia. W naszych wcześniejszych relacjach udokumentowaliśmy, że branża sztucznej inteligencji wywiera nacisk na bezpieczeństwo młodzieży; nowy raport jest pierwszym poważnym niezależnym audytem sprawdzającym, czy zabezpieczenia w trybie dla nastolatków sprawdzają się w praktyce.
Jakie przetestowano zdroworozsądkowe media
Według relacji The National News Desk and Fast Company należącej do Sinclair Broadcast Group badacze z Youth AI Safety Institute przetestowali ponad 4000 podpowiedzi przed i po uruchomieniu trybu dla nastolatków. Grupa zaleca, aby OpenAI wstrzymało marketing trybu dla nastolatków i uniemożliwiło nastolatkom korzystanie z ChatGPT do czasu, aż firma opracuje to, co nazywa „bezpiecznym, odpowiednim pod względem rozwojowym doświadczeniem”.
„Niektóre reklamowane zabezpieczenia ChatGPT sprawdziły się w naszych testach, w tym odmowa jawnego odgrywania ról o charakterze seksualnym” – stwierdzono w recenzji produktów tej organizacji. „Ale inne zawiodły – a niektóre pogorszyły się po zastosowaniu nowego trybu dla nastolatków. Obawiamy się, że ChatGPT dla nastolatków może dać rodzicom fałszywe zaufanie do poręczy, które często nie działają”.
Alerty rodzicielskie, które nie zadziałały
Najbardziej uderzające odkrycie raportu dotyczyło systemu powiadamiania rodziców. Badacze utworzyli kilkanaście kont, na których samodzielnie zgłaszały, że są nastolatkami i które były powiązane z kontem rodzica, a następnie wdawali się z chatbotem w rozmowy zawierające wyraźne odniesienia do myśli samobójczych, samookaleczenia lub zaburzeń odżywiania. Konta zostały zbudowane na fikcyjnych osobach.
Według raportu testerzy nie otrzymali żadnych alertów rodzicielskich z nowych kont, na których pojawiły się te odniesienia. Alerty pojawiały się tylko w przypadku innych kont, które miały tygodniową historię rozmów na podobną tematykę – luka sugerująca, że system powiadomień zależy bardziej od zgromadzonego kontekstu niż od wagi tego, co nastolatek ujawnia w danej rozmowie.
W przeglądzie stwierdzono również, że w programie ChatGPT dla nastolatków pominięto więcej niż jeden na cztery przypadki uzasadniające skierowanie do specjalisty z powodu kryzysu psychicznego, jak ocenił panel licencjonowanych specjalistów w dziedzinie zdrowia psychicznego dzieci, który zapoznał się ze wskazówkami.
Poręcze szkolne „Łatwe do ominięcia”
Oprócz wykrywania sytuacji kryzysowych organ nadzorczy odkrył, że funkcję mającą na celu uniemożliwienie uczniom używania chatbota do ściągania w zadaniach szkolnych można było łatwo ominąć lub od razu wyłączyć.
„Możesz poprosić ich, aby napisali dla ciebie pracę, wyrafinowaną pracę, i to zrobi, a nawet powie ci, jak redagować w sposób, którego nauczyciel nie będzie wiedział” – powiedział założyciel i dyrektor generalny Common Sense Media Jim Steyer w komentarzach zgłoszonych przez The National News Desk. „Zatem przeszkadza to w nauce. Zakłóca podstawowy proces i dzieci muszą samodzielnie wykonywać tę pracę”.
W testach stwierdzono, że bariery ochronne, przewidywanie wieku i przypomnienia o przerwach również okazały się nieskuteczne. Jeden z powszechnie cytowanych danych: OpenAI twierdzi, że przeciętny nastolatek spędza mniej niż 15 minut dziennie na ChatGPT. Jednak wśród niewielkiej grupy nastolatków, którzy spędzają więcej niż trzy kolejne godziny dziennie – mniej niż 2 procent użytkowników – prawie połowa zakończyła rozmowę w ciągu pięciu minut od otrzymania przypomnienia o przerwie, co sugeruje, że szturchnięcia rzadko przerywały dłuższe sesje.
OpenAI rezygnuje z metodologii
W oświadczeniu będącym odpowiedzią na raport OpenAI stwierdziło, że jest „głęboko zaangażowane” w bezpieczeństwo nastolatków i wskazało na stworzone przez siebie zabezpieczenia oraz narzędzia, które daje rodzicom.
„Z zadowoleniem przyjmujemy rygorystyczną niezależną ocenę, ale nie wierzymy, że testy Common Sense Media dokładnie odzwierciedlają, jak zabezpieczenia ChatGPT dla nastolatków działają w praktyce lub z punktu widzenia ekspertów na temat tego, jak sztuczna inteligencja może wspierać nastolatki” – powiedział rzecznik OpenAI. Firma stwierdziła, że przegląd metodologii grupy wykazał, że „większość testów mogła rozpocząć się i zakończyć przed zakończeniem aktywacji kontroli rodzicielskiej, co sprawia, że ich ustalenia są niedokładne”, dodała, że takie testy nie wykazałyby, czy powiadomienia dotyczące bezpieczeństwa rodzicielskiego działają zgodnie z założeniami.
Steyer powiedział, że jego organizacja kontaktowała się z OpenAI w sprawie ustaleń, zgodnie ze standardową praktyką tej organizacji podczas ocen produktów, i podtrzymała wyniki. „W 100% popieramy jakość naszych badań i testów oraz fakt, że określiliśmy ten produkt jako„ ryzyko niedopuszczalne ”” – powiedział, dokonując porównania z bezpieczeństwem motoryzacyjnym: „Nie wprowadziłbyś samochodu na rynek, gdyby nie przeszedł testu zderzeniowego”.
Coraz większe zainteresowanie sztuczną inteligencją i nieletnimi
Spór pojawia się w obliczu wzmożonej analizy wpływu chatbotów AI na młodych użytkowników, począwszy od okręgów szkolnych ograniczających dostęp do prawodawców rozważających wymogi dotyczące weryfikacji wieku. Niezależne audyty, takie jak ten, stają się de facto poligonem doświadczalnym dla twierdzeń dotyczących bezpieczeństwa młodzieży, jakie firmy AI przedstawiają w swoich marketingach.
Obie strony są zgodne co do jednego: sednem sprawy jest system powiadamiania rodziców. Jeśli alerty nie zostaną uruchomione, gdy nowe konto nastolatka po raz pierwszy wzbudzi myśli o samookaleczeniu, oznacza to, że najważniejsza funkcja bezpieczeństwa przestaje działać w momencie, w którym ma to największe znaczenie. OpenAI twierdzi, że testy były wadliwe; Common Sense Media twierdzi, że produkt został wysłany, zanim był gotowy. Organy regulacyjne i rodzice będą teraz oceniać, kto ma rację, a OpenAI staje w obliczu rosnącej presji, aby naprawić luki lub wycofać produkt.
Aby uzyskać więcej informacji na temat bezpieczeństwa sztucznej inteligencji, zasad i rozwoju branży sztucznej inteligencji, które ją kształtują, śledź rozwój tej historii.
---
Wyprzedź sztuczną inteligencjęOtrzymuj najnowsze wiadomości, analizy i przełomowe informacje dotyczące sztucznej inteligencji — wszystko w jednym miejscu.
Przeczytaj więcej aktualności o sztucznej inteligencji →