Rozsáhlá bezpečnostní kontrola od Common Sense Media dospěla k závěru, že režim ChatGPT OpenAI pro Teens představuje „nepřijatelné riziko“ pro uživatele mladší 18 let – nejhorší hodnocení hlídací skupiny – méně než dva měsíce po uvedení produktu s příslibem vestavěné ochrany. Jak uvedla NPR, skupina zjistila, že většina inzerovaných ochranných opatření režimu nefungovala tak, jak slibovala při testování.

Zjištění se dostávají do citlivého okamžiku pro OpenAI, která v srpnu spustila ChatGPT pro dospívající jako specializovaný zážitek pro nezletilé uživatele, doplněný rodičovskou kontrolou a přísnějšími ochrannými zábradlími. Naše dřívější zpravodajství dokumentovalo, že odvětví umělé inteligence prosazuje a táhne bezpečnost mládeže; nová zpráva je prvním velkým nezávislým auditem toho, zda ochrany režimu pro mladistvé obstojí v praxi.

Co testovala média Common Sense

Podle zpravodajství The National News Desk and Fast Company společnosti Sinclair Broadcast Group otestovali výzkumníci z Institutu pro bezpečnost AI mládeže více než 4 000 výzev před a po spuštění režimu pro dospívající. Skupina doporučuje, aby OpenAI pozastavila marketing režimu pro dospívající a zabránila dospívajícím v používání ChatGPT, dokud společnost nevyvine to, co nazývá „bezpečný, vývojově vhodný zážitek“.

"Některé z inzerovaných ochran ChatGPT obstály při našem testování, včetně odmítnutí explicitního sexuálního hraní rolí," uvádí se v hodnocení produktu organizace. "Jiné však selhaly - a některé se s novým režimem Teen zhoršily. Obáváme se, že ChatGPT pro dospívající by mohl rodičům poskytnout falešnou důvěru v zábradlí, které často nefungují."

Rodičovská upozornění, která se nespustila

Nejpozoruhodnějším zjištěním zprávy byl systém upozornění rodičů. Výzkumníci vytvořili více než tucet účtů, které samy hlásily věk dospívajících a byly propojeny s účtem rodičů, poté zapojili chatbota do konverzací obsahujících explicitní odkazy na sebevražedné myšlenky, sebepoškozování nebo neuspořádané stravování. Účty byly postaveny na fiktivních osobách.

Podle zprávy neobdrželi testeři žádná rodičovská upozornění z nových účtů, které tyto odkazy obsahovaly. Upozornění dorazila pouze pro jiné účty, které měly týdny konverzační historie pokrývající podobná témata – mezera, která naznačuje, že systém upozornění závisí více na nahromaděném kontextu než na závažnosti toho, co dospívající v dané konverzaci odhalí.

Přezkum také zjistil, že ChatGPT pro dospívající vynechal více než jeden ze čtyř případů, které zaručovaly postoupení krizí duševního zdraví, jak posoudila skupina licencovaných odborníků na duševní zdraví dětí, kteří výzvy přezkoumali.

Zábradlí na školní práci „Snadno obejít“

Kromě detekce krizí hlídací pes zjistil, že funkci, která měla zabránit studentům používat chatbota k podvádění při školní práci, bylo snadné obejít nebo rovnou deaktivovat.

"Mohli byste je požádat, aby pro vás napsali práci, sofistikovanou práci pro vás a ono by to udělalo, a dokonce by vám řeklo, jak to upravit způsobem, který by váš učitel nevěděl," uvedl zakladatel a generální ředitel Common Sense Media Jim Steyer v komentářích, o nichž informoval The National News Desk. "Takže to narušuje učení. Narušuje to základní proces a děti musí dělat práci samy."

Zábrany obsahu, předpověď věku a připomenutí přestávky byly také při testování neúčinné. Jeden široce citovaný datový bod: OpenAI říká, že průměrný dospívající uživatel stráví na ChatGPT méně než 15 minut denně. Ale mezi malým podílem dospívajících, kteří tráví více než tři po sobě jdoucí hodiny denně – méně než 2 procenta uživatelů – téměř polovina ukončila konverzaci do pěti minut po obdržení připomenutí o přestávce, což naznačuje, že pošťuchování jen zřídka přerušilo delší sezení.

OpenAI tlačí zpět na metodologii

OpenAI ve svém prohlášení v reakci na zprávu uvedlo, že je „hluboce oddáno“ bezpečnosti mladistvých a poukázalo na ochranná opatření, která vytvořila, a nástroje, které poskytuje rodičům.

"Vítáme přísné nezávislé hodnocení, ale nevěříme, že testování Common Sense Media přesně odráží to, jak v praxi fungují ochranné prvky ChatGPT pro dospívající, nebo názory odborníků na to, jak může AI podporovat dospívající," řekl mluvčí OpenAI. Společnost uvedla, že její revize metodologie skupiny ukázala, že „většina jejich testování mohla začít a skončila předtím, než byla dokončena aktivace rodičovské kontroly, takže jejich zjištění jsou nepřesná,“ a dodala, že takové testy nepotvrdí, zda oznámení o rodičovské bezpečnosti fungují tak, jak bylo navrženo.

Steyer řekl, že jeho organizace byla v kontaktu s OpenAI ohledně zjištění, jak je její standardní praxí při hodnocení produktů, a stála si za výsledky. „Stoprocentně si stojíme za kvalitou našeho výzkumu a testování a za tím, že jsme tento produkt označili za ‚nepřijatelné riziko‘,“ řekl a přirovnal k automobilové bezpečnosti: „Neuvedli byste auto na trh, pokud by neprošlo nárazovým testem.“

Rostoucí pozornost na AI a nezletilé

Spor přichází uprostřed intenzivnějšího zkoumání toho, jak AI chatboti ovlivňují mladé uživatele, ze školních obvodů omezujících přístup zákonodárcům zvažujícím požadavky na ověření věku. Nezávislé audity, jako je tento, se stávají de facto testovacím prostorem pro tvrzení společností AI o bezpečnosti mládeže ve svém marketingu.

Obě strany se shodují na jedné věci: podstatou je rodičovský oznamovací systém. Pokud se výstrahy nespustí, když nový účet pro dospívající poprvé vyvolá myšlenky na sebepoškozování, nejdůležitější bezpečnostní prvek selže v okamžiku, na kterém nejvíce záleží. OpenAI říká, že testování bylo chybné; Common Sense Media říká, že produkt byl odeslán dříve, než byl připraven. Regulátoři a rodiče nyní zváží, kdo má pravdu – a OpenAI čelí rostoucímu tlaku, aby napravil mezery nebo stáhl produkt.

Chcete-li se dozvědět více o bezpečnosti, zásadách a vývoji odvětví AI, které je utvářejí, sledujte, jak se tento příběh vyvíjí.

---

Stay Ahead of AI

Získejte nejnovější zprávy, analýzy a průlomové informace o umělé inteligenci – vše na jednom místě.

Přečtěte si další zprávy o AI →