Kajian keselamatan menyeluruh oleh Common Sense Media telah menyimpulkan bahawa mod OpenAI's ChatGPT for Teens menimbulkan "risiko yang tidak boleh diterima" kepada pengguna di bawah 18 tahun — penarafan paling teruk kumpulan pengawas itu — kurang daripada dua bulan selepas produk dilancarkan dengan janji perlindungan terbina dalam. Seperti yang dilaporkan NPR, kumpulan itu mendapati bahawa kebanyakan perlindungan yang diiklankan oleh mod tidak berfungsi seperti yang dijanjikan dalam ujiannya.

Penemuan itu tiba pada saat yang sensitif untuk OpenAI, yang melancarkan ChatGPT untuk Remaja pada bulan Ogos sebagai pengalaman khusus untuk pengguna bawah umur, lengkap dengan kawalan ibu bapa dan pagar pengadang yang lebih ketat. Liputan awal kami mendokumentasikan bahawa industri AI menolak dan menarik sekitar keselamatan belia; laporan baharu itu ialah audit bebas utama yang pertama sama ada perlindungan mod remaja itu kekal dalam amalan.

Apa yang Diuji oleh Media Akal Waras

Penyelidik di Institut Keselamatan AI Belia kumpulan itu menguji lebih daripada 4,000 gesaan sebelum dan selepas pelancaran mod remaja itu, menurut liputan oleh Sinclair Broadcast Group's The National News Desk and Fast Company. Kumpulan itu mengesyorkan OpenAI menjeda memasarkan mod remaja dan menghalang remaja daripada menggunakan ChatGPT sehingga syarikat membangunkan apa yang dipanggil "pengalaman yang selamat, sesuai dengan perkembangan."

"Beberapa perlindungan yang diiklankan oleh ChatGPT ditahan semasa ujian kami, termasuk penolakannya terhadap lakonan seksual yang jelas," kata semakan produk organisasi itu. "Tetapi yang lain gagal — dan ada yang menjadi lebih teruk dengan mod Remaja baharu. Kami bimbang ChatGPT untuk Remaja boleh memberi keyakinan palsu kepada ibu bapa terhadap pagar yang selalunya tidak berfungsi."

Makluman Ibu Bapa Yang Tidak Menyalakan

Penemuan paling menarik dalam laporan itu melibatkan sistem pemberitahuan ibu bapa. Penyelidik mencipta lebih daripada sedozen akaun yang melaporkan sendiri usia remaja dan dikaitkan dengan akaun ibu bapa, kemudian melibatkan chatbot dalam perbualan yang mengandungi rujukan eksplisit kepada pemikiran untuk membunuh diri, mencederakan diri sendiri atau makan yang tidak teratur. Akaun dibina berdasarkan persona fiksyen.

Menurut laporan itu, penguji tidak menerima makluman ibu bapa daripada akaun baharu yang membuat rujukan ini. Makluman hanya tiba untuk akaun lain yang mempunyai sejarah perbualan berminggu-minggu meliputi tema yang serupa — jurang yang mencadangkan sistem pemberitahuan lebih bergantung pada konteks terkumpul berbanding keterukan perkara yang didedahkan oleh remaja dalam perbualan tertentu.

Semakan juga mendapati bahawa ChatGPT untuk Remaja terlepas lebih daripada satu dalam empat keadaan yang memerlukan rujukan krisis kesihatan mental, seperti yang dinilai oleh panel profesional kesihatan mental kanak-kanak berlesen yang menyemak gesaan.

Pengawal Kerja Sekolah 'Mudah Dipintas'

Di luar pengesanan krisis, badan pemerhati mendapati bahawa ciri yang bertujuan untuk menghalang pelajar daripada menggunakan chatbot untuk menipu kerja sekolah adalah mudah untuk memintas atau melumpuhkan secara langsung.

"Anda boleh meminta mereka menulis kertas untuk anda, kertas yang canggih untuk anda dan ia akan melakukannya, malah ia akan memberitahu anda cara mengedit dengan cara yang guru anda tidak tahu," kata pengasas dan Ketua Pegawai Eksekutif Common Sense Media Jim Steyer dalam ulasan yang dilaporkan oleh The National News Desk. "Oleh itu, ia mengganggu pembelajaran. Ia mengganggu proses asas dan kanak-kanak perlu melakukan kerja sendiri."

Pagar kandungan, ramalan umur dan peringatan rehat juga didapati tidak berkesan dalam ujian. Satu titik data yang dipetik secara meluas: OpenAI telah berkata purata pengguna remaja menghabiskan kurang daripada 15 minit sehari di ChatGPT. Tetapi di kalangan sebahagian kecil remaja yang menghabiskan lebih daripada tiga jam berturut-turut setiap hari — kurang daripada 2 peratus pengguna — hampir separuh menamatkan perbualan mereka dalam masa lima minit selepas menerima peringatan rehat, mencadangkan dorongan itu jarang mengganggu sesi lanjutan.

OpenAI Menolak Kembali pada Metodologi

OpenAI, dalam satu kenyataan menjawab laporan itu, berkata ia "sangat komited" terhadap keselamatan remaja dan menunjuk kepada perlindungan yang telah dibina dan alat yang diberikannya kepada ibu bapa.

"Kami mengalu-alukan penilaian bebas yang ketat, tetapi kami tidak percaya ujian Common Sense Media menggambarkan dengan tepat cara perlindungan remaja ChatGPT berfungsi dalam amalan atau perspektif pakar tentang cara AI boleh menyokong remaja," kata jurucakap OpenAI. Syarikat itu berkata kajian semula terhadap metodologi kumpulan itu menunjukkan bahawa "sebahagian besar ujian mereka mungkin telah bermula dan berakhir sebelum pengaktifan kawalan ibu bapa selesai, menjadikan penemuan mereka tidak tepat," sambil menambah bahawa ujian sedemikian tidak akan menentukan sama ada pemberitahuan keselamatan ibu bapa berfungsi seperti yang direka.

Steyer berkata organisasinya telah berhubung dengan OpenAI mengenai penemuan itu, seperti amalan standardnya semasa penilaian produk, dan berpegang teguh pada keputusannya. "Kami 100% berdiri di belakang kualiti penyelidikan dan ujian kami dan fakta bahawa kami melabelkan produk ini sebagai 'risiko yang tidak boleh diterima,'" katanya, membuat perbandingan dengan keselamatan automotif: "Anda tidak akan meletakkan kereta di pasaran jika ia tidak lulus ujian kemalangan."

Tumpuan yang Berkembang pada AI dan Anak Bawah Umur

Pertikaian itu berlaku di tengah-tengah penelitian yang semakin intensif tentang cara chatbots AI mempengaruhi pengguna muda, dari daerah sekolah yang menyekat akses kepada penggubal undang-undang yang menimbang keperluan pengesahan umur. Audit bebas seperti ini menjadi medan ujian de facto untuk tuntutan keselamatan belia yang dibuat oleh syarikat AI dalam pemasaran mereka.

Kedua-dua pihak bersetuju dengan satu perkara: sistem pemberitahuan ibu bapa adalah intinya. Jika amaran gagal dinyalakan apabila akaun remaja baharu mula-mula membangkitkan pemikiran mencederakan diri sendiri, ciri keselamatan yang paling penting gagal pada masa ia paling penting. OpenAI mengatakan ujian itu cacat; Common Sense Media mengatakan produk dihantar sebelum ia siap. Pengawal selia dan ibu bapa kini akan menimbang siapa yang betul — dan OpenAI menghadapi tekanan yang semakin meningkat untuk membetulkan jurang atau menarik balik produk.

Untuk liputan lanjut tentang keselamatan AI, dasar dan perkembangan industri AI yang membentuk mereka, ikuti sepanjang cerita ini berkembang.

---

Kekal Mendahului AI

Dapatkan berita, analisis dan penemuan terkini AI — semuanya di satu tempat.

Baca lebih banyak berita AI →