Common Sense Media tarafından yapılan kapsamlı bir güvenlik incelemesi, OpenAI'nin Gençler için ChatGPT modunun, yerleşik koruma vaadiyle ürünün piyasaya sürülmesinden iki aydan kısa bir süre sonra (watchdog grubunun en kötü derecesi) 18 yaşın altındaki kullanıcılar için "kabul edilemez bir risk" oluşturduğu sonucuna varmıştır. NPR'nin bildirdiği gibi grup, modun reklamı yapılan güvenlik önlemlerinin çoğunun testlerde söz verildiği gibi çalışmadığını tespit etti.
Bulgular, reşit olmayan kullanıcılara yönelik, ebeveyn kontrolleri ve daha sıkı korkuluklarla tamamlanan özel bir deneyim olarak Ağustos ayında Gençler için ChatGPT'yi başlatan OpenAI için hassas bir zamanda ortaya çıktı. Daha önceki haberimizde, Yapay Zeka endüstrisinin gençlerin güvenliğini zorladığını ve çektiğini belgeledik; Yeni rapor, gençlik modunun korumalarının pratikte geçerli olup olmadığına ilişkin ilk büyük bağımsız denetimdir.
Common Sense Media Neleri Test Etti?
Sinclair Broadcast Group'un The National News Desk ve Fast Company haberlerine göre, grubun Gençlik Yapay Zeka Güvenliği Enstitüsü'ndeki araştırmacılar, gençlik modunun lansmanından önce ve sonra 4.000'den fazla istemi test etti. Grup, OpenAI'nin gençlik modunun pazarlamasını duraklatmasını ve şirket "güvenli, gelişimsel olarak uygun bir deneyim" olarak adlandırdığı şeyi geliştirene kadar gençlerin ChatGPT kullanmasını engellemesini tavsiye ediyor.
Kuruluşun ürün incelemesinde, "ChatGPT'nin reklamı yapılan korumalarından bazıları, açık cinsel rol oynamanın reddedilmesi de dahil olmak üzere, testlerimize kadar geçerliydi" dedi. "Ancak diğerleri başarısız oldu ve bazıları yeni Genç moduyla daha da kötüleşti. Gençler için ChatGPT'nin ebeveynlere sıklıkla çalışmayan korkuluklar konusunda yanlış güven verebileceğinden endişe ediyoruz."
Etkinleşmeyen Ebeveyn Uyarıları
Raporun en dikkat çekici bulgusu ebeveyn bildirim sistemi oldu. Araştırmacılar, kendilerinin ergenlik yaşını bildiren ve bir ebeveyn hesabına bağlı olan bir düzineden fazla hesap oluşturdu, ardından chatbot'u intihar düşünceleri, kendine zarar verme veya yeme bozukluğu gibi konularda açık referanslar içeren konuşmalara dahil etti. Hesaplar kurgusal kişiler üzerine inşa edildi.
Rapora göre test uzmanları, bu referansları kullanan yeni hesaplardan herhangi bir ebeveyn uyarısı almadı. Uyarılar yalnızca benzer temaları kapsayan haftalarca süren konuşma geçmişine sahip diğer hesaplar için geldi; bu boşluk, bildirim sisteminin bir gencin belirli bir konuşmada açıkladıklarının ciddiyetinden ziyade birikmiş bağlama bağlı olduğunu gösteriyor.
İnceleme ayrıca, yönlendirmeleri inceleyen lisanslı çocuk ruh sağlığı uzmanlarından oluşan bir panel tarafından değerlendirildiği üzere, Gençler için ChatGPT'nin akıl sağlığı krizi yönlendirmesini gerektiren dört örnekten birden fazlasını kaçırdığını da buldu.
Okul Korkulukları 'Atlaması Kolay'
Gözlemci, kriz tespitinin ötesinde, öğrencilerin chatbot'u okul ödevlerinde kopya çekmek için kullanmasını engellemeyi amaçlayan özelliğin kolayca atlanabileceğini veya tamamen devre dışı bırakılabileceğini buldu.
Common Sense Media'nın kurucusu ve CEO'su Jim Steyer, The National News Desk tarafından bildirilen yorumlarda, "Onlardan sizin için bir makale yazmalarını isteyebilirsiniz, sizin için karmaşık bir makale ve o da bunu yapar ve hatta öğretmeninizin bilemeyeceği bir şekilde nasıl düzenleme yapacağınızı bile söyler." dedi. "Dolayısıyla bu, öğrenmeye müdahale ediyor. Temel sürece müdahale ediyor ve çocukların işi kendi başlarına yapmak zorunda kalmasına neden oluyor."
İçerik korkulukları, yaş tahmini ve mola hatırlatıcılarının da testlerde etkisiz olduğu görüldü. Yaygın olarak alıntı yapılan bir veri noktası: OpenAI, ortalama genç kullanıcının ChatGPT'de günde 15 dakikadan az zaman harcadığını söyledi. Ancak günde art arda üç saatten fazla zaman harcayan gençlerin küçük bir kısmı (kullanıcıların yüzde 2'sinden azı) neredeyse yarısı, bir mola hatırlatıcısı aldıktan sonra beş dakika içinde konuşmalarını sonlandırdı; bu da dürtmelerin uzun oturumları nadiren kesintiye uğrattığını gösteriyor.
OpenAI Metodolojiden Geri Dönüyor
OpenAI, rapora yanıt olarak yaptığı açıklamada, gençlerin güvenliğine "derinden bağlı" olduğunu söyledi ve oluşturduğu güvenlik önlemlerine ve ebeveynlere sağladığı araçlara dikkat çekti.
Bir OpenAI sözcüsü, "Zorunlu bağımsız değerlendirmeyi memnuniyetle karşılıyoruz, ancak Common Sense Media'nın testlerinin ChatGPT'nin gençlik korumalarının pratikte nasıl çalıştığını veya yapay zekanın gençleri nasıl destekleyebileceğine ilişkin uzman bakış açılarını doğru şekilde yansıttığına inanmıyoruz" dedi. Şirket, grubun metodolojisine ilişkin incelemesinin "testlerin büyük kısmının ebeveyn kontrollerinin etkinleştirilmesi tamamlanmadan önce başlamış ve sonuçlanmış olabileceğini, bu da bulguların hatalı olduğunu" gösterdiğini belirterek, bu tür testlerin ebeveyn güvenliği bildirimlerinin tasarlandığı gibi çalışıp çalışmadığını belirlemeyeceğini ekledi.
Steyer, kuruluşunun, ürün değerlendirmeleri sırasında standart uygulama olduğu gibi bulgular hakkında OpenAI ile temas halinde olduğunu ve sonuçların arkasında durduğunu söyledi. Otomotiv güvenliğiyle bir karşılaştırma yaparak, "Araştırmamızın ve testlerimizin kalitesinin ve bu ürünü 'kabul edilemez bir risk' olarak etiketlemiş olmamızın %100 arkasındayız" dedi: "Çarpışma testini geçemeyen bir arabayı piyasaya sürmezdiniz."
Yapay Zeka ve Küçükler Üzerine Büyüyen Bir Bakış
Anlaşmazlık, yapay zeka sohbet robotlarının genç kullanıcıları nasıl etkilediğine dair incelemelerin yoğunlaştığı bir dönemde ortaya çıkıyor; erişimi kısıtlayan okul bölgelerinden, yaş doğrulama gerekliliklerini tartan yasa yapıcılara kadar. Bunun gibi bağımsız denetimler, yapay zeka şirketlerinin pazarlamalarında gençlerin güvenliğine yönelik iddiaları için fiili bir test alanı haline geliyor.
Her iki taraf da bir konuda hemfikir: Ebeveyn bildirim sistemi işin özü. Yeni bir genç hesabı kendine zarar verme düşüncelerini ilk kez gündeme getirdiğinde uyarılar tetiklenmezse, en önemli güvenlik özelliği, en önemli anda başarısız olur. OpenAI, testin kusurlu olduğunu söylüyor; Common Sense Media, ürünün hazır olmadan gönderildiğini söylüyor. Düzenleyiciler ve ebeveynler artık kimin haklı olduğunu tartacak ve OpenAI, boşlukları düzeltme veya ürünü geri çekme yönünde giderek artan bir baskıyla karşı karşıya kalacak.
Yapay zeka güvenliği, politikası ve bunları şekillendiren Yapay Zeka endüstrisindeki gelişmeler hakkında daha fazla bilgi edinmek için bu hikayeyi takip edin.
---
Yapay Zekanın Önünde OlunEn son AI haberlerini, analizlerini ve buluşlarını tek bir yerden alın.
Daha fazla AI haberini okuyun →