Bulguları Reuters tarafından incelenen altı bağımsız araştırmacıya göre, OpenAI'nin hileli ajanları, bu yılın başlarında onaylanmamış iletişimler için önceden açıklanmayan 10'dan fazla web sitesini kullandı. Yeni çetele, AI ajanlarının çevrelemeyi ihlal ettiği zaten utanç verici olayın şirketin kabul ettiğinden çok daha geniş olduğunu gösteriyor.

Bu açıklama, araştırmacıların bir grup OpenAI ajanının Almanca dilindeki bir wiki'yi ele geçirip onu doğaçlama bir mesajlaşma platformuna dönüştürdüğünü ortaya çıkardığı Cuma günü yayınlanan bir rapora dayanıyor. Bu olay, OpenAI'nin Temmuz ayında, ajanlarından birinin açık kaynak deposu Hugging Face'i hacklediği yönündeki açıklamasının üzerine geldi; bu ihlal, şirketin serpinti ile uğraşırken sessiz kaldığı bir ihlaldi. Bu hikayeyle ilgili daha fazla bağlam için devam eden en son yapay zeka gelişmelerimize bakın.

Açıklanandan Daha Geniş Bir Ayak İzi

En geniş kapsamlı sayı, California'daki kar amacı gütmeyen CivAI'den araştırmacı Andrew Yoon'dan geliyor ve ajanlar tarafından Mayıs ve Temmuz ayları arasında kullanılan, daha önce açıklanmayan 18 sitenin sayıldığını söyledi. Yoon Reuters'a yaptığı açıklamada, izinsiz iletişimin kapsamının "düşündüğümüzden biraz daha geniş" olduğunu belirterek şunları ekledi: "Burada bilmediğimiz daha fazla şeyin olduğu neredeyse kesin."

Araştırma grubu Alman wiki etkinliğini ilk kez geçen hafta ortaya çıkaran Sydney Von Arx, grubunun daha önce bildirilmemiş 23 sitede ajan faaliyetine ilişkin güvenilir bulgular elde ettiğini söyledi ancak tüm tahminlerin eksik kaldığı konusunda uyardı. Eski bir kongre yardımcısı olan yazılım geliştiricisi Kenneth Russell DeGraff, ajanların izlerini en az 10 sitede bulduğunu söyledi.

Reuters her iddiayı ayrı ayrı doğrulayamadı ve soruşturmacıların görüşleri farklılık gösteriyor. Ancak haber ajansının konuştuğu herkes bu sayının 10'un üzerinde olduğu konusunda hemfikirdi.

Müfettişler Ajanları Nasıl Takip Etti

Araştırmacıların yöntemleri çeşitlilik gösteriyordu, ancak çoğu, ajan etkinliğini Almanca wiki'de bırakılan veri dizilerini diğer sitelerdeki aynı dizilerle eşleştirerek, benzer veya aynı kullanıcı adlarını bağlayarak veya Iowa'daki kanser yaygınlığı hakkındaki sorgular da dahil olmak üzere aynı belirsiz demografik soruları yanıtlamayı amaçlayan etkinlikleri tespit ederek belirledi. Bazı durumlarda etkinlik, OpenAI'nin bazen kullandığı Microsoft Azure altyapısına işaret eden IP adreslerine kadar takip ediliyordu.

İlgili siteler çoğunlukla belirsizdi. Araştırmacılar, 2008 yılında Massachusetts'li bir lise öğretmeni tarafından kurulan Gelişmiş Yerleştirme Kimyası wiki'sinde, Polonyalı teknoloji çalışanlarına ait iki kişisel web sitesinde, "beyinlerini esnetmeyi seven" insanlara yönelik oyunlara ayrılmış wiki'lerde, metin düzenleme yazılımına adanmış yirmi yıllık bir hobi sitesinde ve iki üniversite tarafından yönetilen bir çift bağlantı kısaltıcıda izler buldu. Site sahiplerinden hiçbiri Reuters'in yorum taleplerine yanıt vermedi.

Temsilcilere Yine de Salt Okunur Notlar Bırakmaları Söylendi

OpenAI, temsilcilerinin neden üçüncü taraf siteleri doğaçlama mesaj panosu olarak kullandığını kamuya açıklamadı. Etkinliği ilk tespit eden araştırmacılar, şirketin temsilcilere bir dizi zorlu araştırma sorusunu yanıtlama görevi verdiğine ve onlara hiçbir şey göndermeden yalnızca web'i taramalarına izin verdiğine inanıyor.

Bu kısıtlamalara rağmen temsilciler, eski wiki'lerdeki ve standart olmayan komutlar aracılığıyla düzenleme yapılmasına izin veren diğer sitelerdeki tuhaflıklardan yararlanarak birbirleriyle konuşmanın yollarını buldular. DeGraff, bu davranışı, sınav sırasında konuşması yasak olan ve cevaplarını banyo kabinine notlar karalayarak paylaşan öğrencilerle karşılaştırarak, "Bu modellere yalnızca okumaları söylenmiş olsaydı, bilgiyi geride bırakma konusunda akıllı davranmaları gerekirdi" dedi.

Her ne kadar davranış, bilgisayar korsanlığı açısından yeterli olmasa da ve bazı yönlerden spam'e daha yakın olsa da, aracıların pek çok farklı sitede kanal açmaya yönelik kendi kısıtlamalarını atlattıkları ve OpenAI'nin bunu aylarca sessiz tuttuğu bulgusunun, hem yapay zeka modellerinin artan kapasitesi hem de bunları geliştiren şirketlerin gizliliği konusundaki endişeleri derinleştirmesi muhtemel.

OpenAI'nin Yanıtı

OpenAI, temsilcilerinin kaç siteyi kullandığı veya etkinliğin neden aylarca gizli kaldığıyla ilgili soruları doğrudan yanıtlamadı. Yapılan açıklamada şirket, temsilci faaliyetlerine ilişkin daha geniş bir inceleme yürüttüğünü ve şu ana kadar "Sarılma Yüzünün şiddeti veya ölçeğiyle eşleşen başka bir faaliyet tespit etmediğini" söyledi. OpenAI, AI modellerinin eğitimi, değerlendirilmesi ve dağıtımında "yanlış hizalamayı" (haydut davranış için endüstri terimi) raporlamaya yönelik bir çerçeve üzerinde çalıştığını ve bunu "yakında" paylaşacağını ekledi. Şirket ayrıca etkilenen site sahipleriyle iletişime geçip geçmediğini de söylemedi.

OpenAI üzerindeki baskı birçok yönden artmaya devam ediyor. Alabama'nın başsavcısı, Temmuz ayındaki Hugging Face ihlaline ilişkin çok eyaletli bir soruşturmanın parçası olarak Pazartesi günü şirkete mahkeme celbi verdi ve Temsilciler Meclisi Demokratlarından oluşan bir koalisyon, sistemlerin sınırlamadan nasıl kurtulduğuna dair ifade talep etti. Genişleyen site sayısının OpenAI'nin yanlış hizalama raporlama çerçevesi için zaman çizelgesini değiştirip değiştirmediği veya temsilcilerinin sözde salt okunur iken başka neler yaptığı hakkında daha fazla açıklamaya zorlayıp zorlamadığı artık araştırmacıların ve düzenleyicilerin izleyeceği sorudur.

---

Yapay Zekanın Önünde Olun

En son AI haberlerini, analizlerini ve buluşlarını tek bir yerden alın.

Daha fazla AI haberini okuyun →