İkinci bir matematikçi, OpenAI'yi ünlü matematik atılımlarının ardındaki veriler üzerinde etik olmayan ve "dürüst olmayan" davranışlarla suçladı ve şirketin, ChatGPT ile olan özel etkileşimlerinin geçen ay büyük bir tantanayla açıklanan sonuçlara katkıda bulunmadığını kanıtlayamadığını söyledi.

Çarşamba günü The Verge tarafından Mastodon hakkında bildirilen bir dizi gönderide matematikçi Andreas Thom, kendisinin ve meslektaşlarının OpenAI'nin duyurulmasından önce ChatGPT ile yaptıkları konuşmaların modelin başarısına katkıda bulunabileceğine dair endişelerini dile getirdi. Müdahalesi, New York Üniversitesi matematik profesörü Tristan Buckmaster'ın OpenAI modellerinin şirketin Codex aracını kullanmasının fayda sağlayıp sağlamadığını kamuoyuna sormasından birkaç gün sonra gerçekleşti; bu, laboratuvar için bir zafer anını, eğitim verilerinin kaynağı konusunda devam eden bir tartışmaya dönüştürdü. For more context on this story, see our ongoing more AI stories.

Atılımdan Tepkiye

Ağustos ayında OpenAI, sisteminin matematik ve teorik bilgisayar bilimlerinde her biri makine tarafından doğrulanmış Yalın kanıtlarla kontrol edilen on önemli sonuç ürettiğini duyurdu; bu, şirketin Milenyum Ödülü sorununa yönelik iddia ettiği çözümün yanı sıra o zamanlar bu sitenin kapsadığı bir kilometre taşıydı. On sonuçtan biri, grup teorisinde uzun süredir cevap bekleyen bir soru olan sofik olmayan grupların varlığını ortaya koydu.

Bu sonuç yeni tartışmanın merkezinde yer alıyor. The Verge'e göre OpenAI, kanıtın ağırlıklı olarak Thom ve matematikçi arkadaşı Gábor Kun'un önceki çalışmalarına dayandığını kabul etti ve matematik çevrelerinin başlangıçta son katkılarını kabul etmedikleri yönündeki eleştirilerinin ardından şirket, yazısını sessizce değiştirdi.

Thom için bu kabul rahatsız edici bir soruyu gündeme getirdi: Model nasıl kendisinin ve Kun'un tekniklerini bu kadar ayrıntılı bir şekilde yönetmeye başladı?

Thom'un Söylediği Soru Cevapsız Kaldı

Thom, "OpenAI'nin tekniklerimiz üzerindeki ayrıntılı hakimiyetinin" onu etkilediğini söyledi ve bunların o dönemde çözüme giden ne en açık ne de en umut verici yollar olduğunu belirtti. OpenAI araştırmacıları Sébastien Bubeck ve Mark Sellke'ye (ikincisi aynı zamanda Harvard'da bir istatistikçi) e-postalar yazdı ve ChatGPT ile olan etkileşimlerinin "eğitim verilerinin bir parçası mı yoksa akıl yürütme süreci için erişilebilir mi" olduğunu ve bu nedenle sonuca katkıda bulunup bulunamayacağını sordu.

Aldığı yanıt, konuşmaların şirketin modellerini eğitmek ve geliştirmek için kullanılan geniş veri havuzlarına girip girmediği değil, yalnızca konuşmalarına doğrudan erişilip erişilemeyeceğiyle ilgiliydi. Thom, "Böyle bir nitelik, açıklama veya kanıt sunulmadı" diye yazdı. "Bunu en hafif tabirle sahtekârlık olarak kabul ediyorum."

The Verge tarafından aktarılan devam yazısında suçlamayı daha da keskinleştirdi: "Sellke'nin kategorik yanıtı en azından haksız yere geniş ve maddi açıdan yanıltıcıydı; geriye dönüp baktığımızda açıkça sahtekârlıktı."

Thom'un argümanı OpenAI'nin ne yaptığıyla ilgili değil, kanıt yükünü kimin taşıdığıyla ilgili. Araştırmacıların şirketin eğitim hattını tersine mühendislik yapacak donanıma sahip olmadıklarını söyledi. "Yalnızca OpenAI bununla ilgili verilere sahip" diye yazdı; dolayısıyla şirket, kullanıcı verilerinin sonuçlarına katkıda bulunduğunu inkar etmek isterse, ilgili veri kümelerini açıklayarak ve müşteri etkileşimlerini nasıl kullandığını açıklayarak bunu kanıtlama sorumluluğu OpenAI'ye aittir.

OpenAI'nin Dikkatli Reddi

Anlaşmazlık, The Verge'e göre Buckmaster'ın Antropik araştırmacı Levent Alpöge ile kişisel olarak üzerinde çalıştığı iddia edilen Navier-Stokes atılımını şirketin ele alma biçimini yansıtıyor. Bu sonucu açıklayan blog yazısında OpenAI şunu belirtti: "Biz (araştırmacılar ve temsilciler), kamuya açıklanıncaya kadar onların hiçbir çalışmasını görmedik; özellikle de bu sorunu çözmek için hiçbir belirli kullanıcı verisine erişilmedi."

Ancak aynı gönderi dolaylı bir kanalı da kabul ediyordu: "Her ne kadar pek olası olmasa da, ürünlerimizin kullanımından elde edilen kimlik bilgilerinin gizlendiği verilerin modellerimizi iyileştirmeye yardımcı olduğunu göz ardı edemeyiz."

Thom'a göre tüm sorun bu ayrımdır. "Kimliksizleştirme bir adı ortadan kaldırabilir; matematiksel bir fikrin entelektüel içeriğini ortadan kaldırmaz" diye yazdı. OpenAI, The Verge'ın yorum talebine hemen yanıt vermedi.

Kullanıcılar tarafından sağlanan kamuya açık olmayan araştırmaların, şirketin daha sonra aynı kullanıcılarla - rıza, uygun şekilde açıklama veya kredi olmadan - yayın için yarıştığı modellerin geliştirilmesine yardımcı olması durumunda bunun "etik açıdan savunulamaz olacağını" ekledi.

Matematiğin Rahatlaması

Milenyum Ödülü hamlesinin koşulları sinirleri yatıştırmak için çok az şey yaptı. OpenAI, internette diğer araştırmacıların büyük ilerleme kaydettiklerine dair söylentiler duyduktan sonra sorunun peşine düştüğünü ve akademisyenlerin yıllar boyunca ulaşmaya çalıştıkları bir sonuca ulaşmak için etkili bir şekilde yarıştığını söyledi.

Çok sayıda araştırmacı The Verge'e, eğer matematikçiler yakın bir buluşa dair söylentilerin bile, iyi kaynaklara sahip, zafere hevesli bir teknoloji devine karşı bir yarışı ateşleyebileceğine inanırlarsa, bu tür davranışların matematiği daha gizli bir duruma sürükleyeceğinden endişe ettiklerini söyledi. Verge'nin konuyla ilgili haberi - "OpenAI'nin kurnaz matematiksel atılımı akademide soğukluk yaratıyor" - sahadaki ruh halini yansıtıyordu.

Bu bölüm, yapay zeka şirketleri ve giderek daha fazla karşılaştıkları araştırma toplulukları için hassas bir döneme denk geliyor. Herhangi bir sonucun değeri ne olursa olsun, Thom'un tanımladığı asimetri yapısaldır: Laboratuvarlar kullanıcı etkileşimlerini geniş ölçekte alabilirken, bu verileri üreten kişilerin alınanları denetleme yolu yoktur. Şirketler eğitim hatlarını incelemeye açana veya müşteri konuşmaları ile model eğitimi arasında sıkı, doğrulanabilir güvenlik duvarları empoze edene kadar, her "verilerinizi kullanmadık" ifadesi üstü kapalı bir yıldız işareti taşıyacak - ve her atılım, matematikçilerin ve giderek artan sayıda diğer alanlardaki araştırmacıların kanıt istemesiyle gelecektir.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →