The Guardian'ın Cumartesi günü bildirdiği dahili belgelere göre Oxford Üniversitesi, OpenAI'nin yapay zeka modellerini Bodleian Kütüphanesi'ndeki tarihi metinler üzerinde eğitmesine izin verdi ve dijitalleştirilmiş materyal, "OpenAI eğitim setini doldurmak" için kullanıldı. Bu amaç, ortaklığın kamuya duyurulduğu sırada hiç belirtilmemişti.

Oxford, iş birliğini Mart 2025'te bir dijitalleştirme projesi olarak açıklayarak, dünyanın en ünlü kütüphanelerinden birindeki metinleri taramak için OpenAI yazılımının kullanılmasının, içeriğin öğrenciler ve araştırmacılar için daha geniş çapta kullanılabilir hale geleceğini söyledi. Duyuruda malzemenin OpenAI'nin ticari modellerinin eğitimini besleyeceği söylenmiyordu. Guardian tarafından incelenen dahili belgeler bu amacı açıkça ortaya koyuyor ve prestijli bir kültür kurumunun sessizce AI endüstrisi için hammadde tedarik ettiğine dair bugüne kadarki en açık örneklerden birini işaret ediyor.

Belirtilmemiş bir amacı olan bir ortaklık

Düzenlemenin ayrıntıları, bilgi edinme özgürlüğü talebiyle ortaya çıktı ve Bodleian'ın kendi yönetim komitesi üyeleri de dahil olmak üzere personelin ChatGPT'nin arkasındaki şirketle ortaklık kurmanın itibar riski hakkındaki endişelerini kaydeden üniversite toplantı tutanakları ortaya çıktı. Personel ayrıca enerji yoğun bir teknoloji şirketiyle yapılacak bir anlaşmanın üniversitenin çevresel taahhütleri üzerindeki etkisini de dile getirdi.

Bir OpenAI sözcüsü programı savundu ve şirketin "bugünün yapay zeka modellerinin dünyanın tarihsel bilgisini gelecek için korumasını" sağlamaktan "gurur duyduğunu" söyledi. Sözcü, "Bir milyardan fazla insanın bu teknolojiyi günlük yaşamda kullandığı göz önüne alındığında, bunun farklı kültürleri, tarihleri ​​ve bakış açılarını yansıtması önemli" diye ekledi.

Tudor baladlarından doktora tezlerine

Dijitalleşmenin ölçeği oldukça büyüktür. Haziran 2025 itibarıyla, 19. ve 20. yüzyıllarda Avrupa ve Amerika üniversitelerinden yazılan doktora tezleri de dahil olmak üzere, Bodleian koleksiyonundan tarihi tezlerden taranan 125.000 görüntü OpenAI ile paylaşıldı. Taranan diğer materyaller arasında, bir zamanlar Tudor sokak köşelerinde dolaşan şarkı sözleri ve müzik notalarından oluşan 10.000 on altıncı yüzyıl "geniş kenar baladlarından" oluşan nadir bir koleksiyon yer alıyor.

Bunların hiçbiri geleneksel anlamda gizli değil; Bodleian'ın tarihi varlıklarının çoğu kamu malı çalışmalardır ve telif hakkı kanunu, bu kadar eski metinler üzerindeki eğitim modellerine çok az kısıtlama getirmektedir. Ancak akademisyenler için bir kütüphanenin dijitalleştirilmesi ile ticari bir eğitim setinin doldurulması arasındaki ayrım, tarihsel olarak kurumların yüksek sesle ifade etmesi beklenen türden bir ayrımdır. Oxford bunu yapmadı - ve bu ihmal, yasal haklar hakkında söylediklerinden ziyade, bir üniversite ile kendi topluluğu arasındaki şeffaflık hakkında söylediklerinden daha önemli.

Yeni veri sınırı olarak kütüphaneler

Kütüphane raflarına hücumun basit bir ekonomik nedeni var: Açık web'de yararlı veriler tükeniyor. Parçalanmış web siteleri yapay zeka tarafından oluşturulan materyallerle doldukça, bu içerikle ilgili eğitim döngüsel hale geliyor ve kalitesizleşiyor ve geliştiriciler, yeni, insan tarafından yazılmış metin kaynağı olarak fiziksel, genellikle tarihi kitap koleksiyonlarına yöneliyor.

Semptomlar ana caddede görülebilir. The Guardian, ikinci el kitapçıların, 18. yüzyıl Afrika'sındaki tarım aletlerine ilişkin bir rehber, 1950'lerdeki araba sürücülerinin biyografileri gibi belirsiz kitaplar için bir sipariş yağmuru gördüğünü bildirdi. Kitapçılar, satın almaların yeni nesil yapay zeka modelleri için yeni verileri temsil ettiğini öne sürdü.

OpenAI, akademi ve kültür kurumlarında aynı stratejiyi takip etti. Şirket, Oxford'un projenin İngiltere'deki tek üyesi olduğu NextGenAI adlı bir proje kapsamında Boston Halk Kütüphanesi, Caltech, MIT ve Michigan Üniversitesi ile anlaşmalar yaptı. Binlerce yıla yayılan bir koleksiyona sahip Avrupa'nın en eski kütüphanelerinden biri olan Bodleian, açık ara en çok katlı kütüphanedir.

Kültür kurumları için ne anlama geliyor?

Oxford olayı muhtemelen dünya çapındaki müzeler, arşivler ve kütüphanelerde halihazırda devam eden bir tartışmayı daha da keskinleştirecek: Bir teknoloji şirketi bir koleksiyonu ücretsiz olarak dijitalleştirmeyi teklif ettiğinde, gerçekte ne değiş tokuş ediliyor? Dijitalleşme, erişim, koruma, aranabilirlik gibi gerçek kamu yararları sağlar. Ancak Oxford belgeleri, değerin her iki yönde de aktığını ve duyurulacak kadar önemli olmasa bile eğitim seti kullanımının OpenAI için önemli olduğunu öne sürüyor.

Kısıtlı bütçelerle karşı karşıya olan kurumlar için bu istek anlaşılabilir: Profesyonel dijitalleştirme pahalıdır ve OpenAI gibi şirketler bunu hiçbir ücret ödemeden yapmayı teklif ediyor. Bodleian'ın itibar riskinden endişe duyan yönetişim komitesi üyeleri, FOI belgelerinin daha sonra doğruladığı şeyi sezmiş gibi görünüyor: niyet bu olsa da olmasa da, üniversitenin markası bir veri toplama çabasına meşruiyet kazandırıyordu.

Şimdi soru, diğer kurumların yapay zeka ortaklıklarında şeffaflık maddelerinde ısrar edip etmeyecekleri: eğitim kullanımının açık bir şekilde açıklanması, hassas materyaller için kapsam dışında kalma ve neyin ve neden paylaşıldığına dair kamuya raporlama. Bunu yapana kadar dünyanın harika koleksiyonları, her seferinde sessiz bir dijitalleştirme projesi olan eğitim verileri haline gelmeye devam edecek.

---

Yapay Zekanın Önünde Olun

Yapay zeka eğitim verilerine yönelik mücadele, endüstrileri teknolojinin çok ötesinde yeniden şekillendiriyor. En son yapay zeka haberlerini, analizlerini ve buluşlarını tek bir yerden alın.

Daha fazla AI haberini okuyun →