Universitas Oxford ngidini OpenAI nglatih model AI babagan teks sejarah saka Perpustakaan Bodleian, kanthi materi digital sing digunakake kanggo "ngisi set pelatihan OpenAI," miturut dokumen internal sing dilaporake dening The Guardian, Sabtu - tujuan sing ora nate kasebut nalika kemitraan kasebut diumumake sacara umum.

Oxford ngumumake kolaborasi kasebut ing Maret 2025 minangka proyek digitalisasi, ujar manawa nggunakake piranti lunak OpenAI kanggo mindai teks saka salah sawijining perpustakaan paling misuwur ing donya bakal nggawe konten kasebut kasedhiya kanggo siswa lan peneliti. Apa sing ora dikandhakake woro-woro yaiku materi kasebut bakal menehi latihan model komersial OpenAI. Dokumen internal sing dideleng dening Guardian nggawe tujuan kasebut kanthi jelas, menehi tandha minangka salah sawijining conto sing paling jelas nganti saiki babagan institusi budaya adiluhung sing nyedhiyakake [bahan mentah kanggo industri AI] (https://aibuzzwire.news).

Kemitraan kanthi tujuan sing ora ditemtokake

Rincian pengaturan kasebut muncul liwat panyuwunan informasi sing bebas, sing dadi menit rapat universitas sing nyathet keprihatinan saka staf - kalebu anggota panitia pamrentahan Bodleian dhewe - babagan risiko reputasi kerjasama karo perusahaan ing mburi ChatGPT. Staff uga wungu efek menehi hasil karo perusahaan teknologi-intensif energi bakal duwe ing komitmen lingkungan universitas.

Juru bicara OpenAI mbela program kasebut, ujar manawa perusahaan kasebut "bangga" kanggo mesthekake "model AI saiki ngreksa kawruh sejarah donya kanggo masa depan." "Kanthi luwih saka milyar wong nggunakake teknologi iki ing saben dinten gesang, iku penting iku nuduhake budaya beda, sajarah lan perspektif," ngandika ngandika.

Saka balada Tudor nganti tesis doktoral

Skala digitalisasi cukup gedhe. Ing wulan Juni 2025, 125,000 gambar sing dipindai saka disertasi sejarah wis dienggo bareng karo OpenAI saka koleksi Bodleian, kalebu tesis PhD saka universitas Eropa lan Amerika sing ditulis ing abad kaping 19 lan 20. Materi liyane sing dipindai kalebu koleksi langka saka 10.000 "balada amba" abad kaping nembelas - lirik lagu lan cathetan musik sing tau disebar ing pojok-pojok dalan Tudor.

Ora ana sing rahasia ing pangertèn konvensional; akeh kepemilikan sajarah Bodleian minangka karya domain umum, lan hukum hak cipta menehi sawetara larangan kanggo model latihan ing teks sing lawas. Nanging prabédan antarane digitalisasi perpustakaan kanggo sarjana lan populating pesawat latihan komersial minangka jinis bédané sing institusi historis wis samesthine kanggo negara metu. Oxford ora - lan omission kurang kanggo apa ngandika bab hak legal saka apa ngandika bab transparan antarane universitas lan komunitas dhewe.

Pustaka minangka wates data anyar

Rush kanggo rak perpustakaan duwe driver ekonomi prasaja: web mbukak entek data migunani. Nalika situs web sing dicopot dadi jenuh karo materi sing digawe AI, latihan babagan konten kasebut dadi bunder lan rusak, lan pangembang wis ngowahi koleksi buku fisik, asring historis, minangka sumber teks tulisan manungsa sing seger.

Gejala kasebut katon ing dalan dhuwur. The Guardian nglaporake manawa para penjual buku bekas wis ndeleng pirang-pirang pesenan kanggo judhul sing ora jelas - pandhuan kanggo alat pertanian ing Afrika abad kaping 18, biografi driver mobil taun 1950-an - amarga buku kasebut ora ana ing wangun digital ing endi wae online. Penjual buku spekulasi tuku kasebut nuduhake data anyar kanggo model AI generasi sabanjure.

OpenAI wis ngupayakake playbook sing padha ing akademisi lan institusi budaya. Perusahaan kasebut wis nggawe perjanjian karo Perpustakaan Umum Boston, Caltech, MIT, lan Universitas Michigan ing proyek sing diarani NextGenAI, kanthi Oxford minangka siji-sijine anggota UK proyek kasebut. Bodleian, salah sawijining perpustakaan paling tuwa ing Eropa kanthi koleksi nganti pirang-pirang millennia, minangka tambahan sing paling akeh.

Apa tegese kanggo institusi budaya

Episod Oxford bisa uga bakal ngasah debat sing wis ana ing museum, arsip, lan perpustakaan ing saindenging jagad: nalika perusahaan teknologi nawakake digitalisasi koleksi kanthi gratis, apa sing diijolke? Digitalisasi nggawa keuntungan umum sing asli - akses, pengawetan, telusuran. Nanging dokumen Oxford nyaranake nilai kasebut dadi loro, lan panggunaan latihan kasebut minangka bahan kanggo OpenAI sanajan ora cukup materi kanggo diumumake.

Kanggo institusi sing ngadhepi anggaran sing sithik, godaan bisa dingerteni: digitalisasi profesional larang, lan perusahaan kaya OpenAI nawakake kanggo nindakake tanpa biaya. Anggota panitia pamrentahan Bodleian sing kuwatir babagan risiko reputasi katon ngerti apa sing dikonfirmasi dening dokumen FOI - manawa merek universitas kasebut menehi legitimasi kanggo upaya akuisisi data, apa maksude.

Pitakonan saiki yaiku apa institusi liyane bakal negesake klausa transparansi ing kemitraan AI: pambocoran eksplisit babagan panggunaan latihan, milih metu saka materi sing sensitif, lan nglaporake publik babagan apa sing dituduhake lan ngapa. Nganti rampung, koleksi gedhe ing donya bakal terus dadi data latihan - siji proyek digitalisasi sing sepi.

---

Tetep Ahead of AI

Pertempuran kanggo data pelatihan AI nggawe maneh industri sing ngluwihi teknologi. Entuk warta, analisis, lan terobosan AI paling anyar - kabeh ing sak panggonan.

Waca liyane warta AI →