OpenAI, yayınlanmamış bir dahili sınır modeli tarafından üretilen 722 matematiksel el yazmasını yayınladı ve koleksiyonun tamamını Apache-2.0 lisansı altında halka açık bir GitHub deposuna yerleştirdi. 6 Ekim 2026'da "Matematikte Yapay Zeka İlerlemesini Paylaşmak" başlıklı bir araştırma gönderisinde duyurulan sürüm, bugüne kadar yapay zeka tarafından oluşturulan matematiksel sonuçların en büyük tek dökümü arasında yer alıyor ve resmi Yalın kanıt kontrolleri, kısaltılmış akıl yürütme özetleri ve her bir sonucun ne kadar hesaplama tükettiğine ilişkin olağandışı ayrıntılarla birlikte geliyor.

Hareket zaten gergin olan bir alana iniyor. New York Times, bu sürümün ciddi araştırma sonuçları üreten yapay zeka sistemleriyle aylarca uğraşan matematik topluluğunu daha da sarstığını bildirdi. Scientific American ise OpenAI'yi "zaten şokta olan bir alanda yüzlerce matematik sonucunu daha" ortaya çıkaracak şekilde tanımladı. En yeni yapay zeka araştırma gelişmelerini takip eden okuyucular için bu sürüm, öncü laboratuvarların kredi anlaşmazlıklarını alevlendirmeden makine tarafından üretilen bilimi nasıl paylaştığına dair bir test örneğidir.

Deponun İçinde Ne Var?

Koleksiyon GitHub'daki openai/math deposunda bulunuyor. README'ye göre içerikler, açık araştırma problemlerine ilişkin model geliştirme değerlendirmelerinin bir parçası olarak bir araya getirilen, dahili bir OpenAI modeli tarafından üretilen matematiksel metinler ve destekleyici kanıt eserlerdir. Mevcut katalog, 372 aile halinde düzenlenmiş 722 el yazması içermektedir; burada bir aile grubu, her biri matematik disiplinine göre sınıflandırılmış, temel sonucu, yardımcı argümanları, sonuçları veya alternatif kanıtları içerebilen ilgili makaleleri gruplandırır.

Bir önbaskı dizini PDF'leri, kaynak dosyalarını ve her el yazması için alıntı ve derleme talimatlarını içerir. Yalın kütüphane, resmi kanıtları, ilgili makaleler ve doğrulama yapılandırmalarıyla birlikte kataloglar. Her taslak resmileştirilmemiştir: birçok sonuç, bilgisayarların provaları satır satır kontrol etmesine izin veren programlama dili olan Lean'da resmileştirmelere eşlik etmektedir, ancak README, bazı resmileştirilmemiş sonuçların sorunlar içerebileceği konusunda uyarmaktadır. OpenAI, bu tür sorunları hızlı bir şekilde çözeceğini söylüyor ve koleksiyonun kamuya açık yayın geçmişini korumayı, düzeltmeleri ve revizyonları yeni sürümler olarak kaydetmeyi ve önceki sürümleri erişilebilir tutmayı taahhüt ediyor. Her makale dizini aynı zamanda alıntı için bir BibTeX bloğu da taşır.

Sonuçlar Nasıl Üretildi?

Sonuçların büyük çoğunluğu, yayınlanmamış bir dahili OpenAI modelinin kullanıldığı tek ve sabit bir prosedürden geldi. Değerlendirme süresince modele yaklaşık 4.000 problem soruldu. OpenAI, yayınlanan ortalama sonucun, sektörde hala nadir görülen bir şeffaflık düzeyi olan yaklaşık üç saatlik ChatGPT Pro düşünme hesaplamasına eşdeğer tükettiğini bildiriyor. Şirket, mevcut matematiksel ölçütlerdeki performans doyuma ulaştıktan sonra bu değerlendirmeleri genişlettiğini ve bazı çıktıların kendi modelleri tarafından üretilen daha önceki sonuçlara dayandığını söylüyor. Uygun bir önem düzeyi gerektirmek ve ham çıktıları aileler ve el yazmaları halinde toplamak, yayınlanan kataloğu oluşturdu.

Bu prosedürden adı geçen iki istisna ayrıldı: okunabilirlik için insan tarafından düzenlenen Re(s) > 11/12 bölgesini kapsayan yazıyla birlikte Riemann zeta fonksiyonu için sıfırsız bir bölge oluşturma çalışması ve CM değişmeli çeşitleri için Hodge Varsayımının bir kanıtı. Her ikisi de ciddi ana akım matematiktir ve her ikisi de artık topluluk incelemesiyle karşı karşıya kalacak.

Modelin mantığının on kısaltılmış özeti de yayınlanmıştır. Pi'nin irrasyonellik üssü, simetrik ve genel Mahler varsayımları, serbest grup faktörlerinin izomorfizmi, aritmetik ilerlemeler için yarı polinom sınırları, Kaplansky'nin karakteristik ikideki doğrudan sonluluk varsayımı, seyreltilmiş döner camlar için Mezard-Parisi formülü, kuantum Heisenberg ferromıknatısında kendiliğinden mıknatıslanma ve üç boyutlu göreli Vlasov-Maxwell sistemi gibi sonuçları kapsar.

Bir Danışma Grubu Yayının Şekillendirilmesine Yardımcı Oldu

OpenAI, sonuçları paylaşmak için en iyi uygulamaları geliştirirken İleri Araştırma Enstitüsü'ndeki bağımsız Matematik ve Yapay Zeka Danışma Grubuna danıştığını söyledi. Bu grup, matematik topluluğundan 600'den fazla yanıt aldıktan sonra 29 Eylül 2026'da sorumlu sürüm önerilerini yayınladı. Öneriler açık ve net: "Bu uygulamayı onaylamıyoruz ve onlardan gelişmiş matematik problemlerini özel modeller üzerinde test etmeyi bırakmalarını istiyoruz." Grup, laboratuvarları, sonuçları hiçbir yapay zeka laboratuvarının kontrol etmediği bilimsel veri havuzlarına saklamaya, kalıcı alıntı yapılabilir tanımlayıcılar atamaya, model adını, kullanılan istemleri ve özetlenmiş akıl yürütme zincirlerini açıklamaya ve sonuç açıklamalarını pazarlama aracı olarak ele almaktan kaçınmaya çağırıyor.

OpenAI'nin piyasaya sürülmesi açıkça bu çerçeveye meydan okumak yerine ona uyma girişimidir. Toplumun bunu kabul edip etmeyeceği başka bir sorudur. Danışma grubunun anketi, özellikle bir laboratuvarın birçok sonucun varlığını ayrıntı vermeden duyurduğu bir senaryoyu sordu ve ortaya çıkan tavsiyeler, duyuruların doğrulamayı geride bıraktığı yönündeki derin endişeyi yansıtıyor.

Doğrulama Yükü Matematikçilere Kayıyor

Pratik zorluk artık çalışan matematikçilere aittir. Resmi Yalın kanıtları mekanik olarak kontrol edilebilir ve bunların varlığı hata riskini önemli ölçüde azaltır. Ancak README'nin potansiyel olarak kusurlu olarak işaretlediği, resmileştirilmemiş el yazmaları, geleneksel hakem incelemesini gerektirir ve 722 el yazması, topluluğun hızla özümseyebileceğinden çok daha fazladır. Ayrıca öncelik ve kredi sorunu da var: Yıllarını bu problemlerle uğraşarak geçiren matematikçiler, modele tam olarak ne sorulduğunu, ona ne verildiğini ve herhangi bir insan sonucunun dahil edilip edilmediğini bilmek isteyeceklerdir. OpenAI'nin bilgi istemleri özetleri ve hesaplama istatistikleri yayını, bu soruların bazılarını önceden yanıtlamak için tasarlanmıştır.

Sürüm aynı zamanda rakiplerin takip etmesi için baskı yapılabilecek bir şablon da belirliyor. Antropik, Google DeepMind ve araştırma düzeyinde matematik yapabilen öncü modellere sahip diğer laboratuvarlar, artık danışma grubu tarafından dile getirilen, özel modellerde gizlenen sonuçların ya tam kaynağıyla yayınlanması ya da hiç alay edilmemesi gerektiği yönünde fiili bir normla karşı karşıyadır.

Şimdilik, veri havuzu yayında, resmileştirme çalışmaları devam ediyor ve düzeltmeler halka açık olarak yayınlanıyor. Bunun yapay zeka tarafından üretilen matematik için standart bir başucu kitabı mı olacağı, yoksa laboratuvarlar ve onların yararlandığı araştırma toplulukları arasında genişleyen bir çatışmanın başka bir parlama noktası mı olacağı, önümüzdeki birkaç haftalık incelemenin nasıl geçeceğine bağlı olacaktır.

Yapay Zeka Eğrisinin Önünde Kalın

Yapay zekanın ürettiği bilim, basın bülteninden hakem değerlendirmesine geçiyor. Tüm önemli araştırma yayınlarını, model lansmanlarını ve politika değişikliklerini kapsayan son dakika yapay zeka haberlerini aibuzzwire.news'te takip edin.

Daha fazla AI haberini okuyun →