OpenAI, dahili bir sürümün matematik ve teorik bilgisayar bilimlerinde on önemli ilerleme sağlamasının ardından, "bir sonraki ana modelimiz" olarak adlandırdığı yayınlanmamış bir sistem olan Astra'nın perdesini geri çekti. Şirket, duyuruyu matematiksel sonuçları belgeleyen bir araştırma gönderisinin içine koydu ve bu, son dakika yapay zeka haberlerini yakından takip eden araştırmacıların hem heyecanlanmasına hem de inceleme yapmasına neden oldu.

OpenAI, Astra'nın çözülmesine yardımcı olduğu sorunların "en az on yıldır ve çoğu durumda çok daha uzun bir süredir merkezi sonuçlarında ilerleme kaydedilmediğini" yazdı. Sonuçlar, yüksek boyutlu geometri, kodlama teorisi, aritmetik devre karmaşıklığı, grup teorisi, kuantum karmaşıklığı, kafes kriptografisi ve ekstremal kombinatorik gibi alanları kapsıyor; bu alanlar, ilerlemenin tek bir araştırma çalışmasıyla değil, normalde yıllarla ölçüldüğü alan.

Yalnızca Cevaplar Değil, Doğrulanmış Kanıtlar

Astra'nın çıktısını, matematikte tahmin yapan bir sohbet robotundan ayıran şey doğrulamadır. OpenAI, insan araştırmacıların argümanları metinler halinde hazırlamak için aynı modeli kullandığını ve Astra'nın daha sonra her argümanı Yalın sertifika olarak resmileştirdiğini söyledi. Yalın, matematiksel argümanları makineyle kontrol edebilen açık kaynaklı bir kanıt asistanıdır; bu, diğer matematikçilerin sonuçlara güvenmek zorunda olmadığı anlamına gelir; bunlar yazılım tarafından bağımsız olarak birkaç saniye içinde doğrulanabilir.

Bu ayrım önemlidir. Bir dil modeli, ince ve ölümcül bir hata içeren makul görünen bir kanıt üretebilir. OpenAI, her argümanı Yalın'a çevirerek bir pazarlama iddiasını kontrol edilebilir bir yapıya dönüştürdü. Ayrıntıları bildiren BleepingComputer'a göre, belirli ilerlemeler arasında sofik olmayan grupların varlığını ortaya koyan ve grup teorisindeki önemli bir açık soruyu çözen bir kanıt yer alıyor; Connes'in katılık varsayımının çürütülmesi; yüksek boyutlu küre ambalajlamada yeni sınırlar; ve üretken matematikçi Paul Erdős'in başlangıçta ortaya attığı çeşitli problemleri çözen sonuçlar.

OpenAI, bu çözümleri bulmak için gereken toplam token sayısının mevcut API oranlarında yaklaşık 2.000 dolara mal olacağını belirtti; bu, modern matematiksel keşiflerin bilgi işlem ayak izi hakkında çarpıcı bir veri noktasıdır ve sınır düzeyindeki araştırmaları yalnızca laboratuvarların değil, iyi finanse edilen akademik ekiplerin erişimine yerleştirir.

Matematikçiler Tepki Veriyor

Manchester Üniversitesi'nden matematikçi ve Erdős problemi referans sitesi erdosproblems.com'u yöneten Thomas Bloom, The Decoder'a göre sonuçları X hakkında "büyük haber" olarak nitelendirdi. Bunları, Mayıs ayında yayınlanan birim uzaklık varsayımına karşı bir örnekten daha önemli olarak değerlendirdi. Bloom, "Belki birim mesafenin kanıtından daha büyük olmayabilir, ancak yapılar açısından bu büyük" diye yazdı.

Bloom ayrıca yapay zekanın matematikçilerin yerini aldığı şeklindeki çerçeveye de karşı çıktı; sistemin bir asırdan fazla teoriye dayandığı, matematikçiler tarafından oluşturulduğu ve matematikçilerin şimdiye kadar yazdığı her şey üzerine eğitim aldığı göz önüne alındığında bu iddianın pek mantıklı olmadığını savundu.

Astra'nın güvendiği test zamanı muhakeme teknolojisinin arkasındaki araştırmacı olan Noam Brown daha ölçülüydü. X'te, Clay Matematik Enstitüsü'nün her biri için 1 milyon dolar teklif ettiği yedi ünlü probleme atıfta bulunarak "Ne yazık ki (henüz) Milenyum Ödülü Problemi yok" diye bir paylaşımda bulundu; ödüllerin açıklandığı 2000 yılından bu yana yalnızca bir tanesi çözüldü.

Herkes etkilenmedi. AI eleştirmeni Gary Marcus, bir Substack gönderisinde modeli "şaşırtıcı ama çok fazla satılmış" olarak nitelendirdi; bu, bir sınır laboratuvarının bir dönüm noktası olduğunu iddia ettiğinde tanıdık bir şüphecilik çizgisiydi. Gerçek teknik başarı ile tanıtım çerçevesi arasındaki gerilim muhtemelen Astra'nın nasıl karşılanacağını belirleyecek.

Uzun Görevler İçin Yeni Bir Model Ailesi

Bilgiler, Astra'nın uzun süreli iş yükleri için tasarlanmış yeni bir model ailesi olduğunu bağımsız olarak doğruladı. OpenAI, bunu birden fazla yapay zeka aracısının daha büyük bir sorunun farklı bölümleri üzerinde işbirliği yapmasına olanak tanıyan bir sistem olarak tanımlıyor; bir teoremi kanıtlamak veya büyük bir kod tabanını yeniden düzenlemek gibi saniyeler yerine saatler veya günler süren görevleri doğrudan hedefleyen bir tasarım.

BleepingComputer, OpenAI'nin modelin GPT-5.7, GPT-6 olarak mı yoksa başka bir adla mı gönderileceğine karar vermediğini bildirdi. The Decoder'ın haberine göre CEO Sam Altman, Astra'yı Washington D.C.'de sergiledi ve şirketin sistemi politika yapıcıların önüne koyacak kadar olgun gördüğünün sinyalini verdi.

Hükümet İnceleme Engeli

Belki de en önemli ayrıntı düzenleyicidir. The Decoder'a göre Astra, kamuya açıklanmadan önce resmi onay gerektiren planlı bir ABD hükümeti inceleme sürecinden geçen ilk modeller arasında yer alacak. Bu, lansman zaman çizelgesine daha önceki amiral gemisi modellerinin hiç karşılaşmadığı bir siyasi belirsizlik katmanı ekliyor ve OpenAI'nin Astra'nın yeteneklerini nasıl tanımladığına ilişkin riskleri artırıyor.

İlk çıkış aynı zamanda şiddetli bir açık siklet yarışının ortasında geliyor. Birkaç gün önce Thinking Machines Lab, Inkling-Small açık ağırlık modelini piyasaya sürdü ve Çin laboratuvarları açık ağırlık sınır sistemlerini zorlamaya devam ediyor. Astra, OpenAI'nin, Yalın gibi araçlarla doğrulanan özel, büyük ölçekli akıl yürütmenin en büyük atılımlara giden yol olmaya devam edeceği yönündeki iddiasının sinyalini veriyor.

Astra şimdilik yayınlanmadı. Ancak matematiksel başlangıcı, öncü yapay zeka sistemlerinin saf bilime ne gibi katkıda bulunabileceği ve halkın bunlara eşlik eden iddiaları ne kadar yakından incelemesi gerektiği hakkındaki tartışmayı şimdiden yeniden şekillendirdi.

Yapay Zekanın Önünde Olun

Astra ve daha geniş öncü model yarışı gibi gelişmelere ayak uydurmak mı istiyorsunuz? En son yapay zeka gelişmeleri için merkezimize yer işareti koyun.

Daha fazla AI haberini okuyun →