OpenAI, en yeni sınır modeli GPT-6 Astra'nın piyasaya sürülmesinden bu yana daha da aptallaştığına dair bir haftadır kullanıcı şikayetlerini açıkladığını söylediği üç kusuru düzeltti ve bir tür özür olarak Codex abonelerinin kullanım sınırlarını sıfırlıyor. Güncelleme, Codex ürün lideri Tibo Sottiaux'dan geldi. Sottiaux, Cumartesi günü yayınlanan bir güncellemeye göre ekibin hataları izlemek için kullanıcılarla birlikte çalıştığını, ardından yerel saatle gece yarısından önce düzeltmeleri ve tam kullanım sıfırlamasını gönderdiğini söyledi.
Kabul, OpenAI'nin bugüne kadarki en yetenekli model olarak ilan ettiği zorlu bir süreci kapatıyor. Astra, Eylül başında geniş çapta kullanılabilirliğe ulaştığından beri, X'teki geliştiriciler, lansman günü Astra ve mevcut sürüm için aynı istemleri çalıştırıyor, her ayarı aynı tutuyor ve oldukça zayıflamış bir modeli gösteren yan yana karşılaştırmalar yayınlıyordu. Bu tartışmayı yönlendiren modeller hakkında daha fazla bilgi için en son yapay zeka gelişmeleri haberimize bakın.
Adlandırılan Üç Kusur
Sottiaux'ya göre ilk suçlu, Astra altında çok sık tetiklenen ve bazen modelin kendi çalışmasını kontrol etmesini engelleyen önceki modeller için yazılan bilgi istemi dosyalarıydı. İkincisi, modelin erkenden çıkmasını veya eski mesajlara yanıt vermesini sağlayabilecek isteğe bağlı bir içerik yönetimi deneyiydi. Şirket, OpenAI'nin yaklaşık 4.000 ila 5.000 kullanıcının etkilenmesinin ardından deneyi devre dışı bıraktığını söyledi.
Üçüncü kusur, modelin kendisinden ziyade altyapıyla ilgiliydi: bazı çıkarım motorları yanlış yapılandırılmıştı ve bunlar üzerinden yönlendirilen kuyruk trafiğinin kalitesi ölçülebilir şekilde düşmüştü. OpenAI bu motorları çıkardı ve birkaç küçük onarım yaptı. Sottiaux, modelin artık kullanıcının en son mesajını daha doğru bir şekilde takip ettiğini yazdı; bu, Astra'nın kullanıcının daha önce geçmiş olduğu soruları yanıtladığı yönündeki şikayetlere bir selam niteliğinde.
Geliştiriciler Zaten Devam Etmişti
Şikayetler hafta boyunca arttı. Astra'yı günler önce öven geliştirici Pranjal Paliwal, geri dönüp kendisi için yazdığı kodu okudu ve ardından sonucu ilerleme yerine gerileme olarak nitelendirdi. Opencode kodlama aracını geliştiren Dax Raad, Astra'ya yapılan harcamanın, ödenen paraya değmeyeceğine karar vermesi nedeniyle iki katına çıkmasının ardından ekibini eski GPT-5.6 Sol'a geri taşıdı. Bir forum posteri, Astra'nın artık aynı yeniden denemelerle aynı görevlerde Sol ile aynı seviyede olduğunu tanımladı.
Herkes bu okumayı kabul etmedi. Antikythera olarak yazan takma adlı bir kullanıcı, modelin her zaman tembel olduğunu ve madde işaretlerine düşkün olduğunu ve kullanıcıların gözlerini kamaştırmayı bıraktığını savundu. Bu anlaşmazlık, model kalitesi iddialarının çözümlenmesinin ne kadar zor olduğunu ortaya koyuyor: aynı yönlendirmeler, farklı kararlar.
Arka Planda Kapasite Sorunu
Kapasite, kullanıma sunulmasını gölgede bırakırken kalite satırı indi. OpenAI, kullanıcı raporlarına göre yoğun ChatGPT kullanıcıları için Astra kullanım sınırlarını düşürdü ve 200 dolarlık yeni Pro aboneliklerini duraklattı; bu, Sottiaux'nun talebi gerekçe göstererek 10 Eylül'de onayladığı bir adım. Modelin maliyeti hâlâ milyon girdi tokenı başına 10 dolar ve çıktı tokenı başına 50 dolardır; bu, Sol'un piyasaya sürüldüğünde ücretlendirdiği tutarın 2,5 katıdır.
Ayrıca rahatsız edici bir emsal de var: Bu, iki ay içinde ödeme yapan kullanıcılardan aynı suçlamayı alan ikinci OpenAI amiral gemisi. Temmuz ayında kullanıcılar, Sol'un en iyi muhakeme modunun bir gecede sığlaştığını söyledi. Sottiaux, şirketin o sırada kasıtlı olarak zayıflatıldığını reddederken, şirketin muhakeme çabasıyla deneyler yaptığını doğruladı. Tekrarlanan "model daha da kötüleşti" ve ardından "kusurlar bulduk" döngüleri, şirketin yönetmesi gereken bir model haline geliyor; şeffaflık yardımcı olur, ancak istikrar da yardımcı olur.
OpenAI'nin Kendi Tavsiyesi: Daha Az Korkuluk Kullanın
Düzeltmelerin yanı sıra OpenAI, mühendis Eric Provencher'ın sunduğu geçiş kılavuzunu yayınladı; bu, mantığa aykırı bir öneri anlamına geliyor: daha yetenekli modeller daha az elle tutulmaya ihtiyaç duyar. Kılavuz, aşırı uzun beceri tanımlarının, genel okuma gerekliliklerinin ve katı onay kurallarının Astra'nın yoluna çıkabileceğini söylüyor. Zamanla biriken talimatlar bağlamı tüketebilir veya modelin çalışmayı çok erken durdurmasına neden olabilir.
Provencher, ekiplerin model değiştirdikleri zaman becerilerini, AGENTS.md dosyalarını ve görev istemlerini gözden geçirmelerini, talimatları belirli görevlere sıkı bir şekilde bağlamalarını ve bir işin ne zaman tamamlandığını net bir şekilde tanımlamalarını öneriyor; çünkü kısıtlama olmasa bile Astra, GPT-5.6 Sol'dan daha erken durabilir. Önceki modellerin hileli hale gelmesinden sonra işleri kilitleyen takımların bu kuralları tekrar gözden geçirmesi gerekiyor: Gönderide, Astra'nın daha iyi muhakeme gücüne sahip olduğu, ancak eski kısıtlamaları tam anlamıyla yorumlayabildiği ve devam etmesini istediğinizde durabileceği iddia ediliyor.
Sırada Ne Olacak?
Kullanımın sıfırlanması, Codex abonelerine modeli yeniden değerlendirmeleri için temiz bir sayfa sunuyor ve OpenAI, kullanıcılarının yaptığı aynı testleri yan yana izleyecek. Daha derin soru güvendir: Bir amiral gemisinin piyasaya sürülmesinden sonraki bir hafta içinde bozulduğunu gören ödeme yapan geliştiricilerin artık belgelenmiş bir açıklaması, üç adlandırılmış kusuru ve bir sıfırlaması var - ama aynı zamanda her model güncellemesini piyasaya sürüldüğü günle karşılaştırmak için yeni bir neden.
Yapay Zekanın Önünde Olun
Model lansmanları, kusurlu otopsiler ve yazılım çalışmasını yeniden şekillendiren araçlar her gün takip edilir.
Daha fazla AI haberini okuyun →