OpenAI, 30 Temmuz 2026'da üç GPT-5.6 modelinden ikisinde API fiyatlarını düşürerek, ailenin genel kullanıma sunulmasından yalnızca üç hafta sonra en ucuz katmanı %80 oranında düşürdü. Bu hamle, lider model üreticisinin yüksek hacimli, maliyete duyarlı iş yükleri için ne kadar agresif bir şekilde rekabet ettiğini ve müşterilerinin artık her jetonu ne kadar yakından saydığını gösteriyor. Yapay zeka ekonomisindeki daha geniş çaplı değişim hakkında daha fazla bilgi için en son yapay zeka gelişmelerini takip edin.

Ne değişti

OpenAI'nin yayınlanan ücret listesine ve API değişiklik günlüğüne göre, milyon token başına standart fiyatlar artık şu şekilde:

  • GPT-5.6 Luna: 20 sent giriş ve 1,20 dolar çıkış; 1 dolar ve 6 dolar yerine — %80 düşüş
  • GPT-5.6 Terra: 2,50 Dolar ve 15 Dolar yerine 2 Dolar ve 12 Dolar — %20 kesinti
  • GPT-5.6 Sol (amiral gemisi): 5 ABD Doları ve 30 ABD Doları, değişmedi

Her üç seviye de 9 Temmuz 2026'da daha yüksek oranlarla genel kullanıma sunuldu ve yeniden fiyatlandırma, ailenin ticari hayatında yalnızca 21 gün sürdü. Reuters ve CNBC kesintileri doğruladı ve Axios, en büyük azalmanın Luna modelinde gerçekleştiğini bildirdi.

Her hizmet katmanında akışı keser

İndirimler sadece başlık fiyatlarıyla sınırlı değil. Ücret listesindeki her seçeneğin üzerinden geçerler:

  • Toplu ve Esnek işleme, her ikisi de standart fiyatın yarısı, Luna'yı milyon jeton başına 10 sent girdi ve 60 sent çıktıya koyuyor.
  • Önbelleğe alınmış girdi okumaları, %90 indirimli, Luna'da milyon token başına iki sente ve Terra'da 20 sente düştü.
  • Uzun bağlamlı talepler, girdi oranının iki katı ve çıktının 1,5 katı olarak faturalandırılır ve Luna için 40 sent ve 1,80 ABD doları tutarındadır.

Halihazırda toplu sınıflandırma, çıkarma veya uzun temsilci döngülerini daha ucuz katmanlara yönlendiren ekipler için, aynı çağrılar artık bir gün önce yaptıklarının çok daha azına mal oluyor.

Antropik ile karşılaştırıldığında kesintilerin durumu nasıl?

Anthropic'in fiyatlandırma sayfasına göre Luna, girişte 20 sent ve çıkışta 1,20 dolar ile Anthropic'in yayınlanan en ucuz modeli olan Haiku 4,5'in girdide kabaca beş kat ve çıktıda dört kat altını çiziyor. Terra'nın yeni ücreti, Claude Sonnet 5'in başlangıç fiyatı 31 Ağustos 2026'da sona erdiğinde ücretlendirmesi planlanan 3 ABD Doları ve 15 ABD Doları'nın altında bulunuyor.

Her iki serinin de en üstünde yer alan Sol'un çıktı maliyeti hâlâ Anthropic'in 5 ve 25 dolar fiyat aralığındaki Opus 5'inden daha pahalı.

Öncelikli İşleme Hızlı moda dönüşür

Aynı değişiklik günlüğü girdisi "Öncelikli İşleme"yi kullanımdan kaldırdı ve onu "Hızlı mod" ile değiştirdi. Amiral gemisi Sol modeli için OpenAI, Hızlı modun iki kat fiyatla standart hızın 2,5 katına kadar çalıştığını ve anahtarın geriye dönük olarak uyumlu olduğunu söylüyor; istekler, kod değişikliği olmadan Hızlı moda öncelikli rota için zaten etiketlenmiştir.

Hızlı mod fiyatları Sol için 10 dolar ve 60 dolar, Terra için 4 dolar ve 24 dolar, Luna için 40 sent ve 2,40 dolar. Anthropic'in aynı ürünü aynı isim ve aynı koşullar altında satması dikkat çekicidir ve iki ücret listesi de artık bölgeye dayalı çıkarımda birleşiyor: OpenAI, bir müşteri veri yerleşimine ihtiyaç duyduğunda 5 Mart 2026'da veya sonrasında piyasaya sürülen modellerde %10'luk bir artış talep ederken, Anthropic yalnızca ABD'ye yönelik çıkarımları standart ücretinin 1,1 katı olarak faturalandırıyor.

Ucuz katmanlar neden ucuzladı?

Kesimden bir gün önce OpenAI, çıkarım yığınındaki optimizasyonları açıklayan bir mühendislik yazısı yayınladı. Şirketin teknik ekibinin beş üyesi, Codex kodlama aracında çalışan Sol'un üretim GPU çekirdeklerini yeniden yazdığını yazdı; OpenAI, uçtan uca hizmet maliyetlerini %20 oranında azalttığını söylüyor. Model ayrıca yüzlerce deney boyunca kendi spekülatif kod çözme taslak modelini yeniden tasarladı; bu değişiklik, token oluşturma verimliliğini %15'ten fazla artırdı.

Bunlar OpenAI'nin kendi yığınına ilişkin kendi rakamlarıdır, ancak fiyat indirimlerinin adreslendiği aynı maliyet merkezine işaret ediyorlar: Codex ve ChatGPT'nin arkasındaki aracı koşum takımı. OpenAI, araç çıkışını varsayılan olarak 10.000 jetonla sınırlandırır ve modelin görünür geçmişini yalnızca eklenti olarak tutar; böylece her adımda talimatlarını yeniden gönderen bir aracı döngüsü, tam giriş ücretlerini ödemek yerine bilgi istemi önbelleğine ulaşır. Şirket, "gizli iyileştirmeleri daha geniş çapta erişilebilir, uygun maliyetli istihbarat biçiminde kullanıcılarımıza geri gönderme" taahhüdüyle gönderiyi kapattı. Ücret listesi bir gün sonra geldi.

Bulut iş ortakları ve faturalandırma

OpenAI, trafiği Amazon Bedrock üzerinden yönlendiren alıcıların AWS tarafından faturalandırıldığını ve bu ücretlerin kendi yayınlanan kartından farklı olabileceğini belirtti. Daha fazla kuruluş model erişimini tek bir bulut sağlayıcısı aracılığıyla merkezileştirdikçe, OpenAI'nin doğrudan fiyatlandırması ile müşterilerin aracılar aracılığıyla gerçekte ödediği tutar arasındaki fark, manşet rakamları kadar önemli olacak.

Her jetonu sayan bir pazar

Kurumsal alıcıların harcamalarını her zamankinden daha yakından denetlemesi nedeniyle kesintiler yaşanıyor. Haftanın başındaki raporlar, büyük platformlarda kurumsal yapay zeka faturalarının artmasıyla birlikte, kontrolsüz "tokenmaxxing" (seyir maliyeti olmadan hacmi artırma) döneminin nasıl söndüğünü belgeledi. OpenAI'nin marjı biriktirmek yerine dahili maliyet tasarruflarını müşterilere aktarma kararı, rekabet savaşının şu anda nerede yürütüldüğüne inandığının açık bir sinyalidir: Sol'un hala premium fiyatlandırmaya sahip olduğu sınırda değil, üretim trafiğinin çoğunun fiilen yaşadığı ucuz, yüksek hacimli katmanlarda.

Sol'un fiyatı değişmeden, geliştiricilerin canlı kararı, OpenAI'nin ailenin piyasaya sürülmesinden bu yana koyduğu yerde kalıyor: her isteğin hangi katmanı gerektirdiği. Aradaki fark, bu kararı yanlış vermenin maliyetinin dramatik bir şekilde düşmesidir.

---

Yapay Zekanın Önünde Olun

En son yapay zeka haberlerini, analizlerini ve buluşlarını tek bir yerden alın.

Daha fazla AI haberini okuyun →