xAI, haftalarca kamuoyuna duyurulması ve en az bir gecikmeden sonra şirketin kodlama ve bilgi çalışmaları açısından bugüne kadarki en yetenekli modeli olan Grok 4.7'yi piyasaya sürdü. Pazar günü şirketin sitesinde duyurulan model, önceki Grok 4.6 ile aynı fiyata ve hizmet hızına sahip: Bir milyon giriş tokenı başına 2 dolar ve bir milyon çıkış tokenı başına 6 dolar; bu, OpenAI'nin GPT-5.6 Sol Max'in (4 $/20 $) liste fiyatının yaklaşık yarısı kadar ve Anthropic's Fable 5.1 Max'in (10 $/50 $) çok altında.

En son yapay zeka haberleri ve analizleri için AI Buzz Wire adresini ziyaret edin.

Uzun Görevler İçin Eğitilmiş Daha Büyük Bir Temel Model

xAI'nin duyurusuna göre Grok 4.7, Grok 4.6'ya kıyasla yeni, daha büyük bir temel model kullanıyor ve tamamlanması saatler süren sorunlara ağırlık verilen daha zorlu görev karışımı üzerinde daha uzun bir takviyeli öğrenme çalışmasıyla eğitildi. Şirket, modelin kendi çalışmasını doğrulama ve daha uzun bağlamı yönetme konusunda daha iyi olduğunu ve Grok Bot donanımını yerel olarak anlayacak, konuşma görevlerini ve genel bilgi çalışmasını iyileştirecek şekilde eğitildiğini söylüyor.

Sürüm, gürültülü bir yükselişin ardından geliyor. TeslaNorth.com'a göre Elon Musk ilk olarak Eylül ayı başında Grok 4.7'nin on gün içinde ineceğini söyledi, ardından Eylül ortasında modelin birkaç gün daha iyileştirilmesi gerektiğini kabul etti. Şu anda gönderiliyor ve GitHub aynı gün Grok 4.7'nin GitHub Copilot'ta mevcut olduğunu doğruladı.

Karşılaştırmalı Resim: Güçlü, Kapsamlı Değil

xAI tarafından yayınlanan kıyaslama verileri, birçok uzun ufuklu kategoride lider olan ve diğerlerinde Anthropic'in en pahalı konfigürasyonunun gerisinde kalan bir modeli gösteriyor:

  • Daha uzun süren kodlama görevlerini vurgulayan CursorBench 4.0: Grok 4.7 %46,3 puan alarak GPT-5.6 Sol Max (%41,7) ve Grok 4.6 High'ın (%40,4) önünde, ancak Fable 5.1 Max'in (%51,8) gerisinde kaldı.
  • Terminal-Bench 4.0, çok saatli terminal çalışması: Grok 4.6 için %20,3'ten keskin bir yükselişle %38,0 ve GPT-5.6 Sol Max'in (%37,3) hemen önünde, ancak Fable 5.1 Max %57,9 ile önde.
  • EEBench, bir elektrik mühendisliği kriteri: %64,0, Grok 4.6'nın %53,0'ından büyük bir sıçrama ve listelenen modeller arasında en yüksek seviye.
  • DeepSWE v1.1: Yüksek eforda %71,0, Grok 4,6 için %65,2 ve GPT-5,6 Sol Max için %72,7.
  • AA Evrak Çantası v1.1, çok saatli ofis işleri: 1.546'dan 1.657'ye yükseldi ve 1.678 ile Fable 5.1 Max'in hemen arkasında.
  • Harvey Legal Agent Benchmark: %19,6, bu ölçümde Grok 4,6'nın (%15,8) önünde ve GPT-5,6 Sol Max (%2,5) ve Fable 5.1 Max'in (%6,7) çok ilerisinde.
  • HealthBench Professional: %56,7, Grok 4,6'nın %48,5'ine göre ilerleme kaydetti ancak GPT-5,6 Sol Max (%60,5) ve Fable 5.1 Max'in (%62,1) gerisinde kaldı.

Elo tarafından puanlanan profesyonel bir bilgi çalışması kriteri olan GDPval'de xAI'nin grafiği, Grok 4.7'yi xhigh muhakeme seviyesinde 1.695'e koyuyor - Grok 4.6 için 1.605'ten Fable 5.1 Max'in (1.735) gerisinde ve GPT-6 Astra Max'in (1.542) önünde.

Fiyat Hikayedir

Duyurudaki en agresif iddia teknik olmaktan çok ekonomik: xAI, Grok 4.7'yi karşılaştırılabilir modellerin yarı fiyatına iki kat daha hızlı olarak tanımlıyor ve yayınlanan fiyat tablosu, iki baş rakibinin üst düzey konfigürasyonlarıyla manşet karşılaştırmasını destekliyor. Grok 4.7'nin 2$/6$ token fiyatlandırması Grok 4.6'ya göre değişmedi, bu da alıcıların fiyat artışı olmadan nesilden nesile iyileşme elde edeceği anlamına geliyor.

Bu konumlandırma, xAI'nin Grok 4.x hattında izlediği stratejiyi genişletiyor: OpenAI ve Anthropic'in premium fiyatlandırma katmanlarının altını çizerken sınır kalitesini eşleştirin veya yaklaşın, ardından GitHub, Cursor ve OpenRouter gibi ortaklar aracılığıyla agresif bir şekilde dağıtım yapın.

Ne İzlemeli

Dürüst bir uyarı, xAI'nin karşılaştırma tablosunu kendisinin yayınladığı ve kıyaslama toplayıcılarının bağımsız doğrulamasının günler alacağıdır. xAI'nin vurgulamayı seçtiği rakamlara göre, Grok 4.7, Grok 4.6'dan gerçek bir adımdır - en belirgin şekilde Terminal-Bench 4.0 ve EBench'te - ancak kodlama ve sağlık kıyaslamalarında liderliği koruyan ve çıkış tokenı başına beş kat daha fazla maliyete sahip olan Fable 5.1 Max'i geçmiyor.

Uzun, birkaç saat süren aracı iş yükleri çalıştıran geliştiriciler için fiyat-performans matematiği, ham liderlik sıralamasından daha önemli olabilir. Grok 4.7 artık xAI'nin API'si ve GitHub Copilot'ta mevcut.

Yapay Zekanın Önünde Kalın

Yapay zeka endüstrisindeki en önemli gelişmelerin sürekli kapsamı için, AI Buzz Wire'a yer işareti koyun ve hiçbir son dakika haberini kaçırmayın.

Daha fazla AI haberini okuyun