xAI, sınır geniş dil modelinin en son yinelemesi olan Grok 4.6'yı piyasaya sürdü ve Yapay Analiz Zekası Endeksi'nde OpenAI'nin GPT-5.6 Sol'uyla eşleşecek şekilde 61 puan aldı. Model bugün piyasaya sürüldü ve OpenRouter, Vercel ve Cloudflare aracılığıyla API erişimi ve iş ortağı entegrasyonlarıyla birlikte Cursor ve Grok Build'te hemen kullanıma sunuldu.

En son yapay zeka haberleri ve analizleri için AI Buzz Wire adresini ziyaret edin.

Çok Düşük Maliyetle Sınır İstihbaratı

Bağımsız bir kıyaslama platformu olan Yapay Analiz'e göre Grok 4.6, İstihbarat Endeksi'nde selefi Grok 4.5'e göre beş puan kazanarak xAI'yi OpenAI ile birlikte sınır katmanına geri getiriyor. Model, Anthropic'in Claude Opus 5 (63) ve Claude Fable 5'inin (62) hemen arkasında ve Kimi K3'ün önünde yer alıyor.

Grok 4.6'yı özellikle dikkat çekici kılan şey fiyatlandırmasıdır. Başlık fiyatlandırması, Grok 4,5'ten değişmeden, bir milyon girdi tokenı başına 2 dolar ve bir milyon çıktı tokenı başına 6 dolardır. Bu da onu Claude Opus 5 (5$/25$) ve GPT-5.6 Sol'un (5$/30$) %60'tan fazla altına koyuyor. Görev başına ölçülen maliyet 0,84 ABD dolarıdır ve bu da onu İstihbarat ve Maliyet Pareto sınırına yerleştirir.

Fiyatlandırmanın bir nesil boyunca sabit tutulması, istihbarat kazanımlarının genellikle fiyat artışlarıyla birlikte gerçekleştiği sınır bölgesinde alışılmadık bir durumdur. Grok 4.6, değişmeyen fiyatlandırmayla beş puanlık İstihbarat Endeksi kazancı sağlıyor.

Uzun Süreli Çalışan Temsilciler için Geliştirildi

Grok 4.6, xAI'nin uzun süredir devam eden aracılara ve daha iddialı etkileşimli ve görsel çalışmalara odaklanma olarak tanımladığı şeyle Grok 4.5'i temel alıyor. Şirket, modelin bir konuyu araştırmak, bilgiyi analiz etmek, kod tabanında çalışmak veya bir fikri gösterişli bir uygulamaya dönüştürmek gibi birçok adımda karmaşık görevleri yerine getirdiğini söylüyor.

Ajans kıyaslamaları ilgi çekici bir hikaye anlatıyor. Grok 4.6, gerçek dünyadaki etmensel bilgi çalışmasının önde gelen ölçüsü olan GDPval-AA v2'de, yalnızca Claude Opus 5'in gerisinde ve istatistiksel olarak Claude Fable 5 ve Qwen3.8 Max ile eşit olan 1753 Elo'ya ulaşıyor. Çok yönlü müşteri hizmetleri için tau küplü Bankacılık değerlendirmesinde %50,7 puan alarak Qwen3,8 Max ile birlikte ilk ikiye yerleşiyor.

CursorBench v3.2'de Grok 4.6 %69,9 puan alarak hem GPT-5,6 Sol'u (%67,2) hem de Grok 4,5'i (%66,7) geride bıraktı. DeepSWE v1.1'de %65,9 ve FrontierCode v1.1 Extended'da %61,3'tür.

Olağanüstü Dönüş Verimliliği

Yapay Analizin göze çarpan bulgularından biri, Grok 4.6'nın uzun ufuklu aracılı bilgi çalışması görevlerinin özel bir karşılaştırması olan AA-Briefcase'deki verimlilik profilidir. Model, 1577 Elo ile piyasaya sürülüyor ve onu Fable 5 seviyesine yerleştiriyor.

Verimlilik rakamları dikkat çekici. Grok 4.6, Claude Opus 5 max için kabaca 103 tur ve 2,0 milyar giriş tokenıyla karşılaştırıldığında, görevleri ortalama 53 turda ve ortalama 0,5 milyar giriş jetonunda çözer. Uzun ufuklu aracılı çalışma bağlamı hızlı bir şekilde biriktirdiğinden, dönüşlerin yarısında ve girdi tokenlarının dörtte birinde karşılaştırılabilir bir cevaba ulaşan bir model, token başına fiyatlandırmasının çok ötesinde bir maliyet avantajına sahiptir.

Eğitim ve Güvenlik

Grok 4.6, muhakeme ve gelişmiş teknik kavramlar için seçilmiş model tarafından oluşturulan veriler, yüksek kaliteli mühendislik verileri ve iyileştirilmiş bir optimize edici ve eğitim tarifi ile Grok 4.5'ten daha uzun bir tamamlayıcı eğitim çalışmasına tabi tutuldu. xAI, muhakeme çabaları, aracı koşumları ve STEM, yazılım mühendisliği ve bilgi çalışması gibi alanlar genelinde SFT yörüngelerini yeniden oluşturmak için Grok 4.5'i kullandı.

Model, Grok 4.5'ten farklı olarak 500.000 jetonluk bir bağlam penceresi taşıyor. xAI, Grok 4.6'nın yetenekler ve koruma kalibrasyonu için şimdiye kadarki en geniş dağıtım öncesi test paketinin yanı sıra kapsamlı dağıtım sonrası ve üçüncü taraf testlerinden geçtiğini bildirdi.

Stok Durumu ve Fiyatlandırma

Grok 4.6 bugün Cursor ve Grok Build'da mevcut. xAI, ilk hafta her iki platformda da çift dahil kullanım sunuyor. Fiyatlandırma, bir milyon giriş tokenı başına 2 dolardan ve bir milyon çıkış tokenı başına 6 dolardan başlıyor; hızlı varyant ise iki katı fiyatla sunuluyor. Önbellek isabetleri milyon jeton başına 0,50 ABD dolarına indirilir.

Sürüm, xAI için hızlı bir tempoyu sürdürüyor ve Grok 4.6, Grok 4.5'ten sadece bir ay sonra geliyor. Model, xAI'yi özellikle aracı performansa ve maliyet verimliliğine öncelik veren geliştiriciler için sınır yarışında ciddi bir rakip olarak konumlandırıyor.

Yapay Zekanın Önünde Kalın

Yapay zeka endüstrisindeki en önemli gelişmelerin sürekli kapsamı için, AI Buzz Wire'a yer işareti koyun ve hiçbir son dakika haberini kaçırmayın.

Daha fazla AI haberini okuyun