Avrupalı ​​yapay zeka şirketi Multiverse Computing, şirketin Avrupa'da üretilen en akıllı yapay zeka modeli olduğunu söylediği büyük bir akıl yürütme modeli olan Quasar 438B'yi piyasaya sürdü. Şirketin açıklamasına göre Quasar 438B, Yapay Analiz Zeka Endeksi'nde 43 puan alarak bu kıyaslamada ölçülen tüm Avrupa modelleri arasında en yüksek sonucu elde etti.

Lansman, itibarını sınır ölçekli sistemleri eğitmek yerine yapay zeka model sıkıştırması üzerine inşa eden İspanyol firması için önemli bir adıma işaret ediyor. Quasar 438B, Multiverse Computing'in piyasaya sürdüğü ilk büyük modeldir ve Avrupa hükümetleri ve şirketlerinin tamamen Amerikan ve Çin laboratuvarlarına bağlı olmayan yapay zeka yeteneği için çabalamasıyla ortaya çıkmıştır. Yapay zeka haberlerimizi takip eden okuyucular için bu sürüm aynı zamanda öncü modellerle aradaki farkı kapatma yarışının artık ABD'deki sıradan rakiplerle sınırlı olmadığının da sinyalini veriyor.

Quasar 438B'nin Aslında Puanları Nedir?

Yapay Analiz Zekası Endeksi (versiyon 4.1.1), GDPval-AA v2, tau3-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience ve AA-LCR dahil olmak üzere dokuz değerlendirmeyi birleştirir. Şirketin duyurusuna göre Quasar 438B'nin 43'lük bileşik puanı, onu 30 puanla Mistral Medium 3.5'in, 38 puanla NVIDIA Nemotron 3 Ultra'nın ve 42 puanla Inkling'in önüne koyuyor.

Daha geniş alan hâlâ Amerika sınırına ait: Claude Opus 5, endeksin 63. sırasında yer alıyor. Multiverse Computing aksini iddia etmiyor. Bunun yerine şirket, Quasar 438B'yi Avrupa'nın en güçlü seçeneği olarak çerçeveliyor ve vurguladığı sekiz seçilmiş Yapay Analiz değerlendirmesinin yedisinde karşılaştırılabilir Avrupa modellerinden daha iyi performans gösteriyor.

Hız İkinci Argümandır

Ham kıyaslama puanları Multiverse Computing'in yalnızca yarısı kadardır. Şirket, Quasar 438B'nin düşünme süresi de dahil olmak üzere 500 jetonu 15,3 saniyede döndürdüğünü söylüyor. Karşılaştırmasındaki modeller arasında yalnızca Nemotron 3.5 Lightning (9,4 saniye), Gemini 3.5 Flash-Lite (10,8 saniye) ve Gemini 3.7 Flash (11,5 saniye) daha hızlıdır ve yalnızca Gemini 3.7 Flash endekste hem daha hızlı hem de daha yeteneklidir.

Mistral Medium 3.5 ile karşılaştırma her iki eksende de tek yönlü ilerliyor: Quasar daha yüksek puan alıyor (30'a karşı 43) ve daha hızlı yanıt veriyor (18,8 saniyeye karşı 15,3 saniye). Quasar'ın 42 zekasıyla neredeyse eşleşen Inkling'in, aynı 500 jetonluk yanıt için 48,3 saniyeye ihtiyacı var; bu süre üç kattan fazla.

Güçlü Uzun Bağlamlı Muhakeme

Duyuruda öne çıkan bir sonuç var: Uzun belgelere yayılmış bilgileri çıkarma, bağlama ve bunlar üzerinde mantık yürütme yeteneğini test eden değerlendirme olan AA-LCR'de Quasar 438B 75,0 puan aldı. Şirketin rakamlarına göre bu, Grok 4,6 (yüksek) seviyesinde, 75,7 puanla Claude Opus 5'in yakınında ve 75,3 puanla Qwen3,8 2,4T A95B'nin önünde yer alıyor.

Uzun bağlam yönetimi önemlidir çünkü kurumsal araştırma, belge analizi ve ajanslı iş akışları bunun üzerine kurulmuştur. Bir model, uzun bir belgedeki bilgileri tutamaz ve birbirine bağlayamazsa, şirketlerin gerçekte dağıtmak istediği çok adımlı araçlara güç sağlayamaz. Burası Quasar'ın sınır grubuna en yakın olduğu yer.

Ajansal Kodlamanın Hala Boşluğu Var

Duyurudaki en zayıf sonuç, kodlama aracılarının gerçek terminal ortamlarında çalışmasını sağlayan Terminal-Bench v2.1'dir. Quasar 438B 69,3 puanla Mistral Medium 3,5'i 18,7 puanla ve Nemotron 3 Ultra'yı 15,4 puanla önde, ancak Claude Opus 5 liderliğindeki sınır grubunu 89,1 puanla geride bırakıyor. Multiverse Computing, bunun en fazla boşluk payına sahip değerlendirme olduğunu kabul ediyor ve bir sonraki çalışma turunun bunu hedeflediğini söylüyor.

Kurumsal Aracılar için Geliştirildi

Quasar 438B, yazılım geliştirme aracılarını, teknik yardımcı pilotları, araştırma sistemlerini ve iş akışı otomasyonunu çalıştıran kuruluşlar için bir model olarak konumlandırılmıştır. 400 milyardan fazla parametreden oluşan sınıfta yer alır, İngilizce ve İspanyolcayı yönetir ve sınıfın normalde taşıdığı gecikme olmaksızın planlama, araç kullanımı, kod yürütme ve geniş bağlam gerektiren çok adımlı görevler için tasarlanmıştır.

Erişim şirketin CompactifAI API'si üzerinden yürütülüyor, böylece ekipler kendi altyapılarını kurmadan modeli test edebiliyor. Multiverse Computing, Quasar için daha fazla güncellemenin geleceğini söylüyor.

Avrupa Yapay Zeka Yarışı İçin Ne İfade Ediyor?

Sürüm, Avrupa yapay zekası için tuhaf bir zamanda geliyor. Kıtanın uzun süredir standart taşıyıcısı olan Mistral, gidişatıyla ilgili sorularla karşı karşıya kalırken, ABD laboratuvarları kompozit kıyaslamalarda liderliğini pekiştirdi. Bağımsız bir endekste yasal olarak Avrupa alanının en üstünde yer alan bir Avrupa modeli, kıtadaki işletmelere, özellikle de iki dilli İngilizce-İspanyolca konuşlandırmalar için güvenilir bir bölgesel seçenek sunuyor.

Quasar 438B'nin bu konumu koruyup koruyamayacağı başka bir konudur. Şirketin kendisi, endeks liderlerinin yalnızca bir kısmının daha hızlı yanıt verdiğini ve Claude Opus 5 ile aradaki farkın yirmi puan geniş kaldığını belirtiyor. Ancak sıkıştırmaya öncelik veren şirket artık ağır sıklet sınıfında rekabet edebildiğini gösterdi ve Avrupalı ​​şirketler nihayet ABD'deki temerrütleriyle karşılaştırmaya değer bir iç pazar modeline sahip oldu.

Yapay Zekanın Önünde Olun

Yapay zeka manzarası her geçen saat değişiyor ve Ocak ayında tartışmasız görünen referans puanlar yaz aylarında kayboluyor. Her modelin piyasaya sürülmesini, karşılaştırma sonucunu ve politika değişikliğini anında takip etmek için AI Buzz Wire'da daha fazla AI haberini okuyun.

En son yapay zeka gelişmelerini buradan takip edin.