Evropská společnost pro umělou inteligenci Multiverse Computing uvedla na trh Quasar 438B, velký model uvažování, o kterém společnost říká, že je nejinteligentnějším modelem umělé inteligence vytvořeným v Evropě. Podle oznámení společnosti má Quasar 438B skóre 43 v indexu Artificial Analysis Intelligence Index, což je nejvyšší výsledek ze všech evropských modelů měřených na tomto benchmarku.

Uvedení na trh znamená významný krok pro španělskou firmu, která si vybudovala svou reputaci spíše na kompresi modelu AI než na školení hraničních systémů. Quasar 438B je první velký model, který společnost Multiverse Computing vydala, a přichází v době, kdy evropské vlády a společnosti prosazují schopnost umělé inteligence, která nezávisí zcela na amerických a čínských laboratořích. Pro čtenáře, kteří sledují naše zpravodajství o AI, zpráva také signalizuje, že závod o odstranění mezery s hraničními modely již není omezen na obvyklé americké uchazeče.

Co Quasar 438B ve skutečnosti boduje

Index Artificial Analysis Intelligence (verze 4.1.1) kombinuje devět hodnocení, včetně GDPval-AA v2, tau3-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience a AA-LCR. Složené skóre Quasar 438B 43 jej řadí před Mistral Medium 3.5 na 30, Nemotron 3 Ultra od NVIDIA na 38 a Inkling na 42, podle oznámení společnosti.

Širší pole stále patří k americké hranici: Claude Opus 5 vede index na 63. Multiverse Computing netvrdí něco jiného. Namísto toho společnost navrhuje Quasar 438B jako nejsilnější evropskou variantu, která překonává srovnatelné evropské modely v sedmi z osmi vybraných hodnocení umělé analýzy, na které upozornila.

Rychlost je druhý argument

Nezpracované skóre benchmarku je pouze polovinou hřiště Multiverse Computing. Společnost tvrdí, že Quasar 438B vrátí 500 tokenů, včetně času na přemýšlení, za 15,3 sekundy. Mezi modely v jeho srovnání jsou rychlejší pouze Nemotron 3.5 Lightning (9,4 sekundy), Gemini 3.5 Flash-Lite (10,8 sekundy) a Gemini 3.7 Flash (11,5 sekundy) a pouze Gemini 3.7 Flash je rychlejší a schopnější na indexu.

Srovnání s Mistral Medium 3.5 probíhá jednosměrně na obou osách: Quasar má vyšší skóre (43 proti 30) a odpovídá rychleji (15,3 sekundy proti 18,8 sekundám). Inkling, který se téměř rovná inteligenci Quasaru na 42, potřebuje 48,3 sekundy na stejnou odezvu 500 tokenů, což je více než třikrát déle.

Silné uvažování v dlouhém kontextu

Jeden výsledek z oznámení vyčnívá: na AA-LCR, hodnocení, které testuje schopnost extrahovat, propojovat a uvažovat informace rozložené v dlouhých dokumentech, Quasar 438B dosáhl skóre 75,0. To je úroveň s Grokem 4,6 (vysoká), v rámci bodu Claude Opus 5 na 75,7 a před Qwen3,8 2,4T A95B na 75,3, podle údajů společnosti.

Manipulace s dlouhým kontextem je důležitá, protože na něm je postaven podnikový výzkum, analýza dokumentů a agentní pracovní postupy. Pokud model nemůže uchovávat a propojovat informace v dlouhém dokumentu, nemůže pohánět vícestupňové nástroje, které společnosti skutečně chtějí nasadit. Zde se Quasar nejvíce přibližuje hraniční skupině.

Kódování agentů má stále prostor

Nejslabším výsledkem v oznámení je Terminal-Bench v2.1, který umožňuje kódovacím agentům pracovat ve skutečných terminálových prostředích. Quasar 438B má skóre 69,3, vede Mistral Medium 3,5 o 18,7 bodů a Nemotron 3 Ultra o 15,4, ale zaostává za hraniční skupinou vedenou Claudem Opusem 5 na 89,1. Multiverse Computing uznává, že toto je hodnocení s největším prostorem a říká, že další kolo práce je zaměřeno právě na něj.

Vytvořeno pro Enterprise Agents

Quasar 438B je umístěn jako model pro organizace provozující agenty vývoje softwaru, technické kopiloty, výzkumné systémy a automatizaci pracovních postupů. Patří do třídy s více než 400 miliardami parametrů, zvládá angličtinu a španělštinu a je navržena pro vícestupňové úkoly, které vyžadují plánování, použití nástrojů, provádění kódu a rozsáhlý kontext bez latence, kterou třída běžně nese.

Přístup probíhá prostřednictvím firemního rozhraní CompactifAI API, takže týmy mohou testovat model, aniž by museli postavit vlastní infrastrukturu. Multiverse Computing říká, že se chystají další aktualizace pro Quasar.

Co to znamená pro European AI Race

Vydání přichází ve zvláštní chvíli pro evropskou AI. Mistral, dlouho nositel standardů na kontinentu, čelil otázkám ohledně jeho směřování, zatímco americké laboratoře si upevnily svůj náskok ve složených benchmarkech. Evropský model, který legitimně vede evropské pole na nezávislém indexu, dává podnikům na kontinentu důvěryhodnou regionální možnost, zejména pro dvojjazyčné anglicko-španělské nasazení.

Zda Quasar 438B zastává tuto pozici, je jiná věc. Samotná společnost poznamenává, že pouze zlomek lídrů indexu odpovídá rychleji a mezera na Claude Opus 5 zůstává široká dvacet bodů. Společnost, která byla první kompresí, však nyní ukázala, že může konkurovat v těžké váze, a evropské podniky mají konečně model domácího trhu, který stojí za to porovnat s jejich výchozími hodnotami v USA.

Udržujte si náskok před AI

Krajina umělé inteligence se každou hodinu posouvá a benchmarkové vodítka, které se v lednu zdály nenapadnutelné, jsou v létě pryč. Přečtěte si další zprávy o AI na AI Buzz Wire, abyste mohli sledovat každé vydání modelu, výsledek benchmarku a změnu zásad, jak k tomu dojde.

Sledujte nejnovější vývoj AI zde.