ヨーロッパの AI 企業 Multiverse Computing は、ヨーロッパで構築された最もインテリジェントな AI モデルであると同社が主張する大型推論モデル Quasar 438B を発表しました。同社の発表によると、Quasar 438B は人工分析インテリジェンス インデックスで 43 のスコアを獲得しており、このベンチマークで測定された欧州モデルの中で最高の結果となっています。

この立ち上げは、最先端規模のシステムのトレーニングではなく AI モデルの圧縮で評判を築いてきたスペインの企業にとって、重要な一歩となります。 Quasar 438B は、Multiverse Computing がリリースした最初の大型モデルであり、ヨーロッパの政府や企業がアメリカや中国の研究所に完全に依存しない AI 機能を推進する中で登場しました。私たちの AI ニュース報道を読んでいる読者にとって、このリリースはまた、フロンティア モデルとの差を縮める競争が、もはや通常の米国の競争相手に限定されていないことを示しています。

Quasar 438B の実際の得点

Artificial Analysis Intelligence Index (バージョン 4.1.1) は、GDPval-AA v2、tau3-Banking、 Terminal-Bench v2.1、SciCode、Humanity's Last Exam、GPQA Diamond、CritPt、AA-Omniscience、AA-LCR を含む 9 つの評価を組み合わせたものです。同社の発表によると、Quasar 438Bの総合スコアは43で、Mistral Medium 3.5の30点、NVIDIAのNemotron 3 Ultraの38点、Inklingの42点を上回っている。

より広い分野は依然としてアメリカのフロンティアに属しており、クロード オーパス 5 が 63 で指数をリードしています。マルチバース コンピューティングはそれ以外の主張はしていません。その代わりに、同社はQuasar 438Bを最も強力なヨーロッパのオプションとして位置づけており、強調表示した8つの選択された人工分析評価のうち7つで同等のヨーロッパのモデルを上回っています。

速度は 2 番目の引数です

生のベンチマーク スコアは、Multiverse Computing のピッチの半分にすぎません。同社によれば、Quasar 438Bは思考時間を含めて15.3秒で500トークンを返すという。比較対象のモデルの中で、Nemotron 3.5 Lightning (9.4 秒)、Gemini 3.5 Flash-Lite (10.8 秒)、および Gemini 3.7 Flash (11.5 秒) だけがより高速であり、インデックスでより高速かつより多くの機能を備えているのは Gemini 3.7 Flash だけです。

Mistral Medium 3.5 との比較は、両軸で一方向に実行されます。Quasar の方がスコアが高く (43 対 30)、回答が速くなります (15.3 秒対 18.8 秒)。 Inkling は、Quasar の知能の 42 にほぼ匹敵しますが、同じ 500 トークンの応答には 48.3 秒かかり、3 倍以上の時間がかかります。

強力なロングコンテキスト推論

この発表で際立った結果が 1 つあります。AA-LCR (長い文書にまたがる情報を抽出、接続、推論する能力をテストする評価) で、Quasar 438B のスコアは 75.0 でした。同社の数値によると、これはGrok 4.6(高)と同等で、Claude Opus 5の75.7点より1ポイント以内であり、Qwen3.8 2.4T A95Bの75.3点を上回っている。

エンタープライズ調査、ドキュメント分析、エージェント ワークフローは長いコンテキストに基づいて構築されているため、長いコンテキストの処理が重要になります。モデルが長い文書全体にわたる情報を保持して接続できない場合、企業が実際に導入したい複数ステップのツールを強化することはできません。ここは、クェイサーがフロンティアグループに最も近づく場所です。

エージェントコーディングにはまだ余裕がある

発表の中で最も弱い結果は、コーディング エージェントを実際の端末環境で動作させる Terminal-Bench v2.1 です。 Quasar 438B のスコアは 69.3 で、Mistral Medium 3.5 を 18.7 ポイント、Nemotron 3 Ultra を 15.4 ポイント上回っていますが、Claude Opus 5 が率いるフロンティア グループの 89.1 ポイントには後れをとっています。 Multiverse Computing は、これが最も余裕のある評価であることを認めており、次の作業はこれを目指していると述べています。

エンタープライズ エージェント向けに構築

Quasar 438B は、ソフトウェア開発エージェント、技術副操縦士、研究システム、ワークフロー自動化を実行する組織向けのモデルとして位置付けられています。これは 4,000 億パラメータ以上のクラスに属し、英語とスペイン語を処理し、計画、ツールの使用、コードの実行、およびクラスに通常発生する遅延なしで大規模なコンテキストを必要とする複数ステップのタスク向けに設計されています。

Access は同社の CompactifAI API を通じて実行されるため、チームは独自のインフラストラクチャを立ち上げることなくモデルをテストできます。 Multiverse Computing は、Quasar のさらなるアップデートが予定されていると述べています。

ヨーロッパの AI 競争にとっての意味

このリリースは、ヨーロッパの AI にとって奇妙なタイミングで行われました。ミストラルは長らく大陸の旗手であったが、その方向性について疑問に直面してきた一方、米国の研究所は複合ベンチマークでリードを固めてきた。独立系の指標で欧州分野で合法的にトップに立つ欧州モデルは、特に英語とスペイン語のバイリンガル展開において、大陸の企業に信頼できる地域オプションを提供します。

クエーサー 438B がその立場を維持するかどうかは別の問題です。同社自身も、指数リーダーのうちより早く回答できるのはほんの一部であり、Claude Opus 5 との差は依然として 20 ポイントあると指摘しています。しかし、圧縮優先の企業は重量級クラスで競争できることを示し、欧州企業はついに米国のデフォルトと比較してベンチマークする価値のある国内市場モデルを手に入れた。

AI の先を行く

AI の状況は刻一刻と変化しており、1 月には攻略不可能に見えたベンチマークのリードも夏には消えてしまいます。 AI Buzz Wire で AI ニュースの詳細を読む では、すべてのモデルのリリース、ベンチマークの結果、ポリシーの変更を随時追跡します。

AI の最新開発については、こちらをご覧ください