Syarikat AI Eropah Multiverse Computing telah melancarkan Quasar 438B, model penaakulan besar yang dikatakan syarikat itu adalah model AI paling pintar yang dibina di Eropah. Menurut pengumuman syarikat itu, Quasar 438B mendapat markah 43 pada Indeks Kecerdasan Analisis Buatan, hasil tertinggi daripada mana-mana model Eropah yang diukur pada penanda aras itu.

Pelancaran itu menandakan satu langkah penting bagi firma Sepanyol itu, yang membina reputasinya pada pemampatan model AI dan bukannya melatih sistem skala sempadan. Quasar 438B ialah model besar Multiverse Computing pertama yang dikeluarkan, dan ia tiba apabila kerajaan dan syarikat Eropah mendesak keupayaan AI yang tidak bergantung sepenuhnya pada makmal Amerika dan China. Bagi pembaca yang mengikuti liputan berita AI kami, keluaran itu juga menandakan bahawa perlumbaan untuk merapatkan jurang dengan model sempadan tidak lagi terhad kepada pesaing AS biasa.

Apakah Skor Sebenarnya Quasar 438B

Indeks Kecerdasan Analisis Buatan (versi 4.1.1) menggabungkan sembilan penilaian, termasuk GDPval-AA v2, tau3-Banking, Terminal-Bench v2.1, SciCode, Peperiksaan Terakhir Kemanusiaan, GPQA Diamond, CritPt, AA-Omniscience dan AA-LCR. Skor komposit Quasar 438B sebanyak 43 meletakkannya di hadapan Mistral Medium 3.5 pada 30, Nemotron 3 Ultra NVIDIA pada 38, dan Inkling pada 42, mengikut pengumuman syarikat.

Medan yang lebih luas masih dimiliki oleh sempadan Amerika: Claude Opus 5 mendahului indeks pada 63. Pengkomputeran Multiverse tidak menuntut sebaliknya. Sebaliknya, syarikat itu membingkai Quasar 438B sebagai pilihan Eropah terkuat, mengatasi model Eropah yang setanding pada tujuh daripada lapan penilaian Analisis Buatan terpilih yang diserlahkannya.

Kelajuan Adalah Hujah Kedua

Markah penanda aras mentah hanyalah separuh daripada padang Pengkomputeran Berbilang Alam. Syarikat itu berkata Quasar 438B mengembalikan 500 token, termasuk masa berfikir, dalam 15.3 saat. Antara model dalam perbandingannya, hanya Nemotron 3.5 Lightning (9.4 saat), Gemini 3.5 Flash-Lite (10.8 saat) dan Gemini 3.7 Flash (11.5 saat) lebih pantas, dan hanya Gemini 3.7 Flash yang lebih pantas dan lebih berkebolehan pada indeks.

Perbandingan terhadap Mistral Medium 3.5 berjalan sehala pada kedua-dua paksi: Quasar mendapat markah lebih tinggi (43 berbanding 30) dan menjawab lebih pantas (15.3 saat melawan 18.8 saat). Inkling, yang hampir menyamai kecerdasan Quasar pada 42, memerlukan 48.3 saat untuk respons 500 token yang sama, lebih daripada tiga kali ganda.

Penaakulan Konteks Panjang yang Kuat

Satu keputusan menonjol daripada pengumuman itu: pada AA-LCR, penilaian yang menguji keupayaan untuk mengekstrak, menyambung dan menaakul maklumat yang tersebar di seluruh dokumen panjang, Quasar 438B mendapat markah 75.0. Itu adalah tahap dengan Grok 4.6 (tinggi), dalam satu mata Claude Opus 5 pada 75.7, dan mendahului Qwen3.8 2.4T A95B pada 75.3, mengikut angka syarikat.

Urusan pengendalian konteks panjang kerana penyelidikan perusahaan, analisis dokumen dan aliran kerja agen dibina di atasnya. Jika model tidak dapat menyimpan dan menyambung maklumat merentasi dokumen yang panjang, model itu tidak dapat menggerakkan alat berbilang langkah yang sebenarnya ingin digunakan oleh syarikat. Di sinilah Quasar datang paling hampir dengan kumpulan sempadan.

Pengekodan Agensi Masih Mempunyai Ruang Utama

Keputusan paling lemah dalam pengumuman itu ialah Terminal-Bench v2.1, yang meletakkan ejen pengekodan berfungsi dalam persekitaran terminal sebenar. Quasar 438B mendapat 69.3, mendahului Mistral Medium 3.5 dengan 18.7 mata dan Nemotron 3 Ultra dengan 15.4, tetapi mengekori kumpulan sempadan yang diketuai oleh Claude Opus 5 pada 89.1. Pengkomputeran Multiverse mengakui ini adalah penilaian dengan ruang utama yang paling banyak dan mengatakan pusingan kerja seterusnya ditujukan kepadanya.

Dibina untuk Ejen Perusahaan

Quasar 438B diletakkan sebagai model untuk organisasi yang menjalankan ejen pembangunan perisian, copilot teknikal, sistem penyelidikan dan automasi aliran kerja. Ia berada dalam kelas 400-bilion-parameter-plus, mengendalikan bahasa Inggeris dan Sepanyol, dan direka untuk tugasan berbilang langkah yang memerlukan perancangan, penggunaan alat, pelaksanaan kod dan konteks besar tanpa kependaman yang biasanya dibawa oleh kelas.

Akses dijalankan melalui API CompactifAI syarikat, jadi pasukan boleh menguji model tanpa membina infrastruktur mereka sendiri. Multiverse Computing mengatakan lebih banyak kemas kini untuk Quasar akan datang.

Maksudnya untuk Perlumbaan AI Eropah

Keluaran tiba pada saat yang pelik untuk AI Eropah. Mistral, yang telah lama menjadi pemegang piawai di benua itu, telah menghadapi persoalan tentang hala tujunya, manakala makmal AS telah menyatukan petunjuk mereka pada penanda aras komposit. Model Eropah yang secara sah mendahului bidang Eropah pada indeks bebas memberikan perusahaan di benua itu pilihan serantau yang boleh dipercayai, terutamanya untuk penggunaan dwibahasa Inggeris-Sepanyol.

Sama ada Quasar 438B memegang jawatan itu adalah perkara lain. Syarikat itu sendiri menyatakan bahawa hanya sebahagian kecil daripada pemimpin indeks menjawab lebih cepat, dan jurang kepada Claude Opus 5 kekal dua puluh mata lebar. Tetapi syarikat yang mengutamakan mampatan kini telah menunjukkan ia boleh bersaing dalam kelas wajaran berat, dan perusahaan Eropah akhirnya mempunyai model pasaran rumah yang patut ditanda aras terhadap lalai AS mereka.

Kekal Mendahului AI

Landskap AI berubah mengikut jam, dan petunjuk penanda aras yang kelihatan tidak dapat dipertikaikan pada bulan Januari hilang menjelang musim panas. Baca lebih banyak berita AI di AI Buzz Wire untuk menjejaki setiap keluaran model, hasil penanda aras dan anjakan dasar semasa ia berlaku.

Ikuti perkembangan AI terkini di sini.