Європейська компанія штучного інтелекту Multiverse Computing випустила Quasar 438B, велику модель міркування, яка, за словами компанії, є найрозумнішою моделлю штучного інтелекту, створеною в Європі. Згідно з повідомленням компанії, Quasar 438B отримав 43 бали за Індексом штучного аналізу інтелекту, що є найвищим результатом серед усіх європейських моделей, виміряних за цим показником.

Запуск знаменує собою значний крок для іспанської фірми, яка побудувала свою репутацію на стисненні моделі штучного інтелекту, а не на навчанні систем прикордонного масштабу. Quasar 438B є першою великою моделлю, випущеною Multiverse Computing, і вона з’явилася в той момент, коли європейські уряди та компанії наполягають на можливостях ШІ, які не залежать повністю від американських і китайських лабораторій. Для читачів, які стежать за нашими новинами щодо штучного інтелекту, випуск також сигналізує про те, що змагання за скорочення розриву з передовими моделями більше не обмежуються звичайними суперниками з США.

Які результати має Quasar 438B

Індекс штучного аналізу інтелекту (версія 4.1.1) об’єднує дев’ять оцінок, у тому числі GDPval-AA v2, tau3-Banking, Terminal-Bench v2.1, SciCode, Humanity’s Last Exam, GPQA Diamond, CritPt, AA-Omniscience та AA-LCR. Загальна оцінка Quasar 438B у 43 бали випереджає Mistral Medium 3.5 з 30, NVIDIA Nemotron 3 Ultra з 38 і Inkling з 42, згідно з повідомленням компанії.

Більш широке поле все ще належить до американського кордону: Claude Opus 5 очолює індекс із 63 місцем. Multiverse Computing не стверджує протилежного. Натомість компанія називає Quasar 438B найпотужнішим європейським варіантом, перевершуючи аналогічні європейські моделі в семи з восьми вибраних оцінок штучного аналізу, які вона підкреслила.

Швидкість - другий аргумент

Необроблені результати тестування становлять лише половину висоти Multiverse Computing. Компанія каже, що Quasar 438B повертає 500 жетонів, включаючи час на обдумування, за 15,3 секунди. Серед порівнюваних моделей лише Nemotron 3.5 Lightning (9,4 секунди), Gemini 3.5 Flash-Lite (10,8 секунди) і Gemini 3.7 Flash (11,5 секунди) є швидшими, і лише Gemini 3.7 Flash є одночасно швидшою та потужнішою за індексом.

Порівняння з Mistral Medium 3.5 відбувається в одному напрямку на обох осях: Quasar отримує вищі бали (43 проти 30) і відповідає швидше (15,3 секунди проти 18,8 секунди). Інклінгу, який майже відповідає інтелекту Квазара з рівнем 42, потрібно 48,3 секунди для відповіді з 500 жетонами, тобто втричі більше.

Міркування в довгому контексті

З оголошення виділяється один результат: за AA-LCR, оцінкою, яка перевіряє здатність витягувати, з’єднувати та міркувати над інформацією, поширеною в довгих документах, Quasar 438B отримав 75,0. Згідно з даними компанії, це нарівні з Grok 4.6 (високий), у межах від Claude Opus 5 у 75,7 і випереджає Qwen3.8 2.4T A95B у 75,3.

Обробка тривалого контексту має значення, оскільки на цьому базуються корпоративні дослідження, аналіз документів і агентські робочі процеси. Якщо модель не може утримувати та з’єднувати інформацію в довгому документі, вона не зможе використовувати багатоетапні інструменти, які компанії насправді хочуть розгорнути. Тут Квазар найближче підходить до прикордонної групи.

Агентське кодування все ще має запас

Найслабшим результатом в оголошенні є Terminal-Bench v2.1, який дозволяє агентам кодування працювати в реальних термінальних середовищах. Quasar 438B набирає 69,3 бала, випереджаючи Mistral Medium 3.5 на 18,7 бала та Nemotron 3 Ultra на 15,4, але відстаючи від передової групи на чолі з Claude Opus 5 з показником 89,1. Multiverse Computing визнає, що це оцінка з найбільшим резервом, і каже, що наступний раунд роботи спрямований на це.

Створено для корпоративних агентів

Quasar 438B позиціонується як модель для організацій, які використовують агентів розробки програмного забезпечення, технічних копілотів, дослідницьких систем і автоматизації робочих процесів. Він міститься в класі з понад 400 мільярдами параметрів, обробляє англійську та іспанську мови та розроблений для багатоетапних завдань, які потребують планування, використання інструментів, виконання коду та великого контексту без затримки, яку зазвичай несе клас.

Доступ здійснюється через CompactifAI API компанії, тож команди можуть тестувати модель, не створюючи власної інфраструктури. Multiverse Computing повідомляє, що для Quasar надходять нові оновлення.

Що це означає для європейської гонки ШІ

Реліз відбувається в особливий момент для європейського штучного інтелекту. Містраль, тривалий час прапороносець континенту, зіткнувся з питаннями щодо свого напрямку, в той час як американські лабораторії зміцнили свою лідерську позицію в складних тестах. Європейська модель, яка законно очолює європейське поле за незалежним індексом, дає підприємствам на континенті надійний регіональний вибір, особливо для двомовного англо-іспанського розгортання.

Інше питання, чи збереже Quasar 438B цю позицію. У самій компанії відзначають, що лише частина лідерів індексу відповідає швидше, а відставання від Claude Opus 5 залишається на двадцять пунктів. Але компанія, яка займається стисненням, тепер показала, що може конкурувати у важкій вазі, і європейські підприємства нарешті мають модель для домашнього ринку, яку варто порівняти з їхніми стандартами в США.

Будьте попереду ШІ

Ландшафт штучного інтелекту змінюється з кожною годиною, а лідерство в еталонних показниках, яке здавалося неприступним у січні, до літа зникає. Читайте більше новин про штучний інтелект на сайті AI Buzz Wire, щоб відстежувати кожен випуск моделі, результати порівняльного тесту та зміну політики, коли це відбувається.

Слідкуйте за останніми розробками ШІ тут.