Европейская компания Multiverse Computing, занимающаяся искусственным интеллектом, выпустила Quasar 438B, большую модель рассуждения, которая, по словам компании, является самой интеллектуальной моделью искусственного интеллекта, созданной в Европе. Согласно заявлению компании, Quasar 438B получил 43 балла по индексу искусственного анализа интеллекта, что является самым высоким результатом среди всех европейских моделей, измеренных по этому показателю.
Запуск знаменует собой значительный шаг для испанской фирмы, которая заработала свою репутацию на сжатии моделей ИИ, а не на обучении систем передового масштаба. Quasar 438B — первая крупная модель, выпущенная Multiverse Computing, и она появляется, когда европейские правительства и компании стремятся к возможностям искусственного интеллекта, которые не зависят полностью от американских и китайских лабораторий. Для читателей, следящих за нашими новостями об искусственном интеллекте, этот выпуск также сигнализирует о том, что гонка за сокращение разрыва с передовыми моделями больше не ограничивается обычными претендентами из США.
Какие на самом деле результаты у Quasar 438B
Индекс искусственного анализа интеллекта (версия 4.1.1) объединяет девять оценок, включая GDPval-AA v2, tau3-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience и AA-LCR. Согласно заявлению компании, совокупный балл Quasar 438B, равный 43, опережает Mistral Medium 3.5 с 30 баллами, NVIDIA Nemotron 3 Ultra с 38 баллами и Inkling с 42 баллами.
Более широкое поле по-прежнему принадлежит Америке: Claude Opus 5 возглавляет индекс с 63-м местом. Multiverse Computing не утверждает иного. Вместо этого компания называет Quasar 438B самым сильным европейским вариантом, превосходящим сопоставимые европейские модели по семи из восьми выбранных оценок искусственного анализа, которые она выделила.
Скорость — второй аргумент
Первичные результаты тестов — это лишь половина успеха Multiverse Computing. Компания заявляет, что Quasar 438B возвращает 500 токенов, включая время на размышление, за 15,3 секунды. Среди моделей в его сравнении только Nemotron 3.5 Lightning (9,4 секунды), Gemini 3.5 Flash-Lite (10,8 секунды) и Gemini 3.7 Flash (11,5 секунды) быстрее, и только Gemini 3.7 Flash одновременно быстрее и производительнее по этому показателю.
Сравнение с Mistral Medium 3.5 проходит в одну сторону по обеим осям: Quasar набирает больше баллов (43 против 30) и отвечает быстрее (15,3 секунды против 18,8 секунды). Инклингу, который почти соответствует интеллекту Квазара (42), требуется 48,3 секунды для того же ответа из 500 токенов, то есть более чем в три раза дольше.
Сильное рассуждение в длинном контексте
В объявлении выделяется один результат: по AA-LCR, тесту, проверяющему способность извлекать, связывать и анализировать информацию, распределенную по длинным документам, Quasar 438B получил оценку 75,0. По данным компании, это уровень Grok 4,6 (высокий), на один балл Claude Opus 5 с 75,7 и опережающий Qwen3.8 2.4T A95B с 75,3.
Обработка длинного контекста имеет большое значение, поскольку на этом построены корпоративные исследования, анализ документов и агентские рабочие процессы. Если модель не может хранить и связывать информацию в длинном документе, она не может служить основой для многоэтапных инструментов, которые компании действительно хотят развернуть. Именно здесь Квазар ближе всего подходит к пограничной группе.
Агентское кодирование все еще имеет запас
Самый слабый результат в анонсе — Terminal-Bench v2.1, который позволяет агентам кодирования работать в реальных терминальных средах. Quasar 438B набрал 69,3, опережая Mistral Medium 3,5 на 18,7 балла и Nemotron 3 Ultra на 15,4, но отставая от пограничной группы во главе с Claude Opus 5 с 89,1. Multiverse Computing признает, что это оценка с наибольшим запасом, и заявляет, что следующий этап работы направлен на это.
Создано для корпоративных агентов
Quasar 438B позиционируется как модель для организаций, использующих агентов по разработке программного обеспечения, технических вторых пилотов, исследовательские системы и автоматизацию рабочих процессов. Он относится к классу с более чем 400 миллиардами параметров, обрабатывает английский и испанский языки и предназначен для многоэтапных задач, требующих планирования, использования инструментов, выполнения кода и большого контекста без задержек, которые обычно несет класс.
Доступ осуществляется через API CompactifAI компании, поэтому команды могут тестировать модель, не создавая собственную инфраструктуру. Multiverse Computing сообщает, что появятся новые обновления для Quasar.
Что это значит для европейской гонки ИИ
Релиз приходится на особенный момент для европейского ИИ. Mistral, долгое время являвшийся знаменосцем континента, столкнулся с вопросами о своем направлении, в то время как американские лаборатории укрепили свое лидерство по композитным показателям. Европейская модель, которая законно возглавляет европейскую сферу по независимому индексу, дает предприятиям на континенте надежный региональный вариант, особенно для двуязычного англо-испанского развертывания.
Другой вопрос, удержит ли Квазар 438B эту позицию. В самой компании отмечают, что лишь часть лидеров индекса отвечает быстрее, а отставание от Claude Opus 5 по-прежнему составляет двадцать пунктов. Но компания, занимающаяся сжатием воздуха, теперь показала, что может конкурировать в тяжелом классе, и европейские предприятия наконец-то получили модель внутреннего рынка, достойную сравнения с ее дефолтными моделями в США.
Будьте впереди ИИ
Ландшафт ИИ меняется с каждым часом, и лидеры в области эталонных тестов, которые в январе выглядели неприступными, к лету исчезли. Подробнее читайте на AI Buzz Wire, чтобы отслеживать выпуск каждой модели, результаты тестов и изменения в политике по мере их возникновения.
Следите за последними разработками в области искусственного интеллекта здесь.