유럽 ​​AI 기업 멀티버스 컴퓨팅(Multiverse Computing)이 유럽에서 구축된 가장 지능적인 AI 모델이라고 밝히는 대형 추론 모델인 Quasar 438B를 출시했습니다. 회사의 발표에 따르면 Quasar 438B는 인공 분석 지능 지수에서 43점을 얻었으며, 이는 해당 벤치마크에서 측정된 유럽 모델 중 가장 높은 결과입니다.

이번 출시는 프론티어 규모 시스템 교육보다는 AI 모델 압축으로 명성을 쌓은 스페인 회사에게 중요한 단계입니다. Quasar 438B는 Multiverse Computing이 출시한 최초의 대형 모델로, 유럽 정부와 기업이 미국과 중국 연구소에 전적으로 의존하지 않는 AI 기능을 추진함에 따라 출시되었습니다. AI 뉴스 보도를 따르는 독자들에게 이 릴리스는 또한 개척 모델과의 격차를 줄이기 위한 경쟁이 더 이상 일반적인 미국 경쟁자에만 국한되지 않는다는 신호입니다.

퀘이사 438B가 실제로 득점하는 것

인공 분석 지능 지수(버전 4.1.1)는 GDPval-AA v2, tau3-Banking, Terminal-Bench v2.1, SciCode, Humanity's Last Exam, GPQA Diamond, CritPt, AA-Omniscience 및 AA-LCR을 포함한 9가지 평가를 결합합니다. 회사 발표에 따르면 Quasar 438B의 종합 점수는 43점으로 Mistral Medium 3.5(30점), NVIDIA의 Nemotron 3 Ultra(38점), Inkling(42점)보다 앞서 있습니다.

더 넓은 분야는 여전히 미국 개척지에 속합니다. Claude Opus 5가 63으로 지수를 주도합니다. Multiverse Computing은 달리 주장하지 않습니다. 대신 회사는 Quasar 438B를 가장 강력한 유럽 옵션으로 프레임하여 강조한 8개의 선택된 인공 분석 평가 중 7개에서 유사한 유럽 모델을 능가합니다.

속도가 두 번째 주장입니다

원시 벤치마크 점수는 Multiverse Computing의 주장의 절반에 불과합니다. 회사에 따르면 Quasar 438B는 사고 시간을 포함하여 15.3초 만에 500개의 토큰을 반환합니다. 비교 대상 모델 중 Nemotron 3.5 Lightning(9.4초), Gemini 3.5 Flash-Lite(10.8초) 및 Gemini 3.7 Flash(11.5초)만이 더 빠르고, Gemini 3.7 Flash만이 지수에서 더 빠르고 성능이 더 좋습니다.

Mistral Medium 3.5와의 비교는 두 축 모두에서 한 방향으로 진행됩니다. Quasar는 점수가 더 높고(43 대 30) 더 빠르게 응답합니다(15.3초 대 18.8초). 42로 퀘이사의 지능과 거의 일치하는 Inkling은 동일한 500개 토큰 응답에 48.3초가 필요하며 이는 3배 이상 길다.

강력한 장기 상황 추론

발표에서 한 가지 결과가 눈에 띕니다. 긴 문서에 분산된 정보에 대한 추출, 연결 및 추론 능력을 테스트하는 평가인 AA-LCR에서 Quasar 438B는 75.0점을 받았습니다. 회사 수치에 따르면 이는 Grok 4.6(높음)과 동일하며 Claude Opus 5의 75.7점 이내이며 Qwen3.8 2.4T A95B의 75.3보다 앞서 있습니다.

엔터프라이즈 연구, 문서 분석 및 에이전트 워크플로우가 이를 기반으로 구축되므로 긴 컨텍스트 처리가 중요합니다. 모델이 긴 문서 전체에 걸쳐 정보를 보유하고 연결할 수 없다면 회사가 실제로 배포하려는 다단계 도구를 지원할 수 없습니다. 이것은 퀘이사가 프론티어 그룹에 가장 가까운 곳입니다.

에이전트 코딩에는 여전히 여유 공간이 있습니다

이번 발표에서 가장 취약한 결과는 코딩 에이전트를 실제 터미널 환경에서 작동하게 하는 Terminal-Bench v2.1입니다. Quasar 438B는 69.3점으로 Mistral Medium 3.5를 18.7점, Nemotron 3 Ultra를 15.4점으로 앞서지만 Claude Opus 5가 이끄는 프론티어 그룹보다 89.1점 뒤처졌습니다. 멀티버스 컴퓨팅(Multiverse Computing)은 이것이 가장 여유가 있는 평가임을 인정하고 다음 작업이 이를 목표로 한다고 말했습니다.

엔터프라이즈 에이전트를 위해 구축됨

Quasar 438B는 소프트웨어 개발 에이전트, 기술 부조종사, 연구 시스템 및 작업 흐름 자동화를 실행하는 조직을 위한 모델로 자리잡고 있습니다. 4000억 매개변수 이상의 클래스에 속하며 영어와 스페인어를 처리하고 일반적으로 클래스에서 발생하는 대기 시간 없이 계획, 도구 사용, 코드 실행 및 대규모 컨텍스트가 필요한 다단계 작업을 위해 설계되었습니다.

액세스는 회사의 CompactifAI API를 통해 실행되므로 팀은 자체 인프라를 구축하지 않고도 모델을 테스트할 수 있습니다. Multiverse Computing은 Quasar에 대한 추가 업데이트가 예정되어 있다고 말합니다.

유럽 AI 경쟁에 미치는 영향

이번 출시는 유럽 AI에게는 특별한 순간에 이루어졌습니다. 오랫동안 대륙의 표준을 지켜온 Mistral은 방향에 대한 의문에 직면해 있는 반면, 미국 연구소는 종합 벤치마크에서 선두를 확고히 했습니다. 독립적인 지수에서 유럽 분야를 합법적으로 1위를 차지한 유럽 모델은 대륙의 기업에 특히 영어-스페인어 이중 언어 배포의 경우 신뢰할 수 있는 지역 옵션을 제공합니다.

Quasar 438B가 그 위치를 유지하는지 여부는 또 다른 문제입니다. 회사 자체는 지수 리더 중 일부만이 더 빨리 응답하며 Claude Opus 5와의 격차는 여전히 20포인트 넓다고 지적합니다. 그러나 압축 우선 회사는 이제 헤비급 클래스에서 경쟁할 수 있음을 보여 주었고 유럽 기업은 마침내 미국 기본값에 대해 벤치마킹할 가치가 있는 국내 시장 모델을 갖게 되었습니다.

AI보다 앞서 나가세요

AI 환경은 시시각각 변하고, 1월에는 난공불락으로 보였던 벤치마크 리드가 여름이 되면 사라지게 됩니다. AI Buzz Wire에서 더 많은 AI 뉴스 읽기를 통해 모든 모델 출시, 벤치마크 결과 및 정책 변화를 실시간으로 추적할 수 있습니다.

여기에서 최신 AI 개발을 팔로우하세요.