중국 AI 연구소 MiniMax는 최신 릴리스에 대해 특이한 접근 방식을 취했습니다. 거의 인정하지 않았습니다. 9월 27일 회사의 공식 계정은 개발자가 제품에서 이미 발견한 내용을 확인했습니다. M3.1-Flash-Preview라는 새로운 모델이 회사의 코딩 보조 도구인 MiniMax Code 내에서 실행되었습니다. 이것이 출시 범위였습니다. 모델 카드도 없고, 벤치마크 테이블도 없고, 백만 토큰당 가격도 없습니다.
Startup Fortune에 따르면 X의 중국 AI 관찰자들은 확인 전에 제품에 모델이 나타나는 것을 발견했습니다. 음소거 출시는 MiniMax가 마지막 플래그십을 출시한 방식과 현저한 대조를 이룹니다. 이 이야기에 대한 자세한 내용은 최신 AI 동향를 참조하세요.
의도적으로 조용한 데뷔
MiniMax는 6월에 M3를 출시했을 때 아키텍처 세부 정보, SWE 벤치 점수 및 경쟁사보다 90% 낮은 가격표를 발표했습니다. 이번에는 M3.1-Flash-Preview에 대한 API 엔드포인트가 제한되어 있으며, 모델을 시험해 볼 수 있는 유일한 방법은 MiniMax 자체 제품 내부에서 관찰 가능한 주요 신호로 추론 추적과 동작을 사용하는 것입니다.
낮은 키 전략은 MiniMax가 출시를 헤드라인 출시라기보다는 실험처럼 취급할 수 있음을 시사합니다. 즉, 제품 기능에 대한 A/B 테스트를 거쳐 인터넷에 이를 알리는 것입니다. 이는 개발자가 모델을 사용하면 해당 모델이 그 자체로 입증될 것이라는 자신감을 반영할 수도 있고, 단순히 이번 릴리스가 큰 릴리스는 아니지만 더 빠르고 저렴한 동반 계층이라는 자신감을 반영할 수도 있습니다.
Base M3가 우리에게 말하는 것
기본 M3 모델은 관심이 필요할 때 MiniMax가 무엇을 제공할 수 있는지에 대한 감각을 제공합니다. 이는 토큰당 약 230억 개의 활성 매개변수, 1백만 개의 토큰 컨텍스트 창, 기본 이미지 및 비디오 입력을 갖춘 4,280억 매개변수의 전문가 혼합 모델입니다. SWE-bench Verified에서 MiniMax는 80.5%의 점수를 보고했습니다.
Flash는 일상적인 코딩의 속도와 가격 이점을 향상시키기 위해 구축된 버전입니다. 즉, 개발자가 주력 제품을 위해 예약된 장거리 에이전트 작업 대신 빠른 버그 수정과 소규모 기능 작업을 하루에 수십 번 실행합니다. 대규모 프론티어 버전과 빠르고 저렴한 동반자를 통해 이러한 방식으로 모델 라인을 분할하는 것은 개발자 마인드 공유를 위해 경쟁하는 중국 연구실 사이의 표준 플레이북이 되었습니다.
혼잡한 현장으로 배송
미니맥스는 조용한 시장에 출시되지 않습니다. Alibaba는 8월 3일 Qwen3.8-Max(입력 토큰 백만 개당 2달러의 가격으로 책정되는 2.4조 매개변수 플래그십)를 출시한 후 8월 12일 Max 계층 Qwen 모델의 첫 번째 개방형 버전을 출시했습니다. Zhipu의 GLM-5.3은 8월 14일 자체적으로 백만 개의 토큰 컨텍스트 창을 갖춘 상태로 출시되었습니다.
개발자들은 유능하고 저렴한 옵션이 넘쳐나는 것을 알아차렸습니다. OpenRouter 데이터에 대한 CNBC의 보고에 따르면, 중국 모델은 9월 14일이 포함된 주 동안 플랫폼에서 전체 토큰 사용량의 57%~67%를 차지했습니다. 이는 2월의 6%에서 13%로 증가한 수치입니다. Vercel도 비슷한 점프를 보였으며, 8월에는 자사 플랫폼에서 중국 모델의 사용 점유율이 55%까지 상승했습니다.
워싱턴이 지켜보고 있다
이러한 급증은 개발자 커뮤니티를 넘어 주목을 끌었습니다. 신미국안보센터(Centre for a New American Security)의 기술 및 국가 안보 프로그램 선임 연구원인 다니엘 렘러(Daniel Remler)는 CNBC와의 인터뷰에서 중국 AI가 "미국의 실제 경제 및 안보 위험"을 대표하며 중국 모델을 중요한 작업 흐름에 통합하지 말라고 경고했습니다.
이러한 면밀한 조사는 MiniMax의 조용한 릴리스에 복잡성을 추가합니다. 모델 카드, 게시된 평가 또는 가격이 없이 출시되는 모델은 독립 개발자가 품질과 안전성을 평가할 때 작업할 수 있는 작업을 줄여줍니다. 비록 연구소의 제품이 미국 경쟁사와 비교하여 실제 사용 점유율을 확보하더라도 마찬가지입니다.
조용한 출시가 전략적일 수 있는 이유
회사 자체 제품 내에서 제어되는 미리보기 모델은 익숙한 패턴입니다. 더 광범위한 API가 출시되기 전에 사용 데이터와 피드백을 생성하는 동시에 모델의 성능이 저조할 경우 노출을 제한합니다. MiniMax의 경우 M3.1-Flash-Preview의 음소거 데뷔는 더 큰 출시를 위한 스포트라이트를 받는 방법일 수도 있습니다. Startup Fortune이 인용한 보고에 따르면 이 회사는 새로운 주력 모델을 준비하면서 매출이 두 배 이상 증가했습니다.
개발자에게 있어 실질적인 시사점은 간단합니다. 중국 최고의 연구소 중 한 곳의 새로운 고속 코딩 계층이 현재 MiniMax Code 내에 적용되어 있으며 일반적으로 이러한 릴리스를 구성하는 벤치마크와 가격은 아직 누락되어 있습니다. M3.1-Flash-Preview가 중국 모델을 OpenRouter 트래픽의 대부분으로 끌어올리는 추진력을 확장할 수 있는지 여부는 개발자가 이를 통해 실제 워크로드를 추진하기 시작한 후 M3.1-Flash-Preview가 어떻게 수행되는지에 달려 있습니다.
---
AI 최신 소식최신 AI 뉴스, 분석 및 혁신을 한 곳에서 확인하세요.
AI 뉴스 더 보기 →