대규모 언어 모델을 위한 세계 최대 집계 플랫폼인 OpenRouter의 최신 데이터에 따르면 중국 인공지능 모델이 글로벌 사용에서 미국 경쟁사를 앞질렀습니다. 2026년 6월 20일 여러 매체에 보고된 수치에 따르면 중국 연구소에서 구축한 시스템은 이제 OpenAI, Google 또는 Anthropic의 시스템보다 전 세계적으로 더 많은 토큰을 소비하고 있습니다. 이는 공격적인 가격 책정, AI 에이전트 작업 부하 증가, 미국 칩 수출 통제로 인한 효율성 향상의 물결에 따른 변화입니다.
DeepSeek V4 플래시, 중국 압도적 순위 1위 이 이야기에 대한 자세한 내용은 인공지능 뉴스를 참조하세요.
The News International이 인용하고 CGTN과 Firstpost가 확인한 OpenRouter 데이터에 따르면, 중국 모델은 현재 글로벌 토큰 소비 리더보드의 상위권을 차지하고 있습니다. DeepSeek V4 Flash는 처리된 4조 6300억 개의 토큰으로 1위를 차지했으며, MiniMax M3이 4조 1300억 개의 토큰으로, Xiaomi의 MiMo-V2.5가 3조 8000억 개의 토큰으로 그 뒤를 이었습니다.
더 넓은 상위 10위에는 중국 개발자의 Tencent의 Hy3, DeepSeek V4 Pro 및 Owl Alpha와 Anthropic의 Claude Opus 4.7, Claude Sonnet 4.6 및 Claude Opus 4도 포함되어 있습니다. Anthropic은 상위 5위 안에 드는 유일한 미국 기반 회사입니다. Google의 Gemini 2와 OpenAI의 GPT-5.5는 각각 12위와 13위를 기록하며 상당히 나쁜 성적을 거두었습니다.
OpenRouter는 중국 플랫폼이 아니기 때문에 결과는 놀랍습니다. NFT 마켓플레이스 OpenSea의 전 CTO인 Alex Atallah가 설립한 이 회사는 60개 이상의 공급자가 제공하는 400개 이상의 모델에 대한 단일 API 게이트웨이를 제공하며, 투명한 사용 데이터는 개발자와 기업이 실제로 실행하기로 선택한 모델의 업계 지표로 널리 취급됩니다.
토큰이 새로운 전쟁터가 된 이유
토큰은 AI 모델이 처리하는 가장 작은 단위(단어 전체, 조각 또는 단일 문자)이며 공급자는 입력과 출력 모두에 대해 처리되는 토큰의 양에 대해 요금을 청구합니다. 이는 토큰 소비가 모델이 얼마나 많이 사용되는지에 대한 직접적인 프록시가 되며 업계의 중심 가격 책정 전선이 되었습니다.
AI 에이전트로 인해 위험이 빠르게 증가하고 있습니다. 간단한 챗봇은 셰익스피어의 햄릿을 요약하는 약 30,000개의 토큰을 소모할 수 있지만, 코딩 작업을 실행하는 자율 에이전트는 최대 2천만 개의 토큰을 소모할 수 있습니다. Goldman Sachs는 AI 에이전트의 확산으로 인해 2030년까지 토큰 소비가 24배 증가하여 향후 12~18개월 동안 예상되는 칩 공급 경색에 기여할 것이라고 예측했습니다.
중국 모델이 비용 측면에서 승리
중국이 앞서는 핵심 이유는 가격이다. OpenRouter 가격 데이터를 기반으로 한 Trending Topics 보고에 따르면 중국 모델은 미국의 주요 모델보다 약 10~20배 저렴합니다. 예를 들어 MiniMax M2.5는 입력 토큰 백만 개당 약 0.30달러, 출력 토큰 백만 개당 1.10달러를 청구합니다. 이에 비해 Anthropic의 Claude Opus 4.6은 약 $5.00 및 $25.00입니다.
이러한 격차는 막대한 토큰 볼륨을 지속적으로 처리하는 에이전트 워크로드의 경우 매우 중요합니다. 몇 가지 요인이 비용 이점을 뒷받침합니다. 재생 가능 에너지에 대한 막대한 국가 투자로 강화된 저렴한 에너지, 보다 효율적인 "전문가 혼합" 아키텍처, 고급 칩에 대한 미국의 수출 제한으로 인해 부과된 규율로 인해 중국 개발자는 더 적은 컴퓨팅으로 더 많은 작업을 수행할 수 있습니다. 중국 정부는 2026년 업무 계획에서 에너지 정책과 AI 경쟁력을 국가 우선순위로 명시적으로 연결했습니다.
성능으로 격차를 좁힙니다
모델의 품질이 뒤떨어지면 가격만으로는 충분하지 않습니다. 하지만 기술 격차는 급격히 줄어들었다. MiniMax M2.5는 소프트웨어 엔지니어링 기능에 대한 표준 벤치마크인 SWE-Bench Verified에서 80.2%를 기록했으며, Claude Opus 4.6의 80.8%에 근소하게 뒤처졌습니다. 분석 플랫폼인 Artificial Analysis에 따르면 현재 여러 중국 모델이 프로그래밍, 다중 모드 이해 및 장기 컨텍스트 처리 분야에서 글로벌 최상위 계층에 도달했습니다.
채택 패턴은 미국 스타트업 자체까지 확장됩니다. 벤처 기업인 Andreessen Horowitz의 Martin Casado는 오픈 소스 스택을 기반으로 구축된 젊은 AI 기업 중 약 80%가 현재 중국 모델을 사용하고 있다고 추정했습니다.
미국 기업은 토큰 한도 및 예산 통제로 후퇴
OpenRouter의 수치는 미국의 주요 기업들이 무제한적인 AI 지출을 철회하는 순간에 이루어졌습니다. 몇몇 미국 기업은 정액 구독에서 토큰 기반 청구로 전환하고 있으며 기업은 비용을 억제하기 위해 하드 캡을 도입하고 있습니다. Uber, Amazon, Microsoft 및 Meta는 대규모 AI 배포 비용이 예산을 초과함에 따라 최근 몇 주 동안 토큰 소비가 제한되었다고 합니다.
특히 마이크로소프트의 축소가 두드러졌다. 회사는 최근 경험 및 장치 부문에 대한 내부 Claude 코드 라이센스를 취소하고 2026년 6월 30일까지 액세스를 종료하기로 결정했습니다. 이는 최대 기업 구매자조차도 토큰당 경제성을 면밀히 조사하고 있다는 신호입니다.
변화하는 경쟁 지도
OpenRouter 스냅샷은 전체 글로벌 시장을 포착하지 않습니다. 이는 하나의 수집기를 통해 흐르는 사용량의 점유율만 반영합니다. 그러나 이동 방향은 한때 빠른 추종자로 일축되었던 중국 연구소가 개발자가 가장 중요하게 생각하는 측정 항목인 가격, 속도 및 충분한 기능에 대한 속도를 점점 더 설정하고 있는 광범위한 재조정과 일치합니다.
미국 연구소가 가격을 인하하거나, 프리미엄 성능에 더욱 집중하거나, 정책 수단을 강화하는 방식으로 대응할지는 아직 알 수 없습니다. 현재 토큰 데이터는 개발자가 API 호출로 투표하면 중국이 승리한다는 명확한 이야기를 전달합니다.
---
AI 최신 소식최신 AI 뉴스, 분석 및 혁신을 한 곳에서 확인하세요.
AI 뉴스 더 보기 →




