중국 인공지능 연구소 Moonshot AI는 지금까지 구축된 개방형 가중치 시스템 중 최대 규모인 2조 8천억 매개변수의 대형 언어 모델인 Kimi K3의 출시가 임박했다고 발표했습니다. Reuters, Wall Street Journal 및 South China Morning Post에 따르면 이 모델은 독립적인 벤치마크에서 OpenAI 및 Anthropic의 최고의 독점 시스템 바로 뒤에 위치하면서 가격면에서는 급격히 낮아졌습니다. 관찰자들은 이미 DeepSeek의 시장을 뒤흔드는 데뷔작과 비교하고 있는 조합입니다. 가중치는 7월 27일 대중에게 공개될 예정이며, 누구나 무료로 다운로드하여 모델을 구축할 수 있습니다.
이번 출시는 중국 연구소가 미국 연구소와의 격차를 얼마나 빨리 좁혔는지 보여주는 AI 속보의 물결 중에 이루어졌습니다. Moonshot은 Alibaba Group Holding의 지원을 받아 블로그 게시물을 통해 Kimi K3가 여전히 일부 분야에서 OpenAI의 GPT-5.6 Sol과 Anthropic의 Claude Fable 5를 뒤쫓고 있지만 회사의 내부 테스트에 따르면 여러 주요 작업에서 해당 모델에 "극도로 뒤처지는" 것으로 나타났습니다. 맥락에 따라 Anthropic은 지난달 Fable 5만 출시했고 OpenAI의 GPT-5.6은 불과 일주일 전에 데뷔했습니다.
벤치마크가 보여주는 것
독립 평가 회사인 인공 분석(Artificial Analysis)은 이미 Kimi K3를 시험해 보았습니다. SiliconANGLE의 보도에 따르면 이 모델은 인공 분석의 지능 지수와 실제 작업 평가에서 최고의 독점 모델 바로 뒤에 위치합니다. 그러나 Arena.ai의 프런트엔드 개발 순위표에서 Kimi K3는 실제로 GPT-5.6 Sol 및 Claude Fable 5보다 위 순위를 기록했습니다. 이는 개방형 시스템에서 놀라운 결과입니다. 이 순위는 Moonshot의 이전 릴리스인 Kimi K2.6보다 17계단 높은 순위입니다.
Arena의 최고 경영자인 Anastasios Angelopoulos는 X에 대한 게시물에서 이번 출시가 "올해 최대 규모의 출시"라고 부르며 중국이 마침내 모델 역량에서 미국을 능가하는 순간을 대표할 수 있다고 제안하면서 특히 대담한 주장을 했습니다. Axios와 Fortune은 이러한 프레임을 반영하여 Kimi K3가 "AI 세계를 놀라게 하고" 중국 AI를 최전선 수준의 영역으로 밀어넣고 있다고 보고했습니다.
자율 소프트웨어 엔지니어링을 위해 제작됨
Moonshot은 블로그 게시물에서 Kimi K3가 주로 장기 실행 자율 소프트웨어 개발 작업을 위해 설계되었다고 설명했습니다. 이 모델은 대규모 코드베이스를 분석하고, 외부 프로그래밍 도구를 조정하고, 다단계 작업을 실행하여 최종 목표(2026년 AI 연구소의 주요 전쟁터가 된 일종의 에이전트 워크플로)를 달성할 수 있습니다.
뛰어난 기능은 Moonshot이 "vision-in-the-loop" 시스템이라고 부르는 것입니다. Kimi K3는 화면 캡처를 검사하고, 코드를 수정한 다음, 결과로 표시되는 출력을 검사하여 자체 작업을 확인할 수 있습니다. Moonshot은 이 모델이 게임 개발, 사용자 인터페이스 디자인, 컴퓨터 지원 디자인에 특히 적합하다고 말합니다.
이러한 기능을 시연하기 위해 Moonshot은 Kimi K3가 Three.js, WebGPU 및 GPU Compute를 사용하여 웹 브라우저 내에서 완전히 구축한 3D 오픈 월드 게임을 보여주는 비디오를 게시했습니다. 모델은 절차적으로 환경을 생성하고 외부 도구를 사용하여 3D 라이더와 말을 만들었습니다. 추가 데모에는 중국의 Long March 10 로켓 발사 및 귀환 시뮬레이션과 Game Boy Advance 에뮬레이터가 포함되었습니다.
서구 대안보다 훨씬 저렴함
가격은 Kimi K3가 진정으로 파괴적인 것으로 입증될 수 있는 부분입니다. 모델의 API 문서에 따르면 Kimi K3의 비용은 캐시 적중이 있는 경우 입력 토큰 100만개당 30센트이고, 캐시 적중이 없는 경우 3달러입니다. 추론을 포함하여 100만 개의 출력 토큰 비용은 15달러입니다. 이러한 요율은 컨텍스트 길이에 관계없이 적용됩니다.
이로 인해 Kimi K3는 서구 경쟁사보다 훨씬 저렴해졌습니다. SiliconANGLE의 비교에 따르면 Anthropic의 Claude Fable 5는 입력 토큰 100만 개당 1달러, 출력 토큰 100만 개당 50달러를 청구하는 반면, OpenAI의 GPT-5.6 Sol은 입력 토큰 100만 개당 50센트, 출력 토큰 100만 개당 30달러를 청구합니다.
또 다른 DeepSeek 순간이 있나요?
이 출시는 R1 모델이 2025년 1월 기능이 분명해졌을 때 주요 기술주에서 약 1조 달러의 손실을 촉발한 DeepSeek과 즉각적인 비교를 촉발했습니다. 전 백악관 AI 정책 고문 Sriram Krishnan은 X에 대한 분위기를 요약하면서 Kimi K3의 데뷔를 "전체 업계에 여러 영향을 미치는 큰 순간"이라고 말했습니다.
이번 발사는 또한 조사가 확대되는 배경에서 시작됩니다. 올해 초 Anthropic은 Moonshot, DeepSeek 및 MiniMax가 Claude의 기능을 추출하여 자체 모델을 훈련시키는 과정(증류라고 알려진 과정)을 통해 규칙을 위반했다고 비난했습니다. 이후 트럼프 행정부는 증류를 "적대적" 접근 방식으로 분류하고 이를 단속하겠다고 약속했습니다. 이는 Kimi K3의 공개 중량 출시가 수출 통제, 모델 보안 및 중국 AI 회사에 대한 제한이 측정 가능한 영향을 미치는지에 대한 논쟁을 다시 촉발할 수 있음을 의미합니다.
Neowin은 Kimi K3를 통해 개방형 AI 모델이 미국 기반 경쟁사를 "마침내 따라잡았습니다"라는 광범위한 시사점을 분명하게 보고했습니다. 시장이 DeepSeek만큼 격렬하게 반응할지 여부는 아직 알 수 없지만, 개방형 중국 모델이 이제 개척지에서 경쟁하고 있다는 근본적인 주장에 대해서는 이의를 제기하기가 점점 더 어려워지고 있습니다.
Moonshot의 경우, 프론티어급 모델의 가중치를 자유롭게 공개하면 채택이 가속화되고 글로벌 오픈 소스 생태계에서 중국의 입지가 확고해질 것이라고 확신합니다. 7월 27일 가중치가 공개되면 세계는 처음으로 전체 모습을 보게 될 것입니다.
AI 곡선보다 앞서 나가세요
이와 같은 더 많은 보도를 원하십니까? 업계 전반의 최신 AI 개발, 모델 출시 및 분석을 보려면 AI Buzz Wire를 즐겨찾기에 추가하세요.
AI 뉴스 자세히 보기 →

