xAI는 몇 주 간의 공개 놀림과 적어도 한 번의 지연 끝에 현재까지 회사의 코딩 및 지식 작업을 위한 가장 유능한 모델인 Grok 4.7을 출시했습니다. 일요일에 회사 사이트에 발표된 이 모델은 이전 Grok 4.6과 동일한 가격 및 서비스 속도로 제공됩니다. 입력 토큰 백만 달러당 2달러, 출력 토큰 백만 달러당 6달러입니다. OpenAI의 GPT-5.6 Sol Max 정가($4/$20)의 약 절반이고 Anthropic의 Fable 5.1 Max($10/$50)보다 훨씬 낮습니다.

최신 AI 속보 및 분석을 보려면 AI Buzz Wire를 방문하세요.

장기 작업을 위해 훈련된 더 큰 기본 모델

xAI의 발표에 따르면 Grok 4.7은 Grok 4.6에 비해 새롭고 더 큰 기본 모델을 사용하며 완료하는 데 많은 시간이 걸리는 문제에 중점을 둔 더 어려운 작업 혼합에 대해 더 긴 강화 학습 실행으로 훈련되었습니다. 회사는 이 모델이 자체 작업을 검증하고 더 긴 컨텍스트를 관리하는 데 더 뛰어나며 Grok Bot 하네스를 기본적으로 이해하도록 훈련되어 대화 작업과 일반 지식 작업을 개선한다고 말합니다.

릴리스는 시끄러운 실행을 따릅니다. TeslaNorth.com에 따르면 Elon Musk는 9월 초에 Grok 4.7이 10일 이내에 출시될 것이라고 처음 말한 후 9월 중순에 모델에 며칠 더 개선이 필요하다는 점을 인정했습니다. 현재 출시 중이며 GitHub는 같은 날 GitHub Copilot에서 Grok 4.7을 사용할 수 있음을 확인했습니다.

벤치마크 그림: 강함, 휩쓸리지 않음

xAI가 게시한 벤치마크 데이터는 여러 장기적인 카테고리에서 선두를 달리는 동시에 다른 카테고리에서는 Anthropic의 가장 비싼 구성보다 뒤처지는 모델을 보여줍니다.

  • 장기 실행 코딩 작업에 중점을 두는 CursorBench 4.0: Grok 4.7은 46.3%로 GPT-5.6 Sol Max(41.7%) 및 Grok 4.6 High(40.4%)보다 앞서지만 Fable 5.1 Max(51.8%)보다 뒤처집니다.
  • Terminal-Bench 4.0, 다중 시간 터미널 작업: 38.0%로 Grok 4.6의 20.3%에서 급격히 증가했으며 GPT-5.6 Sol Max(37.3%)보다 약간 앞선 반면 Fable 5.1 Max는 57.9%로 앞섰습니다.
  • 전기 공학 벤치마크인 EEBench: 64.0%, Grok 4.6의 53.0%에 비해 크게 도약했으며 나열된 모델 중 가장 높습니다.
  • DeepSWE v1.1: 높은 노력에서 71.0%, Grok 4.6의 경우 65.2%, GPT-5.6 Sol Max의 경우 72.7%입니다.
  • AA Briefcase v1.1, 다중 시간 사무: 1,657로 1,546에서 증가했으며 Fable 5.1 Max에 이어 1,678로 마감되었습니다.
  • Harvey Legal Agent 벤치마크: 19.6%로 Grok 4.6(15.8%)보다 앞서고 이 측정에서 GPT-5.6 Sol Max(2.5%) 및 Fable 5.1 Max(6.7%)보다 훨씬 앞서 있습니다.
  • HealthBench Professional: 56.7%, Grok 4.6의 48.5%보다 향상되었지만 GPT-5.6 Sol Max(60.5%) 및 Fable 5.1 Max(62.1%)에 뒤처졌습니다.

Elo가 점수를 매긴 전문 지식 작업 벤치마크인 GDPval에서 xAI의 차트는 Grok 4.7을 1,695로 xhigh 추론으로 제시합니다. 이는 Grok 4.6의 1,605에서 증가한 것으로, Fable 5.1 Max(1,735)보다 뒤지고 GPT-6 Astra Max(1,542)보다 앞서 있습니다.

가격이 이야기입니다

발표에서 가장 공격적인 주장은 기술적이라기보다는 경제적입니다. xAI는 Grok 4.7이 동급 모델의 절반 가격으로 두 배 더 빠르다고 설명하고 있으며, 게시된 가격표는 두 주요 경쟁사의 최상위 구성에 대한 헤드라인 비교를 뒷받침합니다. Grok 4.7의 $2/$6 토큰 가격은 Grok 4.6과 동일합니다. 즉, 구매자는 가격 인상 없이 세대에 걸쳐 개선된 혜택을 누릴 수 있습니다.

이러한 포지셔닝은 xAI가 Grok 4.x 라인 전반에 걸쳐 추구한 전략을 확장합니다. 즉, OpenAI 및 Anthropic의 프리미엄 가격 계층을 낮추면서 최전선 품질에 일치하거나 접근한 다음 GitHub, Cursor 및 OpenRouter를 포함한 파트너를 통해 공격적으로 배포하는 것입니다.

볼만한 동영상

정직한 주의 사항은 xAI가 비교 차트 자체를 게시했으며 벤치마킹 수집기의 독립적인 검증에는 며칠이 걸린다는 것입니다. xAI가 강조하기로 선택한 수치에서 Grok 4.7은 Grok 4.6보다 훨씬 더 발전한 것이며(Terminal-Bench 4.0 및 EEBench에서 가장 눈에 띄게 나타남) 출력 토큰당 5배 더 많은 비용을 지불하면서 코딩 및 상태 벤치마크에서 선두를 유지하는 Fable 5.1 Max를 휩쓸지는 않습니다.

오랜 시간에 걸쳐 에이전트 작업을 수행하는 개발자의 경우 가격 대비 성능 계산이 원시 순위표 위치보다 더 중요할 수 있습니다. Grok 4.7은 이제 xAI의 API와 GitHub Copilot을 통해 사용할 수 있습니다.

AI보다 앞서 나가세요

AI 산업의 가장 중요한 발전을 지속적으로 보도하려면 AI Buzz Wire를 북마크에 추가하고 속보를 놓치지 마세요.

AI 뉴스 더 보기