xAI는 최첨단 대규모 언어 모델의 최신 버전인 Grok 4.6을 출시하여 인공 분석 지능 지수에서 OpenAI의 GPT-5.6 Sol과 일치하는 61점을 기록했습니다. 오늘 출시된 이 모델은 OpenRouter, Vercel 및 Cloudflare를 통한 API 액세스 및 파트너 통합을 통해 Cursor 및 Grok Build에서 즉시 사용할 수 있습니다.
최신 AI 속보 및 분석을 보려면 AI Buzz Wire를 방문하세요.
적은 비용으로 프론티어 인텔리전스
독립적인 벤치마킹 플랫폼인 Artificial Analysis에 따르면 Grok 4.6은 지능 지수에서 이전 Grok 4.5에 비해 5점을 획득하여 xAI를 OpenAI와 함께 최전선 계층으로 다시 끌어올렸습니다. 이 모델은 Anthropic의 Claude Opus 5(63)와 Claude Fable 5(62) 바로 뒤, Kimi K3보다 앞에 위치합니다.
Grok 4.6을 특히 주목할 만한 이유는 가격입니다. 헤드라인 가격은 입력 토큰 백만 개당 2달러, 출력 토큰 백만 개당 6달러로 Grok 4.5와 동일합니다. 이는 Claude Opus 5($5/$25) 및 GPT-5.6 Sol($5/$30)보다 60% 이상 낮은 가격입니다. 작업당 측정된 비용은 0.84달러로 지능 대 비용 파레토 경계에 위치합니다.
한 세대에 걸쳐 가격을 동일하게 유지하는 것은 일반적으로 정보 획득이 가격 인상을 동반하는 개척지에서는 이례적입니다. Grok 4.6은 변경되지 않은 가격으로 5포인트의 지능 지수 향상을 제공합니다.
장기 실행 에이전트를 위해 구축됨
Grok 4.6은 xAI가 장기 실행 에이전트와 더욱 야심찬 대화형 및 시각적 작업에 중점을 두고 설명하는 Grok 4.5를 기반으로 구축되었습니다. 회사에 따르면 이 모델은 주제 조사, 정보 분석, 코드베이스 작업, 아이디어를 세련된 애플리케이션으로 전환 등 여러 단계에 걸쳐 복잡한 작업을 수행합니다.
에이전트 벤치마크는 흥미로운 이야기를 들려줍니다. 실제 에이전트 지식 작업의 주요 척도인 GDPval-AA v2에서 Grok 4.6은 Claude Opus 5에 뒤처지고 통계적으로 Claude Fable 5 및 Qwen3.8 Max와 동등한 1753년 Elo를 달성했습니다. 다중 턴 고객 서비스에 대한 tau-cubed Banking 벤치마크에서 50.7%를 기록하여 Qwen3.8 Max와 함께 상위 2위에 올랐습니다.
CursorBench v3.2에서 Grok 4.6은 69.9%를 기록하여 GPT-5.6 Sol(67.2%)과 Grok 4.5(66.7%)보다 앞서 있습니다. DeepSWE v1.1에서는 65.9%, FrontierCode v1.1 Extended에서는 61.3%를 기록했습니다.
놀라운 턴 효율성
인공 분석에서 눈에 띄는 결과 중 하나는 장거리 에이전트 지식 작업 작업의 비공개 벤치마크인 AA-Briefcase에 대한 Grok 4.6의 효율성 프로필입니다. 이 모델은 1577년 Elo로 데뷔하여 Fable 5 등급에 속합니다.
효율성 수치는 놀랍습니다. Grok 4.6은 Claude Opus 5 Max의 약 103턴 및 20억 입력 토큰과 비교하여 평균 약 53턴 및 5억 개의 입력 토큰으로 작업을 해결합니다. 장거리 에이전트 작업은 컨텍스트를 빠르게 축적하기 때문에 절반의 턴과 1/4의 입력 토큰으로 비슷한 답변에 도달하는 모델은 토큰당 가격 책정을 훨씬 뛰어 넘는 비용 이점을 갖습니다.
교육 및 안전
Grok 4.6은 추론 및 고급 기술 개념을 위해 선별된 모델 생성 데이터, 고품질 엔지니어링 데이터, 향상된 최적화 프로그램 및 교육 레시피를 사용하여 Grok 4.5보다 더 긴 보충 교육 실행을 거쳤습니다. xAI는 Grok 4.5를 사용하여 STEM, 소프트웨어 엔지니어링 및 지식 작업을 포함한 추론 노력, 에이전트 하네스 및 도메인 전반에 걸쳐 SFT 궤적을 재생성했습니다.
이 모델은 Grok 4.5에서 변경되지 않은 500,000개의 토큰 컨텍스트 창을 제공합니다. xAI는 Grok 4.6이 광범위한 배포 후 및 타사 테스트와 함께 기능 및 보호 교정에 대한 가장 광범위한 사전 배포 테스트 제품군을 거쳤다고 보고합니다.
가용성 및 가격
Grok 4.6은 현재 Cursor 및 Grok Build에서 사용할 수 있습니다. xAI는 첫 주 동안 두 플랫폼 모두에서 두 배로 포함된 사용량을 제공합니다. 가격은 입력 토큰 백만 개당 2달러, 출력 토큰 백만 개당 6달러부터 시작하며 빠른 변형은 두 배의 가격으로 제공됩니다. 캐시 적중은 백만 토큰당 0.50달러로 할인됩니다.
Grok 4.5가 출시된 지 한 달여 만에 Grok 4.6이 출시되면서 xAI의 릴리스가 계속해서 빠르게 진행되고 있습니다. 이 모델은 특히 에이전트 성능과 비용 효율성을 우선시하는 개발자에게 xAI를 개척 경쟁의 심각한 경쟁자로 자리매김합니다.
AI보다 앞서 나가세요
AI 산업의 가장 중요한 발전을 지속적으로 보도하려면 AI Buzz Wire를 즐겨찾기에 추가하고 속보를 놓치지 마세요.
AI 뉴스 더 보기