xAI lançou Grok 4.6, a mais recente iteração de seu modelo de linguagem de fronteira grande, pontuando 61 no Índice de Inteligência de Análise Artificial para corresponder ao GPT-5.6 Sol da OpenAI. O modelo foi lançado hoje e está disponível imediatamente em Cursor e Grok Build, com acesso API e integrações de parceiros por meio de OpenRouter, Vercel e Cloudflare.

Para obter as últimas notícias e análises sobre IA, visite AI Buzz Wire.

Inteligência de fronteira por uma fração do custo

De acordo com a Artificial Analysis, uma plataforma de benchmarking independente, o Grok 4.6 ganha cinco pontos sobre seu antecessor Grok 4.5 no Índice de Inteligência, trazendo o xAI de volta ao nível de fronteira ao lado do OpenAI. O modelo fica logo atrás de Claude Opus 5 (63) e Claude Fable 5 (62) da Anthropic, e à frente do Kimi K3.

O que torna o Grok 4.6 particularmente notável é o seu preço. O preço principal permanece inalterado em relação ao Grok 4.5, com US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída. Isso o coloca mais de 60% abaixo de Claude Opus 5 (US$ 5/US$ 25) e GPT-5.6 Sol (US$ 5/US$ 30). O custo medido por tarefa é de US$ 0,84, colocando-o na fronteira Inteligência versus Custo Pareto.

Manter os preços estáveis ​​ao longo de uma geração é incomum na fronteira, onde os ganhos de inteligência têm sido normalmente acompanhados por aumentos de preços. Grok 4.6 oferece um ganho de Índice de Inteligência de cinco pontos com preços inalterados.

Criado para agentes de longa duração

O Grok 4.6 baseia-se no Grok 4.5 com o que xAI descreve como um foco particular em agentes de longa duração e em trabalhos interativos e visuais mais ambiciosos. A empresa diz que o modelo acompanha tarefas complexas em muitas etapas, seja pesquisando um tópico, analisando informações, trabalhando em uma base de código ou transformando uma ideia em um aplicativo sofisticado.

Os benchmarks da agência contam uma história convincente. No GDPval-AA v2, uma medida líder do trabalho de conhecimento agente do mundo real, Grok 4.6 atinge um Elo de 1753, atrás apenas de Claude Opus 5 e estatisticamente no mesmo nível de Claude Fable 5 e Qwen3.8 Max. Ele obteve 50,7% no benchmark bancário tau-cubed para atendimento ao cliente multivoltas, colocando-o entre os dois primeiros ao lado de Qwen3.8 Max.

No CursorBench v3.2, o Grok 4.6 pontua 69,9%, à frente do GPT-5.6 Sol (67,2%) e do Grok 4.5 (66,7%). Ele publica 65,9% no DeepSWE v1.1 e 61,3% no FrontierCode v1.1 Extended.

Eficiência de curva notável

Uma das descobertas mais destacadas da Análise Artificial é o perfil de eficiência do Grok 4.6 na AA-Briefcase, uma referência privada de tarefas de trabalho de conhecimento agente de longo horizonte. O modelo estreia com um Elo de 1577, colocando-o no nível Fable 5.

Os números de eficiência são impressionantes. Grok 4.6 resolve tarefas em aproximadamente 53 turnos e 0,5 bilhão de tokens de entrada em média, em comparação com cerca de 103 turnos e 2,0 bilhões de tokens de entrada para Claude Opus 5 no máximo. Como o trabalho de agência de longo horizonte acumula contexto rapidamente, um modelo que atinge uma resposta comparável em metade dos turnos e um quarto dos tokens de entrada tem uma vantagem de custo muito além do preço por token.

Treinamento e Segurança

O Grok 4.6 passou por um treinamento suplementar mais longo do que o Grok 4.5, com dados gerados por modelos selecionados para raciocínio e conceitos técnicos avançados, dados de engenharia de alta qualidade e um otimizador e receita de treinamento aprimorados. xAI usou Grok 4.5 para regenerar trajetórias SFT em esforços de raciocínio, equipamentos de agentes e domínios, incluindo STEM, engenharia de software e trabalho de conhecimento.

O modelo carrega uma janela de contexto de 500.000 tokens, inalterada desde o Grok 4.5. xAI relata que o Grok 4.6 passou por seu mais amplo conjunto de testes de pré-implantação para capacidades e calibração de proteção, juntamente com extensos testes pós-implantação e de terceiros.

Disponibilidade e preços

Grok 4.6 está disponível hoje em Cursor e Grok Build. xAI está oferecendo uso duplo incluído em ambas as plataformas na primeira semana. O preço começa em US$ 2 por milhão de tokens de entrada e US$ 6 por milhão de tokens de saída, com uma variante rápida disponível pelo dobro do preço. Os acessos ao cache são descontados em US$ 0,50 por milhão de tokens.

O lançamento continua em ritmo rápido para xAI, com o Grok 4.6 chegando pouco mais de um mês após o Grok 4.5. O modelo posiciona o xAI como um sério concorrente na corrida de fronteira, especialmente para desenvolvedores que priorizam o desempenho da agência e a eficiência de custos.

Fique à frente da IA

Para cobertura contínua dos desenvolvimentos mais importantes da indústria de IA, marque AI Buzz Wire e nunca perca uma notícia de última hora.

Leia mais notícias sobre IA