xAI ha lanzado Grok 4.6, la última versión de su modelo de lenguaje de gran frontera, con una puntuación de 61 en el Índice de Inteligencia de Análisis Artificial para igualar el GPT-5.6 Sol de OpenAI. El modelo se lanzó hoy y está disponible de inmediato en Cursor y Grok Build, con acceso API e integraciones de socios a través de OpenRouter, Vercel y Cloudflare.
Para conocer las últimas noticias y análisis sobre IA, visite AI Buzz Wire.
Inteligencia de frontera a una fracción del costo
Según Artificial Analysis, una plataforma de evaluación comparativa independiente, Grok 4.6 gana cinco puntos sobre su predecesor Grok 4.5 en el Índice de Inteligencia, lo que devuelve a xAI al nivel fronterizo junto con OpenAI. El modelo se sitúa justo detrás de Claude Opus 5 (63) y Claude Fable 5 (62) de Anthropic, y delante de Kimi K3.
Lo que hace que Grok 4.6 sea particularmente notable es su precio. El precio principal se mantiene sin cambios desde Grok 4.5 en $2 por millón de tokens de entrada y $6 por millón de tokens de salida. Eso lo coloca más de un 60% por debajo de Claude Opus 5 ($5/$25) y GPT-5.6 Sol ($5/$30). El costo medido por tarea es de $0,84, lo que lo ubica en la frontera de Inteligencia versus Costo de Pareto.
Mantener los precios estables a lo largo de una generación es inusual en la frontera, donde las ganancias en inteligencia generalmente han ido acompañadas de aumentos de precios. Grok 4.6 ofrece una ganancia de cinco puntos en el índice de inteligencia a un precio sin cambios.
Creado para agentes de larga duración
Grok 4.6 se basa en Grok 4.5 con lo que xAI describe como un enfoque particular en agentes de larga duración y un trabajo visual e interactivo más ambicioso. La compañía dice que el modelo se basa en tareas complejas en muchos pasos, ya sea investigar un tema, analizar información, trabajar en una base de código o convertir una idea en una aplicación pulida.
Los puntos de referencia agentes cuentan una historia convincente. En GDPval-AA v2, una medida líder del trabajo de conocimiento agente del mundo real, Grok 4.6 logra un Elo de 1753, solo detrás de Claude Opus 5 y estadísticamente a la par con Claude Fable 5 y Qwen3.8 Max. Obtiene una puntuación del 50,7% en el punto de referencia bancario tau-cubed para servicio al cliente de múltiples turnos, lo que lo coloca entre los dos primeros junto con Qwen3.8 Max.
En CursorBench v3.2, Grok 4.6 obtiene una puntuación del 69,9 %, por delante de GPT-5.6 Sol (67,2 %) y Grok 4.5 (66,7 %). Publica un 65,9% en DeepSWE v1.1 y un 61,3% en FrontierCode v1.1 Extended.
Eficiencia de giro notable
Uno de los hallazgos más destacados del Análisis Artificial es el perfil de eficiencia de Grok 4.6 en AA-Briefcase, un punto de referencia privado de tareas de trabajo de conocimiento agente de largo plazo. El modelo debuta con un Elo de 1577, lo que lo sitúa en el nivel Fable 5.
Las cifras de eficiencia son sorprendentes. Grok 4.6 resuelve tareas en aproximadamente 53 turnos y 500 millones de tokens de entrada en promedio, en comparación con aproximadamente 103 turnos y 2000 millones de tokens de entrada para Claude Opus 5 max. Dado que el trabajo de agencia de largo plazo acumula contexto rápidamente, un modelo que alcanza una respuesta comparable en la mitad de los turnos y una cuarta parte de los tokens de entrada tiene una ventaja de costos mucho más allá de su precio por token.
Formación y seguridad
Grok 4.6 se sometió a una ejecución de entrenamiento suplementaria más larga que Grok 4.5, con datos seleccionados generados por modelos para razonamiento y conceptos técnicos avanzados, datos de ingeniería de alta calidad y un optimizador y una receta de entrenamiento mejorados. xAI utilizó Grok 4.5 para regenerar trayectorias SFT a través de esfuerzos de razonamiento, arneses de agentes y dominios que incluyen STEM, ingeniería de software y trabajo del conocimiento.
El modelo lleva una ventana de contexto de 500.000 tokens, sin cambios desde Grok 4.5. xAI informa que Grok 4.6 se sometió a su conjunto más amplio de pruebas previas a la implementación para capacidades y calibración de salvaguardias, junto con extensas pruebas posteriores a la implementación y de terceros.
Disponibilidad y precios
Grok 4.6 está disponible hoy en Cursor y Grok Build. xAI ofrece un uso doble incluido dentro de ambas plataformas durante la primera semana. El precio comienza en $2 por millón de tokens de entrada y $6 por millón de tokens de salida, con una variante rápida disponible al doble del precio. Los accesos a la caché se descuentan a 0,50 dólares por millón de tokens.
El lanzamiento continúa una cadencia rápida para xAI, con Grok 4.6 llegando poco más de un mes después de Grok 4.5. El modelo posiciona a xAI como un serio contendiente en la carrera fronteriza, particularmente para los desarrolladores que priorizan el rendimiento de la agencia y la eficiencia de costos.
Manténgase por delante de la IA
Para una cobertura continua de los desarrollos más importantes de la industria de la IA, marque AI Buzz Wire y no se pierda nunca una noticia de última hora.
Leer más noticias sobre IA