xAI ha rilasciato Grok 4.6, l'ultima iterazione del suo modello di linguaggio di grandi dimensioni di frontiera, ottenendo un punteggio di 61 nell'Indice di intelligenza di analisi artificiale per eguagliare il GPT-5.6 Sol di OpenAI. Il modello è stato lanciato oggi ed è immediatamente disponibile in Cursor e Grok Build, con accesso API e integrazioni dei partner tramite OpenRouter, Vercel e Cloudflare.

Per le ultime notizie e analisi sull'intelligenza artificiale, visita AI Buzz Wire.

Intelligence di frontiera a una frazione del costo

Secondo Artificial Analysis, una piattaforma di benchmarking indipendente, Grok 4.6 guadagna cinque punti rispetto al suo predecessore Grok 4.5 nell'Intelligence Index, riportando xAI al livello di frontiera insieme a OpenAI. Il modello si trova appena dietro Claude Opus 5 (63) e Claude Fable 5 (62) di Anthropic e davanti a Kimi K3.

Ciò che rende Grok 4.6 particolarmente notevole è il suo prezzo. Il prezzo principale rimane invariato rispetto a Grok 4.5: 2 dollari per milione di token di input e 6 dollari per milione di token di output. Ciò lo colloca più del 60% al di sotto di Claude Opus 5 ($ 5/$ 25) e GPT-5.6 Sol ($ 5/$ 30). Il costo misurato per attività è di $ 0,84, posizionandolo sulla frontiera dell'intelligenza rispetto al costo di Pareto.

Mantenere i prezzi invariati per una generazione è insolito alla frontiera, dove i guadagni di intelligence sono stati generalmente accompagnati da aumenti di prezzo. Grok 4.6 offre un guadagno dell'indice di intelligence di cinque punti a prezzo invariato.

Costruito per agenti di lunga durata

Grok 4.6 si basa su Grok 4.5 con ciò che xAI descrive come un'attenzione particolare agli agenti di lunga durata e al lavoro interattivo e visivo più ambizioso. L'azienda afferma che il modello supporta compiti complessi in molte fasi, sia che si tratti di ricercare un argomento, analizzare informazioni, lavorare su una base di codice o trasformare un'idea in un'applicazione raffinata.

I benchmark degli agenti raccontano una storia avvincente. Su GDPval-AA v2, una misura leader del lavoro di conoscenza agente nel mondo reale, Grok 4.6 raggiunge un Elo di 1753, dietro solo a Claude Opus 5 e statisticamente alla pari con Claude Fable 5 e Qwen3.8 Max. Ottiene un punteggio del 50,7% sul benchmark bancario al cubo tau per il servizio clienti multi-turno, posizionandosi tra i primi due insieme a Qwen3.8 Max.

Su CursorBench v3.2, Grok 4.6 ottiene un punteggio del 69,9%, davanti sia a GPT-5.6 Sol (67,2%) che a Grok 4.5 (66,7%). Pubblica il 65,9% su DeepSWE v1.1 e il 61,3% su FrontierCode v1.1 Extended.

Notevole efficienza in virata

Uno dei risultati più importanti di Artificial Analysis è il profilo di efficienza di Grok 4.6 su AA-Briefcase, un punto di riferimento privato di attività di lavoro di conoscenza degli agenti a lungo orizzonte. Il modello debutta con un Elo di 1577, posizionandolo al livello Fable 5.

I numeri sull’efficienza sono sorprendenti. Grok 4.6 risolve le attività in circa 53 turni e 0,5 miliardi di token di input in media, rispetto a circa 103 turni e 2,0 miliardi di token di input per Claude Opus 5 max. Poiché il lavoro degli agenti a lungo orizzonte accumula rapidamente il contesto, un modello che raggiunge una risposta comparabile nella metà dei turni e in un quarto dei token di input ha un vantaggio in termini di costi ben oltre il suo prezzo per token.

Formazione e Sicurezza

Grok 4.6 è stato sottoposto a un corso di formazione supplementare più lungo rispetto a Grok 4.5, con dati curati generati da modelli per ragionamenti e concetti tecnici avanzati, dati tecnici di alta qualità e un ottimizzatore e una ricetta di formazione migliorati. xAI ha utilizzato Grok 4.5 per rigenerare le traiettorie SFT attraverso sforzi di ragionamento, cablaggi di agenti e domini tra cui STEM, ingegneria del software e lavoro di conoscenza.

Il modello porta una finestra di contesto da 500.000 token, invariata rispetto a Grok 4.5. xAI riferisce che Grok 4.6 è stato sottoposto alla più ampia suite di test pre-distribuzione mai realizzata per verificare funzionalità e calibrazione di salvaguardia, insieme a test estesi post-distribuzione e di terze parti.

Disponibilità e prezzi

Grok 4.6 è disponibile oggi in Cursor e Grok Build. xAI offre il doppio utilizzo incluso all'interno di entrambe le piattaforme per la prima settimana. Il prezzo parte da 2 dollari per milione di token di input e 6 dollari per milione di token di output, con una variante veloce disponibile al doppio del prezzo. Gli accessi alla cache sono scontati a $ 0,50 per milione di token.

Il rilascio continua a ritmo serrato per xAI, con Grok 4.6 in arrivo poco più di un mese dopo Grok 4.5. Il modello posiziona xAI come un serio contendente nella corsa all’avanguardia, in particolare per gli sviluppatori che danno priorità alle prestazioni degli agenti e all’efficienza dei costi.

Stai al passo con l'intelligenza artificiale

Per una copertura continua degli sviluppi più importanti del settore dell'intelligenza artificiale, aggiungi AI Buzz Wire ai preferiti e non perdere mai una notizia dell'ultima ora.

Leggi altre notizie sull'AI