xAI a lansat Grok 4.6, cea mai recentă iterație a modelului său de limbă mare de frontieră, cu un punctaj de 61 pe Indexul Inteligenței de Analiză Artificială pentru a se potrivi cu GPT-5.6 Sol al OpenAI. Modelul a fost lansat astăzi și este disponibil imediat în Cursor și Grok Build, cu acces API și integrări de parteneri prin OpenRouter, Vercel și Cloudflare.
Pentru cele mai recente știri și analize AI, accesați AI Buzz Wire.
Frontier Intelligence la o fracțiune din cost
Potrivit Artificial Analysis, o platformă independentă de benchmarking, Grok 4.6 câștigă cinci puncte față de predecesorul său Grok 4.5 la Intelligence Index, aducând xAI înapoi la nivelul de frontieră alături de OpenAI. Modelul se află chiar în spatele lui Anthropic Claude Opus 5 (63) și Claude Fable 5 (62) și înaintea lui Kimi K3.
Ceea ce face ca Grok 4.6 să fie deosebit de remarcabil este prețul său. Prețul general rămâne neschimbat față de Grok 4.5 la 2 USD per milion de jetoane de intrare și 6 USD per milion de jetoane de ieșire. Asta îl pune cu mai mult de 60% sub Claude Opus 5 (5 USD/25 USD) și GPT-5.6 Sol (5 USD/30 USD). Costul măsurat pe sarcină este de 0,84 USD, plasându-l pe frontiera Intelligence versus Cost Pareto.
Menținerea stabilă a prețurilor de-a lungul unei generații este neobișnuită la frontieră, unde câștigurile de informații au fost de obicei însoțite de creșteri ale prețurilor. Grok 4.6 oferă un câștig de cinci puncte în Intelligence Index la prețuri neschimbate.
Construit pentru agenți de lungă durată
Grok 4.6 se bazează pe Grok 4.5 cu ceea ce xAI descrie ca fiind un accent special pe agenții de lungă durată și lucrările interactive și vizuale mai ambițioase. Compania spune că modelul rămâne cu sarcini complexe în mai mulți pași, fie că cercetează un subiect, analizează informații, lucrează pe o bază de cod sau transformă o idee într-o aplicație șlefuită.
Benchmark-urile agentice spun o poveste convingătoare. Pe GDPval-AA v2, o măsură principală a activității de cunoaștere agentică din lumea reală, Grok 4.6 realizează un Elo de 1753, în spatele lui Claude Opus 5 și statistic la egalitate cu Claude Fable 5 și Qwen3.8 Max. Obține un punctaj de 50,7% la benchmark-ul bancar tau-cubed pentru serviciul clienți multi-turn, plasându-l în primele două, alături de Qwen3.8 Max.
Pe CursorBench v3.2, Grok 4.6 obține un scor de 69,9%, înaintea ambelor GPT-5.6 Sol (67,2%) și Grok 4.5 (66,7%). Postează 65,9% pe DeepSWE v1.1 și 61,3% pe FrontierCode v1.1 Extended.
Eficiență remarcabilă a virajului
Una dintre descoperirile remarcabile de la Artificial Analysis este profilul de eficiență al lui Grok 4.6 pe AA-Briefcase, un etalon privat al sarcinilor de lucru cu cunoștințe agentice pe orizont lung. Modelul debutează cu un Elo de 1577, plasându-l la nivelul Fable 5.
Cifrele de eficiență sunt izbitoare. Grok 4.6 rezolvă sarcini în aproximativ 53 de ture și 0,5 miliarde de jetoane de intrare în medie, comparativ cu aproximativ 103 de ture și 2,0 miliarde de jetoane de intrare pentru Claude Opus 5 max. Deoarece munca agentică pe orizont lung acumulează contextul rapid, un model care ajunge la un răspuns comparabil în jumătate din ture și un sfert din jetoanele de intrare are un avantaj de cost cu mult dincolo de prețul pe token.
Instruire și siguranță
Grok 4.6 a fost supus unui antrenament suplimentar mai lung decât Grok 4.5, cu date curatate generate de model pentru raționament și concepte tehnice avansate, date de inginerie de înaltă calitate și un optimizator îmbunătățit și o rețetă de antrenament. xAI a folosit Grok 4.5 pentru a regenera traiectorii SFT în eforturile de raționament, hamurile de agenți și domeniile, inclusiv STEM, ingineria software și munca de cunoaștere.
Modelul are o fereastră de context de 500.000 de jetoane, neschimbată față de Grok 4.5. xAI raportează că Grok 4.6 a trecut vreodată în cea mai largă suită de teste înainte de implementare pentru capabilități și calibrare de siguranță, împreună cu teste extinse după implementare și terțe părți.
Disponibilitate și prețuri
Grok 4.6 este disponibil astăzi în Cursor și Grok Build. xAI oferă utilizare dublă inclusă în ambele platforme pentru prima săptămână. Prețul începe de la 2 USD per milion de jetoane de intrare și 6 USD per milion de jetoane de ieșire, cu o variantă rapidă disponibilă la dublul prețului. Accesările în cache sunt reduse la 0,50 USD per milion de jetoane.
Lansarea continuă o cadență rapidă pentru xAI, Grok 4.6 sosind la puțin peste o lună după Grok 4.5. Modelul poziționează xAI ca un concurent serios în cursa de frontieră, în special pentru dezvoltatorii care acordă prioritate performanței agentice și eficienței costurilor.
Rămâi înaintea AI
Pentru o acoperire continuă a celor mai importante evoluții din industria AI, marcați AI Buzz Wire și nu ratați niciodată o poveste de ultimă oră.
Citiți mai multe știri AI