xAI har släppt Grok 4.6, den senaste versionen av dess frontier-stora språkmodell, med 61 poäng på Artificial Analysis Intelligence Index för att matcha OpenAI:s GPT-5.6 Sol. Modellen lanserades idag och är tillgänglig omedelbart i Cursor och Grok Build, med API-åtkomst och partnerintegrationer genom OpenRouter, Vercel och Cloudflare.
För de senaste nyheterna om AI och analyser, besök AI Buzz Wire.
Frontier Intelligence till en bråkdel av kostnaden
Enligt Artificial Analysis, en oberoende benchmarking-plattform, vinner Grok 4.6 fem poäng jämfört med sin föregångare Grok 4.5 på Intelligence Index, vilket för xAI tillbaka till frontier-nivån tillsammans med OpenAI. Modellen sitter precis bakom Anthropics Claude Opus 5 (63) och Claude Fable 5 (62), och före Kimi K3.
Det som gör Grok 4.6 särskilt anmärkningsvärt är dess prissättning. Rubrikprissättningen förblir oförändrad från Grok 4.5 till $2 per miljon inmatade tokens och $6 per miljon output-tokens. Det gör det mer än 60 % under Claude Opus 5 ($5/$25) och GPT-5.6 Sol ($5/$30). Den uppmätta kostnaden per uppgift är $0,84, vilket placerar den på Intelligence kontra Cost Pareto-gränsen.
Att hålla priserna oförändrade över en generation är ovanligt vid gränsen, där intelligensvinster vanligtvis har åtföljts av prisökningar. Grok 4.6 ger en fempunktsvinst i Intelligence Index till oförändrad prissättning.
Byggd för långvariga agenter
Grok 4.6 bygger på Grok 4.5 med vad xAI beskriver som ett särskilt fokus på långvariga agenter och mer ambitiöst interaktivt och visuellt arbete. Företaget säger att modellen förblir med komplexa uppgifter i många steg, oavsett om man undersöker ett ämne, analyserar information, arbetar över en kodbas eller förvandlar en idé till en polerad applikation.
De agentiska riktmärkena berättar en fängslande historia. På GDPval-AA v2, ett ledande mått på verkligt verkligt verkligt kunskapsarbete, uppnår Grok 4.6 en Elo på 1753, bakom endast Claude Opus 5 och statistiskt i paritet med Claude Fable 5 och Qwen3.8 Max. Den får 50,7 % på det tau-kubade Banking-riktmärket för kundservice med flera svängar, vilket placerar den i topp två tillsammans med Qwen3.8 Max.
På CursorBench v3.2 får Grok 4.6 69.9%, före både GPT-5.6 Sol (67.2%) och Grok 4.5 (66.7%). Den publicerar 65,9 % på DeepSWE v1.1 och 61,3 % på FrontierCode v1.1 Extended.
Anmärkningsvärd svängeffektivitet
Ett av de framstående resultaten från artificiell analys är Grok 4.6:s effektivitetsprofil på AA-portföljen, ett privat riktmärke för arbetsuppgifter för agenter med lång horisont. Modellen debuterar med en Elo från 1577, vilket placerar den på Fable 5-nivån.
Effektivitetssiffrorna är slående. Grok 4.6 löser uppgifter i cirka 53 varv och 0,5 miljarder inmatade tokens i genomsnitt, jämfört med ungefär 103 varv och 2,0 miljarder inmatade tokens för Claude Opus 5 max. Eftersom agentarbete med långa horisonter ackumulerar kontext snabbt, har en modell som når ett jämförbart svar i halva varven och en fjärdedel av inmatningstokenen en kostnadsfördel långt utöver sin prissättning per token.
Utbildning och säkerhet
Grok 4.6 genomgick en längre kompletterande träningskörning än Grok 4.5, med kurerade modellgenererade data för resonemang och avancerade tekniska koncept, högkvalitativ ingenjörsdata och en förbättrad optimerare och träningsrecept. xAI använde Grok 4.5 för att återskapa SFT-banor över resonemangsinsatser, agenter och domäner inklusive STEM, mjukvaruteknik och kunskapsarbete.
Modellen har ett kontextfönster på 500 000 token, oförändrat från Grok 4.5. xAI rapporterar att Grok 4.6 genomgick sin hittills bredaste svit av tester före driftsättning för funktioner och säkerhetskalibrering, tillsammans med omfattande efterinstallation och testning från tredje part.
Tillgänglighet och prissättning
Grok 4.6 är tillgänglig idag i Cursor och Grok Build. xAI erbjuder dubbel inkluderad användning inom båda plattformarna under den första veckan. Prissättningen börjar på $2 per miljon inmatade tokens och $6 per miljon output-tokens, med en snabb variant tillgänglig till dubbelt så mycket pris. Cacheträffar är rabatterade till $0,50 per miljon tokens.
Utgivningen fortsätter en snabb takt för xAI, med Grok 4.6 som kommer drygt en månad efter Grok 4.5. Modellen positionerar xAI som en seriös utmanare i gränskapplöpningen, särskilt för utvecklare som prioriterar agentprestanda och kostnadseffektivitet.
Ligg före AI
För kontinuerlig täckning av AI-branschens viktigaste utvecklingar, bokmärk AI Buzz Wire och missa aldrig en brytande historia.
Läs fler AI-nyheter