xAI har släppt Grok 4.7, företagets mest kapabla modell för kodnings- och kunskapsarbete hittills, efter veckor av offentlig retas och minst en försening. Tillkännagiven på företagets webbplats på söndagen landar modellen till samma pris och serveringshastighet som föregångaren Grok 4.6: 2 $ per miljon inmatade tokens och $ 6 per miljon output-tokens, ungefär hälften av listpriset för OpenAI:s GPT-5.6 Sol Max ($4/$20) och långt under Anthropics fabel 5,1 $/$ Max.
För de senaste nyheterna om AI och analyser, besök AI Buzz Wire.
En större basmodell, utbildad för långa uppgifter
Enligt xAIs tillkännagivande använder Grok 4.7 en ny, större basmodell jämfört med Grok 4.6 och tränades med en längre förstärkningsinlärningskörning på en hårdare mix av uppgifter, viktade mot problem som tar många timmar att slutföra. Företaget säger att modellen är bättre på att verifiera sitt eget arbete och hantera längre sammanhang, och att den har tränats för att förstå Grok Bot-selen, förbättra samtalsuppgifter och allmänt kunskapsarbete.
Releasen följer en bullrig uppkörning. Elon Musk sa först i början av september att Grok 4.7 skulle landa inom tio dagar, och erkände sedan i mitten av september att modellen behövde ytterligare några dagars förfining, enligt TeslaNorth.com. Den skickas nu, och GitHub bekräftade samma dag att Grok 4.7 är tillgänglig i GitHub Copilot.
Benchmark-bilden: Stark, inte svepande
Benchmarkdata som publicerats av xAI visar en modell som leder i flera kategorier med lång horisont samtidigt som den ligger bakom Anthropics dyraste konfiguration på andra:
- CursorBench 4.0, som betonar mer långvariga kodningsuppgifter: Grok 4.7 får 46.3%, före GPT-5.6 Sol Max (41.7%) och Grok 4.6 High (40.4%), men bakom Fable 5.1 Max (51.8%).
- Terminal-Bench 4.0, flertimmars terminalarbete: 38,0 %, upp kraftigt från 20,3 % för Grok 4,6 och strax före GPT-5,6 Sol Max (37,3 %), även om Fable 5.1 Max leder med 57,9 %.
- EEBench, ett riktmärke för elteknik: 64,0 %, ett stort hopp från Grok 4,6:s 53,0 % och den högsta av de listade modellerna.
- DeepSWE v1.1: 71,0 % vid hög ansträngning, mot 65,2 % för Grok 4,6 och 72,7 % för GPT-5,6 Sol Max.
- AA Portfölj v1.1, kontorsarbete i flera timmar: 1 657, upp från 1 546, och nära Fable 5.1 Max på 1 678.
- Harvey Legal Agent Benchmark: 19,6 %, före Grok 4,6 (15,8 %) och långt före GPT-5,6 Sol Max (2,5 %) och Fable 5,1 Max (6,7 %) på detta mått.
- HealthBench Professional: 56,7 %, förbättring jämfört med Grok 4,6:s 48,5 % men sämre GPT-5,6 Sol Max (60,5 %) och Fable 5,1 Max (62,1 %).
På GDPval, ett riktmärke för professionellt kunskapsarbete som fått poäng av Elo, sätter xAI:s diagram Grok 4,7 på xhigh resonemang på 1 695 – upp från 1 605 för Grok 4,6, bakom Fable 5.1 Max (1 735) och före GPT-6 Astra Max (1 542).
Priset är historien
Det mest aggressiva påståendet i tillkännagivandet är ekonomiskt snarare än tekniskt: xAI beskriver Grok 4.7 som dubbelt så snabb till halva priset av jämförbara modeller, och den publicerade pristabellen stödjer rubrikjämförelsen mot toppnivåkonfigurationerna för dess två främsta rivaler. Grok 4.7:s tokenprissättning på $2/$6 är oförändrad från Grok 4.6, vilket innebär att köpare får förbättringen generation över generation utan en prishöjning.
Den positioneringen utökar en strategi som xAI har följt över Grok 4.x-linjen: matcha eller närma dig gränskvalitet samtidigt som de underskrider premiumprisnivåerna för OpenAI och Anthropic, distribuera sedan aggressivt genom partners inklusive GitHub, Cursor och OpenRouter.
Vad du ska titta på
Den ärliga varningen är att xAI publicerade själva jämförelsediagrammet, och oberoende verifiering från benchmarkingaggregatorer kommer att ta dagar. När det gäller siffrorna xAI valde att lyfta fram är Grok 4.7 ett genuint steg upp från Grok 4.6 – mest synligt på Terminal-Bench 4.0 och EEBench – men det sveper inte Fable 5.1 Max, som behåller ledningen när det gäller kodning och hälsoriktmärken samtidigt som den kostar fem gånger mer per output token.
För utvecklare som kör långa, flera timmar långa agentarbetsbelastningar kan pris-prestanda-matematiken ha större betydelse än den råa positionen på topplistan. Grok 4.7 är tillgänglig nu via xAI:s API och i GitHub Copilot.
Ligg före AI
För kontinuerlig täckning av AI-branschens viktigaste utvecklingar, bokmärk AI Buzz Wire och missa aldrig en brytande historia.
Läs fler AI-nyheter