xAI heeft Grok 4.6 uitgebracht, de nieuwste versie van zijn grensverleggende grote taalmodel, met een score van 61 op de Artificial Analysis Intelligence Index, vergelijkbaar met OpenAI's GPT-5.6 Sol. Het model is vandaag gelanceerd en is onmiddellijk beschikbaar in Cursor en Grok Build, met API-toegang en partnerintegraties via OpenRouter, Vercel en Cloudflare.
Ga voor het laatste nieuws en analyses over AI naar AI Buzz Wire.
Grensintelligentie tegen een fractie van de kosten
Volgens Artificial Analysis, een onafhankelijk benchmarkingplatform, behaalt Grok 4.6 vijf punten ten opzichte van zijn voorganger Grok 4.5 op de Intelligence Index, waardoor xAI naast OpenAI weer op de eerste plaats komt. Het model bevindt zich net achter Anthropic's Claude Opus 5 (63) en Claude Fable 5 (62), en vóór Kimi K3.
Wat Grok 4.6 bijzonder opmerkelijk maakt, zijn de prijzen. De hoofdprijzen blijven ongewijzigd ten opzichte van Grok 4.5 op $2 per miljoen inputtokens en $6 per miljoen outputtokens. Dat is ruim 60% lager dan Claude Opus 5 ($5/$25) en GPT-5.6 Sol ($5/$30). De gemeten kosten per taak bedragen $ 0,84, waarmee deze op de grens van Intelligence versus Cost Pareto liggen.
Het vasthouden van prijzen over een generatie heen is ongebruikelijk aan de grens, waar de toename van de intelligentie doorgaans gepaard gaat met prijsstijgingen. Grok 4.6 levert een Intelligent Index-winst van vijf punten op tegen ongewijzigde prijzen.
Gebouwd voor langlopende agenten
Grok 4.6 bouwt voort op Grok 4.5 met wat xAI beschrijft als een bijzondere focus op langlopende agenten en ambitieuzer interactief en visueel werk. Het bedrijf zegt dat het model complexe taken in vele stappen kan uitvoeren, of het nu gaat om het onderzoeken van een onderwerp, het analyseren van informatie, het werken met een codebase of het omzetten van een idee in een gepolijste applicatie.
De agentische benchmarks vertellen een overtuigend verhaal. Op GDPval-AA v2, een toonaangevende maatstaf voor real-world agentic kenniswerk, bereikt Grok 4.6 een Elo van 1753, alleen achter Claude Opus 5 en statistisch gezien op één lijn met Claude Fable 5 en Qwen3.8 Max. Het scoort 50,7% op de tau-cubed Banking-benchmark voor multi-turn klantenservice, waarmee het naast Qwen3.8 Max in de top twee staat.
Op CursorBench v3.2 scoort Grok 4.6 69,9%, vóór zowel GPT-5.6 Sol (67,2%) als Grok 4.5 (66,7%). Het scoort 65,9% op DeepSWE v1.1 en 61,3% op FrontierCode v1.1 Extended.
Opmerkelijke draai-efficiëntie
Een van de opvallende bevindingen van Artificial Analysis is het efficiëntieprofiel van Grok 4.6 op AA-Briefcase, een particuliere benchmark voor agentische kenniswerktaken met een lange horizon. Het model debuteert met een Elo uit 1577, waarmee het op het Fable 5-niveau wordt geplaatst.
De efficiëntiecijfers zijn opvallend. Grok 4.6 lost taken op in ongeveer 53 beurten en gemiddeld 0,5 miljard invoertokens, vergeleken met ongeveer 103 beurten en 2,0 miljard invoertokens voor maximaal Claude Opus 5. Omdat agentisch werk met een lange horizon de context snel accumuleert, heeft een model dat in de helft van de beurten en een kwart van de invoertokens een vergelijkbaar antwoord bereikt, een kostenvoordeel dat veel verder gaat dan de prijs per token.
Training en veiligheid
Grok 4.6 onderging een langere aanvullende training dan Grok 4.5, met samengestelde modelgegenereerde gegevens voor redenering en geavanceerde technische concepten, hoogwaardige technische gegevens en een verbeterd optimalisatie- en trainingsrecept. xAI gebruikte Grok 4.5 om SFT-trajecten te regenereren over redeneerinspanningen, middelenharnassen en domeinen zoals STEM, software-engineering en kenniswerk.
Het model heeft een contextvenster van 500.000 tokens, ongewijzigd ten opzichte van Grok 4.5. xAI meldt dat Grok 4.6 het breedste pakket aan pre-implementatietests ooit heeft ondergaan voor mogelijkheden en kalibratie van de beveiliging, samen met uitgebreide post-implementatietests en tests door derden.
Beschikbaarheid en prijzen
Grok 4.6 is vandaag beschikbaar in Cursor en Grok Build. xAI biedt de eerste week dubbel inbegrepen gebruik op beide platforms. De prijzen beginnen bij $2 per miljoen inputtokens en $6 per miljoen outputtokens, waarbij een snelle variant beschikbaar is voor tweemaal de prijs. Cachehits worden verdisconteerd tot $ 0,50 per miljoen tokens.
De release zet het snelle tempo voort voor xAI, waarbij Grok 4.6 iets meer dan een maand na Grok 4.5 arriveert. Het model positioneert xAI als een serieuze kandidaat in de grensrace, vooral voor ontwikkelaars die prioriteit geven aan agentische prestaties en kostenefficiëntie.
Blijf AI een stap voor
Voor voortdurende berichtgeving over de belangrijkste ontwikkelingen in de AI-industrie kunt u een bladwijzer maken voor AI Buzz Wire en nooit meer een actueel verhaal missen.
Lees meer AI-nieuws