xAI heeft Grok 4.7 uitgebracht, het meest capabele model van het bedrijf voor coderen en kenniswerk tot nu toe, na weken van publieke plagerijen en minstens één vertraging. Het model, dat zondag op de site van het bedrijf werd aangekondigd, heeft dezelfde prijs en servicesnelheid als zijn voorganger Grok 4.6: $2 per miljoen inputtokens en $6 per miljoen outputtokens, ongeveer de helft van de catalogusprijs van OpenAI's GPT-5.6 Sol Max ($4/$20) en ruim onder Anthropic's Fable 5.1 Max ($10/$50).
Ga voor het laatste nieuws en analyses over AI naar AI Buzz Wire.
Een groter basismodel, getraind voor lange taken
Volgens de aankondiging van xAI gebruikt Grok 4.7 een nieuw, groter basismodel vergeleken met Grok 4.6 en is het getraind met een langere leercyclus voor versterking op een moeilijkere mix van taken, gericht op problemen die vele uren in beslag nemen. Het bedrijf zegt dat het model beter is in het verifiëren van zijn eigen werk en het beheren van een langere context, en dat het is getraind om het Grok Bot-harnas van nature te begrijpen, waardoor conversatietaken en algemeen kenniswerk worden verbeterd.
De release volgt op een luidruchtige aanloop. Elon Musk zei begin september eerst dat de Grok 4.7 binnen tien dagen zou landen, en erkende vervolgens medio september dat het model nog een paar dagen verfijning nodig had, aldus TeslaNorth.com. Het wordt nu verzonden en GitHub bevestigde dezelfde dag dat Grok 4.7 beschikbaar is in GitHub Copilot.
Het benchmarkbeeld: sterk, niet ingrijpend
De door xAI gepubliceerde benchmarkgegevens laten een model zien dat toonaangevend is in verschillende categorieën met een lange horizon, terwijl het achter de duurste configuratie van Anthropic blijft ten opzichte van andere:
- CursorBench 4.0, dat de nadruk legt op langerlopende codeertaken: Grok 4.7 scoort 46,3%, vóór GPT-5.6 Sol Max (41,7%) en Grok 4.6 High (40,4%), maar achter Fable 5.1 Max (51,8%).
- Terminal-Bench 4.0, terminalwerk van meerdere uren: 38,0%, een scherpe stijging ten opzichte van de 20,3% voor Grok 4.6 en net vóór GPT-5.6 Sol Max (37,3%), hoewel Fable 5.1 Max voorop loopt met 57,9%.
- EEBench, een elektrotechnische benchmark: 64,0%, een grote sprong ten opzichte van de 53,0% van Grok 4.6 en de hoogste van de genoemde modellen.
- DeepSWE v1.1: 71,0% bij hoge inspanning, versus 65,2% voor Grok 4.6 en 72,7% voor GPT-5.6 Sol Max.
- AA Briefcase v1.1, kantoorwerk van meerdere uren: 1.657, gestegen van 1.546, en vlak achter Fable 5.1 Max op 1.678.
- Harvey Legal Agent Benchmark: 19,6%, hoger dan Grok 4.6 (15,8%) en ver hoger dan GPT-5.6 Sol Max (2,5%) en Fable 5.1 Max (6,7%) op deze maatstaf.
- HealthBench Professional: 56,7%, beter dan de 48,5% van Grok 4.6, maar volgt GPT-5.6 Sol Max (60,5%) en Fable 5.1 Max (62,1%).
Op GDPval, een professionele kenniswerkbenchmark gescoord door Elo, plaatst de grafiek van xAI Grok 4,7 op xhigh-redenering op 1.695 – een stijging ten opzichte van 1.605 voor Grok 4.6, achter Fable 5.1 Max (1.735) en vóór GPT-6 Astra Max (1.542).
Prijs is het verhaal
De meest agressieve claim in de aankondiging is eerder economisch dan technisch: xAI beschrijft Grok 4.7 als twee keer zo snel en tegen de helft van de prijs van vergelijkbare modellen, en de gepubliceerde prijstabel ondersteunt de belangrijkste vergelijking met de topconfiguraties van zijn twee belangrijkste rivalen. De $2/$6 tokenprijzen van Grok 4.7 zijn onveranderd ten opzichte van Grok 4.6, wat betekent dat kopers de generatie-over-generatie verbetering krijgen zonder een prijsverhoging.
Die positionering breidt een strategie uit die xAI heeft gevolgd over de hele Grok 4.x-lijn: match of benader grenskwaliteit terwijl je de premium prijsniveaus van OpenAI en Anthropic ondermijnt, en vervolgens agressief distribueren via partners zoals GitHub, Cursor en OpenRouter.
Wat te bekijken
Het eerlijke voorbehoud is dat xAI de vergelijkingsgrafiek zelf heeft gepubliceerd, en dat onafhankelijke verificatie door benchmarking-aggregators dagen zal duren. Wat betreft de cijfers die xAI heeft benadrukt: Grok 4.7 is een echte stap vooruit ten opzichte van Grok 4.6 – het meest zichtbaar op Terminal-Bench 4.0 en EEBench – maar het kan Fable 5.1 Max niet verslaan, dat de leiding behoudt op het gebied van codering en gezondheidsbenchmarks, terwijl het vijf keer meer per outputtoken kost.
Voor ontwikkelaars die lange agentische workloads van meerdere uren uitvoeren, kan de prijs-prestatieverhouding belangrijker zijn dan de ruwe ranglijstpositie. Grok 4.7 is nu beschikbaar via de API van xAI en in GitHub Copilot.
Blijf AI een stap voor
Voor voortdurende berichtgeving over de belangrijkste ontwikkelingen in de AI-industrie kunt u een bladwijzer maken voor AI Buzz Wire en nooit meer een actueel verhaal missen.
Lees meer AI-nieuws