xAI hat Grok 4.6 veröffentlicht, die neueste Version seines bahnbrechenden großen Sprachmodells, das im Artificial Analysis Intelligence Index einen Wert von 61 erreicht und damit mit OpenAIs GPT-5.6 Sol übereinstimmt. Das Modell wurde heute eingeführt und ist ab sofort in Cursor und Grok Build verfügbar, mit API-Zugriff und Partnerintegrationen über OpenRouter, Vercel und Cloudflare.
Die aktuellsten KI-Nachrichten und Analysen finden Sie unter AI Buzz Wire.
Frontier Intelligence zu einem Bruchteil der Kosten
Laut Artificial Analysis, einer unabhängigen Benchmarking-Plattform, gewinnt Grok 4.6 im Intelligence Index fünf Punkte gegenüber seinem Vorgänger Grok 4.5 und bringt xAI damit wieder an die Spitze neben OpenAI. Das Modell liegt direkt hinter Claude Opus 5 (63) und Claude Fable 5 (62) von Anthropic und vor Kimi K3.
Was Grok 4.6 besonders hervorhebt, ist seine Preisgestaltung. Der Hauptpreis bleibt gegenüber Grok 4,5 unverändert und beträgt 2 USD pro Million Input-Tokens und 6 USD pro Million Output-Tokens. Damit liegt es mehr als 60 % unter Claude Opus 5 (5 $/25 $) und GPT-5.6 Sol (5 $/30 $). Die gemessenen Kosten pro Aufgabe betragen 0,84 US-Dollar und liegen damit auf der Grenze zwischen Intelligenz und Kosten-Pareto.
An der Grenze ist es ungewöhnlich, die Preise über eine Generation hinweg unverändert zu lassen, da dort Informationsgewinne typischerweise mit Preiserhöhungen einhergehen. Grok 4.6 bietet einen Anstieg des Intelligence Index um fünf Punkte bei unveränderten Preisen.
Entwickelt für Agenten mit langer Laufzeit
Grok 4.6 baut auf Grok 4.5 auf und legt laut xAI einen besonderen Schwerpunkt auf Agenten mit langer Laufzeit und anspruchsvollere interaktive und visuelle Arbeit. Das Unternehmen sagt, dass das Modell über viele Schritte hinweg bei komplexen Aufgaben bleibt, sei es bei der Recherche zu einem Thema, der Analyse von Informationen, der Arbeit an einer Codebasis oder der Umsetzung einer Idee in eine ausgefeilte Anwendung.
Die Agenten-Benchmarks erzählen eine fesselnde Geschichte. Auf GDPval-AA v2, einem führenden Maß für reale Agentenwissensarbeit, erreicht Grok 4.6 einen Elo von 1753, liegt nur hinter Claude Opus 5 und statistisch auf Augenhöhe mit Claude Fable 5 und Qwen3.8 Max. Im Tau-Cubed-Banking-Benchmark für Multi-Turn-Kundenservice erreicht es 50,7 % und liegt damit neben Qwen3.8 Max unter den ersten beiden.
Auf CursorBench v3.2 erreicht Grok 4.6 69,9 %, vor GPT-5.6 Sol (67,2 %) und Grok 4,5 (66,7 %). Es erreicht 65,9 % bei DeepSWE v1.1 und 61,3 % bei FrontierCode v1.1 Extended.
Bemerkenswerte Wendeeffizienz
Eines der herausragenden Ergebnisse der künstlichen Analyse ist das Leistungsprofil von Grok 4.6 auf AA-Briefcase, einem privaten Benchmark für Aufgaben der Agentendatenarbeit mit langem Horizont. Das Modell debütiert mit einem Elo von 1577 und liegt damit auf der Fable 5-Stufe.
Die Effizienzzahlen sind frappierend. Grok 4.6 löst Aufgaben in etwa 53 Runden und durchschnittlich 0,5 Milliarden Eingabetokens, verglichen mit etwa 103 Runden und 2,0 Milliarden Eingabetokens für Claude Opus 5 max. Da sich bei der Agentenarbeit mit langem Horizont der Kontext schnell ansammelt, hat ein Modell, das in der Hälfte der Runden und einem Viertel der Eingabe-Tokens eine vergleichbare Antwort erreicht, einen Kostenvorteil, der weit über die Preisgestaltung pro Token hinausgeht.
Schulung und Sicherheit
Grok 4.6 durchlief einen längeren zusätzlichen Trainingslauf als Grok 4.5, mit kuratierten, modellgenerierten Daten für Überlegungen und fortgeschrittene technische Konzepte, hochwertigen technischen Daten und einem verbesserten Optimierer und Trainingsrezept. xAI nutzte Grok 4.5, um SFT-Trajektorien über Argumentationsbemühungen, Agentensysteme und Domänen wie MINT, Softwareentwicklung und Wissensarbeit hinweg neu zu generieren.
Das Modell verfügt über ein Kontextfenster mit 500.000 Token, unverändert gegenüber Grok 4.5. xAI berichtet, dass Grok 4.6 die bislang umfangreichste Suite an Tests vor der Bereitstellung für Funktionen und Sicherheitskalibrierung sowie umfangreiche Tests nach der Bereitstellung und Tests durch Dritte durchlaufen hat.
Verfügbarkeit und Preise
Grok 4.6 ist ab sofort in Cursor und Grok Build verfügbar. xAI bietet in der ersten Woche eine doppelte Inklusivnutzung auf beiden Plattformen an. Die Preise beginnen bei 2 US-Dollar pro Million Input-Tokens und 6 US-Dollar pro Million Output-Tokens, wobei eine schnelle Variante zum doppelten Preis erhältlich ist. Cache-Treffer werden auf 0,50 $ pro Million Token reduziert.
Die Veröffentlichung von xAI setzt einen rasanten Rhythmus fort, wobei Grok 4.6 etwas mehr als einen Monat nach Grok 4.5 erscheint. Das Modell positioniert xAI als ernsthaften Konkurrenten im Grenzrennen, insbesondere für Entwickler, denen Agentenleistung und Kosteneffizienz Priorität einräumen.
Bleiben Sie der KI immer einen Schritt voraus
Für eine kontinuierliche Berichterstattung über die wichtigsten Entwicklungen der KI-Branche setzen Sie ein Lesezeichen auf AI Buzz Wire und verpassen Sie keine aktuelle Meldung.
Weitere KI-Neuigkeiten lesen