xAI vydala Grok 4.6, nejnovější iteraci svého hraničního velkého jazykového modelu, se skóre 61 v indexu umělé analýzy inteligence, což odpovídá OpenAI GPT-5.6 Sol. Model byl spuštěn dnes a je okamžitě dostupný v Cursor a Grok Build s přístupem k API a integrací partnerů prostřednictvím OpenRouter, Vercel a Cloudflare.

Nejnovější zprávy a analýzy o AI najdete na [AI Buzz Wire] (https://aibuzzwire.news).

Hraniční zpravodajství za zlomek nákladů

Podle Artificial Analysis, nezávislé srovnávací platformy, získává Grok 4.6 oproti svému předchůdci Grok 4.5 v indexu inteligence pět bodů, čímž se xAI vrací zpět na hraniční úroveň vedle OpenAI. Model je těsně za Claude Opus 5 (63) a Claude Fable 5 (62) od Anthropic a před Kimi K3.

Co dělá Grok 4.6 obzvláště pozoruhodným, je jeho cena. Hlavní ceny zůstávají oproti Grok 4.5 nezměněny na 2 $ za milion vstupních tokenů a 6 $ za milion výstupních tokenů. To jej staví o více než 60 % pod Claude Opus 5 (5 USD/25 USD) a GPT-5.6 Sol (5 USD/30 USD). Naměřená cena za úkol je 0,84 USD, což ji řadí na hranici Inteligence versus Cost Pareto.

Držení cen na stejné úrovni po celou generaci je neobvyklé na hranici, kde jsou zpravodajské zisky obvykle doprovázeny zvýšením cen. Grok 4.6 přináší pětibodový zisk Intelligence Index při nezměněné ceně.

Vytvořeno pro dlouhotrvající agenty

Grok 4.6 navazuje na Grok 4.5 s tím, co xAI popisuje jako zvláštní zaměření na dlouhotrvající agenty a ambicióznější interaktivní a vizuální práci. Společnost říká, že model zůstává u složitých úkolů v mnoha krocích, ať už jde o výzkum tématu, analýzu informací, práci napříč kódovou základnou nebo přeměnu nápadu na dokonalou aplikaci.

Agentní benchmarky vyprávějí přesvědčivý příběh. Na GDPval-AA v2, přední měřítko práce agentů v reálném světě, Grok 4.6 dosahuje Elo 1753, pouze za Claude Opus 5 a statisticky na stejné úrovni jako Claude Fable 5 a Qwen3.8 Max. Dosahuje 50,7 % v benchmarku bankovnictví tau-cubed pro vícekolový zákaznický servis, čímž se řadí na první dva vedle Qwen3.8 Max.

Na CursorBench v3.2 má Grok 4.6 skóre 69,9 %, před GPT-5.6 Sol (67,2 %) a Grok 4.5 (66,7 %). Vykazuje 65,9 % na DeepSWE v1.1 a 61,3 % na FrontierCode v1.1 Extended.

Pozoruhodná účinnost otáčení

Jedním z mimořádných zjištění z Artificial Analysis je profil účinnosti Grok 4.6 na AA-Briefcase, soukromém benchmarku pracovních úkolů s agentskými znalostmi s dlouhým horizontem. Model debutuje s Elo 1577, čímž se umisťuje na úroveň Fable 5.

Čísla účinnosti jsou zarážející. Grok 4.6 řeší úkoly v průměru za přibližně 53 kol a 0,5 miliardy vstupních tokenů, ve srovnání se zhruba 103 otáčkami a 2,0 miliardami vstupních tokenů pro Claude Opus 5 max. Vzhledem k tomu, že agentní práce s dlouhým horizontem rychle akumuluje kontext, má model, který dosáhne srovnatelné odpovědi za polovinu tahů a čtvrtinu vstupních tokenů, nákladovou výhodu daleko přesahující cenu za token.

Školení a bezpečnost

Grok 4.6 prošel delším doplňkovým školením než Grok 4.5, s upravenými modelově generovanými daty pro uvažování a pokročilými technickými koncepty, vysoce kvalitními technickými daty a vylepšeným optimalizátorem a tréninkovým receptem. xAI použil Grok 4.5 k regeneraci trajektorií SFT napříč úsilím o uvažování, svazky agentů a doménami včetně STEM, softwarového inženýrství a práce se znalostmi.

Model nese kontextové okno s 500 000 tokeny, nezměněné oproti Groku 4.5. xAI uvádí, že Grok 4.6 prošel dosud nejširší sadou testů před nasazením pro schopnosti a kalibraci zabezpečení spolu s rozsáhlým testováním po nasazení a testováním třetích stran.

Dostupnost a cena

Grok 4.6 je dnes k dispozici v Cursor a Grok Build. xAI nabízí během prvního týdne dvojnásobné využití v obou platformách. Ceny začínají na 2 USD za milion vstupních tokenů a 6 USD za milion výstupních tokenů, přičemž rychlá varianta je k dispozici za dvojnásobnou cenu. Přístupy do mezipaměti jsou sníženy na 0,50 $ za milion tokenů.

Vydání pokračuje v rychlé kadenci pro xAI, přičemž Grok 4.6 přichází jen něco málo přes měsíc po Groku 4.5. Model staví xAI jako vážného soupeře v hraničním závodě, zejména pro vývojáře, kteří upřednostňují výkon agentů a efektivitu nákladů.

Udržujte si náskok před AI

Pro nepřetržité zpravodajství o nejdůležitějším vývoji v oboru AI si uložte AI Buzz Wire do záložek a nikdy vám neunikne žádný převratný příběh.

Přečtěte si další zprávy o AI