xAI vydala Grok 4.7, nejschopnější model společnosti pro kódování a znalostní práci k dnešnímu dni, po týdnech veřejného škádlení a alespoň jednom zpoždění. Model, který byl v neděli oznámen na webu společnosti, má stejnou cenu a rychlost podávání jako jeho předchůdce Grok 4.6: 2 $ za milion vstupních tokenů a 6 $ za milion výstupních tokenů, což je zhruba polovina katalogové ceny OpenAI GPT-5.6 Sol Max (4 $ / 20 $) a hluboko pod Anthropic's Fable 5.1 / 50 $ Max (10 $).
Nejnovější zprávy a analýzy o AI najdete na [AI Buzz Wire] (https://aibuzzwire.news).
Větší základní model, vyškolený pro dlouhé úkoly
Podle oznámení xAI používá Grok 4.7 nový, větší základní model ve srovnání s Grok 4.6 a byl trénován delším tréninkovým během na těžší kombinaci úkolů, vážených k problémům, jejichž dokončení trvá mnoho hodin. Společnost tvrdí, že tento model je lepší v ověřování vlastní práce a zvládání delšího kontextu a že byl trénován tak, aby nativně porozuměl postroji Grok Bot, zlepšil konverzační úkoly a práci se všeobecnými znalostmi.
Uvolnění následuje po hlučném rozběhu. Elon Musk nejprve začátkem září řekl, že Grok 4.7 přistane do deseti dnů, poté v polovině září uznal, že model potřebuje ještě pár dní zdokonalování, uvádí TeslaNorth.com. Nyní se dodává a GitHub ve stejný den potvrdil, že Grok 4.7 je k dispozici v GitHub Copilot.
Srovnávací obraz: Silný, není rozmáchlý
Srovnávací data publikovaná xAI ukazují model, který vede v několika kategoriích s dlouhým horizontem, zatímco v ostatních zůstává za nejdražší konfigurací Anthropic:
- CursorBench 4.0, který klade důraz na déle trvající úlohy kódování: Grok 4.7 má skóre 46,3 %, před GPT-5.6 Sol Max (41,7 %) a Grok 4.6 High (40,4 %), ale za Fable 5.1 Max (51,8 %).
- Terminal-Bench 4.0, vícehodinová práce na terminálu: 38,0 %, prudký nárůst z 20,3 % u Grok 4.6 a těsně před GPT-5.6 Sol Max (37,3 %), ačkoli Fable 5.1 Max vede s 57,9 %.
- EEBench, elektrotechnický benchmark: 64,0 %, velký skok oproti Grok 4.6 53,0 % a nejvyšší z uvedených modelů.
- DeepSWE v1.1: 71,0 % při vysokém úsilí oproti 65,2 % u Grok 4.6 a 72,7 % u GPT-5.6 Sol Max.
- AA Briefcase v1.1, vícehodinová kancelářská práce: 1 657, oproti 1 546 a těsně za Fable 5.1 Max na 1 678.
- Benchmark Harvey Legal Agent: 19,6 %, před Grokem 4,6 (15,8 %) a daleko před GPT-5,6 Sol Max (2,5 %) a Fable 5,1 Max (6,7 %) v tomto měřítku.
- HealthBench Professional: 56,7 %, zlepšení oproti Grok 4.6 o 48,5 %, ale zaostává za GPT-5.6 Sol Max (60,5 %) a Fable 5.1 Max (62,1 %).
Na GDPval, profesionálním benchmarku znalostí a práce, který skóroval Elo, graf xAI staví Grok 4.7 na xhigh uvažování na 1 695 — což je nárůst z 1 605 pro Grok 4.6, za Fable 5.1 Max (1 735) a před GPT-6 Astra Max (1 542).
Cena je příběh
Nejagresivnější tvrzení v oznámení je spíše ekonomické než technické: xAI popisuje Grok 4.7 jako dvakrát rychlejší za poloviční cenu srovnatelných modelů a zveřejněná cenová tabulka podporuje srovnání titulků s nejvyššími konfiguracemi jeho dvou hlavních rivalů. Cena tokenu Grok 4.7 $ 2/$ 6 se oproti Groku 4.6 nezměnila, což znamená, že kupující dostanou generační vylepšení bez zvýšení ceny.
Toto umístění rozšiřuje strategii, kterou xAI sledovala napříč linií Grok 4.x: vyrovnat se nebo se přiblížit hraniční kvalitě a zároveň podtrhnout prémiové cenové úrovně OpenAI a Anthropic a poté agresivně distribuovat prostřednictvím partnerů včetně GitHub, Cursor a OpenRouter.
Na co se dívat
Upřímnou výhradou je, že xAI zveřejnilo srovnávací tabulku samo a nezávislé ověření od srovnávacích agregátorů bude trvat dny. Pokud jde o čísla, která se xAI rozhodla zdůraznit, Grok 4.7 je skutečným krokem vpřed oproti Grok 4.6 – nejviditelněji na Terminal-Bench 4.0 a EEBench – ale nepřekonal Fable 5.1 Max, který si zachovává vedoucí postavení v kódování a srovnávacích testech zdraví a přitom stojí pětkrát více na výstupní token.
Pro vývojáře, kteří pracují s dlouhými, vícehodinovými agentními pracovními zátěžemi, může být matematický výpočet ceny a výkonu důležitější než surové umístění v žebříčku. Grok 4.7 je nyní k dispozici prostřednictvím xAI API a v GitHub Copilot.
Udržujte si náskok před umělou inteligencí
Pro nepřetržité zpravodajství o nejdůležitějším vývoji v odvětví AI si uložte AI Buzz Wire do záložek a nikdy vám neunikne žádný převratný příběh.
Přečtěte si další zprávy o AI