xAI wypuściło Grok 4.6, najnowszą wersję swojego pionierskiego modelu wielkojęzykowego, uzyskując 61 punktów w indeksie sztucznej inteligencji analitycznej, co równa się GPT-5.6 Sol OpenAI. Model został wprowadzony na rynek dzisiaj i jest natychmiast dostępny w Cursor i Grok Build, z dostępem do API i integracją partnerów za pośrednictwem OpenRouter, Vercel i Cloudflare.

Najnowsze wiadomości i analizy dotyczące sztucznej inteligencji można znaleźć na stronie AI Buzz Wire.

Wywiad graniczny za ułamek kosztów

Według sztucznej analizy, niezależnej platformy testowej, Grok 4.6 zyskuje pięć punktów w stosunku do swojego poprzednika Grok 4.5 w indeksie inteligencji, dzięki czemu xAI z powrotem na czołowy poziom wraz z OpenAI. Modelka plasuje się tuż za Claude Opus 5 (63) i Claude Fable 5 (62) firmy Anthropic, a przed Kimi K3.

To, co sprawia, że ​​Grok 4.6 jest szczególnie godny uwagi, to jego cena. Podstawowe ceny pozostają niezmienione w porównaniu z Grok 4.5 i wynoszą 2 USD za milion tokenów wejściowych i 6 USD za milion tokenów wyjściowych. To stawia go o ponad 60% poniżej Claude Opus 5 (5/25 USD) i GPT-5.6 Sol (5/30 USD). Zmierzony koszt zadania wynosi 0,84 USD, co plasuje go na granicy inteligencji i kosztu w Pareto.

Utrzymywanie stałych cen przez całe pokolenie jest rzadkością na pograniczu, gdzie zyskom wywiadowczym zazwyczaj towarzyszy wzrost cen. Grok 4.6 zapewnia pięciopunktowy wzrost indeksu inteligencji przy niezmienionej cenie.

Stworzony dla agentów działających długo

Grok 4.6 opiera się na Grok 4.5, co xAI opisuje jako szczególny nacisk na długotrwałych agentów i bardziej ambitną pracę interaktywną i wizualną. Firma twierdzi, że model ten uwzględnia złożone zadania na wielu etapach, niezależnie od tego, czy bada dany temat, analizuje informacje, pracuje z bazą kodu, czy też przekształca się pomysł w dopracowaną aplikację.

Testy porównawcze agentów opowiadają fascynującą historię. Na PKBval-AA v2, wiodącym mierniku pracy z wiedzą agentyczną w świecie rzeczywistym, Grok 4.6 osiąga Elo na poziomie 1753, ustępując jedynie Claude Opus 5 i statystycznie na równi z Claude Fable 5 i Qwen3.8 Max. W teście bankowości tau-cubed w zakresie wieloobrotowej obsługi klienta uzyskał 50,7%, co plasowało go w pierwszej dwójce obok Qwen3.8 Max.

W CursorBench v3.2 Grok 4.6 uzyskał 69,9%, wyprzedzając zarówno GPT-5.6 Sol (67,2%), jak i Grok 4.5 (66,7%). Odnotowuje 65,9% na DeepSWE v1.1 i 61,3% na FrontierCode v1.1 Extended.

Niezwykła wydajność skrętu

Jednym z wyróżniających się wniosków z Artificial Analysis jest profil wydajności Grok 4.6 w AA-Briefcase, prywatnym benchmarku długoterminowych zadań związanych z pracą agentyczną. Model debiutuje z Elo na poziomie 1577, plasując go na poziomie Fable 5.

Liczby wydajności są uderzające. Grok 4.6 rozwiązuje zadania w około 53 turach i średnio 0,5 miliarda żetonów wejściowych, w porównaniu do około 103 tur i 2,0 miliardów żetonów wejściowych w przypadku Claude Opus 5 max. Ponieważ długoterminowa praca agenta szybko gromadzi kontekst, model, który osiąga porównywalną odpowiedź w połowie tur i jednej czwartej tokenów wejściowych, ma przewagę kosztową znacznie wykraczającą poza cenę za token.

Szkolenia i bezpieczeństwo

Grok 4.6 przeszedł dłuższe szkolenie uzupełniające niż Grok 4.5, z wyselekcjonowanymi danymi wygenerowanymi przez model na potrzeby wnioskowania i zaawansowanych koncepcji technicznych, wysokiej jakości danymi inżynieryjnymi oraz ulepszonym optymalizatorem i przepisem szkoleniowym. xAI wykorzystało Grok 4.5 do zregenerowania trajektorii SFT w ramach wysiłków wnioskowania, wiązek agentów i dziedzin, w tym STEM, inżynierii oprogramowania i pracy opartej na wiedzy.

Model zawiera okno kontekstowe zawierające 500 000 tokenów, niezmienione w stosunku do Groka 4.5. xAI informuje, że Grok 4.6 przeszedł najszerszy w historii pakiet testów przed wdrożeniem pod kątem możliwości i kalibracji zabezpieczeń, a także szeroko zakrojone testy po wdrożeniu i testy przeprowadzane przez strony trzecie.

Dostępność i ceny

Grok 4.6 jest już dostępny w Cursor i Grok Build. xAI oferuje podwójne wykorzystanie na obu platformach przez pierwszy tydzień. Ceny zaczynają się od 2 USD za milion tokenów wejściowych i 6 USD za milion tokenów wyjściowych, przy czym szybki wariant jest dostępny za dwukrotnie wyższą cenę. Trafienia w pamięci podręcznej są dyskontowane do 0,50 USD za milion tokenów.

Wydanie xAI nabiera szybkiego tempa, a Grok 4.6 pojawia się nieco ponad miesiąc po Groku 4.5. Model ten pozycjonuje xAI jako poważnego konkurenta w wyścigu pionierskim, szczególnie dla programistów, dla których priorytetem jest wydajność agenta i efektywność kosztowa.

Wyprzedź sztuczną inteligencję

Aby na bieżąco informować o najważniejszych wydarzeniach w branży sztucznej inteligencji, dodaj zakładkę AI Buzz Wire i nigdy nie przegapisz przełomowej historii.

Przeczytaj więcej aktualności na temat sztucznej inteligencji