xAI випустив Grok 4.6, останню ітерацію своєї передової великої мовної моделі, набравши 61 бал за індексом штучного аналізу інтелекту, щоб відповідати OpenAI GPT-5.6 Sol. Модель запущено сьогодні та доступна негайно у Cursor і Grok Build, з доступом до API та партнерською інтеграцією через OpenRouter, Vercel і Cloudflare.

Щоб переглянути останні новини та аналіз ШІ, відвідайте AI Buzz Wire.

Frontier Intelligence за незначну вартість

За даними незалежної платформи порівняльного аналізу Artificial Analysis, Grok 4.6 набирає п’ять балів у порівнянні зі своїм попередником Grok 4.5 за індексом інтелекту, повертаючи xAI на передовий рівень разом із OpenAI. Модель стоїть відразу за Claude Opus 5 (63) і Claude Fable 5 (62) від Anthropic і попереду Kimi K3.

Що робить Grok 4.6 особливо помітним, так це його ціна. Основна ціна залишається незмінною порівняно з Grok 4.5 і становить 2 долари США за мільйон вхідних токенів і 6 доларів США за мільйон вихідних токенів. Це на 60% нижче Claude Opus 5 ($5/$25) і GPT-5.6 Sol ($5/$30). Виміряна вартість виконання завдання становить 0,84 дол. США, що поміщає його на межу інтелекту та вартості за Парето.

Зберігати ціноутворення на одному рівні протягом покоління – це незвично на кордоні, де підвищення інтелекту зазвичай супроводжується зростанням цін. Grok 4.6 забезпечує приріст індексу інтелекту на п’ять балів за незмінної ціни.

Створено для довготривалих агентів

Grok 4.6 базується на Grok 4.5 з тим, що xAI описує як особливий фокус на довгострокових агентах і більш амбітній інтерактивній та візуальній роботі. У компанії стверджують, що модель виконує складні завдання на багатьох етапах, будь то дослідження теми, аналіз інформації, робота з кодовою базою або перетворення ідеї на відточену програму.

Тести агентів розповідають переконливу історію. На GDPval-AA v2, провідному показнику реальної агентської роботи зі знаннями, Grok 4.6 досягає Elo 1753, поступаючись лише Claude Opus 5 і статистично нарівні з Claude Fable 5 і Qwen3.8 Max. Він набирає 50,7% за еталонним тестом tau-cubed Banking для багаточергового обслуговування клієнтів, що поміщає його в два лідери разом із Qwen3.8 Max.

У CursorBench v3.2 Grok 4.6 набирає 69,9%, випереджаючи GPT-5.6 Sol (67,2%) і Grok 4.5 (66,7%). Він публікує 65,9% на DeepSWE v1.1 і 61,3% на FrontierCode v1.1 Extended.

Чудова ефективність повороту

Одним із видатних висновків Artificial Analysis є профіль ефективності Grok 4.6 на AA-Briefcase, приватному еталонному тесті довгострокових завдань роботи з агентськими знаннями. Модель дебютує з Elo 1577, що поміщає її на рівень Fable 5.

Показники ефективності вражають. Grok 4.6 вирішує завдання приблизно за 53 ходу та 0,5 мільярда вхідних жетонів у середньому, порівняно з приблизно 103 ходами та 2,0 мільярдами вхідних жетонів для Claude Opus 5 max. Оскільки довгострокова агентська робота швидко накопичує контекст, модель, яка досягає порівнянної відповіді за половину ходів і чверть вхідних токенів, має економічну перевагу, що значно перевищує ціну за токен.

Навчання та безпека

Grok 4.6 пройшов довшу додаткову підготовку, ніж Grok 4.5, із підібраними даними, згенерованими моделями, для міркувань і передових технічних концепцій, високоякісними інженерними даними, а також покращеним оптимізатором і рецептом навчання. xAI використовував Grok 4.5 для регенерації траєкторій SFT у міркуваннях, джгутах агентів і областях, включаючи STEM, розробку програмного забезпечення та роботу з знаннями.

Модель містить контекстне вікно з 500 000 токенів, незмінне порівняно з Grok 4.5. xAI повідомляє, що Grok 4.6 пройшов найширший за всю історію набір тестів перед розгортанням щодо можливостей і калібрування захисних засобів, а також обширне тестування після розгортання та тестування сторонніми розробниками.

Наявність і ціна

Grok 4.6 доступний сьогодні в Cursor і Grok Build. xAI пропонує подвійне включене використання на обох платформах протягом першого тижня. Ціна починається від 2 доларів США за мільйон вхідних токенів і 6 доларів США за мільйон вихідних токенів, а швидкий варіант доступний за ціною вдвічі дорожчою. Звернення до кешу знижуються до 0,50 доларів США за мільйон токенів.

Випуск продовжує швидкий темп для xAI, Grok 4.6 з’являється трохи більше ніж через місяць після Grok 4.5. Модель позиціонує xAI як серйозного суперника в передовій гонці, особливо для розробників, які надають перевагу агентській продуктивності та економічній ефективності.

Будьте попереду ШІ

Щоб постійно висвітлювати найважливіші події індустрії штучного інтелекту, додайте закладку AI Buzz Wire і ніколи не пропускайте важливу історію.

Читати більше новин AI