xAI выпустила Grok 4.7, самую эффективную на сегодняшний день модель компании для кодирования и информационной работы, после нескольких недель публичных насмешек и как минимум одной задержки. Объявленная на сайте компании в воскресенье, модель имеет ту же цену и скорость обслуживания, что и ее предшественник Grok 4.6: 2 доллара за миллион входных токенов и 6 долларов за миллион выходных токенов, что примерно вдвое ниже прейскурантной цены OpenAI GPT-5.6 Sol Max (4 доллара США/20 долларов США) и значительно ниже Fable 5.1 Max от Anthropic (10 долларов США/50 долларов США).
Чтобы узнать последние новости и анализ искусственного интеллекта, посетите AI Buzz Wire.
Более крупная базовая модель, подготовленная для выполнения длительных задач
Согласно объявлению xAI, Grok 4.7 использует новую, более крупную базовую модель по сравнению с Grok 4.6 и прошел обучение с помощью более длительного обучения с подкреплением на более сложном наборе задач, ориентированном на проблемы, выполнение которых занимает много часов. Компания заявляет, что модель лучше проверяет свою собственную работу и управляет более длинным контекстом, и что она была обучена изначально понимать возможности Grok Bot, улучшая диалоговые задачи и общую информационную работу.
Релиз последовал за шумным разгоном. По данным TeslaNorth.com, Илон Маск впервые заявил в начале сентября, что Grok 4.7 приземлится в течение десяти дней, а затем в середине сентября признал, что модель нуждается в еще нескольких днях доработки. Он уже в продаже, и в тот же день GitHub подтвердил, что Grok 4.7 доступен в GitHub Copilot.
Эталонное изображение: сильное, но не резкое
Данные тестов, опубликованные xAI, показывают модель, которая лидирует в нескольких долгосрочных категориях, но уступает самой дорогой конфигурации Anthropic в других:
- CursorBench 4.0, в котором упор делается на длительные задачи кодирования: Grok 4.7 набирает 46,3%, опережая GPT-5.6 Sol Max (41,7%) и Grok 4.6 High (40,4%), но уступая Fable 5.1 Max (51,8%).
- Terminal-Bench 4.0, многочасовая работа терминала: 38,0%, что резко выше 20,3% для Grok 4.6 и чуть выше GPT-5.6 Sol Max (37,3%), хотя Fable 5.1 Max лидирует с 57,9%.
- EEBench, электротехнический тест: 64,0%, большой скачок по сравнению с 53,0% у Grok 4.6 и самым высоким показателем среди перечисленных моделей.
- AA Briefcase v1.1, многочасовая работа в офисе: 1657 по сравнению с 1546 и почти уступает Fable 5.1 Max с 1678.
- Harvey Legal Agent Benchmark: 19,6%, опережая Grok 4,6 (15,8%) и значительно опережая GPT-5.6 Sol Max (2,5%) и Fable 5.1 Max (6,7%) по этому показателю.
- HealthBench Professional: 56,7%, что лучше, чем у Grok 4.6 с 48,5%, но уступает GPT-5.6 Sol Max (60,5%) и Fable 5.1 Max (62,1%).
По GDPval, эталону профессионального интеллектуального труда, оцениваемому Elo, диаграмма xAI показывает, что Grok 4,7 находится на уровне xhigh с показателем 1695 — по сравнению с 1605 для Grok 4,6, отставая от Fable 5.1 Max (1735) и опережая GPT-6 Astra Max (1542).
Цена – это история
Самое агрессивное заявление в объявлении носит экономический, а не технический характер: xAI описывает Grok 4.7 как вдвое более быстрый и вдвое дешевле сопоставимых моделей, а опубликованная таблица цен подтверждает сравнение заголовка с конфигурациями высшего уровня двух его главных конкурентов. Цена токена Grok 4.7 в размере 2/6 долларов США не изменилась по сравнению с Grok 4.6, а это означает, что покупатели получают улучшение от поколения к поколению без повышения цены.
Такое позиционирование расширяет стратегию, которую xAI придерживается в отношении линейки Grok 4.x: соответствовать или приближаться к передовому качеству, одновременно снижая премиальные ценовые уровни OpenAI и Anthropic, а затем активно распространять через партнеров, включая GitHub, Cursor и OpenRouter.
Что посмотреть
Честное предостережение заключается в том, что xAI сама опубликовала сравнительную диаграмму, и независимая проверка агрегаторами сравнительного анализа займет несколько дней. Что касается цифр, которые xAI решил выделить, Grok 4.7 является настоящим шагом вперед по сравнению с Grok 4.6 (наиболее заметно на Terminal-Bench 4.0 и EEBench), но он не превосходит Fable 5.1 Max, который сохраняет лидерство по тестам кодирования и работоспособности, но стоит в пять раз дороже за выходной токен.
Для разработчиков, выполняющих длительные, многочасовые агентские рабочие нагрузки, соотношение цены и производительности может иметь большее значение, чем простое положение в таблице лидеров. Grok 4.7 теперь доступен через API xAI и в GitHub Copilot.
Будьте впереди ИИ
Чтобы постоянно освещать самые важные события в индустрии искусственного интеллекта, добавьте в закладки AI Buzz Wire и никогда не пропустите самые важные новости.
Читать больше новостей об искусственном интеллекте