Компания xAI выпустила Grok 4.6, последнюю версию своей передовой модели большого языка, получившую 61 балл в индексе искусственного интеллекта, что соответствует уровню OpenAI GPT-5.6 Sol. Модель запущена сегодня и сразу же доступна в Cursor и Grok Build с доступом к API и интеграцией с партнерами через OpenRouter, Vercel и Cloudflare.

Чтобы узнать последние новости и анализ искусственного интеллекта, посетите AI Buzz Wire.

Пограничная разведка за небольшую плату

По данным независимой платформы сравнительного анализа Artificial Analysis, Grok 4.6 набирает пять баллов по сравнению со своим предшественником Grok 4.5 в индексе интеллекта, возвращая xAI на передовой уровень наряду с OpenAI. Модель находится сразу за Claude Opus 5 (63) и Claude Fable 5 (62) от Anthropic и опережает Kimi K3.

Что делает Grok 4.6 особенно примечательным, так это его цена. Основная цена остается неизменной по сравнению с Grok 4.5: 2 доллара за миллион входных токенов и 6 долларов за миллион выходных токенов. Это ставит его более чем на 60% ниже Claude Opus 5 (5 долларов США/25 долларов США) и GPT-5.6 Sol (5 долларов США/30 долларов США). Измеренная стоимость одной задачи составляет 0,84 доллара США, что помещает ее на границу интеллекта и стоимости по Парето.

Сохранение фиксированных цен на протяжении поколения является необычным для передовых стран, где рост разведки обычно сопровождается ростом цен. Grok 4.6 обеспечивает прирост индекса интеллекта на пять пунктов при неизменной цене.

Создано для долго работающих агентов

Grok 4.6 основан на Grok 4.5 с тем, что xAI описывает как особый акцент на долгоработающих агентах и более амбициозную интерактивную и визуальную работу. Компания заявляет, что модель позволяет решать сложные задачи на многих этапах, будь то исследование темы, анализ информации, работа с кодовой базой или превращение идеи в законченное приложение.

Агентские тесты рассказывают убедительную историю. На GDPval-AA v2, ведущем показателе реальной работы агентов в области знаний, Grok 4.6 достигает Elo 1753, уступая только Claude Opus 5 и статистически на одном уровне с Claude Fable 5 и Qwen3.8 Max. Он набирает 50,7% по банковскому тесту многооборотного обслуживания клиентов, что ставит его в два лучших места рядом с Qwen3.8 Max.

В CursorBench v3.2 Grok 4.6 набирает 69,9%, опережая GPT-5.6 Sol (67,2%) и Grok 4,5 (66,7%). Он занимает 65,9% на DeepSWE v1.1 и 61,3% на FrontierCode v1.1 Extended.

Замечательная эффективность поворота

Одним из выдающихся результатов искусственного анализа является профиль эффективности Grok 4.6 в AA-Briefcase, частном эталоне долгосрочных задач работы с агентскими знаниями. Модель дебютирует с Эло 1577, что ставит ее на уровень Fable 5.

Показатели эффективности поражают. Grok 4.6 решает задачи в среднем примерно за 53 хода и 0,5 миллиарда входных жетонов по сравнению с примерно 103 ходами и 2,0 миллиарда входных жетонов для Claude Opus 5 max. Поскольку долгосрочная агентская работа быстро накапливает контекст, модель, которая дает сопоставимый ответ за половину оборотов и четверть входных токенов, имеет ценовое преимущество, значительно превышающее ее цену за токен.

Обучение и безопасность

Grok 4.6 прошел более продолжительное дополнительное обучение, чем Grok 4.5, с тщательно подобранными данными, сгенерированными моделями, для рассуждений и передовых технических концепций, высококачественными инженерными данными, а также улучшенным оптимизатором и рецептом обучения. xAI использовал Grok 4.5 для восстановления траекторий SFT в рамках рассуждений, средств агентирования и таких областей, как STEM, разработка программного обеспечения и интеллектуальная работа.

Модель содержит контекстное окно на 500 000 токенов, не изменившееся по сравнению с Grok 4.5. xAI сообщает, что Grok 4.6 прошел самый широкий в истории набор тестов перед развертыванием на предмет возможностей и калибровки безопасности, а также обширное тестирование после развертывания и стороннее тестирование.

Наличие и цены

Grok 4.6 доступен сегодня в Cursor и Grok Build. xAI предлагает двойное использование на обеих платформах в течение первой недели. Цены начинаются с 2 долларов США за миллион входных токенов и 6 долларов США за миллион выходных токенов, причем быстрый вариант доступен в два раза дороже. Попадания в кэш предоставляются со скидкой до 0,50 доллара США за миллион токенов.

Выпуск продолжает стремительный темп развития xAI: Grok 4.6 вышел чуть более чем через месяц после Grok 4.5. Модель позиционирует xAI как серьезного соперника в передовой гонке, особенно для разработчиков, отдающих приоритет производительности агентов и экономической эффективности.

Будьте впереди ИИ

Чтобы постоянно освещать самые важные события в отрасли искусственного интеллекта, добавьте в закладки AI Buzz Wire и никогда не пропустите самые важные новости.

Читать больше новостей об искусственном интеллекте