Cerebras и OpenAI представили миру ранний взгляд на Сверхбыстрый режим, новый уровень сервисов, который впервые запускается в API OpenAI и работает на оборудовании Cerebras. Согласно объявлению Cerebras, опубликованному 13 августа 2026 года, GPT-5.6 Sol, работающий на Ultrafast, обеспечивает до 750 токенов вывода в секунду — без ущерба для качества.
Изначально этот уровень доступен избранной группе клиентов, но со временем доступ будет расширяться. В объявлении, написанном Джойс Эр из Cerebras, это предложение позиционируется как решение компромисса, который на протяжении многих лет определял разработку продуктов искусственного интеллекта: разработчикам приходилось выбирать между скоростью и интеллектом, поскольку более крупные и умные модели несут более высокие затраты на вычисления и перемещение данных, что замедляет время отклика. Читатели, следящие за гонкой по ускорению передовых моделей, могут следить за последними разработками на [AI Buzz Wire] (https://aibuzzwire.news).
Насколько на самом деле сверхбыстро?
Необработанные цифры пропускной способности сами по себе впечатляют, но компания Cerebras также предоставила сравнительный контекст. Согласно данным независимой службы сравнительного анализа Artificial Analysis, GPT-5.6 Sol в сверхбыстром режиме работает:
- В 11 раз быстрее, чем Fable 5
- В 5 раз быстрее, чем Opus 4.8 в быстром режиме
Чтобы проверить это утверждение, Церебрас сравнил модель с популярными конкурентами на Последнем экзамене человечества (HLE), сложном тесте, состоящем из 2500 вопросов, на которые обычно могут ответить только люди, имеющие докторскую степень в таких областях, как химия, экономика и литература.
Результат: GPT-5.6 Sol на Ultrafast ответил на все 2500 вопросов HLE за 11 часов 11 минут. Для того чтобы прийти к тем же выводам, Claude Fable 5 потребовалось 78 часов и 27 минут — более трёх дней непрерывных вычислений. Другими словами, Ultrafast преодолел границы человеческих знаний за один рабочий день, достигнув сопоставимой точности почти в 7 раз быстрее.
Cerebras отметила свою методологию сравнительного анализа: GPT-5.6 Sol Ultrafast была протестирована с помощью Codex на уровне рассуждений xhigh 10 июля, а Claude Fable 5 была протестирована с помощью Claude Code на рассуждениях xhigh 13–15 июля.
Реальные рабочие нагрузки, а не только тесты
Показатели скорости могут вводить в заблуждение, если качество на этом пути ухудшается, поэтому компания Cerebras также выделила результаты по ВВП-Val, эталону для экономически ценных задач интеллектуального труда. Согласно тестам, проведенным Cerebras 31 июля 2026 года с использованием GPT-5.6 Sol и GPT-5.6 Sol Ultrafast, в рамках GDP-Val Ultrafast обеспечил сквозное ускорение без ухудшения качества в 5,6 раза.
Компания заявляет, что GPT-5.6 Sol — лучшая модель OpenAI для юридических документов, финансовых моделей и инженерных отчетов — областей, где качество продукции и время выполнения имеют прямые финансовые последствия.
Почему скорость меняет уравнение агента
Более существенный сдвиг может произойти в том, как работают агенты ИИ. Более быстрый вывод меняет возможности отдельных лиц и организаций, поскольку агентов можно поставить на критический путь решения проблем, где каждая секунда имеет значение.
«Благодаря GPT-5.6 Sol Ultrafast Cerebras позволяет использовать ИИ, который не отстает от того, как вы думаете, кодируете и взаимодействуете», — сказал Рохан Варма, продукт OpenAI, в заявлении, цитируемом в объявлении. «Мы рады видеть, как рабочие процессы и приложения преобразуются благодаря сверхбыстрому выводу».
Cerebras выделил несколько сценариев с высокими ставками, в которых ускорение имеет значение:
Реагирование на инцидент
Компании, эксплуатирующие веб-сервисы, могут использовать Ultrafast для выявления и устранения причин сбоев в производстве, сохраняя доверие клиентов, предотвращая потерю доходов и экономя минуты простоя в соответствии с соглашениями об уровне обслуживания.Кибербезопасность
В состязательных кибератаках с высокими ставками команды безопасности должны быстро обнаруживать злоумышленников и реагировать на них, чтобы сдержать катастрофические потери — задача, в которой задержка вывода напрямую влияет на контроль ущерба.Производительность агента
Ultrafast открывает новые режимы работы с агентами, предоставляя аналитику и обновления в режиме реального времени, уменьшая необходимость переключения контекста между параллельными сеансами.«Если раньше мне приходилось ждать пару минут, чтобы задача завершилась, то теперь она завершается для меня еще до того, как у меня появляется возможность переключить контекст. Это делает меня намного более продуктивным», — сказал в своем заявлении Джеффри Ванг, исследователь из OpenAI.
Стратегия партнерства
Для Cerebras эта сделка представляет собой еще одну веху в ее усилиях по коммерциализации ускорения в масштабе пластины для вывода ИИ. Для OpenAI сверхбыстрый режим добавляет премиальный уровень скорости к его API в тот момент, когда задержка вывода стала конкурентным отличием — особенно для агентных приложений, которые объединяют множество вызовов моделей, где задержки на каждый вызов составляют минуты ожидания.
Компании представляют этот уровень как постоянное преимущество для организаций, использующих передовой искусственный интеллект для быстрого реагирования на входящую информацию, сочетая сверхбыструю обработку для срочной работы со стандартной обработкой для стандартных задач, которые можно распараллеливать в фоновом режиме.
Доступ развертывается постепенно. Заинтересованные разработчики могут отслеживать доступность документации OpenAI API, поскольку Церебрас говорит, что со временем доступ будет расширяться за счет первоначально выбранной группы клиентов.
Будьте впереди ИИ
Чтобы получить больше информации о гонке за аппаратным обеспечением и инфраструктурой, меняющей искусственный интеллект, добавьте в закладки AI Buzz Wire и следите за нашей лентой новости об аппаратном обеспечении искусственного интеллекта.
Читать больше новостей об искусственном интеллекте →