OpenAI снизила цены API на две из трех своих моделей GPT-5.6 30 июля 2026 года, снизив самый дешевый уровень на 80% всего через три недели после того, как семейство стало общедоступным. Этот шаг свидетельствует о том, насколько агрессивно ведущий производитель моделей конкурирует за большие объемы и чувствительные к затратам рабочие нагрузки — и насколько внимательно его клиенты теперь подсчитывают каждый токен. Чтобы узнать больше о более широких изменениях в экономике ИИ, следите за нашими [последними разработками в области ИИ] (https://aibuzzwire.news).

Что изменилось

Согласно опубликованному OpenAI прейскуранту и журналу изменений API, стандартные цены за миллион токенов теперь выглядят следующим образом:

  • GPT-5.6 Luna: вход 20 центов и выход 1,20 доллара по сравнению с 1 и 6 долларами — снижение на 80 %.
  • GPT-5.6 Terra: 2 и 12 долларов США по сравнению с 2,50 и 15 долларов США — скидка 20 %.
  • GPT-5.6 Sol (флагман): 5 и 30 долларов США, без изменений.

Все три уровня стали общедоступными 9 июля 2026 года по более высоким ценам, в результате чего переоценка цен произойдет всего через 21 день после начала коммерческой жизни семейства. Reuters и CNBC подтвердили сокращение, а Axios сообщила, что самое резкое сокращение пришлось на модель Luna.

Сокращает поток на каждом уровне обслуживания

Снижения не ограничиваются общими ценами. Они проходят через все опции прейскуранта:

  • Пакетная и гибкая обработка, стоимость которых составляет половину стандартной цены, обеспечивает Luna входную плату 10 центов и выходную 60 центов за миллион токенов.
  • Чтение кэшированных входных данных, скидка 90%, снижение до двух центов за миллион токенов на Луне и 20 центов на Терре.
  • Запросы с длинным контекстом, оплачиваемые по удвоенной ставке за ввод и в 1,5 раза за вывод, получают 40 центов и 1,80 доллара США для Luna.

Для команд, которые уже маршрутизируют массовую классификацию, извлечение или длинные циклы агентов через более дешевые уровни, те же вызовы теперь стоят лишь часть того, что они делали днем ​​ранее.

Чем сокращения отличаются от Anthropic

Согласно странице с ценами Anthropic, при цене 20 центов и 1,20 доллара Luna теперь уступает самой дешевой опубликованной модели Anthropic, Haiku 4.5, примерно в пять раз по входу и в четыре раза по выходу. Новая ставка Terra находится ниже 3 и 15 долларов США, которые Claude Sonnet 5 планирует взимать после истечения первоначальной цены 31 августа 2026 года.

Находясь на вершине обеих линеек, Sol по-прежнему стоит дороже, чем Opus 5 от Anthropic, цена которого составляет 5 и 25 долларов.

Приоритетная обработка переходит в быстрый режим

В той же записи журнала изменений «Приоритетная обработка» удалена и заменена «Быстрым режимом». Что касается флагманской модели Sol, OpenAI заявляет, что быстрый режим работает в 2,5 раза быстрее стандартной скорости и вдвое дороже, а коммутатор обратно совместим — запросы уже помечены для приоритетного маршрута в быстрый режим без изменения кода.

Тарифы на быстрый режим составляют 10 и 60 долларов для Солнца, 4 и 24 доллара для Терры и 40 центов и 2,40 доллара для Луны. Примечательно, что Anthropic продает один и тот же продукт под одним и тем же названием и на одних и тех же условиях, и теперь две тарифные карты также сходятся в выводах, привязанных к региону: OpenAI взимает 10% надбавку за модели, выпущенные 5 марта 2026 года или после этой даты, когда клиенту требуется резидентность данных, в то время как Anthropic выставляет счет только за вывод в США в 1,1 раза больше стандартной ставки.

Почему более дешевые уровни стали дешевле

За день до сокращения OpenAI опубликовала инженерную статью, описывающую оптимизацию своего стека вывода. Пять технических сотрудников компании написали, что Sol, работая внутри своего инструмента кодирования Codex, переписал ядра графических процессоров — эта работа, по словам OpenAI, сократила затраты на сквозное обслуживание на 20%. Модель также переработала свою собственную черновую модель спекулятивного декодирования в сотнях экспериментов, и это изменение привело к повышению эффективности генерации токенов более чем на 15%.

Это собственные цифры OpenAI для ее собственного стека, но они указывают на тот же центр затрат, на который направлено снижение цен: на агентскую систему, лежащую в основе Codex и ChatGPT. OpenAI по умолчанию ограничивает вывод инструмента 10 000 токенов и сохраняет видимую для модели историю только для добавления, поэтому цикл агента, который повторно отправляет свои инструкции на каждом этапе, попадает в кеш подсказок вместо того, чтобы платить полную скорость ввода. Компания закрыла публикацию, пообещав передать «скрытые улучшения обратно нашим пользователям в форме более широко доступных и экономически эффективных аналитических данных». Прейскурант последовал через день.

Облачные партнеры и биллинг

OpenAI отметила, что AWS выставляет счета покупателям, маршрутизирующим трафик через Amazon Bedrock, и эти тарифы могут отличаться от опубликованных на его собственной карте. Поскольку все больше предприятий централизуют доступ к моделям через одного поставщика облачных услуг, разрыв между прямыми ценами OpenAI и тем, что клиенты фактически платят через посредников, будет иметь такое же значение, как и сами заголовки новостей.

Рынок, считающий каждый токен

Сокращения происходят, поскольку корпоративные покупатели проверяют свои расходы более тщательно, чем когда-либо. Ранее на этой неделе в отчетах было зафиксировано, как эра безудержного «токенмаксинга» — увеличения объемов без учета затрат — угасает, поскольку корпоративные счета за ИИ резко растут на основных платформах. Решение OpenAI передать свою внутреннюю экономию затрат клиентам, а не накапливать прибыль, является четким сигналом того, где, по ее мнению, сейчас ведется конкурентная битва: не на переднем крае, где Sol все еще устанавливает премиальные цены, а на дешевых, объемных уровнях, где фактически живет большая часть производственного трафика.

Поскольку цена Sol не изменилась, решение для разработчиков остается именно там, где OpenAI поставила его с момента выпуска семейства: какой уровень требуется для каждого запроса. Разница в том, что цена принятия неправильного решения только что резко снизилась.

---

Будьте впереди ИИ

Получайте последние новости, анализ и открытия в области искусственного интеллекта — все в одном месте.

Подробнее новости AI →