OpenAI знизив ціни на API для двох із трьох своїх моделей GPT-5.6 30 липня 2026 року, скоротивши найдешевший рівень на 80% лише через три тижні після того, як сімейство досягло загальної доступності. Цей крок свідчить про те, наскільки агресивно провідний виробник моделей конкурує за великі обсяги, чутливі до витрат робочі навантаження — і наскільки ретельно його клієнти тепер підраховують кожен токен. Щоб дізнатися більше про ширші зміни в економіці ШІ, слідкуйте за нашими [останніми розробками ШІ] (https://aibuzzwire.news).

Що змінилося

Відповідно до опублікованого OpenAI прейскуранта та журналу змін API, стандартні ціни за мільйон токенів тепер виглядають так:

  • GPT-5.6 Luna: 20 центів на вході та 1,20 долара на виході, порівняно з 1 і 6 доларами — знижка на 80%
  • GPT-5.6 Terra: $2 і $12, порівняно з $2,50 і $15 — зниження на 20%
  • GPT-5.6 Sol (флагман): $5 і $30, без змін

Усі три рівні були запущені в загальну доступність 9 липня 2026 року за вищими ставками, що призвело до переоцінки лише через 21 день комерційного життя сім’ї. Reuters і CNBC підтвердили скорочення, а Axios повідомив, що найбільше скорочення припало на модель Luna.

Скорочення проходять через кожен рівень обслуговування

Знижки не обмежуються основними цінами. Вони проходять через кожен варіант тарифу:

  • Пакетна і гнучка обробка, ціна вдвічі нижча за стандартну, дає Luna 10 центів на вхід і 60 центів на вихід за мільйон токенів.
  • Кешовані зчитування вхідних даних зі знижкою 90%, падіння до двох центів за мільйон токенів на Luna та 20 центів на Terra.
  • Запити з довгим контекстом, які виставляються за подвійною вхідною ставкою та в 1,5 рази більшою за вихідні дані, коштують 40 центів і 1,80 доларів США для Luna.

Для команд, які вже маршрутизують масову класифікацію, вилучення або довгі петлі агентів через дешевші рівні, ті самі виклики тепер коштують лише частку того, що вони робили днем ​​раніше.

Як скорочення порівнюються з Anthropic

Відповідно до сторінки цін Anthropic, за 20 центів на вході та вартістю 1,20 долара Luna тепер нижча за найдешевшу опубліковану модель Anthropic, Haiku 4.5, приблизно в п’ять разів на вході та в чотири рази на виході. Нова ставка Terra нижча за 3 і 15 доларів США, які планується стягувати за Claude Sonnet 5 після закінчення початкової ціни 31 серпня 2026 року.

У верхній частині обох лінійок Sol все ще коштує дорожче, ніж Opus 5 від Anthropic, який коштує 5 і 25 доларів.

Пріоритетна обробка стає швидким режимом

Той самий запис у журналі змін скасував «Пріоритетну обробку» та замінив його на «Швидкий режим». OpenAI каже, що для флагманської моделі Sol швидкий режим працює в 2,5 рази швидше за стандартну швидкість і вдвічі дорожче, а комутатор має зворотну сумісність — запити вже позначено для пріоритетного маршруту до швидкого режиму без зміни коду.

Тарифи у швидкому режимі становлять 10 і 60 доларів США для Sol, 4 і 24 долари для Terra, 40 центів і 2,40 доларів для Luna. Примітно, що Anthropic продає той самий продукт під тією самою назвою та на тих самих умовах, і обидва тарифні карти тепер також збігаються на підставі прив’язаних до регіону висновків: OpenAI стягує 10% надбавку за моделі, випущені 5 березня 2026 року або після цієї дати, коли клієнт потребує постійного проживання в даних, тоді як Anthropic виставляє рахунки лише для США в 1,1 раза вище стандартної ставки.

Чому дешевші рівні стали дешевшими

За день до скорочення OpenAI опублікував інженерну публікацію з описом оптимізації свого стеку висновків. П'ять членів технічного персоналу компанії написали, що Sol, працюючи в своєму інструменті кодування Codex, переписав робочі ядра GPU — робота, за словами OpenAI, скоротила витрати на наскрізне обслуговування на 20%. Модель також переробила свою власну чорнову модель спекулятивного декодування в сотнях експериментів, зміна, яка підвищила ефективність генерації токенів більш ніж на 15%.

Це власні цифри OpenAI для його власного стеку, але вони вказують на той самий центр витрат, на який спрямоване зниження ціни: агентська система, що стоїть за Codex і ChatGPT. OpenAI за замовчуванням обмежує вихід інструмента на 10 000 токенів і зберігає видиму для моделі історію лише для додавання, тому цикл агента, який повторно надсилає свої інструкції на кожному кроці, потрапляє в кеш підказок замість того, щоб оплачувати повні ставки введення. Компанія закрила публікацію, зобов’язавшись передати «внутрішні вдосконалення нашим користувачам у формі більш доступних, економічно ефективних даних». Тариф з'явився через день.

Хмарні партнери та виставлення рахунків

OpenAI зазначив, що покупцям, які направляють трафік через Amazon Bedrock, виставляє рахунки AWS, і ці тарифи можуть відрізнятися від опублікованої ним картки. Оскільки все більше підприємств централізують доступ до моделі через одного постачальника хмарних технологій, розрив між прямим ціноутворенням OpenAI і тим, що клієнти фактично платять через посередників, матиме таке ж значення, як і самі заголовні цифри.

Ринок, який підраховує кожен токен

Скорочення припадають на те, що аудиторські висновки корпоративних покупців витрачають більше, ніж будь-коли. Раніше цього тижня звіти задокументували, як ера необмеженого «токенмаксингу» — підвищення обсягів без спостереження за витратами — згасає, оскільки корпоративні рахунки за ШІ різко зростають на основних платформах. Рішення OpenAI передати свою внутрішню економію витрат клієнтам, а не зберігати маржу, є чітким сигналом того, де, на її думку, зараз ведеться конкурентна боротьба: не на кордоні, де Sol все ще керує преміальними цінами, а на дешевих рівнях великого обсягу, де фактично живе більшість виробничого трафіку.

Оскільки ціна Sol залишилася незмінною, рішення для розробників залишається саме там, де OpenAI поставив його з моменту доставки сімейства: який рівень вимагає кожен запит. Різниця полягає в тому, що вартість неправильного рішення щойно різко знизилася.

---

Будьте попереду ШІ

Отримуйте останні новини штучного інтелекту, аналіз і прориви — усе в одному місці.

Читати більше новин AI →