Китайська лабораторія штучного інтелекту DeepSeek 31 липня 2026 року випустила V4-Flash «0731» — оновлену версію своєї бюджетної моделі, яка майже відповідає GPT-5.6 Luna OpenAI за тестами сторонніх розробників за приблизно на 60 відсотків нижчою ціною. Випуск, у якому публічна бета-версія API моделі стає загальнодоступною, є останнім залпом у ціновій війні, яка загострюється між китайськими постачальниками відкритих версій і західними прикордонними лабораторіями. Для постійного висвітлення війн моделей дивіться наші останні новини AI.
За даними The Decoder, нова версія набирає 50 балів за Індексом штучного аналізу інтелекту — це на десять балів більше, ніж попередній V4-Flash, який був запущений у квітні 2026 року. Це лише на один бал відстає від GPT-5.6 Luna бюджетного рівня OpenAI, незважаючи на те, що вона коштує приблизно на 60 відсотків менше за завдання, навіть після нещодавнього зниження ціни OpenAI на 80 відсотків.
Створено для агентської роботи
Найбільші переваги прийшли до агентських завдань, здатності автономно виконувати багатоетапну роботу в реальному світі. TechNode повідомила, що модель набрала 82,7 балів на термінальному стенді 2.1 і 54,4 на DeepSWE, двох тестах, призначених для вимірювання того, наскільки добре штучний інтелект може використовувати інструменти, писати код і вирішувати інженерні проблеми без рук.
На GDPval, тесті, який перевіряє моделі для складної офісної роботи, V4-Flash піднявся з 1189 до 1559 балів Elo. DeepSeek також сказав, що модель галюцинує рідше, ніж її попередник, і використовує приблизно на 12 відсотків менше жетонів для виконання тих самих завдань.
Така сама архітектура, розумніші ваги
Оновлення зберігає ту саму основну структуру: загальну кількість 284 мільярдів параметрів із 13 мільярдами активних у будь-який момент часу та контекстне вікно в один мільйон маркерів. Замість того, щоб розширювати модель, DeepSeek перенавчав її, вичавлюючи більшу продуктивність із тієї самої площі. Вагові коефіцієнти моделей оприлюднюються на Hugging Face згідно з дозвільною ліцензією Массачусетського технологічного інституту, продовжуючи підхід відкритої ваги DeepSeek.
DeepSeek ретельно охопив випуск. Оновлення стосується лише V4-Flash API; API вищого рівня V4-Pro та моделі, які обслуговуються через споживчий додаток і веб-сайт DeepSeek, залишаються незмінними. Новий Flash API також додає підтримку Responses API і адаптований для використання з Codex, розширюючи його привабливість для розробників, які створюють агенти кодування.
Cache Discount Edge
Значна частина цінової переваги DeepSeek походить від його механізму ціноутворення. Компанія пропонує 98-відсоткову знижку на кеш-пам’ять — що значно перевищує галузевий стандарт у 90 відсотків — це означає, що повторювані або передбачувані частини запиту виставляються за невеликою часткою звичайної ставки. У поєднанні з меншою кількістю маркерів на завдання ефективна вартість багатьох робочих навантажень різко падає.
Така структура ціноутворення є прямим викликом для OpenAI, яка сама знижувала ціни, щоб захистити частку ринку. Результатом є ринок, де майже передова якість стає товаром, а конкуренція все більше визначається ефективністю інфраструктури та економікою одиниці, а не сировинними можливостями.
Цінова війна без підлоги
Цей реліз посилює те, що зараз аналітики описують як повномасштабну цінову війну. OpenAI знизив ціни на GPT-5.6 Luna на 80 відсотків, щоб захистити свою базу розробників, лише для того, щоб DeepSeek відповів моделлю, яка є порівняно потужною та все ще набагато дешевшою. З кожним раундом реальна вартість інтелектуальних даних на ближньому кордоні знижується, а розрив між найдешевшими та найдорожчими моделями продовжує звужуватися.
Динаміка незвичайна в програмному забезпеченні. На більшості ринків 60-відсоткова перевага у витратах при майже однаковій якості швидко захопить частку. Тут перевага зіставляється та повторно зіставляється протягом кількох тижнів, залишаючи розробників із постійною зміною таблиці лідерів. Еталонний паритет, який колись був винятковим регіоном передових лабораторій, стає все більш доступним для претендентів на відкриту вагу, які бажають опублікувати як свої ваги, так і ціни.
Що це означає для розробників
Для розробників практичне значення зрозуміле: ефективні агентні моделі швидко дешевшають. Модель, яка може автономно керувати терміналом, писати та налагоджувати код, а також виконувати складні офісні завдання — і все це за частки цента за запит — змінює економіку створення продуктів на основі ШІ.
Відкритий випуск також означає, що команди можуть запускати модель на власному апаратному забезпеченні, повністю уникаючи плати за API за токен для чутливих робочих навантажень. Оскільки DeepSeek, OpenAI та інші продовжують боротися за ціну та продуктивність, переможцями стають розробники, які тепер мають на вибір потужні та доступні моделі.
Будьте попереду кривої ШІ
Ландшафт штучного інтелекту розвивається швидше, ніж будь-коли, і фірми, які відстежують ці зміни на ранньому етапі, отримують тривалу перевагу. Слідкуйте за нашими [останніми новинами щодо штучного інтелекту] (https://aibuzzwire.news), щоб отримати постійне, перевірене джерело висвітлення випусків моделей, раундів фінансування та змін політики.
Читати більше новин AI →