Китайская лаборатория искусственного интеллекта DeepSeek выпустила 31 июля 2026 года V4-Flash «0731» — переработанную версию своей бюджетной модели, которая почти соответствует OpenAI GPT-5.6 Luna в сторонних тестах и ​​примерно на 60 процентов дешевле. Релиз, который делает публичную бета-версию API модели общедоступной, является последним залпом в усиливающейся ценовой войне между китайскими поставщиками открытого веса и западными пограничными лабораториями. Чтобы постоянно освещать войны моделей, читайте наши последние новости искусственного интеллекта.

По данным The Decoder, новая версия набирает 50 баллов в индексе искусственного анализа интеллекта — на десять пунктов больше, чем предыдущая версия V4-Flash, выпущенная в апреле 2026 года. Это всего на один балл отстает от бюджетной версии GPT-5.6 Luna от OpenAI, несмотря на то, что стоимость каждой задачи примерно на 60 процентов ниже, даже после недавнего 80-процентного снижения цен OpenAI.

Создан для агентской работы

Наибольшие успехи были достигнуты в агентских задачах — способности автономно выполнять многоэтапную реальную работу. TechNode сообщил, что модель набрала 82,7 балла в Terminal Bench 2.1 и 54,4 балла в DeepSWE, двух тестах, предназначенных для измерения того, насколько хорошо ИИ может использовать инструменты, писать код и решать инженерные задачи без участия оператора.

В GDPval, тесте, который тестирует модели для сложной офисной работы, V4-Flash поднялся с 1189 до 1559 баллов Эло. DeepSeek также сообщил, что модель галлюцинирует реже, чем ее предшественница, и использует примерно на 12 процентов меньше жетонов для выполнения тех же задач.

Та же архитектура, более разумный вес

Обновление сохраняет ту же базовую структуру: всего 284 миллиарда параметров, из которых 13 миллиардов одновременно активны, а также контекстное окно на один миллион токенов. Вместо того, чтобы расширять модель, DeepSeek переобучил ее, выжимая больше производительности из той же площади. Веса моделей выпускаются под разрешительной лицензией MIT на Hugging Face, продолжая подход DeepSeek к открытому весу.

DeepSeek тщательно определил масштаб выпуска. Обновление касается только API V4-Flash; API более высокого уровня V4-Pro и модели, обслуживаемые через потребительское приложение и веб-сайт DeepSeek, остаются неизменными. Новый Flash API также добавляет поддержку API Responses и адаптирован для использования с Codex, что расширяет его привлекательность для разработчиков, создающих агенты кодирования.

Грань со скидкой на кэш

Значительная часть ценового преимущества DeepSeek обусловлена механизмом ценообразования. Компания предлагает 98-процентную скидку на кэш — что значительно выше стандартных 90 процентов — это означает, что повторяющиеся или предсказуемые части запроса оплачиваются по небольшой доле обычной ставки. В сочетании с меньшим количеством токенов на задачу эффективная стоимость многих рабочих нагрузок резко снижается.

Такая структура ценообразования является прямым вызовом OpenAI, которая сама снижает цены, чтобы защитить свою долю рынка. Результатом является рынок, на котором качество, близкое к передовому, становится товаром, а конкуренция все чаще определяется эффективностью инфраструктуры и юнит-экономикой, а не сырьевыми возможностями.

Ценовая война без пола

Этот релиз усиливает то, что аналитики сейчас называют полномасштабной ценовой войной. OpenAI снизила цены на GPT-5.6 Luna на 80 процентов, чтобы защитить свою базу разработчиков, только для того, чтобы DeepSeek ответил моделью, которая сравнительно эффективна и при этом намного дешевле. С каждым раундом эффективная стоимость разведки ближнего зарубежья снижается, а разрыв между самыми дешевыми и самыми дорогими моделями продолжает сокращаться.

Динамика необычна для программного обеспечения. На большинстве рынков 60-процентное преимущество в издержках при почти равном качестве быстро захватит долю рынка. Здесь преимущество сопоставляется и повторно сопоставляется в течение нескольких недель, в результате чего у разработчиков постоянно меняется таблица лидеров. Паритет эталонных показателей, когда-то являвшийся исключительной прерогативой пограничных лабораторий, становится все более доступным для претендентов на открытый вес, желающих публиковать как свои веса, так и цены.

Что это значит для разработчиков

Для разработчиков практический вывод ясен: функциональные агентные модели быстро дешевеют. Модель, которая может автономно управлять терминалом, писать и отлаживать код, а также выполнять сложные офисные задачи — и все это за долю цента за запрос — меняет экономику создания продуктов на базе искусственного интеллекта.

Открытая версия также означает, что команды могут запускать модель на своем собственном оборудовании, полностью избегая платы за API за токен для конфиденциальных рабочих нагрузок. Поскольку DeepSeek, OpenAI и другие продолжают спорить по цене и производительности, в выигрыше оказываются разработчики, у которых теперь есть растущее меню функциональных и доступных моделей на выбор.

Будьте на шаг впереди ИИ

Сфера искусственного интеллекта развивается быстрее, чем когда-либо, и фирмы, которые отслеживают эти изменения заранее, получают устойчивое преимущество. Чтобы постоянно, на основе проверенных источников, освещать выпуски моделей, раунды финансирования и политические решения, следите за нашими [последними новостями об искусственном интеллекте] (https://aibuzzwire.news).

Подробнее новости AI →