DeepSeek обновил свою линейку API новой флагманской моделью V4 Pro, одновременно резко подняв цены на всю свою платформу — решительный отход от стратегии минимального ценообразования, которая прославила китайскую лабораторию и вынудила конкурентов начать ценовую войну. Для отрасли, которая отслеживает каждое снижение цен на DeepSeek как событие, меняющее рынок, этот разворот не менее важен. Следите за новостями об искусственном интеллекте, чтобы быть в курсе последних событий модельного рынка.

В официальной документации API компании, обновленной на этой неделе, теперь перечислены две модели: deepseek-v4-flash, работающая под управлением версии DeepSeek-V4-Flash-0731, и deepseek-v4-pro, работающая под управлением новой сборки DeepSeek-V4-Pro-0813. Оба предлагают контекстное окно на 1 миллион токенов, максимальный выход до 384 000 токенов, а также режимы двойного мышления и без мышления, и оба могут использоваться в качестве серверных моделей внутри инструментов агента, таких как Claude Code, GitHub Copilot и OpenCode. DeepSeek также представляет предварительную версию «DeepSeek Harness», набора инструментов для разработчиков агентов. Подробнее об этой истории — в нашем тенденции ИИ.

Сколько стоит V4 Pro

Согласно опубликованным ценам DeepSeek, новый флагман стоит ровно в три раза дороже Flash на каждом уровне. За 1 миллион токенов V4 Pro стоит 0,022 доллара США за кэшированные входные токены, 0,66 доллара США за некэшированные входные данные в непиковые часы и 1,98 доллара США за 1 миллион выходных токенов. На пике эти цифры удваиваются до $0,044, $1,32 и $3,96. Для сравнения, V4 Flash стоит 0,007/0,014 доллара за попадание в кеш, 0,22/0,44 доллара за промах в кэше и 0,66/1,32 доллара за вывод.

Часы пик определяются как 01:00–04:00 и 06:00–10:00 UTC, а в непиковое время тарифы устанавливаются ровно на половине пиковой цены. Параллелизм также распределяется по уровням: клиенты Flash получают 2500 одновременных запросов, а учетные записи Pro ограничены 500.

Цены выросли в десять раз

Запуск завершает неделю, в течение которой ценовую трансформацию DeepSeek стало невозможно пропустить. 14 августа газета Wall Street Journal сообщила, что DeepSeek подняла цены на модели искусственного интеллекта примерно в четыре раза. В тот же день InfoWorld сообщила, что цены на некоторые версии V4 выросли более чем в 10 раз, сославшись на то, что спрос на ИИ ограничивает возможности компании. Engadget сообщил читателям, что эти модели «будут стоить в четыре раза дороже».

К 17 августа Tech Times сообщила, что цены на V4 API теперь растут в четыре раза в часы пик, в то время как южнокорейская газета Seoul Economic Daily оценила самый резкий рост - до 12 раз и охарактеризовала этот шаг как гонку искусственного интеллекта в Китае, которая превращается в прибыль. Связанная с государством китайская газета Global Times назвала эти повышения частью усилий по «более здоровой коммерциализации» — сигналом о том, что Пекин считает устойчивую юнит-экономику, а не только долю рынка, приоритетом для своих сторонников ИИ.

От ценового оружия к премиальному продукту

Изменение стратегии резкое. DeepSeek заработал свою глобальную репутацию благодаря агрессивному ценообразованию: в конце июля ее недавно выпущенная модель V4 Flash была проверена на соответствие OpenAI GPT-5.6 Luna при цене на 60% ниже, что ускорило гонку ко дну, которая сжала каждого поставщика API. Теперь та же лаборатория взимает повышенные ставки — пиковая выходная цена V4 Pro в 3,96 доллара за миллион токенов значительно превышает ту сумму, которую привыкли платить клиенты эпохи Flash.

Введение периодов пиковой и внепиковой нагрузки само по себе является инструментом управления мощностями. Двойная оплата в самые загруженные часы и сокращение одновременной обработки для премиальной модели позволяет DeepSeek рассчитывать на более прибыльные рабочие нагрузки — сценарий, знакомый по облачным провайдерам и рынкам электроэнергии.

Двухуровневый портфель для эпохи агентов

Разделение между двумя моделями рассчитано на разных покупателей. Flash с его ограничением одновременности в 2500 запросов и минимальной ценой за попадание в кэш предназначен для больших объемов производственного трафика и чувствительных к затратам приложений. Версия Pro с 500 одновременными запросами и тройной ценой ориентирована на сложные рабочие нагрузки, где значение имеет контекстное окно в 1 миллион токенов и потолок вывода в 384 000 токенов — длинные агентские сеансы, большой анализ кодовой базы и конвейеры с большим количеством документов.

DeepSeek также привлекает разработчиков там, где они уже работают. Обе модели можно использовать непосредственно в качестве бэкэндов внутри Claude Code, GitHub Copilot и OpenCode, а API поддерживает форматы, совместимые как с OpenAI, так и с Anthropic, то есть миграция от западных поставщиков может представлять собой однострочное изменение конфигурации. Новая предварительная версия для разработчиков «DeepSeek Harness» расширяет эту стратегию для разработчиков агентских систем.

Что это значит для разработчиков

Для разработчиков, которые создавали чувствительные к затратам приложения, исходя из предположения, что DeepSeek всегда будет выгодным вариантом, смысл заключается в том, что эра бесконечного падения цен на токены закончилась, по крайней мере, в китайской лаборатории. Архитектуры, дружественные к кэшу, теперь платят в 30 раз меньшую скорость ввода, чем вызовы с пропуском кэша в обеих моделях, что делает дисциплину кэширования подсказок гораздо более ценной, чем выбор модели. А для более широкого рынка поворот DeepSeek убирает с рынка самого агрессивного ценителя — тихий подарок OpenAI, Anthropic и Google, которые весь год конкурировали как по стоимости, так и по возможностям.

Оправдывают ли тесты V4 Pro премию, еще предстоит проверить независимым оценщикам. Что уже ясно, так это бизнес-логика: после двух лет субсидирования использования ИИ в мире DeepSeek хочет, чтобы ему платили за это.

---

Будьте в курсе ИИ

Последние новости, аналитика и прорывы в сфере ИИ — всё в одном месте.

Читать больше новостей об ИИ →