DeepSeek оновив свою лінійку API, додавши нову флагманську модель V4 Pro, водночас різко підвищивши ціни на всій своїй платформі — рішучий відхід від стратегії низьких цін, яка прославила китайську лабораторію та змусила конкурентів почати цінову війну. Для галузі, яка відслідковує кожне зниження ціни DeepSeek як подію, що змінює ринок, розворот є настільки ж значним. Слідкуйте за нашими новинами про штучний інтелект, щоб дізнатися про останні новини на ринку моделей.
Офіційна документація API компанії, оновлена цього тижня, тепер перераховує дві моделі: deepseek-v4-flash, що використовує версію DeepSeek-V4-Flash-0731, і deepseek-v4-pro, що використовує нову збірку DeepSeek-V4-Pro-0813. Обидва пропонують контекстне вікно в 1 мільйон токенів, до 384 000 токенів максимального виходу, а також режими подвійного мислення та режими без мислення, і обидва можуть використовуватися як серверні моделі в агентських інструментах, таких як Claude Code, GitHub Copilot і OpenCode. DeepSeek також надає для розробників попередню версію «DeepSeek Harness», набору інструментів для розробників агентів. For more context on this story, see our ongoing more AI stories.
Скільки коштує V4 Pro
Згідно з опублікованою DeepSeek ціною, новий флагман має рівно втричі більшу ціну, ніж Flash на кожному рівні. За 1 мільйон токенів V4 Pro коштує 0,022 дол. США за кешовані вхідні токени та 0,66 дол. США за некешовані введення в непікові години та 1,98 дол. США за 1 мільйон вихідних токенів. На піку ці цифри подвоюються до $0,044, $1,32 і $3,96. V4 Flash, для порівняння, перераховує $0,007/$0,014 для звернень до кешу, $0,22/$0,44 для промахів і $0,66/$1,32 для виведення.
Пікові години визначаються як 01:00–04:00 та 06:00–10:00 UTC, а непікові ставки встановлюються рівно на половину піку. Паралельність також є багаторівневою: клієнти Flash отримують 2500 одночасних запитів, а облікові записи Pro обмежені 500.
Ціни зросли в десять разів
Запуск обмежується тижнем, протягом якого неможливо було пропустити зміну цін DeepSeek. 14 серпня The Wall Street Journal повідомила, що DeepSeek підняв ціни на моделі ШІ приблизно в чотири рази. Того ж дня InfoWorld повідомила, що ціни на деякі V4 зросли більш ніж у 10 разів, посилаючись на те, що попит на штучний інтелект навантажує можливості компанії. Engadget повідомив читачам, що моделі «ось-ось будуть коштувати в чотири рази дорожче».
17 серпня Tech Times повідомила, що ціни на V4 API тепер збільшуються вчетверо в години пік, а південнокорейська газета Seoul Economic Daily зазначає, що найбільше зростання досягає 12 разів, і описує цей крок як китайську гонку штучного інтелекту, яка повертається до прибутку. Китайська державна газета Global Times описала підвищення як частину поштовху до «здоровішої комерціалізації» — це сигнал про те, що Пекін вважає пріоритетом для своїх лідерів штучного інтелекту стійку одиничну економіку, а не лише частку ринку.
Від зброї цінової війни до преміум-продукту
Зміна стратегії різка. DeepSeek створив свою глобальну репутацію завдяки агресивному ціноутворенню: наприкінці липня його нещодавно випущена модель V4 Flash була перевірена на відповідність OpenAI GPT-5.6 Luna за ціною на 60% нижчою, що прискорило гонку до дна, яка витіснила кожного постачальника API. Тепер та сама лабораторія стягує преміальні ставки — пікова вихідна ціна V4 Pro у 3,96 доларів США за мільйон токенів значно перевищує те, що звикли платити клієнти епохи Flash.
Запровадження вікон пікових і непікових навантажень саме по собі є інструментом керування потужністю. Подвійне заряджання під час найактивніших годин — і скорочення паралелізму для преміум-моделі — дозволяє DeepSeek раціонально використовувати обчислення для робочих навантажень з вищим прибутком, інструкція, знайома від хмарних постачальників і ринків електроенергії.
Дворівневе портфоліо для агентської ери
Розподіл між двома моделями розроблений для різних покупців. Flash з обмеженням на 2500 запитів одночасного виконання та мінімальною ціною звернень до кешу позиціонується для великого обсягу робочого трафіку та чутливих до витрат програм. Pro з 500 одночасними запитами та потрійною ціною націлений на важкі робочі навантаження, де важливі вікно контексту в 1 мільйон токенів і верхня межа вихідних даних у 384 000 токенів — тривалі агентські сеанси, великий аналіз кодової бази та конвеєри, що містять велику кількість документів.
DeepSeek також залицяється до розробників там, де вони вже працюють. Обидві моделі можна використовувати безпосередньо як серверні модулі всередині Claude Code, GitHub Copilot і OpenCode, а API підтримує обидва формати, сумісні з OpenAI і Anthropic, тобто міграція із західних провайдерів може бути зміною конфігурації в один рядок. Новий попередній перегляд для розробників "DeepSeek Harness" поширює цю стратегію на конструкторів агентів.
Що це означає для розробників
Для розробників, які створювали рентабельні програми, припускаючи, що DeepSeek завжди буде вигідним варіантом, повідомлення полягає в тому, що ера нескінченного падіння цін на токени закінчилася, принаймні в китайській лабораторії. Архітектури, зручні для кешу, тепер платять у 30 разів нижчу швидкість введення, ніж кеш-пропущені виклики в обох моделях, що робить дисципліну швидкого кешування набагато ціннішою, ніж вибір моделі. А для ширшого ринку інструмент DeepSeek усуває з ринку найагресивніших цінників — тихий подарунок OpenAI, Anthropic і Google, які весь рік конкурували як за вартістю, так і за можливостями.
Чи виправдовують тести V4 Pro премію, ще належить перевірити незалежним експертам. Що вже зрозуміло, так це бізнес-логіка: після двох років субсидування використання штучного інтелекту в усьому світі DeepSeek хоче отримати за це гроші.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →