DeepSeek aktualizoval svou řadu API o nový vlajkový model V4 Pro, přičemž prudce zvýšil ceny napříč svou platformou – rozhodující odklon od cenové strategie, která proslavila čínskou laboratoř a přinutila soupeře k cenové válce. Pro odvětví, které sledovalo každé snížení ceny DeepSeek jako událost, která mění trh, je obrat stejně významný. Sledujte naše zpravodajství o AI pro nejnovější informace o modelovém trhu.
Oficiální dokumentace API společnosti, aktualizovaná tento týden, nyní uvádí dva modely: deepseek-v4-flash s verzí DeepSeek-V4-Flash-0731 a deepseek-v4-pro s novým sestavením DeepSeek-V4-Pro-0813. Oba nabízejí kontextové okno s 1 milionem tokenů, až 384 000 tokenů maximálního výstupu a duální režimy myšlení a nemyšlení a oba lze použít jako backend modely v nástrojích agentů, jako jsou Claude Code, GitHub Copilot a OpenCode. DeepSeek také dodává vývojářskou ukázku „DeepSeek Harness“, sady nástrojů pro vývojáře agentů. For more context on this story, see our ongoing AI trends.
Kolik V4 Pro stojí
Nová vlajková loď nese přesně trojnásobek ceny Flash na každé úrovni, podle zveřejněných cen DeepSeek. Na 1 milion tokenů se V4 Pro uvádí na 0,022 USD za vstupní tokeny uložené v mezipaměti a 0,66 USD za vstup neuložený v mezipaměti mimo špičku a 1,98 USD za 1 milion výstupních tokenů. Na vrcholu se tato čísla zdvojnásobí na 0,044 USD, 1,32 USD a 3,96 USD. V4 Flash pro srovnání uvádí na 0,007 $ / 0,014 $ za přístupy do mezipaměti, 0,22 $ / 0,44 $ za chybějící mezipaměť a 0,66 $ / 1,32 $ za výstup.
Špička je definována jako 01:00–04:00 a 06:00–10:00 UTC, přičemž sazby mimo špičku jsou nastaveny přesně na polovinu špičky. Souběžnost je také odstupňovaná: Zákazníci Flash obdrží 2 500 souběžných požadavků, zatímco účty Pro jsou omezeny na 500.
Ceny vzrostly až desetinásobně
Uvedení na trh je týden, ve kterém nebylo možné přehlédnout transformaci cen DeepSeek. Wall Street Journal 14. srpna uvedl, že DeepSeek zvedl ceny modelů AI zhruba čtyřnásobně. InfoWorld téhož dne oznámilo, že ceny některých zemí V4 vzrostly více než 10krát, s odkazem na poptávku po AI, která zatěžuje kapacitu společnosti. Engadget čtenářům řekl, že modely budou „stát čtyřikrát více“.
Do 17. srpna Tech Times oznámily, že ceny V4 API se nyní ve špičce zčtyřnásobily, zatímco jihokorejský Seoul Economic Daily uvedl nejstrmější nárůst až na 12násobek a zarámoval tento krok jako čínský závod v oblasti umělé inteligence, který směřuje k zisku. Čínský státem přidružený Global Times popsal zvýšení jako součást tlaku na „zdravější komercializaci“ – signál, že Peking vidí jako prioritu pro své šampiony AI udržitelnou ekonomiku jednotek, nejen podíl na trhu.
Od cenové válečné zbraně k prémiovému produktu
Změna strategie je výrazná. DeepSeek vybudoval svou globální reputaci na agresivních cenách: na konci července byl jeho nově vydaný model V4 Flash testován jako srovnání s OpenAI GPT-5.6 Luna za 60% nižší cenu, což urychlilo závod ke dnu, který stlačil každého poskytovatele API. Nyní stejná laboratoř účtuje prémiové sazby – maximální výstupní cena V4 Pro ve výši 3,96 $ za milion tokenů je mnohem vyšší, než kolik byli zákazníci z éry Flash zvyklí platit.
Zavedení oken ve špičce a mimo špičku je samo o sobě nástrojem řízení kapacity. Dvojnásobné nabíjení během nejrušnějších hodin – a snížení souběžnosti u prémiového modelu – umožňuje DeepSeek počítat s vyšší marží, což je příručka známá z cloudových poskytovatelů a trhů s elektřinou.
Dvouvrstvé portfolio pro éru agentů
Rozdělení mezi tyto dva modely je navrženo pro různé zákazníky. Flash se svým limitem souběžnosti 2 500 požadavků a minimální cenou za přístup do mezipaměti je umístěn pro velkoobjemový provoz a aplikace citlivé na náklady. Pro, s 500 souběžnými požadavky a trojnásobnou cenou, se zaměřuje na zátěže náročné na uvažování, kde záleží na kontextovém okně 1 milionu tokenů a výstupním stropu 384 000 tokenů – dlouhé agentní relace, rozsáhlé analýzy kódové základny a kanály náročné na dokumenty.
DeepSeek se také dvoří vývojářům tam, kde již pracují. Oba modely jsou použitelné přímo jako backendy uvnitř Claude Code, GitHub Copilot a OpenCode a API mluví s formáty kompatibilními s OpenAI i Anthropic – což znamená, že migrace od západních poskytovatelů může být jednořádkovou změnou konfigurace. Nový náhled pro vývojáře „DeepSeek Harness“ rozšiřuje tuto strategii na tvůrce svazků agentů.
Co to znamená pro vývojáře
Pro vývojáře, kteří stavěli aplikace citlivé na náklady na předpokladu, že DeepSeek bude vždy výhodnou volbou, je zpráva, že éra nekonečně klesajících cen tokenů skončila, alespoň v čínské laboratoři. Architektury přátelské k cache nyní platí 30x nižší vstupní rychlost než volání cache-miss na obou modelech, díky čemuž je disciplína rychlého ukládání do mezipaměti mnohem cennější než výběr modelu. A co se týče širšího trhu, pivot DeepSeek odstraňuje nejagresivnějšího tvůrce cen z podlahy trhu – tichý dárek pro OpenAI, Anthropic a Google, kteří celý rok soutěží o cenu stejně jako o schopnosti.
Zda benchmarky V4 Pro ospravedlní prémii, musí být otestováno nezávislými hodnotiteli. Co už je jasné, je obchodní logika: po dvou letech dotování světového používání AI chce DeepSeek za to dostat zaplaceno.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →