DeepSeek zaktualizował swoją ofertę interfejsów API o nowy flagowy model, V4 Pro, jednocześnie gwałtownie podnosząc ceny na swojej platformie – zdecydowane odejście od najniższej strategii cenowej, która rozsławiła chińskie laboratorium i zmusiła rywali do wojny cenowej. Dla branży, która każdą obniżkę cen DeepSeek traktuje jako wydarzenie zmieniające rynek, odwrócenie sytuacji jest równie znaczące. Śledź nasze wiadomości dotyczące sztucznej inteligencji, aby uzyskać najnowsze informacje na temat rynku modeli.
Oficjalna dokumentacja API firmy, zaktualizowana w tym tygodniu, zawiera obecnie dwa modele: deepseek-v4-flash z wersją DeepSeek-V4-Flash-0731 i deepseek-v4-pro z nową kompilacją DeepSeek-V4-Pro-0813. Obydwa oferują okno kontekstowe zawierające 1 milion tokenów, do 384 000 tokenów maksymalnej wydajności oraz tryby podwójnego myślenia i niemyślenia, a oba mogą być używane jako modele zaplecza w narzędziach agenta, takich jak Claude Code, GitHub Copilot i OpenCode. DeepSeek udostępnia także wersję deweloperską „DeepSeek Harness”, zestawu narzędzi dla programistów agentów. Więcej kontekstu na ten temat znajdziesz w naszych trendy AI.
Jakie koszty V4 Pro
Według opublikowanych cenników DeepSeek, nowy okręt flagowy jest dokładnie trzy razy droższy od Flasha na każdym poziomie. Za 1 milion tokenów wersja V4 Pro kosztuje 0,022 USD za tokeny wejściowe zapisane w pamięci podręcznej i 0,66 USD za dane wejściowe niezapisane w pamięci podręcznej poza godzinami szczytu oraz 1,98 USD za 1 milion tokenów wyjściowych. W szczytowym momencie liczby te podwoją się do 0,044 USD, 1,32 USD i 3,96 USD. Dla porównania, V4 Flash osiąga wyniki na poziomie 0,007 USD/0,014 USD za trafienia w pamięci podręcznej, 0,22 USD/0,44 USD za chybienia w pamięci podręcznej i 0,66 USD/1,32 USD za dane wyjściowe.
Godziny szczytu definiuje się jako 01:00–04:00 i 06:00–10:00 UTC, a stawki poza szczytem ustalane są dokładnie na połowę szczytu. Współbieżność jest również wielopoziomowa: klienci Flash otrzymują 2500 jednoczesnych żądań, podczas gdy konta Pro są ograniczone do 500.
Ceny wzrosły aż dziesięciokrotnie
Premiera kończy tydzień, w którym nie można było przeoczyć transformacji cenowej DeepSeek. 14 sierpnia dziennik „Wall Street Journal” podał, że DeepSeek podniósł ceny modeli AI mniej więcej czterokrotnie. InfoWorld poinformował tego samego dnia, że ceny niektórych krajów V4 wzrosły ponad 10-krotnie, powołując się na popyt na sztuczną inteligencję obciążający możliwości firmy. Engadget powiedział czytelnikom, że modele „będą kosztować cztery razy więcej”.
Do 17 sierpnia Tech Times poinformował, że ceny API V4 wzrosły obecnie czterokrotnie w godzinach szczytu, podczas gdy południowokoreański dziennik Seoul Economic Daily odnotował największe wzrosty aż do 12-krotne i określił to posunięcie jako wyścig chińskiej sztucznej inteligencji zwracający się w stronę zysków. Powiązany z państwem chiński dziennik Global Times opisał podwyżki jako część dążenia do „zdrowszej komercjalizacji” – co jest sygnałem, że Pekin postrzega zrównoważoną ekonomię jednostek, a nie tylko udział w rynku, jako priorytet swoich mistrzów sztucznej inteligencji.
Od broni cenowej po produkt premium
Zmiana strategii jest wyraźna. Firma DeepSeek zbudowała swoją światową reputację dzięki agresywnym cenom: pod koniec lipca nowo wydany model V4 Flash został porównany z procesorem OpenAI GPT-5.6 Luna przy cenie o 60% niższej, co przyspieszyło wyścig w dół, który zmiażdżył każdego dostawcę API. Teraz to samo laboratorium pobiera stawki premium — maksymalna cena wyjściowa V4 Pro wynosząca 3,96 dolara za milion tokenów jest znacznie wyższa od ceny, do której zwykli płacić klienci ery Flash.
Wprowadzenie okien szczytowych i pozaszczytowych samo w sobie jest narzędziem zarządzania przepustowością. Podwójne ładowanie w najbardziej obciążonych godzinach — i ograniczenie współbieżności w przypadku modelu premium — pozwala DeepSeek obliczać racje w przypadku obciążeń o wyższej marży, co jest sposobem znanym z dostawców usług w chmurze i rynków energii elektrycznej.
Dwupoziomowy portfel dla ery agentów
Podział między tymi dwoma modelami został zaprojektowany z myślą o różnych nabywcach. Flash, z limitem współbieżności wynoszącym 2500 żądań i minimalną ceną za trafienie w pamięć podręczną, jest przeznaczony do zastosowań o dużym natężeniu ruchu produkcyjnego i zastosowań wrażliwych na koszty. Pro, z 500 równoczesnymi żądaniami i trzykrotnie wyższą ceną, jest przeznaczony do zadań wymagających dużego wnioskowania, gdzie liczy się okno kontekstowe zawierające 1 milion tokenów i pułap wyjściowy wynoszący 384 000 tokenów — długie sesje agenta, analiza dużej bazy kodu i potoki zawierające dużo dokumentów.
DeepSeek zabiega także o względy programistów tam, gdzie już pracują. Obydwa modele można używać bezpośrednio jako backendy w Claude Code, GitHub Copilot i OpenCode, a interfejs API obsługuje formaty kompatybilne zarówno z OpenAI, jak i Anthropic, co oznacza, że migracja od zachodnich dostawców może obejmować jednowierszową zmianę konfiguracji. Nowa wersja zapoznawcza dewelopera „DeepSeek Harness” rozszerza tę strategię na twórców wiązek agentów.
Co to oznacza dla programistów
Dla programistów, którzy tworzyli aplikacje wrażliwe na koszty, zakładając, że DeepSeek zawsze będzie opcją okazyjną, wiadomość jest taka, że era niekończącego się spadku cen tokenów dobiegła końca, przynajmniej w chińskim laboratorium. Architektury przyjazne pamięci podręcznej zapewniają teraz 30 razy niższą szybkość wprowadzania danych niż wywołania braku pamięci podręcznej w obu modelach, co sprawia, że dyscyplina szybkiego buforowania jest o wiele cenniejsza niż wybór modelu. A w przypadku szerszego rynku zwrot DeepSeek usuwa z rynku najbardziej agresywnego dyktatora cen — cichy prezent dla OpenAI, Anthropic i Google, które przez cały rok konkurowały zarówno pod względem kosztów, jak i możliwości.
To, czy testy porównawcze V4 Pro uzasadniają wyższą cenę, pozostaje do sprawdzenia przez niezależnych ekspertów. Logika biznesowa jest już jasna: po dwóch latach subsydiowania wykorzystania sztucznej inteligencji na świecie DeepSeek chce otrzymać za to wynagrodzenie.
---
Bądź na Bieżąco z AINajnowsze wiadomości, analizy i przełomy w dziedzinie AI — wszystko w jednym miejscu.
Czytaj więcej wiadomości AI →