DeepSeek ha aggiornato la sua gamma API con un nuovo modello di punta, V4 Pro, aumentando drasticamente i prezzi su tutta la sua piattaforma: una svolta decisiva rispetto alla strategia di prezzo stracciata che ha reso famoso il laboratorio cinese e costretto i rivali in una guerra dei prezzi. Per un settore che ha monitorato ogni taglio dei prezzi di DeepSeek come un evento che muove il mercato, l’inversione è altrettanto significativa. Segui la nostra copertura di notizie sull'intelligenza artificiale per le ultime novità sul mercato dei modelli.
La documentazione API ufficiale dell'azienda, aggiornata questa settimana, ora elenca due modelli: deepseek-v4-flash, che esegue la versione DeepSeek-V4-Flash-0731, e deepseek-v4-pro, che esegue la nuova build DeepSeek-V4-Pro-0813. Entrambi offrono una finestra di contesto da 1 milione di token, fino a 384.000 token di output massimo e modalità dual thinking e non-thinking ed entrambi possono essere utilizzati come modelli backend all'interno di strumenti agente come Claude Code, GitHub Copilot e OpenCode. DeepSeek distribuisce anche un'anteprima per sviluppatori di "DeepSeek Harness", un toolkit per sviluppatori di agenti. Per maggiori informazioni su questa storia, consulta la nostra notizie sull'IA.
Quanto costa V4 Pro
La nuova ammiraglia costa esattamente tre volte il prezzo di Flash ad ogni livello, secondo i prezzi pubblicati da DeepSeek. Per 1 milione di token, V4 Pro costa 0,022 dollari per i token di input memorizzati nella cache, 0,66 dollari per input non memorizzati nella cache nelle ore non di punta e 1,98 dollari per 1 milione di token di output. Al picco, queste cifre raddoppiano a $ 0,044, $ 1,32 e $ 3,96. V4 Flash, in confronto, costa $ 0,007/$ 0,014 per gli hit della cache, $ 0,22/$ 0,44 per i cache miss e $ 0,66/$ 1,32 per l'output.
Le ore di punta sono definite come 01:00–04:00 e 06:00–10:00 UTC, con tariffe non di punta fissate esattamente alla metà dell'ora di punta. Anche la concorrenza è a più livelli: i clienti Flash ricevono 2.500 richieste simultanee, mentre gli account Pro hanno un limite di 500.
Prezzi fino a dieci volte più alti
Il lancio termina una settimana in cui la trasformazione dei prezzi di DeepSeek è diventata impossibile da perdere. Il Wall Street Journal ha riferito il 14 agosto che DeepSeek aveva aumentato i prezzi dei modelli di intelligenza artificiale di circa quattro volte. InfoWorld ha riferito lo stesso giorno che i prezzi di alcuni V4 erano aumentati di oltre 10 volte, citando la domanda di intelligenza artificiale che mette a dura prova la capacità dell'azienda. Engadget ha detto ai lettori che i modelli "costerebbero quattro volte di più".
Entro il 17 agosto, Tech Times ha riferito che i prezzi dell'API V4 sono ora quadruplicati nelle ore di punta, mentre il Seoul Economic Daily della Corea del Sud ha previsto gli aumenti più consistenti fino a 12 volte e ha inquadrato la mossa mentre la corsa all'intelligenza artificiale cinese si stava trasformando in profitto. Il Global Times, affiliato allo stato cinese, ha descritto gli aumenti come parte di una spinta verso una “commercializzazione più sana” – un segnale che Pechino vede l’economia unitaria sostenibile, non solo la quota di mercato, come la priorità per i suoi sostenitori dell’intelligenza artificiale.
Dall'arma della guerra dei prezzi al prodotto premium
Il cambiamento di strategia è netto. DeepSeek ha costruito la sua reputazione globale su prezzi aggressivi: alla fine di luglio, il suo modello V4 Flash appena rilasciato è stato confrontato con il GPT-5.6 Luna di OpenAI a un costo inferiore del 60%, accelerando una corsa al ribasso che ha schiacciato ogni fornitore di API. Ora lo stesso laboratorio sta applicando tariffe premium: il prezzo di uscita massimo di V4 Pro di 3,96 dollari per milione di token è ben al di sopra di quello che i clienti dell'era Flash erano abituati a pagare.
L’introduzione di finestre di punta e non di punta è di per sé uno strumento di gestione della capacità. Ricaricare il doppio durante le ore di maggior traffico e ridurre la concorrenza per il modello premium consente a DeepSeek di elaborare carichi di lavoro con margini più elevati, un programma familiare ai fornitori di servizi cloud e ai mercati elettrici.
Un portafoglio a due livelli per l'era degli agenti
La divisione tra i due modelli è progettata per acquirenti diversi. Flash, con il suo limite di 2.500 richieste simultanee e prezzi minimi per cache-hit, è posizionato per traffico di produzione ad alto volume e applicazioni sensibili ai costi. Pro, con 500 richieste simultanee e un prezzo triplo, si rivolge a carichi di lavoro pesanti in cui contano la finestra di contesto da 1 milione di token e il tetto di output di 384.000 token: lunghe sessioni di agenti, analisi di codebase di grandi dimensioni e pipeline con molti documenti.
DeepSeek corteggia anche gli sviluppatori dove già lavorano. Entrambi i modelli sono utilizzabili direttamente come backend all'interno di Claude Code, GitHub Copilot e OpenCode, e l'API parla sia i formati compatibili con OpenAI che con Anthropic, il che significa che le migrazioni dai provider occidentali possono essere una modifica della configurazione di una sola riga. La nuova anteprima per sviluppatori "DeepSeek Harness" estende questa strategia ai costruttori di imbracature per agenti.
Cosa significa per gli sviluppatori
Per gli sviluppatori che hanno creato applicazioni sensibili ai costi partendo dal presupposto che DeepSeek sarebbe sempre stata un’opzione conveniente, il messaggio è che l’era dei prezzi dei token in costante calo è finita, almeno nel laboratorio cinese. Le architetture che supportano la cache ora pagano una velocità di input 30 volte inferiore rispetto alle chiamate mancate nella cache su entrambi i modelli, rendendo la disciplina del prompt caching molto più preziosa della scelta del modello. E per il mercato più ampio, il perno di DeepSeek rimuove dalla base del mercato coloro che fissano i prezzi più aggressivi: un regalo silenzioso per OpenAI, Anthropic e Google, che sono stati in competizione per tutto l'anno tanto sui costi quanto sulle capacità.
Resta da testare da valutatori indipendenti se i benchmark di V4 Pro giustifichino il premio. Ciò che è già chiaro è la logica aziendale: dopo aver sovvenzionato per due anni l’utilizzo dell’intelligenza artificiale a livello mondiale, DeepSeek vuole essere pagato per questo.
---
Rimani Aggiornato sull'IALe ultime notizie, analisi e scoperte sull'intelligenza artificiale — tutto in un posto.
Leggi altre notizie sull'IA →