DeepSeek ha actualizado su línea de API con un nuevo modelo insignia, V4 Pro, mientras aumenta considerablemente los precios en toda su plataforma, un alejamiento decisivo de la estrategia de precios bajísimos que hizo famoso al laboratorio chino y obligó a sus rivales a una guerra de precios. Para una industria que ha seguido cada recorte de precios de DeepSeek como un evento que mueve el mercado, la reversión es igualmente significativa. Siga nuestra cobertura de noticias sobre IA para conocer lo último sobre el mercado de modelos.
La documentación API oficial de la compañía, actualizada esta semana, ahora enumera dos modelos: deepseek-v4-flash, que ejecuta la versión DeepSeek-V4-Flash-0731, y deepseek-v4-pro, que ejecuta la nueva versión DeepSeek-V4-Pro-0813. Ambos ofrecen una ventana de contexto de 1 millón de tokens, hasta 384.000 tokens de rendimiento máximo y modos de pensamiento dual y no pensamiento, y ambos pueden usarse como modelos de backend dentro de herramientas de agentes como Claude Code, GitHub Copilot y OpenCode. DeepSeek también envía una vista previa para desarrolladores de "DeepSeek Harness", un conjunto de herramientas para desarrolladores de agentes. Para más contexto sobre esta historia, consulta nuestra novedades de IA.
¿Cuánto cuesta V4 Pro?
El nuevo buque insignia tiene exactamente tres veces el precio de Flash en cada nivel, según los precios publicados por DeepSeek. Por cada millón de tokens, V4 Pro cuesta $0,022 para tokens de entrada almacenados en caché y $0,66 para entradas no almacenadas en caché en horas de menor actividad, y $1,98 por cada millón de tokens de salida. En su punto máximo, esas cifras se duplican a 0,044 dólares, 1,32 dólares y 3,96 dólares. V4 Flash, en comparación, tiene un precio de $0,007/$0,014 para aciertos de caché, $0,22/$0,44 para errores de caché y $0,66/$1,32 para salida.
Las horas pico se definen como 01:00 a 04:00 y 06:00 a 10:00 UTC, con tarifas valle establecidas exactamente en la mitad del pico. La simultaneidad también está escalonada: los clientes Flash reciben 2500 solicitudes simultáneas, mientras que las cuentas Pro tienen un límite de 500.
Los precios aumentan hasta diez veces
El lanzamiento culmina una semana en la que era imposible pasar por alto la transformación de precios de DeepSeek. El Wall Street Journal informó el 14 de agosto que DeepSeek había cuadruplicado aproximadamente los precios de los modelos de IA. InfoWorld informó el mismo día que algunos precios de V4 habían aumentado más de 10 veces, citando que la demanda de IA estaba poniendo a prueba la capacidad de la empresa. Engadget dijo a los lectores que los modelos estaban "a punto de costar cuatro veces más".
El 17 de agosto, Tech Times informó que los precios de la API V4 ahora se cuadriplican en las horas pico, mientras que el Seoul Economic Daily de Corea del Sur estimó los aumentos más pronunciados, hasta 12 veces y enmarcó la medida como si la carrera de la IA de China se estuviera volviendo rentable. El Global Times, afiliado al estado de China, describió los aumentos como parte de un impulso para una "comercialización más saludable", una señal de que Beijing considera la economía unitaria sostenible, no solo la participación de mercado, como la prioridad para sus defensores de la IA.
De arma de guerra de precios a producto premium
El cambio de estrategia es marcado. DeepSeek construyó su reputación global sobre la base de precios agresivos: a fines de julio, su modelo V4 Flash recientemente lanzado fue comparado con el GPT-5.6 Luna de OpenAI con un costo 60% menor, acelerando una carrera hacia el fondo que exprimió a todos los proveedores de API. Ahora el mismo laboratorio está cobrando tarifas superiores: el precio máximo de salida de V4 Pro de 3,96 dólares por millón de tokens está muy por encima de lo que los clientes de la era Flash estaban acostumbrados a pagar.
La introducción de períodos de horas punta y valle es en sí misma una herramienta de gestión de la capacidad. Cobrar el doble durante las horas de mayor actividad (y reducir la concurrencia para el modelo premium) permite a DeepSeek racionar la computación para cargas de trabajo de mayor margen, un manual familiar de los proveedores de la nube y los mercados de electricidad.
Una cartera de dos niveles para la era de los agentes
La división entre los dos modelos está diseñada para diferentes compradores. Flash, con su límite de simultaneidad de 2500 solicitudes y su precio mínimo de acceso a caché, está posicionado para tráfico de producción de gran volumen y aplicaciones sensibles a los costos. Pro, con 500 solicitudes simultáneas y el triple de precio, apunta a cargas de trabajo con mucho razonamiento donde la ventana de contexto de 1 millón de tokens y el techo de salida de 384,000 tokens son importantes: largas sesiones de agente, grandes análisis de base de código y procesos con muchos documentos.
DeepSeek también está cortejando a los desarrolladores donde ya trabajan. Ambos modelos se pueden utilizar directamente como backends dentro de Claude Code, GitHub Copilot y OpenCode, y la API habla formatos compatibles con OpenAI y Anthropic, lo que significa que las migraciones desde proveedores occidentales pueden ser un cambio de configuración de una sola línea. La nueva vista previa para desarrolladores "DeepSeek Harness" extiende esa estrategia a los creadores de arneses de agentes.
Qué significa para los desarrolladores
Para los desarrolladores que crearon aplicaciones sensibles a los costos asumiendo que DeepSeek siempre sería la opción más económica, el mensaje es que la era de la caída constante de los precios de los tokens ha terminado, al menos en el laboratorio chino. Las arquitecturas compatibles con el caché ahora pagan una tasa de entrada 30 veces menor que las llamadas sin caché en ambos modelos, lo que hace que la disciplina del almacenamiento en caché rápido sea mucho más valiosa que la elección del modelo. Y para el mercado en general, el giro de DeepSeek elimina al fijador de precios más agresivo del mercado, un regalo silencioso para OpenAI, Anthropic y Google, que han estado compitiendo tanto en costos como en capacidad durante todo el año.
Queda por comprobar si los puntos de referencia del V4 Pro justifican la prima o no por parte de evaluadores independientes. Lo que ya está claro es la lógica empresarial: después de dos años de subsidiar el uso de la IA en el mundo, DeepSeek quiere que le paguen por ello.
---
Mantente al Día con la IALas últimas noticias, análisis y avances de inteligencia artificial, en un solo lugar.
Leer más noticias de IA →