Los modelos chinos de inteligencia artificial han superado a sus competidores estadounidenses en el uso global, según datos recientes de OpenRouter, la plataforma de agregación más grande del mundo para modelos de lenguajes grandes. Las cifras, publicadas en varios medios el 20 de junio de 2026, muestran que los sistemas construidos por laboratorios chinos ahora consumen más tokens en todo el mundo que los de OpenAI, Google o Anthropic, un cambio impulsado por precios agresivos, crecientes cargas de trabajo de agentes de IA y una ola de ganancias de eficiencia forzadas por los controles de exportación de chips de Estados Unidos.
DeepSeek V4 Flash lidera un ranking dominado por los chinos Para más contexto sobre esta historia, consulta nuestra cobertura de la industria de IA.
Según datos de OpenRouter citados por The News International y corroborados por CGTN y Firstpost, los modelos chinos ocupan ahora la cima de la clasificación mundial de consumo de tokens. DeepSeek V4 Flash ocupó el primer lugar con 4,63 billones de tokens procesados, seguido de MiniMax M3 con 4,13 billones de tokens y MiMo-V2.5 de Xiaomi con 3,8 billones de tokens.
El top 10 más amplio también incluyó Hy3, DeepSeek V4 Pro y Owl Alpha de desarrolladores chinos de Tencent, junto con Claude Opus 4.7, Claude Sonnet 4.6 y Claude Opus 4 de Anthropic. Anthropic fue la única empresa con sede en EE. UU. que se ubicó entre los cinco primeros. Gemini 2 de Google y GPT-5.5 de OpenAI obtuvieron resultados considerablemente peores, quedando en el puesto 12 y 13 respectivamente.
El resultado es sorprendente porque OpenRouter no es una plataforma china. Fundada por Alex Atallah, ex director de tecnología del mercado NFT OpenSea, ofrece una única puerta de enlace API a más de 400 modelos de más de 60 proveedores, y sus datos de uso transparentes se tratan ampliamente como un barómetro de la industria sobre qué modelos los desarrolladores y las empresas realmente eligen ejecutar.
Por qué los tokens se han convertido en el nuevo campo de batalla
Un token es la unidad más pequeña que procesa un modelo de IA (una palabra completa, un fragmento o incluso un solo carácter) y los proveedores facturan en función del volumen de tokens manejados tanto para la entrada como para la salida. Eso hace que el consumo de tokens sea un indicador directo de la intensidad con la que se utiliza un modelo, y se ha convertido en el frente central de fijación de precios en la industria.
Lo que está en juego está aumentando rápidamente gracias a los agentes de inteligencia artificial. Un simple chatbot podría quemar alrededor de 30.000 tokens que resuman Hamlet de Shakespeare, pero un agente autónomo que ejecute una tarea de codificación puede consumir hasta 20 millones de tokens. Goldman Sachs ha predicho que la proliferación de agentes de IA impulsará un aumento de 24 veces en el consumo de tokens para 2030, lo que contribuirá a una esperada crisis en el suministro de chips durante los próximos 12 a 18 meses.
Los modelos chinos ganan en costos
La razón principal del liderazgo de China es el precio. Los informes de Trending Topics, basados en datos de precios de OpenRouter, muestran que los modelos chinos son aproximadamente entre 10 y 20 veces más baratos que las principales alternativas estadounidenses. MiniMax M2.5, por ejemplo, cobra alrededor de $0,30 por millón de tokens de entrada y $1,10 por millón de tokens de salida, en comparación con alrededor de $5,00 y $25,00 por Claude Opus 4.6 de Anthropic.
Esa brecha es de enorme importancia para las cargas de trabajo de agentes que procesan enormes volúmenes de tokens de forma continua. Varios factores sustentan la ventaja de costos: energía más barata impulsada por una fuerte inversión estatal en energías renovables, arquitecturas de "mezcla de expertos" más eficientes y la disciplina impuesta por las restricciones estadounidenses a la exportación de chips avanzados, que obligaron a los desarrolladores chinos a hacer más con menos computación. El gobierno de China ha vinculado explícitamente la política energética y la competitividad de la IA como una prioridad nacional en su plan de trabajo para 2026.
El rendimiento cierra la brecha
El precio por sí solo no sería suficiente si los modelos tuvieran menos calidad. Pero la brecha técnica se ha reducido drásticamente. MiniMax M2.5 obtuvo una puntuación del 80,2% en SWE-Bench Verified, un punto de referencia estándar para la capacidad de ingeniería de software, apenas por detrás del 80,8% de Claude Opus 4.6. Según la plataforma de análisis Artificial Analysis, varios modelos chinos han alcanzado el nivel superior mundial en programación, comprensión multimodal y procesamiento de contexto prolongado.
El patrón de adopción se extiende a las propias empresas emergentes estadounidenses. Martin Casado, de la empresa de riesgo Andreessen Horowitz, ha estimado que alrededor del 80% de las empresas jóvenes de IA que construyen sobre pilas de código abierto utilizan ahora modelos chinos.
Las empresas estadounidenses recurren a límites simbólicos y controles presupuestarios
Las cifras de OpenRouter llegan en un momento en el que las principales empresas estadounidenses están retirando su gasto ilimitado en IA. Varias empresas estadounidenses están pasando de las suscripciones de tarifa fija a la facturación basada en tokens, y las empresas están introduciendo límites estrictos para contener los costos. Según se informa, Uber, Amazon, Microsoft y Meta han limitado el consumo de tokens en las últimas semanas, ya que el costo de implementar IA a escala supera sus presupuestos.
La reducción de Microsoft ha sido particularmente visible. La compañía decidió recientemente revocar su licencia interna del código Claude para su división de Experiencias y Dispositivos, finalizando el acceso antes del 30 de junio de 2026, una señal de que incluso los compradores empresariales más grandes están examinando la economía por token.
Un mapa competitivo cambiante
La instantánea de OpenRouter no captura todo el mercado global: refleja solo la proporción de uso que fluye a través de un agregador. Pero la dirección del viaje es consistente con un realineamiento más amplio en el que los laboratorios chinos, alguna vez descartados como seguidores rápidos, están marcando cada vez más el ritmo en las métricas que más preocupan a los desarrolladores: precio, velocidad y capacidad suficientemente buena.
Queda por ver si los laboratorios estadounidenses responden reduciendo los precios, inclinándose más hacia el desempeño premium o impulsando políticas. Por ahora, los datos del token cuentan una historia inequívoca: cuando los desarrolladores votan con sus llamadas API, China está ganando.
---
Mantente al Día con la IALas últimas noticias, análisis y avances de inteligencia artificial, en un solo lugar.
Leer más noticias de IA →




