OpenAI a réduit de plus de 20 % le prix des développeurs pour son modèle frontière GPT-5.6 Sol, a rapporté Reuters vendredi, mettant ainsi fin à des mois de résistance alors que les concurrents réduisaient la prime du produit phare. Cette décision ramène le modèle le plus performant d'OpenAI à 4 $ par million de jetons d'entrée et à 20 $ par million de jetons de sortie au niveau standard, selon la page de tarification officielle de la société – une baisse significative par rapport aux taux d'entrée de 5 $ et de 30 $ de sortie que Sol a pratiqués depuis son lancement. C’est le signal le plus clair à ce jour que la guerre des prix de l’IA a atteint le sommet de la pile de modèles, un changement que nous avons suivi dans notre couverture de l’économie de l’industrie de l’IA.

Les chiffres derrière la coupe

Les nouveaux prix indiqués sur la documentation de la plate-forme OpenAI indiquent GPT-5.6 Sol à 4,00 $ par million de jetons d'entrée, 0,40 $ pour l'entrée en cache, 5,00 $ pour les écritures en cache et 20,00 $ par million de jetons de sortie pour les requêtes à contexte court. Les requêtes à contexte long exécutent désormais une entrée de 8,00 $ et une sortie de 30,00 $. Cela représente une réduction de 20 % sur les intrants et de 33 % sur la production par rapport aux prix de lancement du modèle de 5 $ et 30 $.

OpenAI propose également des tarifs promotionnels Sol à 2,00 $ d'entrée et 10,00 $ de sortie – la moitié du nouveau tarif standard – qui, selon la société, sont disponibles au moins jusqu'au 21 novembre 2026. Les niveaux de lots et flexibles chutent encore plus bas, à partir de 2,00 $ d'entrée et 10,00 $ de sortie pour une planification flexible.

Un produit phare qui a résisté — jusqu'à présent

La réduction inverse une stratégie délibérée. Lorsque OpenAI a réduit les prix de la famille GPT-5.6 le 30 juillet, il a réduit le petit modèle Luna de 80 % à 0,20 $ d'entrée et 1,20 $ de sortie, et a réduit le Terra de niveau intermédiaire de 20 % à 2 $ et 12 $ – mais a laissé Sol intact, arguant que les capacités du produit phare justifiaient une tarification frontière.

Trois semaines de pression sur les marchés semblent avoir changé la donne. Claude Opus 5 d'Anthropic est proposé à 5 $ d'entrée et 25 $ de sortie, ce qui réduit l'ancien tarif de sortie de 30 $ de Sol, tandis que Claude Sonnet 5 est disponible à un prix de lancement de 2 $ et 10 $ de sortie jusqu'au 31 août avant de passer à 3 $ et 15 $. Les laboratoires chinois sous-cotent les deux : le V4 Pro 0813 de DeepSeek est coté à environ 0,435 $ d'entrée et 0,87 $ de sortie par million de jetons via les plates-formes de routage, et le Kimi K3 de Moonshot AI à 2,80 $ et 14 $.

Route des développeurs, ils ne se marient pas

Pour les équipes d’ingénierie, la tarification modèle est devenue une décision de routage. Une pile d'entreprise typique peut confier le travail de codage et de raisonnement le plus difficile à un modèle frontière, les tâches de routine à un niveau intermédiaire et les tâches répétitives à volume élevé à l'option la moins chère. Lorsque les jetons de sortie du produit phare coûtent 30 fois plus que ceux d'un rival crédible, les équipes financières commencent à se demander quelles demandes méritent vraiment la prime.

Le changement de comportement est déjà visible. Fortune a rapporté en juillet que le co-fondateur et directeur technique de DoorDash, Andy Fang, avait déclaré que Moonshot AI offrait une « meilleure qualité » à un « coût moins élevé » pour l'une des expériences d'IA de l'entreprise, et qu'Airbnb et Siemens testaient des fournisseurs chinois, notamment Alibaba et DeepSeek, alors que les factures d'IA montaient en flèche.

Reuters a lié la réduction de vendredi à cette pression concurrentielle, notant qu'OpenAI s'efforce de maintenir les développeurs ancrés dans sa plate-forme alors que ses concurrents – y compris Anthropic, qui prépare une introduction en bourse à succès – pressent de toutes parts. OpenAI a franchi le cap du milliard d'utilisateurs plus tôt cet été après ses baisses de prix de juillet, et la société a fait valoir que le coût d'inférence est désormais une stratégie produit plutôt qu'une plomberie de back-office, attribuant un meilleur routage matériel, un logiciel d'inférence amélioré et une mise en cache contextuelle plus intelligente pour sa capacité à réduire les tarifs.

Ce que cela signifie pour le marché

Pour OpenAI, la coupe Sol protège le fossé là où il est le plus mince : les charges de travail des développeurs qui peuvent se déplacer entre les API avec un changement de configuration. Le niveau promotionnel jusqu'en novembre se présente comme un outil de rétention agressif destiné au cycle d'évaluation que les entreprises effectuent avant d'engager le trafic de production.

Pour le marché plus large, un concurrent inférieur à 1 $, une option intermédiaire à 14 $ et un produit phare désormais à 20 $ signalent que les prix des jetons chutent plus rapidement que ne le prévoyaient la plupart des prévisions pour 2025 – même si les coûts de formation pour les modèles frontières montent en flèche. Les laboratoires subventionnent effectivement l’inférence pour défendre la part de l’écosystème, une dynamique qui favorise les entreprises les plus riches et la plus grande distribution.

La réponse d'Anthropic sera surveillée de près. Avec son introduction en bourse visant une augmentation pouvant atteindre 100 milliards de dollars, selon le New York Times, la société a tout intérêt à conserver son avantage de prix visible. Google, Meta et les laboratoires chinois ont chacun leurs propres coupes à considérer.

Pour les développeurs, le conseil est simple : les prix évoluent chaque semaine et la facture que vous avez budgétée le mois dernier est déjà périmée. Verrouiller l'architecture autour de la grille tarifaire d'un fournisseur unique est désormais un risque en soi : les couches de routage qui peuvent déplacer le trafic entre les modèles à mesure que les prix changent sont devenues une infrastructure standard, une tendance accélérée par l'acquisition d'OpenRouter par Stripe cette semaine.

Gardez une longueur d'avance sur l'IA

Les prix des modèles, les versions et les guerres de référence évoluent à une vitesse vertigineuse. AI Buzz Wire fournit quotidiennement des informations sur l'IA dont la source est vérifiée : des chiffres précis, des sources réelles, aucun battage médiatique.

Lire plus d'actualités sur les modèles d'IA →