La course à la construction de l'infrastructure qui exécute réellement les modèles d'IA a donné lieu à l'une des plus importantes levées de fonds de l'année. Baseten, une startup dont la plateforme sert et fait évoluer des modèles d'IA open source et personnalisés, a levé 1,5 milliard de dollars dans une série F qui valorise l'entreprise jusqu'à 13 milliards de dollars, selon plusieurs rapports publiés les 22 et 23 juin 2026.

Reuters a annoncé l'accord le 23 juin, Bloomberg, le Wall Street Journal et Tech in Asia corroborant les gros chiffres. Ce cycle souligne à quel point l’attention des investisseurs – et le capital – se déplace des laboratoires qui forment les modèles vers les entreprises qui font fonctionner ces modèles rapidement et à moindre coût en production. Pour plus de contexte sur cette histoire, consultez notre actualités IA.

Pourquoi l'inférence est le nouveau champ de bataille

Si la formation d’un modèle fait la une des journaux, l’inférence – l’acte d’exécuter réellement un modèle pour générer une réponse – est l’endroit où l’argent est dépensé chaque jour. Chaque requête transitant par un chatbot, un assistant de codage ou une application basée sur l'IA déclenche un calcul d'inférence. À mesure que l’adoption s’est accélérée, l’inférence est devenue le coût récurrent le plus important de la pile d’IA.

Le propre slogan de Baseten résume clairement la thèse : « L'inférence est tout ». La Baseten Inference Stack de la société promet les temps d'exécution de modèle les plus rapides, une haute disponibilité inter-cloud et des flux de travail de développement transparents, soutenus par des noyaux personnalisés, des techniques de décodage avancées et une mise en cache intégrée directement dans la plateforme.

Le Wall Street Journal, qui a rendu compte de l'entreprise plus tôt en juin, a qualifié Baseten de pariant sur des alternatives moins chères aux modèles hébergés d'OpenAI – arguant essentiellement que les organisations exécuteront de plus en plus de modèles open source performants sur une infrastructure optimisée plutôt que de payer des tarifs majorés à un seul fournisseur.

Un pari record venant d'Australie

L'un des éléments les plus marquants du cycle est la participation de Blackbird, la société australienne de capital-risque. Reuters a rapporté que la participation de Blackbird représente un pari record – considéré comme le plus gros investissement jamais réalisé par un fonds de capital-risque australien. Cet engagement indique que l’appétit pour les accords d’infrastructure d’IA s’est répandu bien au-delà de la Silicon Valley, avec des fonds internationaux prêts à signer d’énormes chèques pour les entreprises positionnées au centre de l’économie d’inférence.

La série F propulse Baseten dans les rangs supérieurs des sociétés privées d’IA. Une valorisation de 13 milliards de dollars la place aux côtés de certaines des startups d'infrastructures et d'outillage les plus valorisées du secteur, et les 1,5 milliards de dollars de nouveau capital lui donnent les ressources nécessaires pour rivaliser en matière de calcul, de talent et d'ingénierie à un moment où le marché de l'inférence se consolide rapidement.

Ce que fait réellement Baseten

Selon le site Web de l'entreprise, Baseten fournit une plate-forme de bout en bout pour déployer des modèles d'IA en production. Ses offres couvrent plusieurs niveaux :

  • Déploiement d'inférence : les organisations peuvent tester des charges de travail, prototyper des produits et évaluer les derniers modèles d'IA optimisés pour la vitesse de production.
  • Formation et déploiement en un clic : les utilisateurs peuvent former des modèles et les déployer sur une infrastructure optimisée pour l'inférence en une seule étape.
  • API de monétisation : Les développeurs de modèles peuvent mettre en place une API d'inférence optimisée par Baseten pour commercialiser leur travail plus rapidement.

La société souligne que pour obtenir l’inférence la plus rapide, il ne suffit pas d’acquérir des GPU. Cela nécessite des noyaux personnalisés adaptés à des modèles spécifiques, les derniers algorithmes de décodage et une mise en cache sophistiquée – des capacités que Baseten a intégrées à sa plate-forme pour se différencier des fournisseurs de calcul cloud brut.

Le boom de l'inférence plus large

Le méga-tour de Baseten est le dernier signe que la couche d'inférence de la pile d'IA est devenue un marché âprement disputé. Alors que le coût de fonctionnement des modèles est devenu une préoccupation majeure pour les entreprises – les incitant à limiter l’utilisation des développeurs et à rechercher des gains d’efficacité – une série de startups a émergé promettant un service de modèles plus rapide, moins cher et plus fiable.

La dynamique concurrentielle est intense. Les géants du cloud comme Amazon, Google et Microsoft proposent leurs propres services d'inférence, tandis que les acteurs spécialisés rivalisent sur le prix, la latence et l'expérience des développeurs. Le pari de Baseten est qu'une pile d'inférence spécialement conçue, optimisée sur l'ensemble du pipeline, du noyau à l'API, peut surpasser les offres généralistes – et que les modèles open source continueront d'éroder la domination de tout fournisseur fermé.

La réussite de cette thèse dépendra de sa mise en œuvre, mais le marché estime clairement que l’opportunité se chiffre en dizaines de milliards. Avec sa série F, Baseten a obtenu à la fois le capital et la validation – auprès d'investisseurs répartis sur trois continents – pour faire valoir que l'inférence, et non la formation, est le lieu où sera construite la prochaine grande entreprise d'IA.

---

Restez à la Pointe de l'IA

Les dernières actualités, analyses et percées en IA — au même endroit.

Lire plus d'actualités IA →