Google prépare l'un des lancements de modèles d'IA les plus conséquents de l'année, le chef de DeepMind, Demis Hassabis, confirmant que Gemini 4 est sur le point de sortir et pourrait arriver beaucoup plus tôt que prévu par la plupart des observateurs.
Selon The Information, Hassabis a déclaré au média que Google avait l'intention de lancer Gemini 4 ", espérons-le, beaucoup plus tôt que la fin de l'année", une déclaration qui recadre immédiatement le calendrier de la prochaine phase de la course aux modèles frontières. Le commentaire est arrivé juste au moment où les actions d'Alphabet se stabilisaient après leur pire baisse en un mois, et cela indique que Google a l'intention de répondre aux publications rapides d'OpenAI et d'Anthropic avec sa propre cadence accélérée. Pour les lecteurs qui suivent le cycle plus large des dernières nouvelles sur l'IA (https://aibuzzwire.news), l'annonce met en place un dernier trimestre en tête-à-tête entre les trois laboratoires frontières dominants.
Une chronologie accélérée pour Gemini 4
Les rapports autour des commentaires de Hassabis indiquent que Gemini 4 est entré dans la phase post-formation, la dernière étape du développement dans laquelle un modèle est affiné pour la qualité du raisonnement, le suivi des instructions et le comportement du produit avant son déploiement public. Selon plusieurs rapports, Google prévoit de déployer prochainement une première version allégée du modèle, le modèle Full Frontier étant ciblé bien avant la fin de l'année.
Cette approche marque un changement délibéré pour Google. Plutôt que de retenir un modèle fini pendant des mois de tests internes, la société prévoit de déployer rapidement les premières itérations, puis de fournir des mises à jour continues, réduisant ainsi l'écart entre les avancées en laboratoire et les produits réellement touchés par les développeurs et les consommateurs. Il s’agit de la même philosophie de publication qu’OpenAI a popularisée et qu’Anthropic a adoptée avec ses itérations rapides de Claude – et cela représente un changement culturel notable au sein de DeepMind, qui a historiquement favorisé des cycles de publication plus longs et plus raffinés.
Pourquoi Google est pressé
Le contexte concurrentiel explique l'urgence. En l’espace de trois jours cette semaine, Anthropic et OpenAI ont lancé des modèles phares rivaux – Claude Opus 5.5 et GPT-6 Sol – à quelques heures d’intervalle, intensifiant la pression sur Google pour démontrer que sa prochaine génération les suit de près. Google a également maintenu son rythme de livraison dans le bas de la gamme, en déployant Gemini 3.8 Flash TTS et Flash-Lite TTS avec une conception vocale personnalisée plus tôt cette semaine.
Les dirigeants d'Alphabet préparent le terrain depuis des mois. En juillet, le PDG Sundar Pichai a déclaré aux investisseurs que Google aurait besoin de « modèles de base beaucoup plus grands » et de Gemini 4 pour rivaliser à la frontière, parallèlement à une prévision de dépenses en capital relevée pour 2026 de 195 à 205 milliards de dollars pour développer la capacité de calcul requise par ces modèles. Plus récemment, des rapports sur les recherches internes de DeepMind ont décrit les premiers signes d'auto-amélioration récursive des systèmes de Google – des capacités affirmant que, si elles se matérialisaient dans Gemini 4, cela ferait des débuts du modèle l'un des lancements les plus scrutés de l'année.
À quoi s'attendre du modèle lui-même
Google n'a pas officiellement détaillé les capacités de Gemini 4, et les affirmations circulant dans les cercles de développeurs doivent être traitées avec prudence jusqu'à ce que la société publie ses propres benchmarks. Cela dit, plusieurs thèmes reviennent dans les premières fuites et dans les commentaires de l’industrie :
- Pression sur les prix. Bindu Reddy, PDG d'Abacus AI, a publiquement suggéré que Gemini 4 pourrait considérablement saper les modèles concurrents, avec des affirmations circulant selon lesquelles les coûts opérationnels pourraient être jusqu'à 5 fois moins chers que les alternatives actuelles.
- Sortie 3D et spatiale native. Des fuites font allusion à la génération de graphiques 3D natifs et à la compréhension de scènes volumétriques, étendant ainsi la direction multimodale suivie par Gemini depuis son lancement.
- Graphiques vectoriels plus propres. Des améliorations dans la génération SVG ont été signalées par les développeurs avec un prétendu accès anticipé, ce qui serait important pour la conception Web et les flux de travail des actifs numériques.
- Codage avancé et comportement agent. Une synthèse de code raffinée et un débogage autonome plus puissant sont attendus, poursuivant ainsi la transition de l'industrie vers des modèles capables d'effectuer de longues tâches avec une supervision minimale.
Aucune de ces fonctionnalités n’est confirmée. Le message officiel de Google reste axé sur le timing, le cadrage de Hassabis "beaucoup plus tôt que la fin de l'année" faisant le travail de définition des attentes sans s'engager sur une date précise.
Les enjeux business
Pour Alphabet, le timing du lancement a un poids financier. L'activité cloud de l'entreprise a été le principal bénéficiaire de la demande d'IA d'entreprise, avec une croissance de 82 % sur un an au deuxième trimestre, et chaque trimestre qui se déroule sans modèle de pointe donne aux concurrents plus de marge pour consolider leurs écosystèmes de développeurs. La réaction du marché boursier à l'annonce de cette semaine (les actions se stabilisent après un mois difficile) illustre à quel point la valorisation de Google est désormais étroitement liée aux perceptions de sa compétitivité en matière d'IA.
Le lancement arrive également sur un marché qui a changé depuis que Google a lancé Gemini 3. Les modèles open source et open-weight, en particulier ceux des laboratoires chinois, ont comblé une grande partie du déficit de capacités à une fraction du coût, tandis que les acheteurs d'entreprise sont devenus plus disciplinés en matière de dépenses. Un modèle pionnier qui associe des performances de premier ordre à des prix agressifs, comme le prévoient Reddy et d’autres, ferait pression sur les concurrents sur deux fronts à la fois.
Ce qui vient ensuite
Si le calendrier indiqué se maintient, les premiers signes de Gemini 4 apparaîtront probablement dans les propres produits de Google (Search, Workspace et l'application Gemini) avant une disponibilité plus large de l'API, reflétant le modèle de déploiement des générations précédentes. Les développeurs devraient surveiller une publication anticipée du point de contrôle dans les semaines à venir, qui donnerait la première preuve concrète de la position du modèle par rapport à Claude Opus 5.5 et GPT-6 Sol.
Pour l'instant, le message de Google au marché est simple : la prochaine course aux modèles de pointe est celle que Google perdra, et l'attente est presque terminée. La question de savoir si Gemini 4 peut réinitialiser les attentes en matière de performances et de prix – et pas seulement être expédié rapidement – déterminera si la confiance de Hassabis se lit comme un revirement ou un triomphe à la fin de l'année.
---
Gardez une longueur d'avance sur l'IARecevez les dernières actualités, analyses et avancées en matière d'IA, le tout en un seul endroit.
Lire plus d'actualités sur l'IA →