Google DeepMind se prépare à lancer dès mercredi un nouveau modèle d'IA, Gemini 3.8 Flash, ciblant les capacités de développement de logiciels là où Google est à la traîne par rapport à ses concurrents Anthropic et OpenAI. Le Wall Street Journal a rapporté ces projets lundi, citant des tests internes qui montrent que le nouveau modèle progresse en matière de codage – un domaine qui est devenu le champ de bataille le plus âprement disputé entre les laboratoires pionniers.
Le rapport a fait bouger les marchés : les actions d'Alphabet ont progressé après les heures d'ouverture suite à l'article du WSJ, selon Barron's. Les investisseurs surveillent de près les performances de codage de Google, alors que les développeurs ancrent de plus en plus leurs choix d'outils sur le modèle qui écrit, débogue et refactorise le code de la manière la plus fiable dans les flux de travail agents. Pour plus de contexte sur cette histoire, consultez notre actualités IA.
Ce que le WSJ a rapporté
Selon le Journal, les tests internes de Gemini 3.8 Flash montrent des progrès spécifiquement dans le codage, capacité dans laquelle Gemini est à la traîne à la fois des modèles Claude d'Anthropic et de la gamme GPT d'OpenAI. Une publication est attendue cette semaine, mercredi étant cité comme le jour le plus tôt possible.
Le cadrage est important : Google ne revendique pas un saut généralisé par rapport à tous ses concurrents. Au lieu de cela, l’entreprise s’attaque à sa faiblesse la plus visible. Le codage agent – dans lequel un modèle d'IA planifie, écrit, teste et corrige le code sur de nombreux fichiers au cours de longues sessions – est devenu la référence dont les acheteurs d'entreprise et les startups d'outils de développement se soucient le plus, et c'est là que les concurrents de Google ont construit des prospects importants et des bases d'utilisateurs fidèles.
L'écart de codage que Google doit combler
Le codage est progressivement devenu le principal moteur de revenus du secteur de l’IA. Anthropic et OpenAI ont tous deux bâti d'importantes entreprises vendant des modèles capables de coder aux entreprises et aux plateformes de développeurs, et les évaluations tierces des performances de codage agent ont systématiquement placé les modèles Claude et GPT devant Gemini jusqu'en 2026.
Cet écart a de réelles conséquences. Les développeurs qui choisissent un modèle de codage ont tendance à rester au sein de son écosystème : ses outils CLI, ses intégrations d'éditeurs, sa facturation API. Les énormes avantages de distribution de Google via Search, Android et Workspace ne se sont pas traduits par une domination équivalente dans le créneau du codage, et le rapport du WSJ suggère que DeepMind connaît la fenêtre de changement qui s'offre actuellement.
La marque Flash elle-même fait partie du calcul. Depuis que Google a commencé à positionner Flash comme le niveau rapide et peu coûteux de la famille Gemini, le suffixe en est venu à représenter le modèle que les développeurs exécutent réellement en production : des charges de travail à volume élevé et sensibles au prix, où de petites différences de latence et de coût déterminent les choix d'API. Un modèle de niveau Flash qui mène également en matière de codage saperait les arguments de prix des concurrents tout en correspondant à leurs revendications de qualité.
Un suivi rapide de Gemini 3.7 Flash
Si le lancement de mercredi a lieu, il interviendra quelques semaines seulement après que Google ait livré Gemini 3.7 Flash à la mi-août, une version que la société a positionnée comme son modèle le plus intelligent pour le codage et les agents, à environ la moitié du prix précédent. Google a également dévoilé Gemini 3.7 Flash avec une puissance de codage améliorée fin août, lors de la couverture de son déploiement.
La cadence compressée n'est pas passée inaperçue. NokiaPowerUser a rapporté cette semaine "comment Google a corrigé Flash 3.7 si rapidement", reflétant une vision plus large selon laquelle DeepMind est passé à une expédition rapide et progressive - plus proche du rythme d'itération hebdomadaire de ses rivaux que des écarts d'un an des générations Gemini précédentes.
Concentration sur le codage et moins d'hallucinations
Au-delà de la force brute du codage, la couverture du prochain modèle pointe vers une deuxième priorité : réduire les hallucinations. VOI.ID a rapporté que les tests Flash de Gemini 3.8 se concentrent sur le codage tout en réduisant les hallucinations de l'IA – le problème de fiabilité qui compte le plus dans le travail logiciel, où une suggestion erronée en toute confiance peut casser un système de production.
Cette combinaison – un codage agent plus puissant et moins de résultats fabriqués – cible exactement les deux axes cités par les développeurs lorsqu'ils expliquent pourquoi ils s'en tiennent aux outils basés sur Claude ou GPT pour un travail d'ingénierie sérieux.
La fuite du papier Tencent
Le nom du modèle a fait surface publiquement avant le rapport du WSJ, mais à peine. Une mention d'une seule ligne de Gemini 3.8 Flash est apparue dans un document de recherche de Tencent, tel que rapporté par Pasquale Pillitteri, donnant aux passionnés la première confirmation concrète de l'existence du modèle sans en révéler essentiellement rien. Les fuites accidentelles sont un phénomène courant dans l'industrie : les tableaux de référence et les listes de citations dans les articles universitaires sont devenus une source récurrente d'informations préalables au lancement sur des modèles inédits.
Ce que cela signifie pour les développeurs et le marché
Si Gemini 3.8 Flash arrive cette semaine, comme indiqué, les développeurs disposeront de trois laboratoires frontières qui expédieront des modèles de codage de premier ordre au cours du même mois, suite au lancement par Anthropic de Claude Fable 5.1 et Mythos 5.1 avec un codage agent moins cher lundi. La pression sur les prix, déjà intense, va s'accentuer et les fabricants d'outils s'appuyant sur ces API gagneront en pouvoir de négociation avec chaque nouveau concurrent.
Pour Google, les enjeux vont au-delà de l’esprit des développeurs. L'activité cloud d'Alphabet, sa suite de productivité Workspace et son écosystème Android en bénéficient tous si les propres modèles de l'entreprise peuvent alimenter de manière crédible les flux de travail de codage que les entreprises automatisent en premier. Une histoire crédible de codage Gemini prend en charge les trois.
Le rapport du WSJ suggère que Google pense avoir enfin comblé l'écart. Il sera clair d’ici quelques jours si les benchmarks – et plus important encore, les développeurs en activité – sont d’accord.
---
Restez à la Pointe de l'IALes dernières actualités, analyses et percées en IA — au même endroit.
Lire plus d'actualités IA →
