Google a présenté un trio de nouveaux modèles Gemini le 21 juillet 2026, doublant ainsi l'efficacité et la rentabilité dont les développeurs ont besoin pour créer des agents d'IA de production à grande échelle. La société a dévoilé Gemini 3.6 Flash, Gemini 3.5 Flash-Lite et Gemini 3.5 Flash Cyber, chacun ciblant un segment différent du paysage des modèles d'IA de plus en plus compétitif. Pour une couverture complète des derniers développements en matière de dernières actualités sur l'IA, ces versions marquent la démarche la plus agressive de Google à ce jour pour conquérir le marché des développeurs, sensible aux coûts.
Cette annonce intervient à un moment charnière pour le géant de la recherche. Alors que des concurrents comme OpenAI et Anthropic ont attiré l'attention avec leurs modèles phares, la série Flash de Google s'est taillée une place de choix pour les développeurs qui ont besoin d'exécuter des agents d'IA de manière économique et fiable. Les nouveaux modèles représentent une avancée significative en termes de qualité et d'efficacité dans les flux de travail agents.
Gemini 3.6 Flash : le nouveau modèle Workhorse
Gemini 3.6 Flash se positionne comme le modèle phare de Google, s'appuyant directement sur les commentaires des développeurs utilisant le précédent Flash 3.5. Selon l'annonce de Google, rédigée par Tulsee Doshi, directeur principal de la gestion des produits, le modèle améliore le codage, le travail de connaissances et les performances multimodales tout en réduisant considérablement la consommation de jetons.
Sur l'indice d'analyse artificielle, Gemini 3.6 Flash consomme 17 % de jetons de sortie en moins que son prédécesseur. Dans certains benchmarks, comme DeepSWE de Datacurve, la réduction atteint jusqu'à 65 %. Le modèle nécessite également moins d'étapes de raisonnement et d'appels d'outils pour réaliser des flux de travail en plusieurs étapes.
Le prix a été fixé à 1,50 $ par million de jetons d'entrée et à 7,50 $ par million de jetons de sortie, ce qui représente un prix inférieur à celui de la génération précédente. Cela rend les agents plus rentables à créer et à exécuter à grande échelle, un facteur essentiel pour les entreprises qui déploient l'IA sur des milliers de tâches simultanées.
Améliorations des références
Google a signalé plusieurs gains de performances notables par rapport à Flash 3.5 :
- DeepSWE : 49 % contre 37 %, reflétant une plus grande précision dans l'édition de code avec moins de modifications indésirables et une réduction des boucles d'exécution.
- MLE Bench : 63,9 % contre 49,7 %, une augmentation significative des capacités de recherche en apprentissage automatique
- OSWorld-Verified : 83,0 % contre 78,4 %, montrant des capacités améliorées d'utilisation de l'ordinateur
- GDPval-AA v2 : 1 421 contre 1 349, reflétant les gains dans les tâches de travail de connaissances
L'utilisation de l'ordinateur est désormais disponible en tant qu'outil côté client intégré via l'API Gemini et Gemini Enterprise, éliminant ainsi le besoin de couches d'orchestration tierces.
Gemini 3.5 Flash-Lite : conçu pour la vitesse et l'évolutivité
Parallèlement à la mise à niveau Flash, Google a publié Gemini 3.5 Flash-Lite, conçu pour les tâches à faible latence et les charges de travail à haut débit telles que la recherche agentique et le traitement de documents. Il s'agit du modèle le plus rapide de la série 3.5, fonctionnant à 350 jetons de sortie par seconde, mesurés par analyse artificielle.
Au prix agressif de 0,30 $ par million de jetons d'entrée et de 2,50 $ par million de jetons de sortie, Flash-Lite offre un rapport prix/performance intéressant pour les développeurs exécutant un trafic de production à grande échelle. Google a noté que dans de nombreuses évaluations d'agents et de codage, le modèle surpasse même le plus grand Gemini 3 Flash, notamment sur SWE-Bench Pro (54,2 % contre 49,6 %) et OSWorld-Verified (74,0 % contre 65,1 %).
Le modèle prend en charge des niveaux de réflexion configurables, permettant aux développeurs de donner la priorité à l'exécution à faible latence pour les tâches à volume élevé ou d'engager des niveaux de réflexion plus élevés pour les charges de travail complexes de sous-agents en plusieurs étapes.
Gemini 3.5 Flash Cyber : IA pour la sécurité du code
La troisième version, Gemini 3.5 Flash Cyber, est un modèle spécialisé affiné pour rechercher et corriger les vulnérabilités de cybersécurité. Construit sur Flash 3.5, il est associé à l'agent CodeMender de Google, qui utilise plusieurs agents Flash Cyber travaillant ensemble pour produire des rapports de sécurité combinés.
Sur le benchmark CyberGym, le modèle atteint des performances compétitives à la frontière. Cependant, étant donné la nature à double usage de la technologie, Google adopte une approche délibérément prudente en matière de déploiement. Le modèle sera exclusivement disponible pour les gouvernements et les partenaires de confiance via CodeMender dans le cadre d'un programme pilote à accès limité.
Cela donne aux défenseurs de première ligne une longueur d’avance pour trouver et corriger les vulnérabilités critiques avant qu’elles ne puissent être exploitées, tout en atténuant le risque d’une utilisation abusive plus large.
Gemini 3.5 Pro toujours en test
Google a confirmé que Gemini 3.5 Pro, le modèle phare dont le retard a été étroitement surveillé, est actuellement testé avec des partenaires et sera largement disponible dès qu'il sera prêt. La société avait précédemment reporté le lancement de Pro en raison d'objectifs de performance internes et d'une vague de départs de chercheurs.
Peut-être plus particulièrement, Google a révélé que l'équipe avait déjà commencé ce qu'elle décrit comme sa phase de pré-formation la plus ambitieuse à ce jour pour Gemini 4, signalant que la prochaine génération de modèles est déjà en cours.
Mesures de sécurité améliorées
Gemini 3.6 Flash est livré avec des garanties renforcées en matière de sécurité aux frontières dans les domaines des menaces chimiques, biologiques, radiologiques et nucléaires (CBRN) et des utilisations abusives des cyberinfractions. Google affirme que ces garanties rendent le modèle nettement plus résistant aux jailbreaks tout en minimisant les refus pour des utilisations bénéfiques.
Cette publication intervient dans un contexte de surveillance accrue de la sécurité des modèles d’IA à Washington, où l’administration Trump a poussé les entreprises à partager des modèles inédits avec des testeurs gouvernementaux avant leur diffusion publique. Google DeepMind et Microsoft ont tous deux signé des accords avec le Centre gouvernemental pour les normes et l'innovation en IA en mai 2026 pour partager leurs modèles frontières pour les tests de sécurité nationale.
Disponibilité
Gemini 3.6 Flash et 3.5 Flash-Lite sont disponibles immédiatement pour les développeurs via l'API Gemini, Google AI Studio et Android Studio. Les clients Entreprise peuvent y accéder via la plateforme d'agent Gemini Enterprise. L'application Gemini prend également en charge les deux modèles destinés à un usage grand public, et la version 3.5 Flash-Lite est en cours de déploiement dans la recherche Google.
Gardez une longueur d'avance sur l'IA
Vous voulez en savoir plus sur le monde de l’intelligence artificielle ? Ajoutez AI Buzz Wire à vos favoris pour connaître la dernière couverture de l'industrie de l'IA à laquelle vous pouvez faire confiance.
Lire plus d'actualités sur l'IA →


