La nouvelle direction de Google DeepMind est sortie de son silence. Koray Kavukcuoglu, qui a repris le laboratoire après le départ de Demis Hassabis en août, a fait mercredi sa première apparition médiatique en tant que responsable de Google DeepMind lors du AI Agenda Live Summit de The Information et a confirmé que le prochain modèle phare de l'entreprise, Gemini 4, en est à la première phase de post-formation, l'étape où un modèle de base est affiné pour se comporter de manière fiable.

S'exprimant lors du sommet, Kavukcuoglu a déclaré qu'il espérait sortir Gemini 4 "beaucoup plus tôt" que la fin de l'année. "Notre intention est de [...] publier dès que possible [...] un résultat post-formation précoce parce que nous voyons les résultats et nous sommes enthousiasmés", a-t-il déclaré, selon un rapport de The Decoder. Des itérations rapides suivraient, Google travaillant toujours sur les garanties et les tests de sécurité. Pour plus de contexte sur cette histoire, consultez notre actualités IA.

Les ingénieurs utilisent déjà Gemini 4 en interne

Le modèle n’est pas seulement une expérience en laboratoire. Kavukcuoglu a révélé que les ingénieurs de Google utilisent déjà Gemini 4 en interne pour l'outil de codage de l'entreprise, Antigravity, un signe précoce que les capacités de codage agentique du modèle sont suffisamment avancées pour être utiles dans les flux de production au sein même de Google.

Gemini 4 sera le premier nouveau modèle phare de Google depuis le lancement de Gemini 3 à la fin de l'année dernière. Depuis lors, la société a publié la mise à jour Gemini 3.1 en février ainsi qu'une série de modèles Flash plus petits et moins chers.

La débâcle de Gemini 3.5 Pro plane sur le lancement

La préparation de Gemini 4 porte les bagages de son prédécesseur disparu. Le PDG Sundar Pichai a annoncé Gemini 3.5 Pro lors de Google I/O en mai pour une sortie en juin, mais le modèle n'est jamais arrivé. Selon le Financial Times, le projet n'a pas respecté trois délais.

Kavukcuoglu n'a pas précisé si Gemini 3.5 Pro avait été officiellement annulé, mais a reconnu que Google avait pris "un peu de recul". "Pour nous, ce qui était important, à l'époque, c'était de maximiser la vitesse d'apprentissage", a-t-il expliqué.

La pause a coûté du terrain à Google. Entre-temps, les concurrents ont pris de l'avance : Anthropic a lancé sa famille Mythos/Fable au printemps et l'a mise à jour, ainsi que la gamme Opus, ce mois-ci, tandis qu'OpenAI déploie des modèles GPT-6 depuis début septembre. Tous sont bien plus performants que les meilleurs modèles actuels de Google, selon l'évaluation de The Decoder.

Kavukcuoglu dit qu'il n'est pas inquiet. Il s'est décrit comme "confiant à cent pour cent" et a exprimé sa confiance dans son "équipe incroyablement forte". "Dans mon esprit, c'est une certitude que nous serons toujours à la frontière", a-t-il déclaré.

Google a déjà rattrapé son retard. Gemini 3 a été un tel bond en avant qu'OpenAI aurait déclaré un « Code Rouge » et n'aurait encore réussi à égaliser qu'avec GPT-5.2. La question de savoir si Gemini 4 peut répéter cet exploit reste une question ouverte.

AGI n'est « pas la bonne conversation »

Tout aussi révélateur que la chronologie est ce que le nouveau chef a dit à propos de l’AGI, l’objectif qui a défini DeepMind pendant plus d’une décennie. "La discussion sur la question de savoir si nous avons atteint ou non l'AGI n'est pas la bonne conversation", a déclaré Kavukcuoglu. « La conversation porte davantage sur la question de savoir si nous sommes capables de créer des agents intelligents auxquels nous pouvons faire confiance ? »

Il s’agit d’un tournant frappant pour un laboratoire dont le co-fondateur avait l’air très différent il y a seulement quelques semaines. "J'ai travaillé pour AGI toute ma vie et maintenant, comme beaucoup d'entre vous, je sens que c'est à portée de main", a écrit Hassabis dans sa note d'adieu lorsqu'il a quitté son poste de PDG. Hassabis préside désormais l'unité et est le scientifique en chef d'Alphabet, tandis que Kavukcuoglu, auparavant directeur technique de l'entreprise, gère les opérations quotidiennes.

La restructuration est profonde. Selon The Decoder, tous les développements de Gemini sont transférés dans la Bay Area, loin du siège londonien qui a donné son identité à DeepMind. "L'ère de DeepMind en tant qu'acteur indépendant est révolue", a déclaré un ancien cadre de Google au Guardian. Le Financial Times a rapporté que les dirigeants étaient frustrés que Hassabis accorde moins d’importance aux besoins commerciaux, citant en exemple sa décision de publier ouvertement AlphaFold.

La connexion à puce

Le travail de modélisation alimente les ambitions matérielles croissantes de Google. La société a commencé à vendre ses TPU directement à ses clients cette année, ce qui la place en concurrence plus étroite avec Nvidia. Selon Kavukcuoglu, les nouveaux modèles montrent aux ingénieurs matériels comment concevoir les « deux ou trois prochaines générations » de puces, une boucle de rétroaction qui relie directement la feuille de route du modèle de Google à l'économie de son centre de données.

Pour l'instant, le message de la nouvelle direction de DeepMind est simple : moins de discussions sur les étapes de l'AGI, plus d'expéditions. Que Gemini 4 arrive "beaucoup plus tôt" que la fin de l'année, comme promis, sera le premier véritable test pour savoir si le laboratoire restructuré peut évoluer au rythme fixé par ses rivaux.

---

Restez à la Pointe de l'IA

Les dernières actualités, analyses et percées en IA — au même endroit.

Lire plus d'actualités IA →