Google is nog niet klaar met de uitrol van Gemini 4 Argon voor het publiek, maar volgens interne documenten die zijn beoordeeld door Business Insider, is het bedrijf al bezig met het testen van het volgende: een Gemini 4-variant met de codenaam Carbon die vroege tekenen vertoont van overeenstemming met het sterkste codeermodel van Anthropic.
De rapportage, vrijdag gepubliceerd en gedetailleerd door The Decoder, beschrijft documenten, screenshots en interne chats waarin Google-medewerkers drie Gemini 4-varianten bespreken die in ontwikkeling zijn: Argon, Barium en Carbon. Voor lezers die de race naar grensmodellen volgen, is dit het nieuwste teken dat de kloof tussen modelgeneraties aan het instorten is in een voortschrijdende stroom van updates, en onze AI-modelnieuws berichtgeving volgt elke stap ervan.
Carbon draait al binnen Google
Volgens Business Insider is Carbon de afgelopen dagen ingezet op Jetski, het interne codeerplatform van Google, en vroege gebruikers zeggen dat het vooral sterker is dan Argon bij programmeertaken. Eén medewerker vergeleek Carbon met Claude Opus 5.5, het sterkste codeermodel van Anthropic, terwijl hij waarschuwde dat het Google-model nog verder getest moet worden voordat die vergelijking veel betekent.
Dezelfde documenten bieden een zeldzame kijk op de manier waarop Google zijn grensreleases een naam geeft en organiseert. Argon, het huidige grensmodel van het bedrijf, droeg voorheen de codenaam 'Barium-B', en een medewerker omschreef Carbon intern als het 'Gemini pro next-model'. Dat suggereert dat Carbon en Barium checkpoints of kandidaat-updates zijn binnen de Argon-grensfamilie in plaats van afzonderlijke productniveaus, hoewel de documenten niet duidelijk maken of Carbon uiteindelijk als een Argon-upgrade of als een eigen release zal worden verzonden.
Niet iedereen binnen Google is ervan overtuigd dat het nieuwe model een grote sprong voorwaarts is. Vroege versies van Argon herinnerden een andere medewerker aan het oudere Opus 5 bij sommige codeertaken, ook al werd de algehele interne ontvangst van het model als positief gerapporteerd.
Waarom Argon geen flitsmodel is
Toen Argon op 30 september werd aangekondigd, deden er speculaties de ronde dat het misschien een voor snelheid geoptimaliseerd Flash-klasse-model zou zijn in plaats van een release met maximale prestaties. Google heeft die theorie sindsdien afgeschermd. In de aankondiging van zijn Gemini-agent voor Google Workspace heeft het bedrijf zijn modellenreeks per doel uiteengezet: Argon voor grensverleggend redeneren, Flash voor snelheid en volume, Omni voor generatieve media en Gemma voor lichtgewicht werk met open gewichten.
Argon is daarom het sterkste redeneermodel van Google, door het bedrijf gepositioneerd naast de Opus-lijn van Anthropic en de Astra van OpenAI. Het is momenteel alleen beschikbaar voor een beperkte groep vertrouwde cyberverdedigers via het Fairwind-programma van Google, met een prijs van $ 2 per miljoen inputtokens en $ 10 per miljoen outputtokens, en in de cache opgeslagen invoer met 95 procent korting.
'Recursieve zelfverbetering'-grappen schrijven zichzelf
Het tempo van de interne iteratie is niet onopgemerkt gebleven. Vedant Misra, een Google DeepMind-onderzoeker, reageerde op het Business Insider-rapport over X met een scherpe grap: "Heb je gehoord van recursieve zelfverbetering?" — een verwijzing naar de praktijk van het gebruik van AI-systemen om betere AI-systemen te helpen bouwen. OpenAI en Anthropic hebben beide een vergelijkbare dynamiek gerapporteerd in hun eigen pijplijnen, waar opeenvolgende modelgeneraties steeds meer helpen bij het produceren van hun opvolgers.
Of Carbon wel of niet een product is van die lus, de codenaam churn zegt veel. Een snelle opeenvolging van interne controlepunten, elk binnen enkele dagen na implementatie getest tegen grensrivalen, suggereert dat Google zijn releaseproces heeft geïndustrialiseerd op een manier die de traditionele modelcyclus van zes tot twaalf maanden comprimeert.
Google is de lanceringsmachines al aan het voorbereiden
Er is nog steeds geen officiële datum voor een bredere lancering van Gemini 4, maar de eigen producten van Google worden herschikt om ruimte te maken. In de Gemini-app hebben gebruikers en testers een nieuwe ‘Automatische’ modus ontdekt voor de modellen uit de 3-serie, naast een instelbare redeneerintensiteitsinstelling die varieert van laag naar hoog. In Google AI Studio is een nieuwe ‘Ultra’-modus verschenen, die toegang belooft tot ‘geavanceerde vaardigheden en tools’.
Google's Logan Kilpatrick heeft publiekelijk bevestigd dat het team eraan werkt om het maximale uit Argon te halen, wat consistent is met het patroon dat de interne documenten beschrijven: het grensmodel naar een klein professioneel publiek sturen, het blijven herhalen ten opzichte van benchmarks van concurrenten en de toegang uitbreiden naarmate de vangrails volwassener worden.
Wat je nu moet bekijken
Drie vragen zullen de komende weken bepalen. Ten eerste: of de vroege codeerprestaties van Carbon stand houden bij bredere interne tests of vervagen zoals veelbelovende controlepunten soms doen. Ten tweede, of Google Argon verder uitbreidt dan cyberverdedigers naar ontwikkelaars en consumenten – het bedrijf heeft alleen gezegd dat een bredere beschikbaarheid “zo snel mogelijk” zal komen. Ten derde, hoe Anthropic en OpenAI reageren: Opus 5.5 is het referentiepunt dat de eigen medewerkers van Google gebruiken voor codeervergelijkingen, en een concurrerende Gemini-update zou een nieuwe prijs- en capaciteitswedstrijd op gang brengen die de kosten van codeermodellen dit jaar al heeft gecomprimeerd.
Voorlopig blijft Carbon een interne codenaam die is gekoppeld aan screenshots en chatlogs, en niet een aangekondigd product. Maar de reisrichting is duidelijk. Google concurreert niet langer door modellen te lanceren; het concurreert door ze voortdurend te vervangen.
Blijf AI een stap voor
Frontier-modellekken, lanceringen en benchmarks komen dagelijks binnen - we scheiden signalen van ruis.
Lees meer AI-nieuws →