Google har ännu inte rullat ut Gemini 4 Argon till allmänheten, men enligt interna dokument som granskats av Business Insider testar företaget redan nästa sak: en Gemini 4-variant med kodnamnet Carbon som visar tidiga tecken på att matcha Anthropics starkaste kodningsmodell.

Rapporten, publicerad i fredags och detaljerad av The Decoder, beskriver dokument, skärmdumpar och interna chattar där Google-anställda diskuterar tre Gemini 4-varianter under utveckling: Argon, Barium och Carbon. För läsare som följer frontiermodellracet är detta det senaste tecknet på att klyftan mellan modellgenerationerna håller på att kollapsa till en rullande ström av uppdateringar, och vår AI-modellnyheter följer varje steg i den.

Kol är redan igång i Google

Enligt Business Insider har Carbon distribuerats under de senaste dagarna på Jetski, Googles interna kodningsplattform, och tidiga användare säger att det i första hand är starkare än Argon i programmeringsuppgifter. En anställd jämförde Carbon med Claude Opus 5.5, Anthropics starkaste kodningsmodell, samtidigt som han varnade för att Google-modellen fortfarande behöver testas ytterligare innan den jämförelsen betyder mycket.

Samma dokument erbjuder en sällsynt titt på hur Google namnger och iscensätter sina frontier-releaser. Argon, företagets nuvarande gränsmodell, bar tidigare kodnamnet "Barium-B", och en anställd beskrev Carbon internt som "Gemini pro nästa modell." Det tyder på att Carbon och Barium är kontrollpunkter eller kandidatuppdateringar inom Argon Frontier-familjen snarare än separata produktnivåer, även om dokumenten inte klargör om Carbon så småningom kommer att skickas som en Argon-uppgradering eller som sin egen release.

Inte alla inom Google är övertygade om att den nya modellen är ett rent steg framåt. Tidiga versioner av Argon påminde en annan anställd om den äldre Opus 5 om vissa kodningsuppgifter, även om den övergripande interna mottagningen av modellen rapporterades som positiv.

Varför Argon inte är en Flash-modell

När Argon tillkännagavs den 30 september cirkulerade spekulationer om att det kan vara en hastighetsoptimerad Flash-klassmodell snarare än en release med maximal prestanda. Google har sedan dess uteslutit den teorin. I tillkännagivandet av sin Gemini-agent för Google Workspace, presenterade företaget sin modellserie efter syfte: Argon för gränsresonemang, Flash för hastighet och volym, Omni för generativa medier och Gemma för lättviktsarbete med öppen vikt.

Argon är därför Googles starkaste resonemangsmodell, placerad av företaget vid sidan av Anthropics Opus-linje och OpenAI:s Astra. Den är för närvarande endast tillgänglig för en begränsad grupp av pålitliga cyberförsvarare genom Googles Fairwind-program, med priset satt till 2 USD per miljon indatatoken och 10 USD per miljon utdatatokens, och cachad indata rabatterad med 95 procent.

Skämt "Rekursiv självförbättring" skriver sig själva

Hastigheten i den interna iterationen har inte gått obemärkt förbi. Vedant Misra, en Google DeepMind-forskare, svarade på Business Insider-rapporten på X med en spetsig spök: "Har du hört talas om rekursiv självförbättring?" — En hänvisning till praxis att använda AI-system för att hjälpa till att bygga bättre AI-system. OpenAI och Anthropic har båda rapporterat liknande dynamik i sina egna pipelines, där successiva modellgenerationer i allt högre grad hjälper till att ta fram sina efterföljare.

Huruvida Carbon är en produkt av den slingan eller inte, är kodnamnet churn talande. En snabb följd av interna kontrollpunkter, var och en testad mot gränsrivaler inom några dagar efter utbyggnad, tyder på att Google har industrialiserat sin releaseprocess på ett sätt som komprimerar den traditionella sex-till-tolv månader långa modellcykeln.

Google förbereder redan lanseringsmaskineriet

Det finns fortfarande inget officiellt datum för en bredare lansering av Gemini 4, men Googles egna produkter håller på att omarrangeras för att göra plats. I Gemini-appen har användare och testare upptäckt ett nytt "Automatiskt" läge för 3-seriemodellerna tillsammans med en justerbar resonemangsintensitetsinställning som sträcker sig från låg till hög. I Google AI Studio har ett nytt "Ultra"-läge dykt upp som lovar tillgång till "avancerade färdigheter och verktyg."

Googles Logan Kilpatrick har bekräftat offentligt att teamet arbetar för att få ut maximalt av Argon, vilket överensstämmer med mönstret som de interna dokumenten beskriver: skicka frontiermodellen till en liten professionell publik, fortsätt att iterera mot konkurrenternas riktmärken och utöka åtkomsten när skyddsräcken mognar.

Vad du ska titta på härnäst

Tre frågor kommer att definiera de närmaste veckorna. För det första, om Carbons tidiga kodningsprestanda håller i bredare interna tester eller bleknar på det sätt som lovande kontrollpunkter ibland gör. För det andra, om Google expanderar Argon bortom cyberförsvarare till utvecklare och konsumenter - företaget har bara sagt att en bredare tillgänglighet kommer att komma "så snart som möjligt." För det tredje, hur Anthropic och OpenAI svarar: Opus 5.5 är referenspunkten som Googles egna anställda använder för kodningsjämförelser, och en konkurrenskraftig Gemini-uppdatering skulle starta om en pris- och kapacitetstävling som redan har komprimerat kodmodellkostnaderna i år.

För närvarande förblir Carbon ett internt kodnamn kopplat till skärmdumpar och chattloggar, inte en annonserad produkt. Men färdriktningen är tydlig. Google konkurrerar inte längre genom att lansera modeller; den konkurrerar genom att kontinuerligt ersätta dem.

Ligg före AI

Frontier-modellläckor, lanseringar och riktmärken landar dagligen — vi sorterar signal från brus.

Läs mer AI-nyheter →