Google non ha ancora finito di lanciare Gemini 4 Argon al pubblico, ma secondo i documenti interni esaminati da Business Insider, la società sta già testando il prossimo passo: una variante di Gemini 4 con nome in codice Carbon che sta mostrando i primi segni di corrispondenza con il modello di codifica più potente di Anthropic.
Il rapporto, pubblicato venerdì e dettagliato da The Decoder, descrive documenti, screenshot e chat interne in cui i dipendenti di Google discutono di tre varianti di Gemini 4 in fase di sviluppo: Argon, Bario e Carbonio. Per i lettori che seguono la corsa ai modelli di frontiera, questo è l'ultimo segnale che il divario tra le generazioni di modelli sta collassando in un flusso continuo di aggiornamenti, e la nostra copertura Notizie sui modelli AI ne segue ogni fase.
Il carbonio è già presente in Google
Secondo Business Insider, il carbonio è stato implementato nei giorni scorsi su Jetski, la piattaforma di codifica interna di Google, e i primi utenti affermano che è principalmente più potente dell'Argon nelle attività di programmazione. Un dipendente ha confrontato Carbon con Claude Opus 5.5, il modello di codifica più potente di Anthropic, avvertendo che il modello di Google necessita ancora di ulteriori test prima che il confronto significhi molto.
Gli stessi documenti offrono uno sguardo raro su come Google nomina e organizza i suoi rilasci di frontiera. Argon, l'attuale modello di frontiera dell'azienda, in precedenza portava il nome in codice "Barium-B" e un dipendente descriveva internamente Carbon come il "prossimo modello Gemini pro". Ciò suggerisce che Carbon e Bario siano punti di controllo o candidati aggiornamenti all'interno della famiglia di frontiera Argon piuttosto che livelli di prodotto separati, sebbene i documenti non chiariscano se Carbon verrà eventualmente distribuito come aggiornamento Argon o come versione propria.
Non tutti all’interno di Google sono convinti che il nuovo modello rappresenti un netto passo avanti. Le prime versioni di Argon hanno ricordato a un altro dipendente il vecchio Opus 5 in alcuni compiti di codifica, anche se la ricezione interna complessiva del modello è stata segnalata come positiva.
Perché Argon non è un modello Flash
Quando Argon fu annunciato il 30 settembre, circolò la speculazione che potesse trattarsi di un modello di classe Flash ottimizzato per la velocità piuttosto che di una versione con le massime prestazioni. Da allora Google ha precluso questa teoria. Nell'annuncio del suo agente Gemini per Google Workspace, l'azienda ha presentato la sua gamma di modelli in base allo scopo: Argon per il ragionamento di frontiera, Flash per velocità e volume, Omni per i media generativi e Gemma per il lavoro leggero a pesi aperti.
Argon è quindi il modello di ragionamento più forte di Google, posizionato dall'azienda accanto alla linea Opus di Anthropic e Astra di OpenAI. Attualmente è disponibile solo per un gruppo limitato di difensori informatici fidati attraverso il programma Fairwind di Google, con un prezzo fissato a 2 dollari per milione di token di input e 10 dollari per milione di token di output, e input memorizzati nella cache scontati del 95%.
Le battute sull'"automiglioramento ricorsivo" si scrivono da sole
Il ritmo dell’iterazione interna non è passato inosservato. Vedant Misra, un ricercatore di Google DeepMind, ha risposto al rapporto di Business Insider su X con una battuta acuta: "Hai sentito parlare di auto-miglioramento ricorsivo?" — un riferimento alla pratica di utilizzare i sistemi di intelligenza artificiale per contribuire a costruire sistemi di intelligenza artificiale migliori. OpenAI e Anthropic hanno entrambi riportato dinamiche simili nelle proprie pipeline, dove le successive generazioni di modelli aiutano sempre più a produrre i loro successori.
Che Carbon sia o meno un prodotto di quel ciclo, il nome in codice churn lo dice chiaramente. Una rapida successione di checkpoint interni, ciascuno testato contro i rivali di frontiera entro pochi giorni dall’implementazione, suggerisce che Google abbia industrializzato il suo processo di rilascio in modo da comprimere il tradizionale ciclo del modello da sei a dodici mesi.
Google sta già preparando il meccanismo di lancio
Non c'è ancora una data ufficiale per un lancio più ampio di Gemini 4, ma i prodotti di Google sono in fase di riorganizzazione per fare spazio. Nell'app Gemini, utenti e tester hanno individuato una nuova modalità "Automatica" per i modelli della serie 3 insieme a un'impostazione di intensità di ragionamento regolabile che varia da bassa ad alta. In Google AI Studio è apparsa una nuova modalità "Ultra", che promette l'accesso a "competenze e strumenti avanzati".
Logan Kilpatrick di Google ha confermato pubblicamente che il team sta lavorando per ottenere il massimo da Argon, il che è coerente con lo schema descritto dai documenti interni: distribuire il modello di frontiera a un pubblico ristretto di professionisti, continuare a ripetere i parametri di riferimento della concorrenza ed espandere l'accesso man mano che i guardrail maturano.
Cosa guardare dopo
Tre domande definiranno le prossime settimane. In primo luogo, se le prestazioni di codifica iniziali di Carbon reggono nei test interni più ampi o svaniscono come a volte fanno i checkpoint promettenti. In secondo luogo, se Google espanderà l’Argon oltre i difensori informatici, rivolgendosi a sviluppatori e consumatori: la società ha affermato solo che una disponibilità più ampia arriverà “il più presto possibile”. In terzo luogo, come rispondono Anthropic e OpenAI: Opus 5.5 è il punto di riferimento che i dipendenti di Google utilizzano per i confronti di codifica, e un aggiornamento competitivo di Gemini riavvierebbe una competizione su prezzi e capacità che ha già compresso i costi dei modelli di codifica quest'anno.
Per ora, Carbon rimane un nome in codice interno allegato a screenshot e registri di chat, non un prodotto annunciato. Ma la direzione del viaggio è chiara. Google non compete più lanciando modelli; compete sostituendoli continuamente.
Stai al passo con l'intelligenza artificiale
Trapelano informazioni, lanci e benchmark sui modelli di frontiera ogni giorno: selezioniamo il segnale dal rumore.
Leggi altre notizie sull'AI →