Elon Musk afferma che il suo data center Colossus 2 a Memphis avrà più di 1,2 milioni di chip Nvidia GB200 e GB300 online entro la fine del 2026, chiudendo un anno in cui il sito aggiungerà circa 660.000 acceleratori e spingerà la flotta di calcolo AI totale di Musk verso 1,44 milioni di GPU in funzione.
Le cifre, esposte da Musk in una serie di post su X e riportate da Benzinga, Wccftech e Tom's Hardware, descrivono un programma di installazione vertiginoso: 220.000 GPU GB300 aggiuntive previste online entro la fine di questa settimana, altre 220.000 entro la fine di novembre e un lotto finale di 220.000 prima che il calendario passi al 2027. Per maggiori informazioni su questa storia, consulta la nostra aggiornamenti sull'intelligenza artificiale.
I numeri dietro la costruzione
Secondo i post di Musk, Colossus 2 attualmente funziona con circa 110.000 chip GB200 e 440.000 chip GB300. Le tre ondate pianificate di 220.000 GB300 ciascuna si sommano esattamente alle 660.000 GPU che Tom's Hardware cita in arrivo quest'anno, portando il solo sito Colossus 2 a oltre 1,2 milioni di pacchetti della generazione Blackwell.
La vecchia struttura Colossus 1, la cui costruzione è iniziata nel 2024 ed è stata originariamente costruita da xAI, contribuisce con altri 230.000 chip: circa 200.000 processori H100 della precedente generazione Hopper di Nvidia più 30.000 GB200. Insieme, i due siti di Memphis si avvicineranno a 1,44 milioni di GPU operative entro la fine del 2026.
In prospettiva, un singolo pacchetto GB200 o GB300 accoppia la CPU Grace di Nvidia con le GPU Blackwell ed è rivolto al tipo di carichi di lavoro di formazione e inferenza su larga scala che i laboratori di frontiera acquistano a centinaia di migliaia. Il conteggio di fine anno di Colossus 2 rivaleggia con il totale delle flotte di acceleratori che la maggior parte dei governi nazionali si è procurata.
Il potere è il vero collo di bottiglia
I chip sono solo la metà dell’equazione. Tom's Hardware riferisce che l'azienda sta costruendo una centrale elettrica da 1,2 gigawatt per portare i sistemi ampliati completamente online: un progetto infrastrutturale sulla scala della domanda elettrica di una città di medie dimensioni, dedicato a un singolo campus AI.
Lo stesso Musk ha delineato chiaramente il vincolo nei suoi post, scrivendo che portare "un'elaborazione online di grandi dimensioni rapidamente è incredibilmente difficile". Il commento è un raro riconoscimento da parte del principale sostenitore del progetto che il vincolo vincolante sulle ambizioni dell’intelligenza artificiale nel 2026 non sono i chip, che possono essere acquistati, ma trasformatori, sottostazioni e turbine, che richiedono anni per essere messi in servizio.
Musk ha già perseguito percorsi non convenzionali per accelerare tale tempistica, inclusa la generazione di turbine in loco e turbine a gas montate su telai mobili – approcci che hanno attirato il controllo normativo a Memphis anche se hanno mantenuto la costruzione di Colossus 1 in anticipo rispetto al programma.
Perché il GB300 ottiene il consenso
Le nuove ondate sono tutte GB300, la variante Blackwell Ultra di Nvidia. Il GB300 condivide la CPU Grace con il GB200 ma è dotato di un die GPU più nuovo e più veloce e di una maggiore larghezza di banda di memoria, ed è diventato il cavallo di battaglia in termini di volume per i training di frontiera del 2026.
I commenti di Musk indicano che Colossus 2 si affiderà principalmente al GB300 in futuro, con il contingente GB200 che fungerà da base installata. Questo rapporto cambierà di nuovo quando la piattaforma Rubin di prossima generazione di Nvidia - oggetto del precedente accordo GPU esclusivo di Musk con Nvidia per l'implementazione spaziale - inizierà a essere distribuita in grandi volumi.
La corsa contro l'antropologia e OpenAI
Il programma di installazione non è solo una flessibilità dell'infrastruttura; è la mossa di apertura della campagna pubblica di Musk per colmare il divario modello con i leader di frontiera. Negli stessi post, Musk ha affermato che i suoi sforzi sull'intelligenza artificiale - che secondo lui hanno solo tre anni, contro i sei di Anthropic e i dieci di OpenAI - potrebbero eguagliare i modelli di classe Fable di Anthropic e GPT-6 di OpenAI entro due o tre mesi, e che se la "seconda derivata" dello sforzo rimane forte, l'azienda "raggiungerebbe la pole position in circa 6 mesi".
"Continueremo ad accelerare", ha scritto Musk.
Queste sono affermazioni coraggiose da parte di un laboratorio i cui più recenti rilasci di modelli pubblici hanno superato la frontiera della maggior parte dei benchmark degli agenti, e la cadenza dei rivali non dà motivo di fermarsi: Anthropic e OpenAI hanno entrambi distribuito importanti aggiornamenti di codifica e modelli di agenti questo trimestre. Ma la traiettoria del calcolo fornisce all’argomentazione una base materiale. Il calcolo dell’addestramento è rimasto il più forte predittore della capacità di frontiera e nessun laboratorio sta aggiungendo capacità di addestramento più velocemente delle operazioni di Musk in questo momento.
Cosa significa per il mercato dell'hardware AI
L’espansione rafforza due tendenze che hanno definito lo sviluppo del 2026. In primo luogo, la concentrazione della capacità di formazione di frontiera in una manciata di campus su scala gigantesca: Colossus 2 si unisce ai siti collegati a Stargate, ai campus Anthropic di Amazon e alle flotte TPU di Google come installazioni a sito singolo misurate in gigawatt. In secondo luogo, il controllo di Nvidia su tale spesa: essenzialmente ogni acceleratore della flotta di Musk è una parte di Nvidia, a sostegno delle ipotesi di domanda che hanno reso il produttore di chip la risorsa centrale dell’economia dell’intelligenza artificiale.
SemiAnalysis, la società di ricerca che in precedenza aveva previsto che le operazioni di elaborazione di Musk avrebbero potuto superare i 10 gigawatt di capacità entro il 2027 con Microsoft come il suo più grande cliente informatico, ha sostenuto che anche l'infrastruttura imperfetta viene assorbita dalla domanda estrema di GPU. Il programma di Colossus 2 – tre ondate da 220.000 GPU in meno di tre mesi – è il test più visibile finora per verificare se questa tesi è valida.
Se le nuove ondate arriveranno sulla linea temporale di Musk dirà tanto sulla catena di fornitura globale delle GPU quanto su Memphis: ogni GB300 nel piano è un chip che Nvidia non ha venduto a un rivale, e ogni megawatt è energia che la rete non ha dovuto risparmiare.
---
Rimani Aggiornato sull'IALe ultime notizie, analisi e scoperte sull'intelligenza artificiale — tutto in un posto.
Leggi altre notizie sull'IA →