Elon Musk는 Memphis에 있는 Colossus 2 데이터 센터가 2026년 말까지 120만 개 이상의 Nvidia GB200 및 GB300 칩을 온라인에 보유하게 될 것이라고 밝혔습니다. 이 기간 동안 사이트는 약 660,000개의 가속기를 추가하고 Musk의 총 AI 컴퓨팅 함대를 144만 GPU로 늘릴 수 있습니다.
Musk가 X에 대한 일련의 게시물에 제시하고 Benzinga, Wccftech 및 Tom's Hardware에서 보고한 수치는 맹렬한 설치 일정을 설명합니다. 이번 주 말까지 220,000개의 추가 GB300 GPU가 온라인으로 예상되며, 11월 말까지 추가로 220,000개, 달력이 2027년으로 바뀌기 전 마지막 220,000개의 배치가 예상됩니다. 이 이야기에 대한 자세한 내용은 인공지능 뉴스를 참조하세요.
구축 뒤에 숨겨진 숫자
머스크의 게시물에 따르면 Colossus 2는 현재 약 110,000개의 GB200 칩과 440,000개의 GB300 칩에서 실행되고 있습니다. 220,000개의 GB300으로 구성된 3개의 계획된 웨이브는 각각 정확히 660,000개의 GPU를 추가하여 Tom's Hardware가 올해 도착할 것으로 인용하여 Colossus 2 사이트에만 120만 개 이상의 Blackwell 세대 패키지를 제공합니다.
2024년에 건설을 시작하고 원래 xAI에 의해 건설된 오래된 Colossus 1 시설은 추가로 230,000개의 칩을 제공합니다. 즉, Nvidia의 이전 Hopper 세대의 약 200,000개의 H100 프로세서와 30,000개의 GB200입니다. 두 멤피스 사이트를 합치면 2026년 말까지 운영되는 GPU가 거의 144만 개에 달합니다.
관점에서 볼 때 단일 GB200 또는 GB300 패키지는 Nvidia의 Grace CPU와 Blackwell GPU를 결합하며 개척 연구소에서 수십만 개 구매하는 일종의 대규모 교육 및 추론 워크로드를 목표로 합니다. Colossus 2의 연말 수는 대부분의 국가 정부가 조달한 총 가속기 함대와 맞먹을 것입니다.
전력이 진짜 병목 현상이다
칩은 방정식의 절반에 불과합니다. Tom's Hardware는 회사가 확장된 시스템을 완전히 온라인으로 전환하기 위해 1.2기가와트 발전소를 건설하고 있다고 보고합니다. 이는 단일 AI 캠퍼스 전용인 중견 도시의 전기 수요 규모의 인프라 프로젝트입니다.
머스크 자신은 자신의 게시물에서 "대규모 컴퓨팅을 온라인으로 빠르게 가져오는 것은 엄청나게 어렵다"고 적으면서 제약 조건을 분명하게 표현했습니다. 이 의견은 2026년 AI 야망에 대한 구속력 있는 제약이 구매할 수 있는 칩이 아니라 시운전하는 데 수년이 걸리는 변압기, 변전소 및 터빈이라는 프로젝트의 주요 제안자의 드문 인정입니다.
머스크는 이전에 현장 터빈 생성 및 모바일 프레임에 장착된 가스 터빈을 포함하여 해당 일정을 가속화하기 위해 비전통적인 경로를 추구해 왔습니다. 이는 Colossus 1호의 건설을 예정보다 앞서 유지했음에도 불구하고 Memphis에서 규제 조사를 받은 접근 방식입니다.
GB300이 호평을 받는 이유
새로운 물결은 모두 Nvidia의 Blackwell Ultra 변형인 GB300입니다. GB300은 Grace CPU를 GB200과 공유하지만 더 새롭고 더 빠른 GPU 다이와 더 많은 메모리 대역폭을 탑재하여 2026년 최전선 훈련 실행을 위한 대량의 주력 제품이 되었습니다.
Musk의 의견에 따르면 Colossus 2는 앞으로 GB300에 주로 의존할 것이며 GB200 파견대가 설치 기반 역할을 할 것임을 나타냅니다. 머스크가 이전에 우주 기반 배포를 위해 Nvidia와 독점 GPU 계약을 맺었던 대상인 Nvidia의 차세대 Rubin 플랫폼이 대량 배송을 시작하면 이 비율은 다시 바뀔 것입니다.
인류와 OpenAI와의 경쟁
설치 일정은 단순한 인프라 유연성이 아닙니다. 이는 선두 지도자들과의 모델 격차를 줄이기 위한 머스크의 공개 캠페인의 첫 번째 움직임입니다. 같은 게시물에서 머스크는 자신의 AI 노력(Anthropic의 경우 6개, OpenAI의 경우 10개)이 2~3개월 내에 Anthropic의 Fable 클래스 모델과 OpenAI의 GPT-6에 필적할 수 있으며, 이러한 노력의 "2차 파생 모델이 강력하게 유지"된다면 회사는 "약 6개월 내에 극 위치에 도달"할 것이라고 주장했습니다.
머스크는 "우리는 계속해서 속도를 높일 것"이라고 썼다.
이는 가장 최근의 공개 모델 릴리스가 대부분의 에이전트 벤치마크에서 선두를 달리고 있는 연구소의 대담한 주장이며, 경쟁사의 속도는 잠시 멈출 이유가 거의 없습니다. Anthropic과 OpenAI는 모두 이번 분기에 주요 코딩 및 에이전트 모델 업데이트를 출시했습니다. 그러나 계산 궤적은 이 주장에 실질적인 기반을 제공합니다. 교육 컴퓨팅은 프론티어 역량에 대한 가장 강력한 예측 변수로 남아 있으며 현재 Musk의 운영보다 더 빠르게 교육 역량을 추가하는 실험실은 없습니다.
AI 하드웨어 시장에 미치는 영향
이번 확장은 2026년 확장을 정의한 두 가지 추세를 강화합니다. 첫째, 최전방 훈련 역량을 소수의 기가 규모 캠퍼스에 집중시킨 것입니다. Colossus 2는 Stargate에 연결된 사이트, Amazon의 Anthropic 캠퍼스 및 Google의 TPU 함대를 기가와트 단위로 측정되는 단일 사이트 설치로 결합합니다. 둘째, 해당 지출에 대한 Nvidia의 통제입니다. 본질적으로 Musk의 모든 가속기는 Nvidia의 일부이며, 칩 제조업체를 AI 경제의 중심 자산으로 만든 수요 가정을 유지합니다.
이전에 Musk의 컴퓨팅 작업이 2027년까지 10기가와트를 초과할 수 있을 것으로 예상했던 연구 회사인 SemiAnalytics는 Microsoft를 최대 컴퓨팅 고객으로 두고 심지어 불완전한 인프라조차도 극심한 GPU 수요에 의해 흡수되고 있다고 주장했습니다. Colossus 2 일정(3개월 이내에 220,000 GPU 세 번의 웨이브)은 해당 이론이 유효한지 여부에 대한 가장 눈에 띄는 테스트입니다.
머스크의 타임라인에 새로운 물결이 도래하는지 여부는 멤피스만큼 글로벌 GPU 공급망에 대해서도 많은 것을 말해 줄 것입니다. 계획의 모든 GB300은 Nvidia가 경쟁업체에 판매하지 않은 칩이며, 모든 메가와트는 그리드가 아끼지 않아도 되는 전력입니다.
---
AI 최신 소식최신 AI 뉴스, 분석 및 혁신을 한 곳에서 확인하세요.
AI 뉴스 더 보기 →