Elon Musk cho biết trung tâm dữ liệu Colossus 2 của ông ở Memphis sẽ có hơn 1,2 triệu chip Nvidia GB200 và GB300 trực tuyến vào cuối năm 2026, giới hạn một năm mà trang này sẽ bổ sung khoảng 660.000 máy gia tốc và đẩy tổng đội máy tính AI của Musk lên 1,44 triệu GPU đang hoạt động.

Các số liệu do Musk đưa ra trong một loạt bài đăng trên X và được báo cáo bởi Benzinga, Wccftech và Tom's Hardware, mô tả một lịch trình cài đặt chóng mặt: 220.000 GPU GB300 bổ sung dự kiến sẽ xuất hiện trực tuyến vào cuối tuần này, 220.000 khác vào cuối tháng 11 và lô 220.000 cuối cùng trước khi lịch chuyển sang năm 2027. For more context on this story, see our ongoing artificial intelligence updates.

Những con số đằng sau quá trình xây dựng

Theo bài đăng của Musk, Colossus 2 hiện chạy trên khoảng 110.000 chip GB200 và 440.000 chip GB300. Ba đợt dự kiến ​​220.000 GB300, mỗi đợt bổ sung chính xác 660.000 GPU mà Tom's Hardware trích dẫn sẽ xuất hiện trong năm nay - chỉ riêng trang web Colossus 2 đã có hơn 1,2 triệu gói thế hệ Blackwell.

Cơ sở Colossus 1 cũ hơn, bắt đầu xây dựng vào năm 2024 và ban đầu do xAI xây dựng, đóng góp 230.000 chip khác: khoảng 200.000 bộ xử lý H100 từ thế hệ Hopper trước đây của Nvidia cộng với 30.000 GB200. Kết hợp lại, hai địa điểm ở Memphis sẽ đạt gần 1,44 triệu GPU hoạt động vào cuối năm 2026.

Về góc độ, một gói GB200 hoặc GB300 duy nhất kết hợp CPU Grace của Nvidia với GPU Blackwell và nhắm đến loại khối lượng công việc suy luận và đào tạo quy mô lớn mà các phòng thí nghiệm biên giới mua hàng trăm nghìn. Số lượng cuối năm của Colossus 2 sẽ sánh ngang với tổng số đội máy gia tốc mà hầu hết các chính phủ quốc gia đã mua sắm.

Quyền lực là nút cổ chai thực sự

Chip chỉ là một nửa của phương trình. Tom's Hardware báo cáo rằng công ty đang xây dựng một nhà máy điện 1,2 gigawatt để đưa các hệ thống mở rộng trực tuyến hoàn toàn - một dự án cơ sở hạ tầng trên quy mô nhu cầu điện của một thành phố cỡ trung, dành riêng cho một khuôn viên AI duy nhất.

Bản thân Musk đã trình bày rõ ràng ràng buộc này trong các bài đăng của mình, viết rằng việc đưa "máy tính khổng lồ lên mạng một cách nhanh chóng là điều vô cùng khó khăn". Nhận xét này là sự thừa nhận hiếm hoi từ người đề xuất chính của dự án rằng hạn chế ràng buộc đối với tham vọng AI vào năm 2026 không phải là chip, thứ có thể mua được, mà là máy biến áp, trạm biến áp và tua bin, phải mất nhiều năm để vận hành.

Trước đây, Musk đã theo đuổi các lộ trình độc đáo để tăng tốc dòng thời gian đó, bao gồm sản xuất tua bin tại chỗ và tua bin khí gắn trên khung di động – những phương pháp đã thu hút sự giám sát của cơ quan quản lý ở Memphis ngay cả khi họ vẫn duy trì việc xây dựng Colossus 1 trước thời hạn.

Tại sao GB300 được đề cử

Các làn sóng mới đều là GB300, biến thể Blackwell Ultra của Nvidia. GB300 dùng chung CPU Grace với GB200 nhưng có khuôn GPU mới hơn, nhanh hơn và băng thông bộ nhớ lớn hơn, đồng thời nó đã trở thành công cụ hỗ trợ khối lượng cho các hoạt động đào tạo tiên phong vào năm 2026.

Nhận xét của Musk cho thấy Colossus 2 sẽ chủ yếu dựa vào GB300 trong tương lai, với đội ngũ GB200 đóng vai trò là cơ sở được lắp đặt. Tỷ lệ đó sẽ thay đổi một lần nữa khi nền tảng Rubin thế hệ tiếp theo của Nvidia - chủ đề trong thỏa thuận GPU độc quyền trước đó của Musk với Nvidia để triển khai trên không gian - bắt đầu được xuất xưởng với số lượng lớn.

Cuộc đua chống lại loài người và OpenAI

Lịch trình cài đặt không chỉ là sự linh hoạt về cơ sở hạ tầng; đó là động thái mở đầu trong chiến dịch công khai của Musk nhằm thu hẹp khoảng cách về hình mẫu với các nhà lãnh đạo ở biên giới. Trong cùng một bài đăng, Musk tuyên bố những nỗ lực AI của mình – mà theo ông chỉ là ba năm tuổi, so với sáu năm đối với Anthropic và mười năm đối với OpenAI – có thể sánh ngang với các mô hình lớp Fable của Anthropic và GPT-6 của OpenAI trong vòng hai đến ba tháng, và rằng nếu "đạo hàm thứ hai vẫn mạnh" của nỗ lực này, thì công ty sẽ "đạt vị trí cực trong khoảng 6 tháng".

“Chúng tôi sẽ tiếp tục tăng tốc,” Musk viết.

Đó là những tuyên bố táo bạo từ một phòng thí nghiệm có các bản phát hành mô hình công khai gần đây nhất đã dẫn đầu về hầu hết các điểm chuẩn tác nhân và nhịp độ của các đối thủ không có lý do gì để tạm dừng: Anthropic và OpenAI đều đã tung ra các bản cập nhật mô hình tác nhân và mã hóa lớn trong quý này. Nhưng quỹ đạo tính toán mang lại cho lập luận một cơ sở vật chất. Điện toán đào tạo vẫn là công cụ dự đoán mạnh mẽ nhất về năng lực tiên phong và hiện tại không có phòng thí nghiệm nào bổ sung năng lực đào tạo nhanh hơn hoạt động của Musk.

Ý nghĩa của thị trường phần cứng AI

Việc mở rộng củng cố hai xu hướng đã xác định việc xây dựng vào năm 2026. Đầu tiên, tập trung năng lực đào tạo ở tuyến đầu vào một số cơ sở có quy mô giga- Colossus 2 tham gia vào các cơ sở được liên kết với Stargate, cơ sở Anthropic của Amazon và nhóm TPU của Google dưới dạng cơ sở lắp đặt tại một cơ sở được đo bằng gigawatt. Thứ hai, Nvidia nắm bắt được khoản chi tiêu đó: về cơ bản mọi máy gia tốc trong đội tàu của Musk đều là một bộ phận của Nvidia, duy trì các giả định về nhu cầu đã biến nhà sản xuất chip trở thành tài sản trung tâm của nền kinh tế AI.

SemiAnalysis, công ty nghiên cứu trước đây dự đoán hoạt động điện toán của Musk có thể vượt quá 10 gigawatt công suất vào năm 2027 với Microsoft là khách hàng điện toán lớn nhất của họ, đã lập luận rằng ngay cả cơ sở hạ tầng không hoàn hảo cũng đang bị hấp thụ bởi nhu cầu GPU cực lớn. Lịch trình Colossus 2 - ba đợt 220.000 GPU trong vòng chưa đầy ba tháng - là thử nghiệm rõ ràng nhất về việc liệu luận điểm đó có đúng hay không.

Liệu những làn sóng mới có đến theo dòng thời gian của Musk hay không sẽ nói lên nhiều điều về chuỗi cung ứng GPU toàn cầu cũng như về Memphis: mỗi GB300 trong kế hoạch là một con chip mà Nvidia không bán cho đối thủ và mỗi megawatt là năng lượng mà lưới điện không cần phải dự phòng.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →