ชิปดังกล่าวเป็น โปรเซสเซอร์ H200 ซึ่งเป็นตัวเร่งความเร็วรุ่น Hopper ที่ล้ำหน้าที่สุดของ Nvidia ตามที่ผู้คนใกล้ชิดกับ Moonshot อ้างโดย Bloomberg คลัสเตอร์ที่เช่าจาก Alibaba Group Holding เป็นส่วนสำคัญของพลังการประมวลผลเบื้องหลังรุ่น Kimi ของ Moonshot ซึ่งรวมถึง Kimi K3 ซึ่งบริษัทปรับขนาดเป็น 2.8 ล้านล้านพารามิเตอร์ โดยประมาณ หากต้องการรายงานข่าวอย่างต่อเนื่องเกี่ยวกับการแข่งขันด้านฮาร์ดแวร์ที่ขับเคลื่อนปัญญาประดิษฐ์ โปรดติดตาม ข่าว AI ล่าสุด ของเรา
การจัดการระบบคลาวด์คอมพิวท์ ไม่ใช่การเป็นเจ้าของชิป
ข้อตกลงดังกล่าวมีโครงสร้างเป็นข้อตกลงด้านพลังงานคอมพิวเตอร์มากกว่าการซื้อฮาร์ดแวร์โดยตรง ซึ่งหมายความว่า Moonshot เช่าการเข้าถึงความสามารถของ Nvidia ของอาลีบาบาได้อย่างมีประสิทธิภาพ Bloomberg รายงานว่าคลัสเตอร์ 20,000 ชิปถือเป็น "ส่วนสำคัญ" ของพลังการประมวลผลที่อยู่เบื้องหลังโมเดล Kimi โดยแนะนำว่า Moonshot เสริมการจัดสรรนี้ด้วยความจุเพิ่มเติมของตัวเอง
ข้อตกลงดังกล่าวเน้นย้ำถึงรูปแบบที่เกิดขึ้นใหม่ในภาค AI ของจีน แทนที่จะเป็นบริษัทสตาร์ทอัพแต่ละรายที่รวบรวม GPU ของตัวเองไว้ บริษัทคลาวด์ยักษ์ใหญ่ เช่น Alibaba และ Tencent ทำหน้าที่เป็นโบรกเกอร์ด้านการคำนวณ โดยให้เช่าความสามารถเร่งความเร็วขั้นสูงแก่ผู้สร้างโมเดลขนาดเล็ก สำหรับ Moonshot ซึ่งมีมูลค่าประมาณ 3.5 พันล้านดอลลาร์เมื่อต้นปีนี้ การเช่าซื้อแทนการซื้อจะช่วยลดอุปสรรคด้านเงินทุนในการฝึกอบรมโมเดลระดับแนวหน้า
การพึ่งพา Nvidia อย่างต่อเนื่องของจีน
รายงานของ Bloomberg ระบุกรอบข้อตกลงอย่างชัดเจนว่าเป็นหลักฐานของ "การที่จีนยังคงพึ่งพาเซมิคอนดักเตอร์ของตะวันตกเพื่อกระตุ้นการพัฒนา AI" ตามข้อมูลจากผู้ที่มีความรู้เกี่ยวกับการดำเนินงานของบริษัทต่างๆ แม้จะมีการผลักดันชิปในประเทศที่แผ่ขยายซึ่งนำโดยกลุ่ม Ascend ของ Huawei และสตาร์ทอัพเช่น Biren และ Moore Threads ระบบนิเวศซอฟต์แวร์ CUDA ของ Nvidia และสถาปัตยกรรม Hopper ยังคงเป็นค่าเริ่มต้นสำหรับการฝึกอบรมโมเดลจีนที่ใหญ่ที่สุด
การพึ่งพาอาศัยกันดังกล่าวยังคงมีอยู่แม้ว่าสหรัฐฯ จะควบคุมการส่งออกชิป AI ขั้นสูงไปยังจีนอย่างเข้มงวดในช่วงหลายปีที่ผ่านมา H200 เป็นศูนย์กลางของความตึงเครียดดังกล่าว: เป็น GPU สำหรับศูนย์ข้อมูลหลักที่ห้องปฏิบัติการตะวันตก รวมถึง Meta และ xAI ใช้โดยคนหลายแสนคน การที่ลูกค้าชาวจีนสามารถเข้าถึงคลัสเตอร์ขนาดนี้ผ่านทางตัวกลางบนคลาวด์ได้นั้น มีแนวโน้มที่จะทบทวนขอบเขตการควบคุมการส่งออกของระบอบการปกครองการส่งออกมากกว่าการประมวลผลแบบเช่า แทนที่จะขาย
ความหมายสำหรับ Kimi K3
สเกลการคำนวณช่วยอธิบายว่า Moonshot สามารถฝึก Kimi K3 ให้มีจำนวนพารามิเตอร์ที่มากขนาดนี้ได้อย่างไร Kimi K3 ได้รับการจัดอันดับให้เป็นคู่แข่งของโมเดลระดับแนวหน้าจาก OpenAI และ Anthropic และ Moonshot ได้เน้นย้ำถึงการใช้เหตุผลในบริบทแบบยาวและความสามารถเชิงตัวแทนในฐานะผู้สร้างความแตกต่าง คลัสเตอร์ 20,000-H200 แม้จะเล็กกว่าคลัสเตอร์ซุปเปอร์คลัสเตอร์ที่ดำเนินการโดย Meta หรือ xAI แต่ก็เป็นหนึ่งในแนวทางการฝึกอบรมเดี่ยวที่สำคัญกว่าที่เปิดเผยโดยห้องปฏิบัติการของจีน
เมื่อมองภาพรวมแล้ว คลัสเตอร์ 20,000-GPU มีขนาดใหญ่ตามมาตรฐานใดๆ แต่ยังเป็นเพียงเศษเสี้ยวของซูเปอร์คลัสเตอร์ที่ดำเนินการโดยห้องปฏิบัติการที่ใหญ่ที่สุดของตะวันตก Meta ได้พูดต่อสาธารณะเกี่ยวกับคลัสเตอร์ที่มี GPU มากกว่า 100,000 ตัว และโรงงาน "Colossus" ของ xAI ในเมืองเมมฟิสก็ถูกสร้างขึ้นเพื่อให้เหนือกว่านั้น สำหรับสตาร์ทอัพแทนที่จะเป็นไฮเปอร์สเกลเลอร์ในการสั่งการตัวเร่งความเร็วระดับฮอปเปอร์ 20,000 ตัวผ่านพันธมิตรการเช่าซื้อ แสดงให้เห็นว่าตัวกลางบนคลาวด์กำลังกระจายการเข้าถึงการประมวลผลระดับแนวหน้าอย่างไร และช่องว่างระหว่างงบประมาณการฝึกอบรมของจีนและตะวันตกอาจแคบลงเร็วกว่ากฎการควบคุมการส่งออกที่ออกแบบมาเพื่อคาดการณ์ได้อย่างไร
การเปิดเผยดังกล่าวเกิดขึ้นท่ามกลางช่วงเวลาอันวุ่นวายของ Moonshot เมื่อเร็วๆ นี้ บริษัทได้หยุดการระดมทุนรอบที่สองชั่วคราว และความคิดเห็นสาธารณะของผู้ก่อตั้ง Liang Wenfeng ก็ได้ดึงดูดความสนใจ การรักษาความปลอดภัยการเข้าถึง GPU ระดับไฮเอนด์นับหมื่นที่เชื่อถือได้ผ่านพันธมิตรอย่าง Alibaba จะช่วยแก้ไขข้อจำกัดที่เร่งด่วนที่สุดประการหนึ่งที่สตาร์ทอัพรุ่นชายแดน — การประมวลผล — แม้ว่าคำถามเกี่ยวกับการระดมทุนและการกำกับดูแลยังคงมีอยู่
ภาพใหญ่กว่า
ข้อตกลง Moonshot-Alibaba แสดงให้เห็นถึงความเป็นจริงเชิงโครงสร้างของการแข่งขัน AI ระดับโลกในปี 2569: ช่องว่างระหว่างแบบจำลองที่ห้องปฏิบัติการสามารถสร้างได้กับฮาร์ดแวร์ที่ห้องปฏิบัติการสามารถรักษาความปลอดภัยได้แคบลง แต่ยังไม่ปิดลง ห้องปฏิบัติการของจีนกำลังนำเสนอโมเดลที่มีการแข่งขันเพิ่มมากขึ้น แต่ซิลิคอนที่อยู่ข้างใต้ยังคงไหลจากห่วงโซ่อุปทานของ Nvidia เดียวกันกับที่ขับเคลื่อนคู่แข่งชาวตะวันตก ทั้งทางตรงและทางอ้อม เนื่องจากการประมวลผลที่เช่าบนระบบคลาวด์ทำให้เส้นแบ่งระหว่างความเป็นเจ้าของและการเข้าถึงไม่ชัดเจน แนวหน้าถัดไปในสงครามชิปจึงอาจต้องต่อสู้กันว่าใครสามารถเช่าตัวเร่งความเร็วขั้นสูงได้ ไม่ใช่แค่เฉพาะผู้ที่สามารถซื้อได้
ก้าวนำหน้า AI
จากข้อเสนอขนาดใหญ่ของศูนย์ข้อมูลไปจนถึงชิปที่ขับเคลื่อนโมเดลชายแดน เรื่องราวของฮาร์ดแวร์กำลังดำเนินไปอย่างรวดเร็ว บุ๊กมาร์ก AI Buzz Wire เพื่อการรายงานข่าวอย่างต่อเนื่องเกี่ยวกับซิลิคอนที่สนับสนุนปัญญาประดิษฐ์
อ่านข่าวฮาร์ดแวร์ AI เพิ่มเติม →
