DeepSeek ประกาศเมื่อวันพุธที่ผ่านมาว่าได้ร่วมมือกับ Huawei ในการพัฒนาเครื่องมือการเขียนโปรแกรมสำหรับโปรเซสเซอร์ Ascend AI ของ Huawei และกำลังเปิดซอร์สผลลัพธ์ รวมถึงเวอร์ชันของภาษา TileLang ที่วางตำแหน่งเป็นทางเลือกที่ง่ายกว่าสำหรับ CUDA ของ Nvidia

การเคลื่อนไหวนี้มุ่งเป้าไปที่จุดที่นุ่มนวลที่สุดในชุดเกราะของ Nvidia ความโดดเด่นของบริษัทในด้านการประมวลผล AI ไม่เคยมีเพียงแค่ซิลิคอนเท่านั้น มันขึ้นอยู่กับ CUDA ซึ่งเป็นระบบนิเวศซอฟต์แวร์ที่นักพัฒนา AI แทบทุกคนเคยฝึกฝนมา สำหรับบริบทที่ว่าทำไมสิ่งนั้นถึงสำคัญ ความครอบคลุมของอุตสาหกรรม AI ของเราได้บันทึกไว้ซ้ำแล้วซ้ำเล่าว่าฮาร์ดแวร์จะชนะก็ต่อเมื่อซอฟต์แวร์ที่อยู่รอบตัวทำให้การเปลี่ยนเป็นเรื่องที่เจ็บปวดเท่านั้น

เครื่องมือโอเพ่นซอร์สหกรายการสำหรับ Ascend

ตามรายงานของ Reuters DeepSeek กำลังเปิดตัวโมดูลซอฟต์แวร์โอเพ่นซอร์สหกโมดูลที่สร้างขึ้นสำหรับแพลตฟอร์ม Ascend ของ Huawei แพ็คเกจนี้ประกอบด้วยไลบรารีที่มุ่งปรับปรุงประสิทธิภาพการประมวลผลและการสื่อสารทั่วทั้งชิป ซึ่งพัฒนาด้วยสิ่งที่ DeepSeek อธิบายว่าเป็นการสนับสนุนทางเทคนิคที่ครอบคลุมจาก Huawei

หัวใจสำคัญคือ TileLang ซึ่งเป็นภาษาการเขียนโปรแกรมระดับสูงแบบโอเพ่นซอร์สที่ออกแบบมาสำหรับตัวเร่งความเร็ว AI DeepSeek แย้งว่านักพัฒนาต้องการภาษาที่สามารถเข้าถึงได้และสามารถดึงประสิทธิภาพสูงสุดจากฮาร์ดแวร์พื้นฐานได้ และกล่าวว่า TileLang เสนอรูปแบบการเขียนโปรแกรมที่ง่ายกว่า CUDA หากทำได้ อุปสรรคในการเขียนโค้ดสำหรับชิป AI ของจีนจะลดลงอย่างมาก ซึ่งเป็นประเด็นที่แท้จริง

ซูเปอร์โหนดขนาด 128 ชิปเป็นหลักฐานพิสูจน์ขนาด

ความร่วมมือยังสร้างผลลัพธ์ด้านฮาร์ดแวร์ด้วย DeepSeek และ Huawei กล่าวว่าพวกเขาทำงานบนระบบ supernode ที่รวมชิป Ascend 950 จำนวน 128 ตัว โดยมุ่งเน้นไปที่การเพิ่มประสิทธิภาพการสื่อสารระหว่างโปรเซสเซอร์ตลอดจนประสิทธิภาพการประมวลผลโดยรวม ซึ่งเป็นปัญหาการเชื่อมต่อระหว่างกันที่เคยแยกตัวเร่งความเร็วเฉพาะออกจากแพลตฟอร์มศูนย์ข้อมูลของแท้ในอดีต

การประกาศดังกล่าวเกิดขึ้นไม่นานหลังจากที่ Huawei ได้เปิดตัวโปรเซสเซอร์ AI รุ่นต่อไปและระบบคอมพิวเตอร์ "supernode" และบริษัทคาดว่าโครงสร้างพื้นฐาน AI ของตนจะได้เห็นการใช้งานการฝึกอบรมโมเดลที่กว้างขึ้นในปีหน้า ห้องปฏิบัติการชายแดนที่เผยแพร่ซอฟต์แวร์ระบบสำหรับแพลตฟอร์มชิปในประเทศถือเป็นสัญญาณที่ชัดเจนที่สุดว่าบริษัท AI ของจีนตั้งใจที่จะดำเนินการฝึกอบรมอย่างจริงจังโดยไม่ต้องใช้ฮาร์ดแวร์ของ Nvidia

ทำไมคูน้ำของ CUDA จึงเป็นสมรภูมิที่แท้จริง

CUDA ได้กลายเป็นส่วนสำคัญของการครอบงำของ Nvidia เนื่องจากระบบนิเวศซอฟต์แวร์ขนาดใหญ่ที่สร้างขึ้นรอบ ๆ GPU - คอมไพเลอร์ ไลบรารี และความคุ้นเคยของนักพัฒนาตลอดสองทศวรรษ PyTorch ทุกเวอร์ชัน ทุกเฟรมเวิร์กการอนุมาน และคลังงานวิจัยทุกรายการถือว่า CUDA ทำงานได้ ความเฉื่อยนั้นมากกว่าข้อมูลจำเพาะของชิปดิบ นั่นคือสิ่งที่ทำให้คู่แข่งต้องเผชิญ

ตรรกะเชิงกลยุทธ์ของโอเพ่นซอร์สนั้นมีเจตนาเท่าเทียมกัน สแต็คซอฟต์แวร์ชิปที่เป็นกรรมสิทธิ์จะชนะโดยเป็นค่าเริ่มต้น ระบบนิเวศแบบเปิดชนะด้วยการเป็นทางเลือกของทุกคน ด้วยการเผยแพร่เครื่องมือ Ascend ภายใต้ใบอนุญาตแบบเปิด DeepSeek จะช่วยลดต้นทุนการสลับสำหรับนักพัฒนาหรือผู้ให้บริการระบบคลาวด์ที่กำลังมองหาการใช้ประโยชน์จากราคาของ Nvidia และทำให้ฮาร์ดแวร์ของ Huawei ใช้งานได้สำหรับผู้ซื้อที่ไม่เคยยอมรับกลุ่มผู้จำหน่ายรายเดียว

นั่นคือเหตุผลว่าทำไมความร่วมมือระหว่าง DeepSeek และ Huawei จึงมีความสำคัญนอกเหนือจากประเทศจีน สิ่งนี้สะท้อนให้เห็นถึงการผลักดันในวงกว้างภายในประเทศในการพัฒนาฮาร์ดแวร์ AI ในประเทศและซอฟต์แวร์ที่จำเป็นต่อการทำงานอย่างมีประสิทธิภาพ โดยลดการพึ่งพาเทคโนโลยีของ Nvidia ในช่วงเวลาที่การควบคุมการส่งออกของสหรัฐฯ ได้จำกัดการเข้าถึงชิปที่ทันสมัยที่สุดของ Nvidia แล้ว New York Times ตีกรอบความเป็นหุ้นส่วนว่าเป็นการโจมตีโดยตรงต่อแหล่งที่มาสำคัญของการครอบงำ AI ของ Nvidia ไม่ใช่ตัวชิป แต่เป็นโค้ดที่ทำให้ขาดไม่ได้

การสร้างความร่วมมือที่มีอยู่

การเปิดตัวในวันพุธไม่ใช่สัญญาณแรกของการเดิมพัน DeepSeek กับซิลิคอนในประเทศ ย้อนกลับไปในเดือนเมษายน ทั้ง Benzinga และ South China Morning Post รายงานว่าโมเดล V4 ของ DeepSeek ถูกสร้างขึ้นและฝึกฝนบนชิปของ Huawei ในสิ่งที่ SCMP อธิบายว่าเป็นความร่วมมือที่เสริมสร้างการพึ่งพาตนเองของ AI ของจีน สิ่งที่แตกต่างในตอนนี้คือซอฟต์แวร์: V4 พิสูจน์แล้วว่าโมเดลต่างๆ สามารถทำงานบน Ascend ได้ ในขณะที่การเปิดตัวครั้งนี้ทำให้นักพัฒนาชาวจีนทุกคนมีเครื่องมือในการติดตาม

ถนนก็ไม่เรียบ Generation-NT รายงานว่า DeepSeek ก่อนหน้านี้ได้เลื่อนรุ่น R2 ออกไปท่ามกลางปัญหากับชิป Huawei Ascend การตัดสินใจดังกล่าวเผยให้เห็นความเปราะบางของระบบนิเวศที่เพิ่งเกิดขึ้น ในส่วนของ Huawei นั้นยังคงเร่งดำเนินการต่อไป - The Business Times รายงานในช่วงกลางเดือนกันยายนว่าบริษัทกำลังเลื่อนการเปิดตัวชิป AI ตัวใหม่เพื่อแข่งขันกับ Nvidia การเปิดตัวโอเพ่นซอร์สจะแปลงความเจ็บปวดที่เพิ่มขึ้นเหล่านั้นให้เป็นโครงสร้างพื้นฐานที่ใช้ร่วมกันได้อย่างมีประสิทธิภาพ ปัญหาที่ DeepSeek แก้ไขด้วยตนเองกลายเป็นปัญหาที่นักพัฒนา Ascend ทุกคนได้รับประโยชน์จากการแก้ไข

จะดูอะไรต่อไป

สามสิ่งจะเป็นตัวกำหนดว่าความพยายามนี้จะกัดฟันหรือไม่ ประการแรก การนำไปใช้: เครื่องมือโอเพ่นซอร์สจะมีความสำคัญก็ต่อเมื่อนักพัฒนาชาวจีนสร้างด้วยเครื่องมือเหล่านี้จริง ๆ และการทดสอบที่แท้จริงของ TileLang ก็คือว่าการฝึกโมเดลบนคลัสเตอร์ Ascend กลายเป็นกิจวัตรมากกว่าการทดลองหรือไม่ ประการที่สอง ประสิทธิภาพ: โมเดลของ DeepSeek ได้รับการรายงานว่าทำงานบนซิลิคอนของ Huawei แล้ว แต่การจับคู่ปริมาณงานการฝึกอบรมในยุค CUDA กับปริมาณงานที่ต่างกันนั้นเป็นแถบที่แตกต่างกัน ประการที่สาม การล้น: หาก TileLang เติบโตเป็นภาษาแบบพกพาอย่างแท้จริงสำหรับตัวเร่งความเร็ว AI ก็อาจทำให้ตำแหน่งของ Nvidia ซับซ้อนยิ่งขึ้นนอกขอบเขตของจีน

สำหรับตอนนี้ข้อความก็ชัดเจน ขั้นต่อไปของการแข่งขันฮาร์ดแวร์ AI กำลังต่อสู้กันในซอฟต์แวร์ และ DeepSeek เพิ่งเผยแพร่ข้อโต้แย้งที่เปิดกว้างต่อสาธารณะ

---

ก้าวนำหน้า AI

รับข่าวสาร AI การวิเคราะห์ และความก้าวหน้าล่าสุด ทั้งหมดในที่เดียว

อ่านข่าว AI เพิ่มเติม →