AMD และ Cerebras Systems เปิดเผยความร่วมมือทางเทคนิคเพื่อสร้างโครงสร้างพื้นฐานการอนุมาน AI รูปแบบใหม่ โดยผสมผสานแพลตฟอร์ม Helios แบบแร็คสเกลของ AMD เข้ากับ Wafer-Scale Engine (WSE) ของ Cerebras ในเวิร์กโฟลว์แบบแยกส่วนเดียว ประกาศที่งาน Advancing AI 2026 ของ AMD เมื่อวันที่ 23 กรกฎาคม 2026 การทำงานร่วมกันมุ่งเป้าตรงไปที่ปัญหาด้านความหน่วงและปริมาณงาน ซึ่งทำให้การอนุมานเป็นหนึ่งในปัญหาที่แพงที่สุดในยุค AI ทั่วไป หากต้องการทราบข้อมูลล่าสุดเกี่ยวกับมุมที่เปลี่ยนแปลงไปอย่างรวดเร็วของอุตสาหกรรม โปรดติดตามการรายงานข่าว ข่าว AI ด่วน ของเรา
แนวคิดหลักคือการหยุดบังคับให้ชิปตัวเดียวทำทุกอย่าง ในการอนุมานแบบดั้งเดิม กลุ่ม GPU เดี่ยวจะจัดการทั้งงานที่ต้องกรอกข้อมูลล่วงหน้าจำนวนมากในการย่อยข้อความพร้อมท์ และงานที่ละเอียดอ่อนและต่อเนื่องในการสร้างโทเค็นใหม่แต่ละรายการ นั่นเป็นการประนีประนอม เนื่องจากทั้งสองงานมีความต้องการที่แตกต่างกันมาก AMD และ Cerebras โต้แย้งว่าการแบ่งงาน ซึ่งเป็นเทคนิคที่เรียกว่าการอนุมานแบบแยกส่วน ช่วยให้แต่ละเครื่องยนต์ทำสิ่งที่ดีที่สุดได้
เครื่องยนต์ทั้งสองแบ่งการทำงานอย่างไร
ตามประกาศอย่างเป็นทางการของ AMD AMD Helios จะทำหน้าที่เป็นกลไกทรูพุตประสิทธิภาพสูงและปรับขนาดได้ โดยใช้ GPU AMD Instinct เพื่อประมวลผลอินพุตจำนวนมากอย่างรวดเร็ว ในขณะเดียวกัน Cerebras Wafer-Scale Engine จะจัดการการถอดรหัสและการสร้างโทเค็นที่รวดเร็วเป็นพิเศษ เวลาแฝงต่ำเป็นพิเศษ ชิปของ Cerebras ถูกสร้างขึ้นบนเวเฟอร์ทั้งหมดแทนที่จะหั่นเป็นลูกเต๋าเดี่ยวๆ ทำให้มีแบนด์วิธหน่วยความจำบนชิปจำนวนมหาศาล ซึ่งเหมาะอย่างยิ่งสำหรับการสตรีมโทเค็นโดยไม่หยุดชะงัก
บริษัทต่างๆ กล่าวว่าการรวมกลไกประมวลผลทั้งสองเข้าด้วยกัน โซลูชันร่วมกันคาดว่าจะส่งมอบโทเค็นที่สูงขึ้นถึง 5 เท่าต่อวินาทีต่อวัตต์ ซึ่งเป็นตัวชี้วัดที่กลายเป็นดัชนีชี้วัดกลางสำหรับเศรษฐศาสตร์อนุมาน ในขณะที่ผู้ให้บริการแข่งขันกันในด้านความเร็วและต้นทุนพลังงาน ตัวเลขดังกล่าวถูกอ้างถึงในการแถลงข่าวของ AMD และรายงานตามช่องทางต่างๆ รวมถึง Tom's Hardware, Investing.com และ Yahoo Tech
ช็อตเด็ดการครอบงำของ Nvidia
ความร่วมมือครั้งนี้ยังเป็นสัญญาณเชิงกลยุทธ์อีกด้วย ระบบนิเวศ CUDA และกลุ่มผลิตภัณฑ์ GPU ของ Nvidia ครองการฝึกอบรมและการอนุมาน AI ในปัจจุบัน และผู้ท้าทายได้สรุปมากขึ้นว่าการเอาชนะผู้ดำรงตำแหน่งหน้าบนสถาปัตยกรรมเดียวเป็นเรื่องยาก Business Insider วางกรอบข้อตกลงในขณะที่ AMD โจมตี Nvidia โดยเดิมพันด้วยการอนุมาน ซึ่งเป็นขั้นตอนของการประมวลผล AI ที่คาดว่าจะเติบโตเร็วที่สุดเมื่อโมเดลเปลี่ยนจากการพัฒนาไปสู่การใช้งานจริง
สำหรับ AMD การจับคู่กับ Cerebras ช่วยขยายความน่าดึงดูดของแผนงาน Instinct และ Helios นอกเหนือจากการฝึกฝน สำหรับ Cerebras ซึ่งซื้อขายในตลาด Nasdaq ภายใต้สัญลักษณ์ CBRS ควบคู่ไปกับ AMD (NASDAQ: AMD) การบูรณาการร่วมกับผู้จำหน่ายเครื่องเร่งรายใหญ่ช่วยให้เทคโนโลยีขนาดเวเฟอร์มีเส้นทางที่ชัดเจนยิ่งขึ้นในการปรับใช้องค์กรขนาดใหญ่และระบบคลาวด์ Cerebras วางแผนที่จะปรับใช้ AMD Helios ในศูนย์ข้อมูลของตนเอง และบริษัทต่างๆ คาดว่าโซลูชันร่วมกันจะพร้อมใช้งานก่อนผ่าน Cerebras Cloud ในช่วงครึ่งหลังของปี 2569
เหตุใดการแยกส่วนจึงมีความสำคัญในขณะนี้
ต้นทุนการอนุมานกลายเป็นจุดกดดันที่สำคัญสำหรับอุตสาหกรรม AI เมื่อโมเดลมีขนาดใหญ่ขึ้นและแอปพลิเคชันต้องการการตอบสนองแบบเรียลไทม์ ค่าใช้จ่ายในการสร้างโทเค็นแต่ละรายการ และประสบการณ์แฝงที่ผู้ใช้รอคอย จะสามารถกำหนดได้ว่าผลิตภัณฑ์จะใช้งานได้หรือไม่ การอนุมานแบบแยกจะถือว่าการกรอกข้อมูลล่วงหน้าและถอดรหัสเป็นปริมาณงานแยกกันซึ่งสามารถกำหนดเส้นทางไปยังฮาร์ดแวร์ที่จับคู่ได้ดีที่สุดกับแต่ละอัน ซึ่งเป็นปรัชญาการออกแบบที่บริษัทอย่าง Cerebras ให้การสนับสนุนมานานกว่าหนึ่งปี
การประกาศของ AMD-Cerebras ชี้ให้เห็นว่าแนวทางดังกล่าวกำลังเปลี่ยนจากแนวคิดที่ไม่สงบไปสู่สถาปัตยกรรมที่ได้รับการรับรองจากอุตสาหกรรม ด้วยการจับคู่ผู้เชี่ยวชาญด้านปริมาณงานกับผู้เชี่ยวชาญด้านเวลาแฝง ทั้งสองบริษัทกำลังเดิมพันว่าอนาคตของการอนุมานไม่ใช่ชิปตัวเดียวที่จะควบคุมพวกเขาทั้งหมด แต่เป็นระบบที่ประสานงานกันของกลไกพิเศษ
จะดูอะไรดี
มีคำถามอีกหลายข้อ ตัวเลขโทเค็นต่อวินาทีต่อวัตต์ 5 เท่านั้นเป็นความคาดหวังมากกว่าการวัดประสิทธิภาพของบุคคลที่สาม และประสิทธิภาพในโลกแห่งความเป็นจริงจะขึ้นอยู่กับรุ่นและปริมาณงานเฉพาะที่ลูกค้าใช้งาน รายละเอียดราคาและการวางจำหน่ายนอกเหนือจากการเปิดตัว Cerebras Cloud ยังไม่ได้รับการเปิดเผย และไม่มีความชัดเจนว่าโซลูชันอาจเข้าถึงผู้ให้บริการคลาวด์รายอื่นเมื่อใด
อย่างไรก็ตาม ข้อตกลงดังกล่าวเน้นย้ำถึงการเปลี่ยนแปลงที่กว้างขึ้นในฮาร์ดแวร์ AI: การสันนิษฐานว่าสถาปัตยกรรม GPU ตัวเดียวจะให้บริการทุกขั้นตอนของไปป์ไลน์ AI นั้นกำลังล่มสลาย หาก AMD และ Cerebras สามารถปฏิบัติตามคำกล่าวอ้างด้านประสิทธิภาพได้ การอนุมานแบบแยกส่วนอาจกลายเป็นส่วนมาตรฐานของวิธีการสร้างระบบ AI ที่ใหญ่ที่สุด
ก้าวนำหน้า AI
ภูมิทัศน์ของฮาร์ดแวร์ AI กำลังแบ่งออกเป็นกลุ่มเฉพาะทาง และผลกระทบด้านต้นทุน ความเร็ว และการแข่งขันนั้นมีมหาศาล อ่านข่าว AI เพิ่มเติม บน AI Buzz Wire เพื่อติดตามทุกข้อตกลงสำคัญ การเผยแพร่ และเกณฑ์มาตรฐาน


