Cerebras Systems และ OpenAI ได้แชร์ภาพรวมเบื้องต้นของโหมด Ultrafast ซึ่งเป็นระดับบริการใหม่ที่เปิดตัวครั้งแรกใน OpenAI API และขับเคลื่อนโดยเทคโนโลยีขนาดเวเฟอร์ของ Cerebras ความร่วมมือดังกล่าวทำให้ GPT-5.6 Sol สามารถทำงานได้ที่โทเค็นเอาท์พุตสูงถึง 750 โทเค็นต่อวินาที ส่งมอบข้อมูลอัจฉริยะระดับแนวหน้าด้วยความเร็วแบบเรียลไทม์ หากต้องการทราบข่าวสารฮาร์ดแวร์ AI ล่าสุด โปรดไปที่ AI Buzz Wire

ขจัดการแลกเปลี่ยนความเร็วและสติปัญญา

ผู้สร้าง AI ต้องเผชิญกับข้อเสียเปรียบพื้นฐานมานานแล้ว เนื่องจากโมเดลขยายขนาดและความชาญฉลาดมากขึ้น ทำให้มีต้นทุนด้านการคำนวณและการเคลื่อนย้ายข้อมูลที่สูงขึ้น ส่งผลให้เวลาตอบสนองช้าลง นักพัฒนาถูกบังคับให้เลือกระหว่างรอผลลัพธ์คุณภาพสูงหรือยอมรับผลลัพธ์ที่ด้อยกว่าโดยใช้เวลาน้อยลง

GPT-5.6 Sol ในโหมด Ultrafast ได้รับการออกแบบมาเพื่อแก้ไขปัญหานี้ จากข้อมูลของ Cerebras บริการนี้ทำงานได้เร็วกว่า Claude Fable 5 ของ Anthropic ถึง 11 เท่า และเร็วกว่า Opus 4.8 ในโหมด Fast ถึง 5 เท่า โดยอิงตามความเร็วเอาท์พุตที่รายงานโดย Artificial Analysis

การทดสอบครั้งสุดท้ายของมนุษยชาติ: การทดสอบความเร็ว

Cerebras ได้นำ Ultrafast มาทดสอบกับโมเดลคู่แข่งใน Humanity's Last Exam (HLE) ซึ่งเป็นเกณฑ์มาตรฐานที่ท้าทายซึ่งประกอบด้วยคำถาม 2,500 ข้อ ซึ่งโดยทั่วไปแล้วจะมีเฉพาะผู้ที่จบปริญญาเอกในสาขาต่างๆ เช่น เคมี เศรษฐศาสตร์ และวรรณคดีเท่านั้นที่จะตอบได้

ในการประเมินที่ดำเนินการโดย Cerebras GPT-5.6 Sol ในโหมด Ultrafast ตอบคำถาม HLE ทั้งหมด 2,500 ข้อใน 11 ชั่วโมง 11 นาที Claude Fable 5 ต้องใช้เวลา 78 ชั่วโมง 27 นาที ซึ่งใช้เวลาคำนวณต่อเนื่องมากกว่า 3 วันจึงจะได้ข้อสรุปเดียวกัน กล่าวอีกนัยหนึ่ง Ultrafast ประมวลผลขอบเขตความรู้ของมนุษย์ในวันทำการเดียว ทำให้ได้รับความแม่นยำที่เทียบเคียงได้เร็วกว่าเกือบเจ็ดเท่า

การเปรียบเทียบดำเนินการโดย Cerebras โดยใช้ GPT-5.6 Sol Ultrafast พร้อม Codex ในการตั้งค่าการใช้เหตุผลสูงในวันที่ 10 กรกฎาคม และ Claude Fable 5 พร้อม Claude Code ในการตั้งค่าการใช้เหตุผลสูงตั้งแต่วันที่ 13 ถึง 15 กรกฎาคม

ผลกระทบทางธุรกิจในโลกแห่งความเป็นจริง

ใน GDP-Val ซึ่งเป็นเกณฑ์มาตรฐานสำหรับงานความรู้ที่มีคุณค่าทางเศรษฐกิจ Ultrafast ให้การเร่งความเร็วตั้งแต่ต้นทางถึง 5.6 เท่าโดยไม่มีการลดคุณภาพ สิ่งนี้แสดงให้เห็นว่าการอนุมานที่รวดเร็วขึ้นสามารถเร่งการทำงานที่มีคุณค่าทางเศรษฐกิจได้อย่างไร โดยไม่กระทบต่อคุณภาพของผลผลิต

Cerebras มองเห็น Ultrafast เป็นเครื่องมือสำหรับสถานการณ์ที่ทุกวินาทีมีความสำคัญ บริษัทที่ดำเนินการบริการบนเว็บสามารถใช้เทคโนโลยีนี้เพื่อหาสาเหตุและแก้ไขปัญหาการหยุดทำงานของการผลิตได้รวดเร็วยิ่งขึ้น รักษาความไว้วางใจของลูกค้าและป้องกันการสูญเสียรายได้ ในสถานการณ์ความปลอดภัยทางไซเบอร์ที่มีเดิมพันสูง ทีมรักษาความปลอดภัยสามารถใช้ประโยชน์จาก Ultrafast เพื่อตรวจจับและตอบสนองต่อการโจมตีได้อย่างรวดเร็ว

เทคโนโลยีเบื้องหลังความเร็ว

ความได้เปรียบด้านประสิทธิภาพมาจากสถาปัตยกรรม Wafer-Scale Engine ของ Cerebras ซึ่งสร้างขึ้นโดยมีจุดประสงค์เพื่อเวิร์กโหลด AI ระดับแนวหน้า ความท้าทายหลักของการอนุมานขอบเขตที่รวดเร็วคือปัญหาการเคลื่อนย้ายข้อมูล บน GPU แบบดั้งเดิม การอนุมานในโมเดลขนาดใหญ่มีปัญหาคอขวดเนื่องจากแบนด์วิธหน่วยความจำ เนื่องจากตุ้มน้ำหนักของโมเดลจะต้องถูกถ่ายโอนซ้ำๆ ระหว่างหน่วยความจำบนชิปและพื้นที่เก็บข้อมูลนอกชิปเพื่อสร้างโทเค็นที่ต่อเนื่องกัน

Cerebras ใช้แนวทางที่แตกต่างโดยพื้นฐาน ชิปขนาดเวเฟอร์แต่ละตัวบรรจุ SRAM ขนาด 44 GB บนซิลิคอนโดยตรง ตุ้มน้ำหนักโมเดลจะอยู่บนชิป และโทเค็นจะไหลอย่างต่อเนื่องผ่านเลเยอร์โมเดลที่ส่งผ่านเวเฟอร์ สิ่งนี้จะกำจัดการเคลื่อนย้ายข้อมูลที่ไม่มีประสิทธิภาพซึ่งจะทำให้การอนุมานตาม GPU ช้าลง และปรับขนาดได้อย่างราบรื่นตามขนาดของโมเดล ซึ่งปูทางไปสู่ความได้เปรียบด้านความเร็วอย่างต่อเนื่องสำหรับโมเดลระดับแนวหน้าในอนาคต

ความพร้อมใช้งานและตำแหน่งทางการตลาด

ขณะนี้ GPT-5.6 Sol ในโหมด Ultrafast มีให้บริการในการแสดงตัวอย่างแบบจำกัดสำหรับลูกค้าบางกลุ่ม โดยการเข้าถึงจะขยายเมื่อเวลาผ่านไปเมื่อความจุเพิ่มขึ้น Cerebras อธิบายถึงความร่วมมือครั้งนี้ว่าเป็นการขับเคลื่อนคลื่นลูกใหม่ของนวัตกรรม AI และยกระดับเพดานสำหรับสิ่งที่องค์กรต่างๆ สามารถทำได้สำเร็จด้วย AI ที่ตอบสนองได้ดี

ความร่วมมือดังกล่าวถือเป็นก้าวสำคัญสำหรับ Cerebras ซึ่งได้ติดตามการประมวลผลระดับเวเฟอร์มายาวนานเพื่อเป็นทางเลือกแทนตลาดฮาร์ดแวร์ AI ที่ครอบงำโดย GPU ด้วยการเป็นพันธมิตรโดยตรงกับ OpenAI เพื่อเร่งโมเดลชายแดนที่มีความสามารถมากที่สุดรุ่นหนึ่ง Cerebras กำลังสร้างกรณีที่ชัดเจนว่าสถาปัตยกรรมของตนมอบความได้เปรียบทางการแข่งขันอย่างแท้จริงสำหรับปริมาณงานการอนุมานความเร็วสูง

เนื่องจากโมเดลมีขนาดใหญ่ขึ้นเรื่อยๆ และมีความชาญฉลาดมากขึ้น ความสามารถในการให้บริการด้วยความเร็วแบบเรียลไทม์อาจกลายเป็นปัจจัยการแข่งขันที่กำหนดในตลาดโครงสร้างพื้นฐาน AI ความร่วมมือระหว่าง Cerebras และ OpenAI ส่งสัญญาณว่าการแข่งขันเพื่อความเร็วอนุมานมีความสำคัญพอๆ กับการแย่งชิงโมเดลอัจฉริยะ

ก้าวนำหน้า AI

หากต้องการข่าวสารฮาร์ดแวร์ AI เพิ่มเติม การวิเคราะห์ประสิทธิภาพของโมเดล และการพัฒนาอุตสาหกรรม โปรดบุ๊กมาร์ก AI Buzz Wire

อ่านข่าว AI เพิ่มเติม →