Cerebras และ OpenAI ทำให้โลกได้เห็น โหมด Ultrafast ซึ่งเป็นระดับบริการใหม่ที่เปิดตัวครั้งแรกใน OpenAI API และขับเคลื่อนโดยฮาร์ดแวร์ Cerebras ตามประกาศของ Cerebras ที่เผยแพร่เมื่อวันที่ 13 สิงหาคม 2026 GPT-5.6 Sol ที่ทำงานบน Ultrafast ให้ โทเค็นเอาท์พุตสูงถึง 750 โทเค็นต่อวินาที — โดยไม่กระทบต่อคุณภาพ

ขั้นแรกจะพร้อมให้บริการแก่ลูกค้ากลุ่มที่เลือก โดยการเข้าถึงจะขยายออกไปเมื่อเวลาผ่านไป ประกาศดังกล่าวซึ่งเขียนโดย Joyce Er ของ Cerebras ระบุว่าข้อเสนอดังกล่าวเป็นข้อยุติในการแลกเปลี่ยนที่กำหนดการพัฒนาผลิตภัณฑ์ AI มานานหลายปี โดยผู้สร้างต้องเลือกระหว่างความเร็วและความชาญฉลาด เนื่องจากโมเดลที่ใหญ่กว่าและชาญฉลาดกว่านั้นจะมีค่าใช้จ่ายในการคำนวณและเคลื่อนย้ายข้อมูลที่สูงขึ้น ซึ่งจะทำให้เวลาตอบสนองช้าลง ผู้อ่านที่ติดตามการแข่งขันเพื่อเร่งโมเดลชายแดนสามารถติดตามการพัฒนาล่าสุดได้ที่ AI Buzz Wire

Ultrafast นั้นเร็วแค่ไหนกันแน่?

จำนวนปริมาณงานดิบนั้นโดดเด่นในตัวเอง แต่ Cerebras ยังให้บริบทเชิงเปรียบเทียบด้วย ตามความเร็วเอาท์พุตที่รายงานโดย Artificial Analysis ซึ่งเป็นบริการเปรียบเทียบมาตรฐานอิสระ GPT-5.6 Sol ในโหมด Ultrafast จะทำงาน:

  • เร็วกว่า Fable 5 ถึง 11 เท่า
  • เร็วกว่า Opus 4.8 5 เท่าในโหมดเร็ว

เพื่อทดสอบข้อกล่าวอ้างนี้ Cerebras ได้ใช้แบบจำลองแบบตัวต่อตัวกับคู่แข่งยอดนิยมใน Humanity's Last Exam (HLE) ซึ่งเป็นเกณฑ์มาตรฐานที่ท้าทายซึ่งประกอบด้วยคำถาม 2,500 ข้อ ซึ่งโดยทั่วไปแล้วมีเพียงผู้ที่จบปริญญาเอกในสาขาต่างๆ เช่น เคมี เศรษฐศาสตร์ และวรรณคดีเท่านั้นที่จะตอบได้

ผลลัพธ์: GPT-5.6 Sol บน Ultrafast ตอบคำถาม HLE ทั้งหมด 2,500 ข้อใน 11 ชั่วโมง 11 นาที Claude Fable 5 ต้องการ 78 ชั่วโมง 27 นาที — ใช้เวลาคำนวณต่อเนื่องมากกว่าสามวัน — เพื่อให้ได้ข้อสรุปเดียวกัน กล่าวอีกนัยหนึ่ง Ultrafast ทำงานผ่านขอบเขตความรู้ของมนุษย์ภายในวันทำงานเดียว โดยได้รับความแม่นยำที่เทียบเคียงได้เร็วกว่าเกือบ 7 เท่า

Cerebras ตั้งข้อสังเกตถึงวิธีการเปรียบเทียบ: GPT-5.6 Sol Ultrafast ได้รับการทดสอบด้วย Codex โดยใช้เหตุผล xhigh เมื่อวันที่ 10 กรกฎาคม ในขณะที่ Claude Fable 5 ได้รับการทดสอบด้วย Claude Code โดยใช้เหตุผล xhigh ในวันที่ 13–15 กรกฎาคม

ปริมาณงานในโลกแห่งความเป็นจริง ไม่ใช่แค่เกณฑ์มาตรฐาน

การวัดประสิทธิภาพความเร็วอาจทำให้เข้าใจผิดได้หากคุณภาพลดลงในระหว่างทาง ซึ่งเป็นเหตุผลว่าทำไม Cerebras จึงเน้นย้ำผลลัพธ์ใน GDP-Val ซึ่งเป็นเกณฑ์มาตรฐานสำหรับงานด้านความรู้ที่มีคุณค่าทางเศรษฐกิจ ใน GDP-Val นั้น Ultrafast ให้ความเร็ว 5.6 เท่าตั้งแต่ต้นจนจบโดยไม่มีการลดคุณภาพ ตามการทดสอบ Cerebras ที่รันเมื่อวันที่ 31 กรกฎาคม 2026 โดยใช้ GPT-5.6 Sol และ GPT-5.6 Sol Ultrafast โดยใช้เหตุผลระดับกลางภายใน Codex

บริษัทกล่าวว่า GPT-5.6 Sol เป็นโมเดลที่ดีที่สุดของ OpenAI สำหรับการสรุปทางกฎหมาย แบบจำลองทางการเงิน และรายงานทางวิศวกรรม โดเมนที่ทั้งคุณภาพผลผลิตและระยะเวลาดำเนินการต่างส่งผลทางการเงินโดยตรง

เหตุใดความเร็วจึงเปลี่ยนสมการของตัวแทน

การเปลี่ยนแปลงที่เป็นผลสืบเนื่องมากขึ้นอาจอยู่ที่วิธีการทำงานของตัวแทน AI การอนุมานที่เร็วกว่าจะเปลี่ยนสิ่งที่เป็นไปได้สำหรับบุคคลและองค์กร เนื่องจากตัวแทนสามารถวางอยู่บนเส้นทางวิกฤติของปัญหาที่ทุกวินาทีมีค่า

“ด้วย GPT-5.6 Sol Ultrafast ทำให้ Cerebras เปิดใช้งาน AI ที่ตามทันวิธีที่คุณคิด เขียนโค้ด และทำงานร่วมกัน” Rohan Varma ผลิตภัณฑ์ของ OpenAI กล่าวในแถลงการณ์ที่อ้างถึงในประกาศ "เรารู้สึกตื่นเต้นที่ได้เห็นว่าเวิร์กโฟลว์และแอปพลิเคชันได้รับการเปลี่ยนแปลงอย่างไรด้วยการอนุมานแบบ Ultrafast"

Cerebras ได้สรุปสถานการณ์ที่มีเดิมพันสูงหลายประการซึ่งการเร่งความเร็วมีความสำคัญ:

การตอบสนองต่อเหตุการณ์

บริษัทที่ดำเนินการบริการบนเว็บสามารถใช้ Ultrafast เพื่อหาสาเหตุและแก้ไขปัญหาการหยุดทำงานของการผลิต รักษาความไว้วางใจของลูกค้า ป้องกันการสูญเสียรายได้ และประหยัดเวลาหยุดทำงานตาม SLA ของตน

ความปลอดภัยทางไซเบอร์

ในการโจมตีทางไซเบอร์ที่มีความเสี่ยงสูง ทีมรักษาความปลอดภัยจะต้องตรวจจับและตอบสนองต่อผู้ไม่ประสงค์ดีอย่างรวดเร็วเพื่อควบคุมการสูญเสียครั้งใหญ่ ซึ่งเป็นงานที่ความล่าช้าในการอนุมานส่งผลโดยตรงต่อการควบคุมความเสียหาย

ผลผลิตของตัวแทน

Ultrafast เปิดใช้งานโหมดใหม่ในการทำงานกับตัวแทนโดยมอบข้อมูลเชิงลึกและการอัปเดตแบบเรียลไทม์ ซึ่งช่วยลดความจำเป็นในการสลับบริบทในเซสชันคู่ขนาน

“ก่อนหน้านี้ฉันอาจต้องรอสองสามนาทีก่อนที่งานจะเสร็จสิ้น แต่ตอนนี้งานเสร็จสิ้นสำหรับฉันก่อนที่ฉันจะมีโอกาสเปลี่ยนบริบท มันทำให้ฉันมีประสิทธิผลมากขึ้น” Jeffrey Wang นักวิจัยของ OpenAI กล่าวในประกาศ

กลยุทธ์เบื้องหลังความร่วมมือ

สำหรับ Cerebras ข้อตกลงดังกล่าวถือเป็นอีกก้าวสำคัญในความพยายามในการจำหน่ายการเร่งความเร็วระดับเวเฟอร์สำหรับการอนุมาน AI สำหรับ OpenAI โหมด Ultrafast จะเพิ่มระดับความเร็วระดับพรีเมียมให้กับ API ในขณะที่เวลาแฝงในการอนุมานกลายเป็นตัวสร้างความแตกต่างทางการแข่งขัน โดยเฉพาะอย่างยิ่งสำหรับแอปพลิเคชันเอเจนต์ที่เชื่อมโยงการเรียกโมเดลจำนวนมากเข้าด้วยกัน โดยที่การหน่วงเวลาต่อการโทรจะรวมกันเป็นนาทีของการรอ

บริษัทต่างๆ วางกรอบระดับนี้ให้เป็นข้อได้เปรียบถาวรสำหรับองค์กรที่ใช้ Frontier AI เพื่อตอบสนองต่อข้อมูลขาเข้าอย่างรวดเร็ว โดยจับคู่การประมวลผลที่เร็วเป็นพิเศษสำหรับงานที่ต้องคำนึงถึงเวลา กับการประมวลผลมาตรฐานสำหรับงานสินค้าโภคภัณฑ์ที่สามารถขนานกันในเบื้องหลังได้

การเข้าถึงกำลังค่อยๆ เปิดตัว นักพัฒนาที่สนใจสามารถตรวจสอบความพร้อมใช้งานของเอกสาร OpenAI API ได้ เนื่องจาก Cerebras กล่าวว่าการเข้าถึงจะขยายออกไปเมื่อเวลาผ่านไปจากกลุ่มลูกค้าที่ได้รับการคัดเลือกเริ่มแรก

ก้าวนำหน้า AI

หากต้องการความคุ้มครองเพิ่มเติมเกี่ยวกับการแข่งขันด้านฮาร์ดแวร์และโครงสร้างพื้นฐานที่เปลี่ยนโฉมปัญญาประดิษฐ์ โปรดบุ๊กมาร์ก AI Buzz Wire และติดตามฟีด ข่าวฮาร์ดแวร์ AI ของเรา

อ่านข่าว AI เพิ่มเติม →