ปัญหาที่ Astra ช่วยแก้ไขนั้น "ไม่มีความคืบหน้าในผลลัพธ์หลักของพวกเขาเป็นเวลาอย่างน้อยหนึ่งทศวรรษ และในกรณีส่วนใหญ่ นานกว่านั้นมาก" OpenAI เขียน ผลลัพธ์ครอบคลุมสาขาต่างๆ เช่น เรขาคณิตมิติสูง ทฤษฎีการเข้ารหัส ความซับซ้อนของวงจรเลขคณิต ทฤษฎีกลุ่ม ความซับซ้อนของควอนตัม วิทยาการเข้ารหัสลับแลตทิซ และวิทยาการรวมกันสุดขั้ว ซึ่งเป็นขอบเขตที่โดยปกติจะวัดความก้าวหน้าเป็นปี ไม่ใช่การวิจัยเดี่ยวๆ
หลักฐานที่ตรวจสอบแล้ว ไม่ใช่แค่คำตอบ
สิ่งที่แยกผลลัพธ์ของ Astra ออกจากแชทบอตที่คาดเดาทางคณิตศาสตร์คือการยืนยัน OpenAI กล่าวว่านักวิจัยที่เป็นมนุษย์ใช้แบบจำลองเดียวกันในการเตรียมข้อโต้แย้งเป็นต้นฉบับ จากนั้น Astra ก็ทำให้ทุกข้อโต้แย้งกลายเป็น ใบรับรองแบบ Lean Lean เป็นผู้ช่วยพิสูจน์อักษรแบบโอเพ่นซอร์สที่สามารถตรวจสอบข้อโต้แย้งทางคณิตศาสตร์ด้วยเครื่องได้ หมายความว่านักคณิตศาสตร์คนอื่นๆ ไม่จำเป็นต้องถือผลลัพธ์โดยศรัทธา เนื่องจากซอฟต์แวร์สามารถตรวจสอบได้อย่างอิสระภายในไม่กี่วินาที
ความแตกต่างนั้นสำคัญ โมเดลภาษาสามารถสร้างข้อพิสูจน์ที่ดูเป็นไปได้ซึ่งมีข้อผิดพลาดร้ายแรงและละเอียดอ่อน ด้วยการแปลข้อโต้แย้งแต่ละรายการเป็นแบบ Lean OpenAI จึงแปลงคำกล่าวอ้างทางการตลาดเป็นสิ่งประดิษฐ์ที่ตรวจสอบได้ ตามรายงานของ BleepingComputer ซึ่งรายงานรายละเอียด ความก้าวหน้าเฉพาะนั้นรวมถึงการพิสูจน์การมีอยู่ของกลุ่มที่ไม่ใช่โซฟิก การแก้ปัญหาคำถามเปิดที่สำคัญในทฤษฎีกลุ่ม การพิสูจน์การคาดเดาความแข็งแกร่งของ Connes; ขอบเขตใหม่สำหรับการบรรจุทรงกลมมิติสูง และผลลัพธ์ที่ได้ช่วยแก้ปัญหาหลายประการที่เดิมทีเกิดจากนักคณิตศาสตร์ชื่อดังอย่าง Paul Erdős
OpenAI ตั้งข้อสังเกตว่าจำนวนโทเค็นทั้งหมดที่จำเป็นในการค้นหาโซลูชันเหล่านี้จะมีราคาประมาณ 2,000 เหรียญสหรัฐฯ ที่อัตรา API ปัจจุบัน ซึ่งเป็นจุดข้อมูลที่โดดเด่นเกี่ยวกับขอบเขตการคำนวณของการค้นพบทางคณิตศาสตร์สมัยใหม่ และอีกโครงการหนึ่งที่ทำให้การวิจัยระดับแนวหน้าเข้าถึงได้ของทีมวิชาการที่ได้รับทุนสนับสนุนอย่างดี ไม่ใช่แค่เพียงห้องปฏิบัติการเท่านั้น
ปฏิกิริยาของนักคณิตศาสตร์
โทมัส บลูม นักคณิตศาสตร์จากมหาวิทยาลัยแมนเชสเตอร์ ผู้ดูแลเว็บไซต์อ้างอิงปัญหาของErdős erdosproblems.com เรียกผลลัพธ์นี้ว่า "ข่าวใหญ่" ใน X ตามรายงานของ The Decoder เขาให้คะแนนสิ่งเหล่านี้สำคัญกว่าตัวอย่างโต้แย้งของการคาดเดาระยะทางต่อหน่วยที่เผยแพร่ในเดือนพฤษภาคม “อาจจะไม่ใหญ่ไปกว่าการพิสูจน์ระยะทางหนึ่งหน่วย แต่ในแง่ของการก่อสร้าง นี่ใหญ่มาก” บลูมเขียนBloom ยังตอบโต้กรอบที่ว่า AI กำลังเข้ามาแทนที่นักคณิตศาสตร์ โดยอ้างว่าข้อกล่าวอ้างนี้ดูสมเหตุสมผลเมื่อระบบใช้ทฤษฎีมากกว่าหนึ่งศตวรรษ สร้างขึ้นโดยนักคณิตศาสตร์ และได้รับการฝึกอบรมเกี่ยวกับทุกสิ่งที่นักคณิตศาสตร์เคยเขียนมา
โนม บราวน์ นักวิจัยที่อยู่เบื้องหลังเทคโนโลยีการให้เหตุผลขณะทดสอบที่ Astra พึ่งพา ได้รับการวัดผลมากกว่า “น่าเศร้าที่ยังไม่มีปัญหารางวัลมิลเลนเนียม (ยัง)” เขาโพสต์บน X ซึ่งหมายถึงปัญหาที่มีชื่อเสียง 7 ข้อที่สถาบันคณิตศาสตร์เคลย์เสนอเงินรางวัลละ 1 ล้านเหรียญสหรัฐ มีเพียงปัญหาเดียวเท่านั้นที่ได้รับการแก้ไขนับตั้งแต่มีการประกาศรางวัลในปี 2543ไม่ใช่ทุกคนจะประทับใจ Gary Marcus นักวิจารณ์ด้าน AI เรียกแบบจำลองนี้ว่า "น่าทึ่ง แต่มียอดขายมากเกินไป" ในโพสต์ Substack ซึ่งเป็นแนวทางที่คุ้นเคยของความกังขาเมื่อใดก็ตามที่ห้องปฏิบัติการชายแดนอ้างว่าเป็นเหตุการณ์สำคัญ ความตึงเครียดระหว่างความสำเร็จทางเทคนิคที่แท้จริงและกรอบการส่งเสริมการขายมีแนวโน้มที่จะกำหนดวิธีการรับ Astra
ครอบครัวต้นแบบใหม่สำหรับงานระยะยาว
ข้อมูลยืนยันอย่างเป็นอิสระว่า Astra เป็นตระกูลโมเดลใหม่ที่สร้างขึ้นสำหรับเวิร์กโหลดระยะยาว OpenAI อธิบายว่าเป็นระบบที่ช่วยให้ตัวแทน AI หลายคนทำงานร่วมกันในส่วนต่างๆ ของปัญหาที่ใหญ่กว่า การออกแบบที่มุ่งเป้าไปที่งานที่ใช้เวลาเป็นชั่วโมงหรือเป็นวันแทนที่จะเป็นวินาที เช่น การพิสูจน์ทฤษฎีบทหรือการปรับโครงสร้างโค้ดเบสขนาดใหญ่
BleepingComputer รายงานว่า OpenAI ยังไม่ได้ตัดสินใจว่าโมเดลดังกล่าวจะจัดส่งในชื่อ GPT-5.7, GPT-6 หรือภายใต้ชื่ออื่น Sam Altman ซีอีโอได้จัดแสดง Astra ในกรุงวอชิงตัน ดี.ซี. แล้ว The Decoder รายงาน โดยส่งสัญญาณว่าบริษัทมองว่าระบบนี้มีความเป็นผู้ใหญ่เพียงพอที่จะแสดงต่อหน้าผู้กำหนดนโยบาย
อุปสรรค์ในการทบทวนรัฐบาล
บางทีรายละเอียดที่เป็นผลสืบเนื่องมากที่สุดก็คือกฎระเบียบ ตามรายงานของ The Decoder แอสตร้าจะเป็นหนึ่งในโมเดลแรกๆ ที่จะผ่านกระบวนการตรวจสอบตามแผนของรัฐบาลสหรัฐฯ ซึ่งต้องได้รับอนุมัติอย่างเป็นทางการก่อนที่จะเผยแพร่สู่สาธารณะ นั่นเพิ่มชั้นของความไม่แน่นอนทางการเมืองให้กับไทม์ไลน์การเปิดตัวซึ่งรุ่นเรือธงรุ่นก่อน ๆ ไม่เคยเผชิญหน้ามาก่อน และเพิ่มเดิมพันว่า OpenAI จะแสดงคุณลักษณะของความสามารถของ Astra อย่างไร
การเปิดตัวยังเกิดขึ้นท่ามกลางการแข่งขันโอเพ่นเวทอันดุเดือด ไม่กี่วันก่อนหน้านี้ Thinking Machines Lab ได้เปิดตัวโมเดล Inkling-Small แบบ open-weight และห้องปฏิบัติการของจีนยังคงผลักดันระบบ open-weight frontier ต่อไป Astra ส่งสัญญาณการเดิมพันของ OpenAI ว่าการใช้เหตุผลขนาดใหญ่ที่เป็นกรรมสิทธิ์ — ตรวจสอบโดยเครื่องมืออย่าง Lean — ยังคงเป็นเส้นทางสู่ความก้าวหน้าครั้งใหญ่ที่สุด
สำหรับตอนนี้ Astra ยังไม่ได้เผยแพร่ แต่การเปิดตัวทางคณิตศาสตร์ได้เปลี่ยนกรอบการสนทนาเกี่ยวกับสิ่งที่ระบบ AI ระดับแนวหน้าสามารถมีส่วนร่วมในวิทยาศาสตร์บริสุทธิ์ได้ และประชาชนควรพิจารณากลั่นกรองข้อกล่าวอ้างที่มาพร้อมกับพวกเขาอย่างใกล้ชิดเพียงใด
ก้าวนำหน้า AI
ต้องการติดตามการพัฒนาเช่น Astra และการแข่งขันโมเดลชายแดนที่กว้างขึ้นหรือไม่? คั่นหน้าศูนย์กลางของเราสำหรับ การพัฒนา AI ล่าสุด
อ่านข่าว AI เพิ่มเติม →