OpenAI เผยแพร่ต้นฉบับทางคณิตศาสตร์ 722 ฉบับที่ผลิตโดยโมเดลชายแดนภายในที่ยังไม่เผยแพร่ โดยวางคอลเลกชันทั้งหมดไว้ในที่เก็บ GitHub สาธารณะภายใต้ใบอนุญาต Apache-2.0 การเปิดตัวดังกล่าวซึ่งประกาศในโพสต์วิจัยในหัวข้อ "การแบ่งปันความก้าวหน้าของ AI ในวิชาคณิตศาสตร์" เมื่อวันที่ 6 ตุลาคม 2569 เป็นหนึ่งในการทิ้งผลลัพธ์ทางคณิตศาสตร์ที่สร้างโดย AI ครั้งใหญ่ที่สุดในปัจจุบัน และมาพร้อมกับการตรวจสอบหลักฐานแบบ Lean อย่างเป็นทางการ การสรุปการใช้เหตุผลแบบย่อ และรายละเอียดที่ผิดปกติเกี่ยวกับปริมาณการประมวลผลแต่ละผลลัพธ์ที่ใช้ไป
การเคลื่อนไหวตกลงไปในสนามที่อยู่ขอบแล้ว The New York Times รายงานว่าการเปิดตัวดังกล่าวสร้างความปั่นป่วนให้กับชุมชนนักคณิตศาสตร์ที่ใช้เวลาหลายเดือนในการต่อสู้กับระบบ AI เพื่อให้ได้ผลการวิจัยที่จริงจัง ในขณะที่ Scientific American อธิบายว่า OpenAI เป็นการปลดปล่อย "ผลลัพธ์ทางคณิตศาสตร์อีกหลายร้อยรายการในสาขาที่น่าตกใจอยู่แล้ว" สำหรับผู้อ่านที่ติดตาม การพัฒนาการวิจัย AI ล่าสุด ข่าวประชาสัมพันธ์ฉบับนี้ถือเป็นกรณีทดสอบว่าห้องปฏิบัติการชายแดนแบ่งปันวิทยาศาสตร์ที่สร้างด้วยเครื่องจักรอย่างไร โดยไม่ก่อให้เกิดข้อพิพาทด้านเครดิต
มีอะไรอยู่ภายในพื้นที่เก็บข้อมูล
คอลเลกชันอาศัยอยู่ในพื้นที่เก็บข้อมูล openai/math บน GitHub ตาม README เนื้อหาเป็นต้นฉบับทางคณิตศาสตร์และหลักฐานสนับสนุนที่สร้างขึ้นโดยโมเดล OpenAI ภายใน ซึ่งรวบรวมเป็นส่วนหนึ่งของการประเมินการพัฒนาแบบจำลองเกี่ยวกับปัญหาการวิจัยแบบเปิด แคตตาล็อกปัจจุบันประกอบด้วยต้นฉบับ 722 ฉบับซึ่งจัดเป็น 372 ตระกูล โดยกลุ่มครอบครัวจะเกี่ยวข้องกับเอกสารที่อาจรวมถึงผลลัพธ์หลัก ข้อโต้แย้งร่วม ผลที่ตามมา หรือการพิสูจน์ทางเลือก โดยแต่ละครอบครัวจำแนกตามระเบียบวินัยทางคณิตศาสตร์
ไดเร็กทอรีก่อนพิมพ์จะเก็บ PDF, ไฟล์ต้นฉบับ และการอ้างอิงต่อต้นฉบับและคำแนะนำในการสร้าง ห้องสมุดแบบ Lean จะจัดรายการการพิสูจน์อย่างเป็นทางการควบคู่ไปกับเอกสารที่เกี่ยวข้องและการกำหนดค่าการตรวจสอบ ไม่ใช่ต้นฉบับทุกฉบับที่ได้รับการรับรองอย่างเป็นทางการ: ผลลัพธ์จำนวนมากมีการจัดทำอย่างเป็นทางการใน Lean ซึ่งเป็นภาษาการเขียนโปรแกรมที่ใช้เพื่อให้คอมพิวเตอร์ตรวจสอบการพิสูจน์ทีละบรรทัด แต่ README เตือนว่าผลลัพธ์ที่ไม่เป็นทางการบางรายการอาจมีปัญหา OpenAI กล่าวว่าจะแก้ไขปัญหาดังกล่าวได้อย่างรวดเร็ว และมุ่งมั่นที่จะรักษาประวัติการเผยแพร่สู่สาธารณะของคอลเลกชัน บันทึกการแก้ไขและการแก้ไขเป็นเวอร์ชันใหม่ ในขณะที่ยังคงเข้าถึงเวอร์ชันก่อนหน้าได้ แต่ละไดเร็กทอรีต้นฉบับยังมีบล็อก BibTeX สำหรับการอ้างอิง
ผลลัพธ์เกิดขึ้นได้อย่างไร
ผลลัพธ์ส่วนใหญ่มาจากขั้นตอนเดียวที่ตายตัวโดยใช้โมเดล OpenAI ภายในที่ยังไม่เผยแพร่ ในระหว่างการประเมิน แบบจำลองนี้ถูกพบปัญหาประมาณ 4,000 ปัญหา OpenAI รายงานว่าผลลัพธ์โดยเฉลี่ยที่เผยแพร่ใช้เวลาเทียบเท่ากับการประมวลผลการคิด ChatGPT Pro ประมาณสามชั่วโมง ซึ่งเป็นระดับความโปร่งใสที่ยังหาได้ยากในอุตสาหกรรม บริษัทกล่าวว่าได้ขยายการประเมินเหล่านี้ หลังจากที่ประสิทธิภาพในเกณฑ์มาตรฐานทางคณิตศาสตร์ที่มีอยู่อิ่มตัวแล้ว และผลลัพธ์บางส่วนสร้างขึ้นจากผลลัพธ์ก่อนหน้านี้ที่สร้างโดยแบบจำลองของบริษัทเอง การต้องมีระดับความสำคัญที่เหมาะสมและการรวบรวมผลงานดิบเข้าไว้ในครอบครัวและต้นฉบับจึงทำให้เกิดแคตตาล็อกที่ตีพิมพ์
ข้อยกเว้นที่มีชื่อสองประการแยกออกจากขั้นตอนนั้น: งานสร้างขอบเขตที่ปราศจากศูนย์สำหรับฟังก์ชันซีตาของรีมันน์ โดยมีการเขียนครอบคลุมขอบเขต Re(s) > 11/12 โดยมนุษย์แก้ไขเพื่อให้อ่านง่าย และข้อพิสูจน์ของการคาดเดาแบบฮอดจ์สำหรับพันธุ์ CM abelian ทั้งสองเป็นคณิตศาสตร์กระแสหลักที่จริงจัง และตอนนี้ทั้งคู่กำลังเผชิญกับการพิจารณาของชุมชน
มีการเผยแพร่บทสรุปย่อสิบประการของการใช้เหตุผลของแบบจำลองด้วย โดยครอบคลุมผลลัพธ์ต่างๆ เช่น เลขชี้กำลังไร้เหตุผลของ pi การคาดเดาแบบสมมาตรและการคาดเดาทั่วไปของ Mahler มอร์ฟิซึมของปัจจัยกลุ่มอิสระ ขอบเขตกึ่งพหุนามสำหรับการก้าวหน้าทางคณิตศาสตร์ การคาดเดาความละเอียดโดยตรงของ Kaplansky ในลักษณะเฉพาะที่ 2 สูตร Mezard-Parisi สำหรับแก้วหมุนแบบเจือจาง การดึงดูดโดยธรรมชาติในแม่เหล็กเฟอร์โรแมกเนติกควอนตัมของ Heisenberg และสามมิติ ระบบวลาซอฟ-แมกซ์เวลล์เชิงสัมพัทธภาพ
กลุ่มที่ปรึกษาช่วยกำหนดรูปแบบการเปิดตัว
OpenAI กล่าวว่าได้ปรึกษากับกลุ่มที่ปรึกษาอิสระด้านคณิตศาสตร์และปัญญาประดิษฐ์ที่สถาบันการศึกษาขั้นสูง พร้อมทั้งพัฒนาแนวทางปฏิบัติที่ดีที่สุดในการแบ่งปันผลลัพธ์ กลุ่มดังกล่าวเผยแพร่คำแนะนำการเปิดเผยความรับผิดชอบเมื่อวันที่ 29 กันยายน พ.ศ. 2569 หลังจากได้รับการตอบกลับมากกว่า 600 รายการจากชุมชนคณิตศาสตร์ คำแนะนำนั้นตรงไปตรงมา: "เราไม่สนับสนุนแนวทางปฏิบัตินี้ และเราขอให้พวกเขาหยุดการทดสอบปัญหาทางคณิตศาสตร์ขั้นสูงในแบบจำลองที่เป็นกรรมสิทธิ์" กลุ่มเรียกร้องให้ห้องปฏิบัติการฝากผลลัพธ์ไว้ในคลังข้อมูลทางวิชาการที่ไม่มีห้องปฏิบัติการ AI ควบคุม เพื่อกำหนดตัวระบุที่สามารถอ้างอิงได้อย่างต่อเนื่อง เปิดเผยชื่อโมเดล ข้อความแจ้งที่ใช้ และสรุปห่วงโซ่การให้เหตุผล และงดเว้นจากการปฏิบัติต่อการเปิดเผยผลลัพธ์ในฐานะเครื่องมือทางการตลาด
การเปิดตัวของ OpenAI นั้นเป็นความพยายามที่จะปฏิบัติตามกรอบงานนั้นอย่างชัดเจนแทนที่จะท้าทายมัน ชุมชนยอมรับหรือไม่นั้นเป็นอีกคำถามหนึ่ง การสำรวจของกลุ่มที่ปรึกษาได้ถามเป็นพิเศษเกี่ยวกับสถานการณ์ที่ห้องปฏิบัติการประกาศการมีอยู่ของผลลัพธ์จำนวนมากโดยไม่ได้ให้รายละเอียด และคำแนะนำที่เกิดขึ้นสะท้อนถึงความกังวลอย่างลึกซึ้งเกี่ยวกับการประกาศที่ก้าวล้ำหน้าการยืนยัน
ภาระในการตรวจสอบเปลี่ยนไปสู่นักคณิตศาสตร์
ความท้าทายในทางปฏิบัติตอนนี้เป็นของนักคณิตศาสตร์ที่ทำงานอยู่ สามารถตรวจสอบการพิสูจน์แบบ Lean อย่างเป็นทางการได้ทางกลไก และการมีอยู่ของสิ่งเหล่านี้ช่วยลดความเสี่ยงของข้อผิดพลาดได้อย่างมาก แต่ต้นฉบับที่ไม่มีการจัดรูปแบบอย่างเป็นทางการ ซึ่ง README ระบุว่าอาจมีข้อบกพร่อง จำเป็นต้องมีการตรวจสอบจากผู้ทรงคุณวุฒิแบบดั้งเดิม และต้นฉบับ 722 ฉบับนั้นเกินกว่าที่ชุมชนจะสามารถซึมซับได้อย่างรวดเร็ว นอกจากนี้ยังมีคำถามเรื่องลำดับความสำคัญและเครดิต นักคณิตศาสตร์ที่ใช้เวลาหลายปีกับปัญหาเหล่านี้จะต้องการทราบว่าแบบจำลองนั้นถูกถามอะไร ได้รับอะไร และรวมเอาผลลัพธ์ของมนุษย์ใดๆ เข้าด้วยกันหรือไม่ การเผยแพร่สรุปพร้อมท์และสถิติการคำนวณของ OpenAI ได้รับการออกแบบมาเพื่อตอบคำถามเหล่านั้นล่วงหน้า
นอกจากนี้การเผยแพร่ยังกำหนดเทมเพลตคู่แข่งที่อาจกดติดตามได้ Anthropic, Google DeepMind และแล็บอื่นๆ ที่มีโมเดลชายแดนที่มีความสามารถทางคณิตศาสตร์ระดับการวิจัย ขณะนี้เผชิญกับบรรทัดฐานตามพฤตินัย ซึ่งกำหนดโดยกลุ่มที่ปรึกษาว่าผลลัพธ์ที่ซ่อนอยู่ในโมเดลที่เป็นกรรมสิทธิ์ควรได้รับการเผยแพร่โดยมีที่มาครบถ้วนหรือไม่ล้อเล่นเลย
สำหรับตอนนี้ พื้นที่เก็บข้อมูลใช้งานได้จริง ความพยายามในการเตรียมการยังดำเนินอยู่ และการแก้ไขกำลังถูกเผยแพร่สู่สาธารณะ ไม่ว่าสิ่งนี้จะกลายเป็นเพลย์บุ๊กมาตรฐานสำหรับคณิตศาสตร์ที่สร้างโดย AI หรือจุดวาบไฟอื่นในความขัดแย้งที่ขยายวงกว้างระหว่างห้องปฏิบัติการและชุมชนการวิจัยที่พวกเขาวาดขึ้น จะขึ้นอยู่กับว่าการตรวจสอบข้อเท็จจริงจะเป็นอย่างไรในอีกไม่กี่สัปดาห์ข้างหน้า
ก้าวนำหน้า AI Curve
วิทยาศาสตร์ที่สร้างโดย AI กำลังเปลี่ยนจากการแถลงข่าวไปสู่การพิจารณาโดยผู้ทรงคุณวุฒิ ติดตามข่าวด่วน AI ได้ที่ aibuzzwire.news สำหรับการรายงานข่าวการวิจัยสำคัญๆ การเปิดตัวโมเดล และการเปลี่ยนแปลงนโยบายทุกครั้ง
อ่านข่าว AI เพิ่มเติม →