OpenAI ได้เผยแพร่ผลการวิจัยเกี่ยวกับปัญหาการวิจัยทางคณิตศาสตร์ 377 รายการ บริษัทกล่าวในบล็อกโพสต์ชื่อ "การแบ่งปันความก้าวหน้าของ AI ในทางคณิตศาสตร์" ที่เผยแพร่เมื่อวันอังคารที่ 6 ตุลาคม 2569 ซึ่งถือเป็นการลดลงทางคณิตศาสตร์ครั้งใหญ่ครั้งที่สองในรอบหลายเดือน

ผลลัพธ์ครอบคลุมพีชคณิต วิทยาการคอมพิวเตอร์เชิงทฤษฎี และตรรกศาสตร์ทางคณิตศาสตร์ และมาถึงเพียงไม่กี่สัปดาห์หลังจาก OpenAI อ้างสิทธิ์ในการแก้สมการเนเวียร์-สโตกส์ ซึ่งเป็นหนึ่งในปัญหาที่ยังไม่แก้ที่มีชื่อเสียงที่สุดในโลกพร้อมเงินรางวัลมูลค่า 1 ล้านดอลลาร์ การกล่าวอ้างก่อนหน้านี้ทำให้นักคณิตศาสตร์แตกแยกกันไปแล้ว การเปิดตัวที่ใหญ่กว่ามากในสัปดาห์นี้ทำให้การอภิปรายรุนแรงขึ้น สำหรับผู้อ่านที่ติดตาม ข่าวด่วน AI ตอนนี้ได้กลายเป็นบททดสอบที่ชัดเจนที่สุดว่าชุมชนการวิจัยควรจัดการกับผลลัพธ์ที่สร้างโดยเครื่องจักรซึ่งมนุษย์ไม่สามารถตรวจสอบได้อย่างง่ายดาย

สิ่งที่ OpenAI เปิดตัวจริง

ตามรายงานของ The Guardian OpenAI เผยแพร่ "ผลลัพธ์ทางคณิตศาสตร์มากกว่า 370 รายการในหัวข้อต่างๆ เช่น พีชคณิต วิทยาการคอมพิวเตอร์เชิงทฤษฎี และตรรกะทางคณิตศาสตร์" เดอะนิวยอร์กไทมส์นับปัญหาไว้ที่ 377 ปัญหา ในขณะที่นักวิทยาศาสตร์ใหม่รายงานว่า การเปิดตัวครั้งนี้มีการค้นพบทางคณิตศาสตร์ 722 รายการเมื่อมีการนับผลลัพธ์เสริมแล้ว การนับที่แตกต่างกันสะท้อนถึงวิธีการต่างๆ ในการจัดกลุ่มบทแทรก ข้อพิสูจน์ และวิธีแก้ปัญหาทั้งหมดให้เป็น "ผลลัพธ์" ที่ไม่ต่อเนื่องกัน

มาตราส่วนเป็นสิ่งที่ทำให้ผู้สังเกตการณ์ตะลึง Navier-Stokes เมื่อเดือนที่แล้วเกี่ยวข้องกับผลลัพธ์เดียวที่ได้รับการตรวจสอบอย่างละเอียด การเปิดตัวครั้งนี้ก็เกิดขึ้นพร้อมกัน โดยมีการค้นพบหลายร้อยรายการในฟิลด์ย่อยหลายรายการ ซึ่งสร้างขึ้นโดยโมเดลภายในที่ทันสมัยที่สุดของ OpenAI เรื่องราวดังกล่าวได้รับการรายงานข่าวจาก The Washington Post, The Economist, The Wall Street Journal และ Fortune ภายในหนึ่งวัน และโพสต์ในบล็อกของ OpenAI ก็ติดอันดับ Hacker News ด้วยคะแนนโหวตมากกว่าพันครั้ง

สถาบันศึกษาขั้นสูงรุกกลับ

สถาบันการศึกษาขั้นสูงในเมืองพรินซ์ตัน รัฐนิวเจอร์ซีย์ ซึ่งเป็นบ้านของบุคคลสำคัญอย่างไอน์สไตน์และฟอน นอยมันน์ ซึ่งก่อตั้งมายาวนาน กล่าวว่า สถาบันไม่สนับสนุนแนวทางปฏิบัติในการทดสอบแบบจำลองขอบเขตกับปัญหาที่เปิดกว้างยากที่สุดในสาขานี้ โดยเฉพาะอย่างยิ่งเมื่องานเกิดขึ้นหลังประตูที่ปิด

“ตอนนี้เป็นกรณีที่ AI สามารถแสดงข้อโต้แย้งทางคณิตศาสตร์ในสถานการณ์โดยที่มนุษย์ไม่สามารถเข้าใจข้อโต้แย้ง ตรวจสอบ หรือรับผิดชอบต่อข้อโต้แย้งเหล่านั้นได้” องค์กรกล่าวในแถลงการณ์ "เราเชื่อว่าความเข้าใจของมนุษย์เกี่ยวกับคณิตศาสตร์ยังคงมีความสำคัญยิ่ง"

ข้อกังวลไม่ใช่ว่าผลลัพธ์จะต้องผิดเสมอไป คณิตศาสตร์ในฐานะวินัยต้องอาศัยการตรวจสอบยืนยัน และการกล่าวอ้างมากมายที่เกิดจากเครื่องจักรว่าไม่มีมนุษย์คนใดตรวจสอบนั้นถือเป็นบรรทัดฐานทางวิชาการอย่างไม่สบายใจ

การตอบสนองของ OpenAI: ที่นั่งที่โต๊ะ

เพื่อจัดการกับฟันเฟืองดังกล่าว OpenAI ได้ประกาศว่าจะทำงานร่วมกับสถาบันการศึกษาขั้นสูงเพื่อให้ "นักคณิตศาสตร์ได้แสดงความคิดเห็นว่าเราก้าวไปข้างหน้าอย่างไร" สิ่งที่บริษัทไม่ได้ให้คำมั่นสัญญา The Guardian ตั้งข้อสังเกตคือการเปลี่ยนแปลงใด ๆ ในแนวทางปฏิบัติพื้นฐาน OpenAI ไม่ได้ให้ข้อบ่งชี้ว่าจะหยุดการทดสอบปัญหาขั้นสูงในโมเดลภายในที่เป็นกรรมสิทธิ์

คณะกรรมการที่ปรึกษาของสถาบันยังได้ขอให้ห้องปฏิบัติการ AI ให้ "การเข้าถึงระบบชายแดนของตนอย่างเท่าเทียมกัน" “การใช้แบบจำลองภายในที่เป็นกรรมสิทธิ์ของห้องปฏิบัติการ AI เพื่อทำการวิจัยทางคณิตศาสตร์มีความเสี่ยงในการสร้างระบบสองชั้นที่ห้องปฏิบัติการมีมากกว่าส่วนที่เหลือ ส่งผลให้ชุมชนคณิตศาสตร์แปลกแยกจากระเบียบวินัยของตนเองอย่างมีประสิทธิภาพ” กลุ่มเขียน

'รับงานของใครบางคนแล้วนำไปทำให้สำเร็จ'

นักคณิตศาสตร์ที่ใกล้ชิดกับปัญหาที่ได้รับผลกระทบกำลังหยิบยกประเด็นย่อยขึ้นมา นั่นก็คือ เครดิต Tristan Buckmaster นักคณิตศาสตร์จากมหาวิทยาลัยนิวยอร์กที่ทำงานเกี่ยวกับปัญหา Navier-Stokes บอกกับ The New York Times ว่านักวิจัยที่กระตุ้นโมเดล AI อาจให้ความคืบหน้าบางส่วนที่โมเดลจากนั้นเสร็จสิ้น

“มีแนวโน้มที่จะมีผลลัพธ์มากมายที่พวกเขารับงานของใครบางคนแล้วนำไปทำให้เสร็จ” Buckmaster กล่าว

หากถูกต้อง ไดนามิกนั้นจะทำให้ทั้งการระบุแหล่งที่มาและการประเมินมีความซับซ้อน ผลลัพธ์ที่ดูเหมือนการพัฒนาเครื่องจักรที่เป็นอิสระ แท้จริงแล้วอาจเป็นขั้นตอนสุดท้ายบนโครงที่มนุษย์สร้างขึ้น ซึ่งเป็นขั้นตอนที่มนุษย์ไม่เคยตกลงที่จะส่งมอบ

การวิจัย AI มีความหมายอย่างไร

การเผยแพร่ทางคณิตศาสตร์กำลังกลายมาเป็นการแสดงให้เห็นถึงความสามารถในห้องปฏิบัติการระดับแนวหน้า และการทดสอบความเครียดที่เกิดขึ้นเป็นประจำเพื่อดูว่าวิทยาศาสตร์ดูดซับผลผลิตของเครื่องจักรอย่างไร การจัดเฟรมของ The Wall Street Journal จับภาพแส้: AI แก้ปัญหาทางคณิตศาสตร์ได้หนึ่งข้อและทุกคนก็ตกใจมาก - ตอนนี้มันแตกไปแล้วหลายร้อยข้อ

คำถามสามข้อจะเป็นตัวกำหนดว่าจะเกิดอะไรขึ้นต่อไป ประการแรก การตรวจสอบความถูกต้อง: นักคณิตศาสตร์อิสระต้องใช้เวลาหลายเดือนในการตรวจสอบผลลัพธ์แม้เพียงเศษเสี้ยวของผลลัพธ์ 377 รายการ และหากพบข้อผิดพลาด จะส่งผลต่อความน่าเชื่อถือของ OpenAI อย่างหนัก ประการที่สอง การเข้าถึง: ไม่ว่าห้องปฏิบัติการจะเปิดแบบจำลองที่แข็งแกร่งที่สุดให้กับนักวิจัยภายนอก ตามที่สถาบันต้องการ หรือให้ปิดวงไว้ ประการที่สาม ลำดับความสำคัญ: ตามข้อกังวลของ Buckmaster ฟิลด์นี้อาจจำเป็นต้องมีบรรทัดฐานใหม่ในการให้เครดิตการพิสูจน์การทำงานร่วมกันของมนุษย์และ AI

OpenAI ไม่ตอบสนองต่อคำร้องขอความคิดเห็นเกี่ยวกับการวิจารณ์ ตามรายงานของ The Guardian ไม่ว่าการเป็นหุ้นส่วนกับสถาบันเพื่อการศึกษาขั้นสูงจะสร้างบรรทัดฐานที่ใช้งานได้จริงหรือเพียงบันทึกความขัดแย้งนั้น มีแนวโน้มว่าจะเป็นตัวกำหนดว่าคณิตศาสตร์ยังคงเป็นเกณฑ์มาตรฐานชั้นนำสำหรับความก้าวหน้าของ AI ในระดับแนวหน้า หรือกลายเป็นสาขาแรกที่จะต่อต้านมันอย่างเป็นทางการ

ก้าวนำหน้า AI อ่านข่าว AI เพิ่มเติมบน AI Buzz Wire