OpenAI กล่าวเมื่อวันที่ 6 กันยายน พ.ศ. 2569 ว่าได้บรรลุเป้าหมายที่ประกาศเมื่อฤดูใบไม้ร่วงปีที่แล้ว โดยส่ง "นักศึกษาฝึกงานด้านการวิจัยอัตโนมัติ" ภายในเดือนกันยายนปีนี้ ในบล็อกโพสต์ใหม่ที่ชื่อว่า "การเร่งการวิจัย: มุมมองภายใน OpenAI" บริษัทยังได้เปิดเผยเป็นครั้งแรกว่าเจ้าหน้าที่ AI ได้เชื่อมโยงเข้ากับองค์กรวิจัยของตนเองอย่างลึกซึ้งเพียงใด ภายในกลางเดือนสิงหาคม องค์กรได้ใช้ความพยายามของตัวแทน-วันทำงาน 3.1 วันในแต่ละวันทำงานของมนุษย์
เหตุการณ์สำคัญซึ่งรายงานครั้งแรกโดย Engadget และ Unite.AI ถือเป็นภาพเชิงปริมาณที่ชัดเจนที่สุดถึงความหมายของ OpenAI เมื่อพูดถึง AI ที่เร่งการวิจัย AI สำหรับผู้อ่านที่ติดตามเรื่องราวในวงกว้าง สิ่งนี้สอดคล้องกับ การครอบคลุมการวิจัย AI ของเราเกี่ยวกับวิธีที่ห้องปฏิบัติการชายแดนกำลังปรับโครงสร้างงานเกี่ยวกับตัวแทน
จริงๆ แล้ว 'การฝึกงานด้านการวิจัยอัตโนมัติ' หมายถึงอะไร
โพสต์ในบล็อกกำหนดเป้าหมายอย่างแม่นยำ: ระบบที่สามารถดำเนินงานวิจัยที่มีการกำหนดชัดเจนภายใต้การดูแลของมนุษย์ รวมถึงงานที่นักวิจัยที่มีทักษะใช้เวลาสองสามวันจึงจะเสร็จสิ้น ตามการวัดของ OpenAI พบว่าตอนนี้บรรลุเป้าหมายแล้ว ตามกำหนดเวลาที่บริษัทกำหนดไว้เมื่อประกาศเป้าหมายเมื่อฤดูใบไม้ร่วงที่แล้ว
เป้าหมายต่อไปมีความทะเยอทะยานมากขึ้นอย่างมาก OpenAI กล่าวว่ากำลังสร้าง "ความก้าวหน้าอย่างแข็งแกร่ง" สู่นักวิจัย AI อัตโนมัติภายในเดือนมีนาคม 2571 ซึ่งเป็นระบบที่ทำงานภายใต้การดูแลของมนุษย์เพื่อผลักดันการเรียนรู้เชิงลึกและการวิจัยการจัดแนว ซึ่งช่วยให้สามารถพัฒนาตนเองแบบวนซ้ำได้ บริษัทระมัดระวังที่จะทราบว่ามนุษย์ยังคงจัดลำดับความสำคัญของการวิจัย ตัดสินว่าแนวคิดและผลลัพธ์ใดที่ควรค่าแก่การติดตาม และตัดสินใจว่าจะปรับขนาด หยุดชั่วคราว หรือปรับใช้ระบบใดก็ตาม
ตัวเลขเบื้องหลังการเรียกร้อง
ตัวเลขที่โดดเด่นที่สุดในโพสต์อธิบายว่างานประจำวันของนักวิจัยของ OpenAI เปลี่ยนแปลงไปอย่างสิ้นเชิงในช่วงปี 2569:
- 3.1 วันทำงานของเจ้าหน้าที่ต่อวันทำงานของมนุษย์ ก่อนเดือนมิถุนายน 2026 รันไทม์รวมของตัวแทนทั่วทั้งองค์กรวิจัยยังต่ำกว่าแรงงานมนุษย์ทั้งหมด ภายในกลางเดือนสิงหาคม เจ้าหน้าที่ได้ทุ่มเทความพยายามของมนุษย์มากกว่าการกำกับพวกเขามากกว่าสามเท่า ซึ่งวัดจากเวลามาตรฐานแปดชั่วโมงต่อวัน
- $600+ ต่อวันสำหรับนักวิจัยค่ามัธยฐาน เมื่อต้นปี ค่ามัธยฐานนักวิจัยที่จัดอันดับตามการใช้ตัวแทนทำการทดลองกับตัวแทนการเขียนโค้ดเท่านั้น ภายในกลางเดือนสิงหาคม นักวิจัยค่ามัธยฐานได้เรียกใช้ตัวแทนทุกวันและใช้การอนุมานมากกว่า 600 ดอลลาร์ต่อวันในราคา API
- $7,000+ ต่อวันที่เปอร์เซ็นไทล์ที่ 90 ขณะนี้ผู้ใช้ที่หนักที่สุดในองค์กรวิจัยตอนนี้ใช้โทเค็นมากกว่า $7,000 ต่อวัน โดยมีเวิร์กโฟลว์ที่ทำงานพร้อมกันอย่างมากโดยมีตัวแทนสี่คนขึ้นไปที่ทำงานพร้อมกัน
- บันทึกปริมาณการทดลอง จำนวนการทดลองต่อผู้ทดลองที่ใช้งานอยู่แตะระดับสูงสุดตลอดกาลในเดือนสิงหาคม 2026 นับตั้งแต่การติดตามเริ่มขึ้นในเดือนมกราคม 2025
OpenAI ระบุว่าประสิทธิภาพการทำงานที่ก้าวกระโดดโดยหลักๆ มาจากการนำ Codex ซึ่งเป็นเอเจนต์การเขียนโค้ดมาใช้ ในขณะเดียวกันก็ยอมรับว่าการประมวลผลที่มีอยู่นั้นได้เติบโตขึ้นอย่างมากนับตั้งแต่ปี 2025 ดังนั้นผลลัพธ์ที่ได้คือการผสมผสานระหว่างเอเจนต์ที่มากขึ้น เอเจนต์ที่ดีขึ้น และฮาร์ดแวร์ที่มากขึ้นเพื่อใช้งาน
สิ่งที่ตัวแทนกำลังทำอยู่จริงๆ
ในการจำแนกกิจกรรมของตัวแทน OpenAI ใช้อนุกรมวิธานงานวิจัยที่เผยแพร่โดย Epoch AI ซึ่งได้รับแรงบันดาลใจจากระบบการจำแนกอาชีพ O*NET โดยแบ่งการวิจัยและพัฒนา AI ออกเป็นหกขั้นตอน ได้แก่ ตัดสินใจ ออกแบบ สร้าง ดำเนินการ วิเคราะห์ และสื่อสาร
กิจกรรมของตัวแทนทั้งหกหมวดหมู่เพิ่มขึ้นระหว่างเดือนมกราคมถึงสิงหาคม 2569 ในเดือนมกราคม การใช้งานที่โดดเด่นคือรหัสการวิจัยและโครงสร้างพื้นฐาน หมวดหมู่ดังกล่าวมีการขยายตัวอย่างต่อเนื่อง โดยมีการเติบโตที่โดดเด่นในด้านความช่วยเหลือทางเทคนิคและในการติดตามการทดสอบ ในทางตรงกันข้าม การวางแผนระดับสูงยังคงเป็นส่วนเล็กๆ ของโทเค็นเอาท์พุตของตัวแทน การตัดสินใจเชิงกลยุทธ์ยังคงขึ้นอยู่กับมนุษย์
ตามรายงานหลังโพสต์ นักวิจัยของ OpenAI พบว่าตัวแทนการเขียนโค้ดเก่งในการแก้ไขปัญหาโครงสร้างพื้นฐานการวิจัยภายใน และหลายทีมที่เคยจัดเวลาทำการก่อนหน้านี้สำหรับปัญหาด้านโครงสร้างพื้นฐานก็ไม่จำเป็นต้องทำเช่นนั้นอีกต่อไป
เหตุใดเหตุการณ์สำคัญจึงมีความสำคัญนอกเหนือจาก OpenAI
การประกาศมาถึงช่วงเวลาที่ละเอียดอ่อน ผู้บัญญัติกฎหมาย นักวิจัยด้านความปลอดภัย และคู่แข่งต่างเฝ้าดูหลักฐานที่ว่าระบบ AI สามารถเร่งการวิจัย AI ได้อย่างมีนัยสำคัญ ซึ่งเป็นกลไกที่มีแนวโน้มมากที่สุดในการบีบอัดไทม์ไลน์ไปสู่ระบบที่มีความสามารถมากขึ้น หัวหน้านักวิทยาศาสตร์ของ OpenAI เองตีพิมพ์บทความร่วมในวันเดียวกันโดยเตือนว่าไม่มีห้องปฏิบัติการใดที่แก้ไขการจัดตำแหน่งได้ดีพอที่จะขยายขนาดด้วยความเร็วเต็มพิกัด ซึ่งเป็นการเทียบเคียงที่น่าทึ่งกับตัวเลขประสิทธิภาพการทำงาน
ผลกระทบทางเศรษฐกิจก็มีความโดดเด่นไม่แพ้กัน หากองค์กรวิจัยแห่งเดียวใช้เงินหลายพันดอลลาร์ต่อนักวิจัยต่อวันในการอนุมาน และถือว่าเป็นการต่อรองราคา นั่นเป็นสัญญาณว่าการใช้จ่ายด้าน AI ขององค์กรกำลังมุ่งหน้าไปที่ใด วันทำงานของตัวแทนกำลังกลายเป็นอินพุตที่ซื้อได้ เช่นเดียวกับการคำนวณนั่นเอง
ผู้คลางแคลงใจจะชี้ให้เห็นว่า OpenAI ให้คะแนนการบ้านของตัวเอง: มาตรฐาน "การฝึกงานด้านการวิจัยแบบอัตโนมัติ" ได้รับการกำหนดและวัดผลภายใน และอัตราส่วน 3.1:1 จะนับทั้งตัวแทนที่เปิดตัวโดยตรงและตัวแทนย่อยขั้นปลายน้ำ ตัวเลขของบริษัทยังผสมผสานงานเขียนโค้ด การติดตาม และการวิเคราะห์ที่มีระดับความยากต่างกันมาก
อย่างไรก็ตาม ทิศทางยังไม่ชัดเจน แปดเดือนที่ผ่านมา เวลาของเจ้าหน้าที่ล่าช้ากว่าเวลาของมนุษย์ภายในห้องปฏิบัติการ AI ที่ได้รับทุนสนับสนุนดีที่สุดในโลกแห่งหนึ่ง ปัจจุบันมีมากกว่าสามต่อหนึ่ง และความเป็นผู้นำของห้องปฏิบัติการกำลังกำหนดหลักชัยถัดไป ซึ่งก็คือนักวิจัย AI แบบอัตโนมัติภายในเดือนมีนาคม 2028 โดยคำนึงถึง "เมื่อ" ไม่ใช่ "ถ้า"
---
ก้าวนำหน้า AIรับข่าวสาร AI การวิเคราะห์ และความก้าวหน้าล่าสุด ทั้งหมดในที่เดียว
อ่านข่าว AI เพิ่มเติม →