OpenAI เปิดตัว GPT-6.1 Sol เมื่อวันที่ 29 กันยายน และเลิกใช้ GPT-6 Sol เพียงเจ็ดวันหลังจากเปิดตัวโมเดลดังกล่าว ตามรายงานของ Artificial Analysis บริษัทเปรียบเทียบอิสระ การแลกเปลี่ยนนี้เกิดขึ้นพร้อมกับการประชุมนักพัฒนา DevDay ของบริษัท โดย CNET รายงานว่าผู้เข้าร่วมสามารถเริ่มใช้ GPT-6.1 Sol ได้ทันทีควบคู่ไปกับตัวแทน Dots ที่เพิ่งเปิดตัวใหม่และชุดการเปลี่ยนแปลงการสมัครสมาชิก
การเปลี่ยนจากเรือธงไปเป็นเรือธงภายในเจ็ดวันนั้นไม่ใช่เรื่องปกติ แม้ว่าจะเป็นไปตามมาตรฐานที่เร่งรัดในปี 2026 และเกณฑ์มาตรฐานก็ชี้ให้เห็นว่าเหตุใด OpenAI จึงดำเนินการอย่างรวดเร็ว เพื่อความครอบคลุมอย่างต่อเนื่องของการเปิดตัวโมเดล การต่อสู้ของเกณฑ์มาตรฐาน และสงครามราคาที่อยู่ภายใต้สิ่งเหล่านี้ AI Buzz Wire ติดตามการพัฒนาที่สำคัญในขณะที่เกิดขึ้น
การกระโดดที่วัดผลได้ในเจ็ดวัน
การวิเคราะห์เชิงประดิษฐ์รายงานว่า GPT-6.1 Sol ได้รับ 4 คะแนนจากดัชนีข่าวกรองของบริษัทเหนือ GPT-6 Sol และ 5 คะแนนเหนือ GPT-5.6 Sol ซึ่งอยู่ต่ำกว่า GPT-6 Astra เพียง 1 จุด ซึ่งเป็นโมเดลที่มีความสามารถมากที่สุดของ OpenAI การประเมินของบริษัทผสมผสานการใช้เหตุผล งานความรู้ คณิตศาสตร์ และงานเชิงตัวแทนเป็นคะแนนเปรียบเทียบเดียว
คะแนนย่อยแสดงว่ากำไรมีสมาธิอยู่ที่ใด GPT-6.1 Sol ปรับปรุง 4 คะแนนใน AA-Briefcase v1.1 และ 5 คะแนนใน GDPval-AA v2.1 ซึ่งทั้งสองอย่างนี้ทดสอบความรู้เชิงตัวแทน การเพิ่มขึ้น 12 จุดใน Terminal-Bench 4.0 ชี้ให้เห็นถึงประสิทธิภาพที่ดีขึ้นอย่างมากในสภาพแวดล้อมเทอร์มินัลจริง ในขณะที่ Humanity's Last Exam เพิ่มขึ้น 5 คะแนน และ GDP.pdf เพิ่มขึ้น 6 คะแนน
ตัวเลขหนึ่งโดดเด่นสำหรับทุกคนที่ใช้แบบจำลองในการวิจัย: ความแม่นยำของ AA-Omniscience เพิ่มขึ้น 8 คะแนน ในขณะที่อัตราการเกิดอาการประสาทหลอนลดลงจาก 60 เปอร์เซ็นต์เป็น 54 เปอร์เซ็นต์ ตัวเลขทั้งสองยังคงอยู่ในระดับสูงในแง่สัมบูรณ์ แต่ทิศทางการเดินทางมีความสำคัญต่อขั้นตอนการทำงานที่คำตอบที่มั่นใจนั้นแย่กว่าการไม่ตอบ
ราคาสติ๊กเกอร์เท่าเดิม ถูกกว่าในทางปฏิบัติ
ในด้านราคา GPT-6.1 Sol จะเก็บเรตการ์ดของ GPT-6 Sol ไว้ 2 ดอลลาร์ต่อโทเค็นอินพุต 1 ล้านดอลลาร์ และ 10 ดอลลาร์ต่อโทเค็นเอาต์พุต 1 ล้านดอลลาร์ แต่ส่วนลดการอ่านแคชเพิ่มขึ้นจาก 90 เปอร์เซ็นต์เป็น 95 เปอร์เซ็นต์ การวิเคราะห์เชิงประดิษฐ์ตั้งข้อสังเกตว่าราคารวมของ GPT-6.1 Sol สำหรับปริมาณงานแบบเอเจนต์จึงต่ำกว่าของ GPT-6 Sol เล็กน้อย ซึ่งขยายแนวการลดราคาอย่างมีประสิทธิผลซึ่งเริ่มขึ้นเมื่อ GPT-6 Sol เปิดตัวด้วยส่วนลด 50 เปอร์เซ็นต์เป็น GPT-5.6 Sol
วิถีการกำหนดราคาเป็นเรื่องจริงที่นี่ ภายในช่วงของการเปิดตัวทั้งสองรุ่น OpenAI ได้ลดต้นทุนที่แท้จริงของแนวชายแดนระดับกลางลงครึ่งหนึ่งโดยประมาณสองครั้ง ในขณะที่ดันคุณภาพขึ้นไปในแต่ละครั้ง
ต้นทุนต่องาน: 0.72 เหรียญสหรัฐฯ เทียบกับ 3.26 เหรียญสหรัฐฯ
ต้นทุนต่องานคือจุดที่ช่องว่างของ GPT-6 Astra หมดสิ้น ด้วยความพยายามสูงสุด การวิเคราะห์เชิงประดิษฐ์จะตรึง GPT-6.1 Sol ไว้ที่ 0.72 ดอลลาร์ต่องาน Intelligence Index ซึ่งน้อยกว่าหนึ่งในสี่ของ GPT-6 Astra ที่ 3.26 ดอลลาร์ เมื่อเทียบกับรุ่นก่อน การประหยัดอยู่ที่ 31 เปอร์เซ็นต์ ($1.05 สำหรับ GPT-6 Sol) และเมื่อเทียบกับ GPT-5.6 Sol พวกเขาถึง 64 เปอร์เซ็นต์ ($1.99)
จากข้อมูลของบริษัท ทุกระดับความพยายามของ GPT-6.1 Sol ผลักดันขอบเขต Pareto ที่ประหยัดต้นทุนออกไป ซึ่งหมายความว่าสำหรับระดับสติปัญญาที่กำหนด ไม่มีตัวเลือกที่ถูกกว่าในรุ่นที่ติดตาม ภาพประสิทธิภาพของโทเค็นมีความหลากหลายมากขึ้น: GPT-6.1 Sol ใช้โทเค็นเอาท์พุตมากกว่า GPT-6 Sol ประมาณ 10 ถึง 30 เปอร์เซ็นต์ในทุกระดับความพยายาม แม้ว่าการตั้งค่าความพยายามต่ำและปานกลางจะยังคงเหมาะสมที่สุดสำหรับ Pareto สำหรับประสิทธิภาพของโทเค็นเมื่อมีการรวมเอาความฉลาดที่สูงกว่าเข้ามาด้วย ในการเข้ารหัส โมเดลได้รับ 3 คะแนนเหนือ GPT-6 Sol ที่ความพยายามสูงสุดในดัชนี Coding Agent ของบริษัท
เหตุใดการพลิกฟื้นเจ็ดวันจึงมีความสำคัญ
กระดานชนวนที่กว้างขึ้นของ DevDay ตอกย้ำภาพเดียวกัน รายงานของ CNET กำหนดกรอบการประชุมเกี่ยวกับสามสิ่งที่นักพัฒนาสามารถใช้งานได้ทันที — GPT-6.1 Sol, ตัวแทน Dots และแผนการสมัครสมาชิกที่ปรับปรุงใหม่ — แทนที่จะแสดงตัวอย่างการวิจัยระยะไกล ข้อความถึงนักพัฒนาคือความพร้อมในวันนี้ ไม่ใช่ความเป็นไปได้ในวันพรุ่งนี้
จังหวะสำคัญส่งสัญญาณสั้นๆ นี้ว่าข้อจำกัดทางการแข่งขันได้เปลี่ยนจากการวิ่งฝึกซ้อมไปเป็นการปรับปรุงหลังการฝึกอบรมและโครงสร้างพื้นฐานการให้บริการ การอัปเกรดระดับจุดที่จัดส่งในหนึ่งสัปดาห์ดูเหมือนเป็นจุดตรวจที่ได้รับการปรับปรุงและแผ่นราคาใหม่มากกว่าแบบจำลองพื้นฐานตั้งแต่ต้น และคู่แข่งก็มีพฤติกรรมในลักษณะเดียวกัน: Google ประกาศ Gemini 4 Argon เมื่อวันที่ 30 กันยายน ซึ่งเป็นโมเดลชายแดนที่เริ่มเข้าถึงผู้พิทักษ์ไซเบอร์ที่เชื่อถือได้ผ่านโปรแกรม Fairwind ในอัตราโทเค็น $2/$10 ต่อล้านเท่าเดิม
สำหรับนักพัฒนา ประเด็นที่เป็นประโยชน์สามประการต่อจากตัวเลขที่ตรวจสอบแล้ว ประการแรก ปริมาณงานเอเจนต์ที่มีการใช้แคชจำนวนมากซ้ำจะได้รับประโยชน์ทันทีจากส่วนลดแคช 95 เปอร์เซ็นต์ ประการที่สอง งบประมาณควรสร้างแบบจำลองการใช้โทเค็นเอาต์พุตที่สูงขึ้นก่อนที่จะทำการย้าย เนื่องจากราคาต่อโทเค็นจะไม่เปลี่ยนแปลง แม้ว่าโมเดลจะคิดนานกว่าก็ตาม ประการที่สาม แอสตร้ายังคงเป็นเพดานสำหรับงานที่จุดอัจฉริยะสุดท้ายมีค่าเท่ากับค่าใช้จ่ายพรีเมียม 4 เท่า กรณีของ GPT-6.1 Sol สำหรับงานส่วนใหญ่กลับไม่เป็นเช่นนั้น
คำเตือนที่ควรทำซ้ำ: ตัวเลขเหล่านี้มาจากผู้ประเมินอิสระเพียงรายเดียว แม้ว่าวิธีการจะเข้มงวดเพียงใด และคะแนนดัชนีจะให้รางวัลตามปริมาณงานที่เฉพาะเจาะจง ทีมที่มีเวิร์กโหลดที่มีความต้องการสูงควรทำการประเมินของตนเองอีกครั้งก่อนที่จะเปลี่ยนเส้นทางการรับส่งข้อมูลที่ใช้งานจริง
---
ก้าวนำหน้า AIรับข่าวสาร AI การวิเคราะห์ และความก้าวหน้าล่าสุด ทั้งหมดในที่เดียว
อ่านข่าว AI เพิ่มเติม →