สิ่งที่เปลี่ยนแปลง
ตามบัตรราคาที่เผยแพร่ของ OpenAI และบันทึกการเปลี่ยนแปลง API ราคาต่อล้านโทเค็นมาตรฐานตอนนี้อ่านได้:
- GPT-5.6 Luna: อินพุต 20 เซ็นต์และเอาต์พุต 1.20 ดอลลาร์ ลดลงจาก 1 ดอลลาร์และ 6 ดอลลาร์ — ลดลง 80%
- GPT-5.6 Terra: $2 และ $12 ลดลงจาก $2.50 และ $15 — ลดลง 20%
- GPT-5.6 Sol (เรือธง): $5 และ $30 ไม่เปลี่ยนแปลง
ทั้งสามระดับเปิดตัวสู่การวางจำหน่ายทั่วไปในวันที่ 9 กรกฎาคม พ.ศ. 2569 ในอัตราที่สูงกว่า ส่งผลให้การปรับราคาใหม่ใช้เวลาเพียง 21 วันในชีวิตเชิงพาณิชย์ของครอบครัว สำนักข่าวรอยเตอร์และ CNBC ต่างยืนยันการปรับลดรุ่นดังกล่าว และ Axios รายงานว่ารุ่น Luna ลดลงมากที่สุด
ลดการไหลผ่านทุกระดับบริการ
การลดราคาไม่จำกัดเพียงการกำหนดราคาพาดหัว โดยจะไหลผ่านทุกตัวเลือกในบัตรราคา:
- การประมวลผลแบบแบตช์และแบบยืดหยุ่น ทั้งสองราคาครึ่งหนึ่งของราคามาตรฐาน ทำให้ Luna อยู่ที่อินพุต 10 เซ็นต์ และเอาต์พุต 60 เซ็นต์ต่อล้านโทเค็น
- อ่านข้อมูลในแคช ลดราคา 90% ลดลงเหลือ 2 เซนต์ต่อล้านโทเค็นบน Luna และ 20 เซ็นต์บน Terra
- คำขอที่มีบริบทยาว เรียกเก็บเงินในอัตราอินพุตสองเท่าและเอาต์พุต 1.5 เท่า ราคาส่งอยู่ที่ 40 เซนต์ และ $1.80 สำหรับ Luna
สำหรับทีมที่กำหนดเส้นทางการจำแนกประเภทจำนวนมาก การดึงข้อมูล หรือลูปเอเจนต์แบบยาวผ่านเทียร์ที่ถูกกว่า การโทรแบบเดียวกันในตอนนี้จะมีค่าใช้จ่ายเพียงเล็กน้อยจากสิ่งที่พวกเขาทำเมื่อวันก่อนหน้า
การตัดเปรียบเทียบกับ Anthropic เป็นอย่างไร
ด้วยราคา 20 เซ็นต์และ 1.20 ดอลลาร์ ตอนนี้ Luna ได้ตัดราคา Haiku 4.5 รุ่นที่ถูกที่สุดของ Anthropic ที่เผยแพร่แล้วประมาณ 5 เท่าของอินพุตและ 4 เท่าของเอาท์พุต ตามหน้าราคาของ Anthropic อัตราใหม่ของ Terra ต่ำกว่า 3 และ 15 ดอลลาร์ที่ Claude Sonnet 5 มีกำหนดเรียกเก็บเมื่อราคาช่วงแนะนำหมดลงในวันที่ 31 สิงหาคม 2026
ที่ด้านบนสุดของทั้งสองรุ่น Sol ยังคงมีต้นทุนการผลิตมากกว่า Opus 5 ของ Anthropic ซึ่งมีราคาอยู่ที่ 5 ดอลลาร์และ 25 ดอลลาร์
การประมวลผลลำดับความสำคัญกลายเป็นโหมดรวดเร็ว
รายการบันทึกการเปลี่ยนแปลงเดียวกันนี้เลิกใช้ "การประมวลผลลำดับความสำคัญ" และแทนที่ด้วย "โหมดเร็ว" สำหรับรุ่นเรือธง Sol นั้น OpenAI กล่าวว่าโหมด Fast ทำงานได้เร็วกว่ามาตรฐานถึง 2.5 เท่าในราคาสองเท่า และสวิตช์ยังเข้ากันได้แบบย้อนหลัง คำขอที่ติดแท็กสำหรับเส้นทางลำดับความสำคัญไปยังโหมด Fast โดยไม่ต้องเปลี่ยนรหัสแล้ว
อัตราโหมดด่วนคือ $10 และ $60 สำหรับ Sol, $4 และ $24 สำหรับ Terra และ 40 เซนต์ และ $2.40 สำหรับ Luna โดยเฉพาะอย่างยิ่ง Anthropic จำหน่ายผลิตภัณฑ์เดียวกันภายใต้ชื่อเดียวกันและเงื่อนไขเดียวกัน และตอนนี้บัตรราคาทั้งสองมาบรรจบกันในการอนุมานที่ปักหมุดภูมิภาคเช่นกัน OpenAI เรียกเก็บเงินเพิ่มขึ้น 10% สำหรับรุ่นที่เปิดตัวในหรือหลังวันที่ 5 มีนาคม 2569 เมื่อลูกค้าต้องการถิ่นที่อยู่ของข้อมูล ในขณะที่ Anthropic จะเรียกเก็บเงินการอนุมานเฉพาะสหรัฐอเมริกาที่ 1.1 เท่าของอัตรามาตรฐาน
ทำไมชั้นที่ถูกกว่าถึงถูกลง
หนึ่งวันก่อนการตัดเฉือน OpenAI เผยแพร่โพสต์ทางวิศวกรรมที่อธิบายการปรับให้เหมาะสมในสแต็กการอนุมาน เจ้าหน้าที่ด้านเทคนิคของบริษัทห้าคนเขียนว่า Sol ซึ่งทำงานอยู่ภายในเครื่องมือเข้ารหัส Codex ได้เขียนเคอร์เนล GPU ที่ใช้งานจริงขึ้นมาใหม่ ซึ่งงาน OpenAI กล่าวว่าสามารถลดต้นทุนการให้บริการแบบ end-to-end ลง 20% โมเดลดังกล่าวยังได้ออกแบบโมเดลร่างการถอดรหัสการเก็งกำไรของตัวเองใหม่จากการทดลองหลายร้อยครั้ง การเปลี่ยนแปลงดังกล่าวเป็นผลมาจากการเพิ่มประสิทธิภาพการสร้างโทเค็นมากกว่า 15%
สิ่งเหล่านี้เป็นตัวเลขของ OpenAI สำหรับสแต็กของตัวเอง แต่พวกเขาชี้ไปที่ศูนย์ต้นทุนเดียวกันกับที่อยู่ในการลดราคา: ตัวแทนควบคุมเบื้องหลัง Codex และ ChatGPT เครื่องมือ OpenAI caps ส่งออกที่ 10,000 โทเค็นตามค่าเริ่มต้น และเก็บประวัติที่มองเห็นโมเดลไว้ต่อท้ายเท่านั้น ดังนั้นเอเจนต์ลูปที่ส่งคำสั่งอีกครั้งในทุกขั้นตอนจะเข้าสู่แคชพร้อมท์ แทนที่จะจ่ายอัตราอินพุตเต็มจำนวน บริษัทปิดโพสต์นี้ด้วยความมุ่งมั่นที่จะส่งต่อ "การปรับปรุงเบื้องหลังให้กับผู้ใช้ของเราในรูปแบบของข้อมูลอัจฉริยะที่พร้อมใช้งานอย่างกว้างขวางและคุ้มค่ามากขึ้น" บัตรราคาตามมาในอีกหนึ่งวันต่อมา
พันธมิตรระบบคลาวด์และการเรียกเก็บเงิน
OpenAI ตั้งข้อสังเกตว่าผู้ซื้อที่กำหนดเส้นทางการรับส่งข้อมูลผ่าน Amazon Bedrock จะถูกเรียกเก็บเงินโดย AWS และราคาเหล่านั้นอาจแตกต่างจากการ์ดที่เผยแพร่ของตนเอง เนื่องจากองค์กรต่างๆ จำนวนมากขึ้นรวมการเข้าถึงแบบจำลองผ่านผู้จำหน่ายคลาวด์รายเดียว ช่องว่างระหว่างการกำหนดราคาโดยตรงของ OpenAI และสิ่งที่ลูกค้าจ่ายจริงผ่านตัวกลางจะมีความสำคัญพอๆ กับตัวเลขพาดหัวข่าว
ตลาดนับทุกโทเค็น
การลดพื้นที่ลงเนื่องจากผู้ซื้อระดับองค์กรใช้เวลาในการอนุมานการตรวจสอบอย่างใกล้ชิดมากขึ้นกว่าเดิม เมื่อต้นสัปดาห์ รายงานระบุว่ายุคของ "tokenmaxxing" ที่ไร้ข้อจำกัด ซึ่งเพิ่มปริมาณโดยไม่ต้องดูต้นทุน กำลังจางหายไปเนื่องจากค่า AI ขององค์กรพุ่งสูงขึ้นในแพลตฟอร์มหลัก ๆ การตัดสินใจของ OpenAI ที่จะส่งต่อการประหยัดต้นทุนภายในให้กับลูกค้า แทนที่จะรักษาส่วนต่างไว้เป็นสัญญาณที่ชัดเจนว่าจุดใดที่เชื่อว่าการต่อสู้ทางการแข่งขันกำลังเกิดขึ้น ไม่ใช่ที่ชายแดน ซึ่ง Sol ยังคงควบคุมการกำหนดราคาระดับพรีเมียม แต่ในระดับราคาถูกและมีปริมาณสูงซึ่งเป็นที่ที่มีปริมาณการใช้งานการผลิตส่วนใหญ่อาศัยอยู่จริง
เนื่องจากราคาของ Sol ไม่เปลี่ยนแปลง การตัดสินใจแบบเรียลไทม์สำหรับนักพัฒนาจึงยังคงอยู่ในตำแหน่งที่ OpenAI ระบุไว้นับตั้งแต่ที่ครอบครัวจัดส่งมา: แต่ละคำขอต้องใช้ระดับใด ความแตกต่างก็คือ ค่าใช้จ่ายในการตัดสินใจผิดพลาดลดลงอย่างมาก
---
ก้าวนำหน้า AIรับข่าวสาร AI การวิเคราะห์ และความก้าวหน้าล่าสุด ทั้งหมดในที่เดียว
อ่านข่าว AI เพิ่มเติม →