Anthropic ได้เปิดตัว Claude Opus 5 ซึ่งเป็นโมเดล AI ใหม่ที่บริษัทกล่าวว่ามอบความอัจฉริยะใกล้ชายแดนในราคาประมาณครึ่งหนึ่งของโมเดล Fable 5 ระดับบนสุด เปิดตัวเมื่อวันที่ 24 กรกฎาคม 2026 ขณะนี้ Opus 5 เป็นโมเดลเริ่มต้นบน Claude Max และเป็นโมเดลที่แข็งแกร่งที่สุดบน Claude Pro โดยวางตำแหน่งให้เป็นงานหลักในชีวิตประจำวันของ Anthropic สำหรับการเขียนโค้ด เจ้าหน้าที่อัตโนมัติ และงานความรู้ทางวิชาชีพ
การเปิดตัวเกิดขึ้นในช่วงเวลาที่ธุรกิจต่างๆ กำลังพิจารณาการใช้จ่ายด้าน AI ตามรายงานของ CNBC โมเดลใหม่ "เป็นคู่แข่งกับ Fable 5 และมีราคาถูกกว่าเนื่องจากธุรกิจกังวลเกี่ยวกับต้นทุน" ในขณะที่ Bloomberg ระบุว่าเป็น "โมเดลที่คุ้มค่ากว่าสำหรับงานประจำวัน" สำหรับทีมที่ติดตาม [การพัฒนา AI] (https://aibuzzwire.news) ล่าสุด Opus 5 แสดงถึงการเดิมพันโดยเจตนาว่าสมรภูมิการแข่งขันครั้งต่อไปนั้นมีคุณค่า ไม่ใช่การมีอำนาจสูงสุดในเกณฑ์มาตรฐาน
ประสิทธิภาพมาตรฐาน: ล้ำสมัยใหม่ในการเขียนโค้ดและงานความรู้
Anthropic รายงานว่า Opus 5 โพสต์ผลลัพธ์ที่ล้ำสมัยเกี่ยวกับการเขียนโค้ดและการประเมินงานองค์ความรู้ รวมถึง Frontier-Bench และ GDPval-AA บน Frontier-Bench v0.1 บริษัทกล่าวว่า Opus 5 เหนือกว่ารุ่นอื่นๆ ทั้งหมด และเพิ่มประสิทธิภาพของ Opus 4.8 รุ่นก่อนมากกว่าสองเท่าด้วยต้นทุนต่องานที่ต่ำกว่า
บน CursorBench 3.2 นั้น Opus 5 มาภายใน 0.5% ของคะแนนสูงสุดของ Fable 5 ในขณะที่มีค่าใช้จ่ายเพียงครึ่งหนึ่งต่องาน ตามเกณฑ์มาตรฐานของ Anthropic Decrypt ตั้งข้อสังเกตว่าโมเดลนี้ "เหนือกว่า Fable 5 ในการวัดประสิทธิภาพส่วนใหญ่ - ในราคาเพียงครึ่งเดียว"
ประโยชน์ที่ได้ขยายไปถึงการประเมินแบบตัวแทนและการแก้ปัญหา:
- ARC-AGI 3: Opus 5 ได้คะแนนสูงกว่ารุ่นถัดไปที่ดีที่สุดประมาณสามเท่าในการทดสอบการแก้ปัญหาแบบใหม่นี้
- Zapier AutomationBench: อัตราการผ่านประมาณ 1.5 เท่าของรุ่นที่ดีที่สุดรองลงมาด้วยต้นทุนเท่าเดิม โดยวัดความสำเร็จของงานทางธุรกิจตั้งแต่ต้นทางถึงปลายทาง
- OSWorld 2.0 (การใช้คอมพิวเตอร์): Opus 5 เหนือกว่าผลลัพธ์ที่ดีที่สุดของ Fable 5 ด้วยต้นทุนเพียงหนึ่งในสาม
โดยเฉพาะอย่างยิ่ง Anthropic ยอมรับว่า Opus 5 "ยังคงตามหลัง Mythos 5 ในเรื่องความปลอดภัยทางไซเบอร์" ซึ่งเป็นพื้นที่ที่โมเดลชายแดนของคู่แข่งยังคงเป็นผู้นำ
หน่วยงานที่แข็งแกร่งและการยืนยันตนเอง
ธีมที่เกิดขึ้นซ้ำในการประกาศคือความสามารถที่ได้รับการปรับปรุงของ Opus 5 ในการตรวจสอบงานของตัวเองและทำซ้ำจนกว่าจะประสบความสำเร็จ Anthropic อธิบายตัวอย่างหลายตัวอย่างจากการทดสอบก่อนเปิดตัวที่เน้นความเป็นอิสระนี้
ในงาน Frontier-Bench งานหนึ่ง โมเดลได้รับการวาดรูปชิ้นส่วนเครื่องจักรและขอให้เขียนโค้ดเพื่อสร้างใหม่เป็นโมเดล 3D FreeCAD แต่จงใจไม่ให้สามารถดูภาพวาดได้โดยตรง มีรายงานว่า Opus 5 ได้เขียนไปป์ไลน์คอมพิวเตอร์วิทัศน์ของตัวเองเพื่อแยกเรขาคณิตออกจากพิกเซลดิบ จากนั้นสร้างส่วนทั้งหมดขึ้นใหม่ โดยประสบความสำเร็จซ้ำแล้วซ้ำเล่าโดยไม่มีโมเดลคู่แข่งใดสามารถแก้ปัญหาได้หลังจากพยายามห้าครั้ง
เมื่อพิจารณาถึงจุดบกพร่องจริงในตัวจัดการแพ็คเกจโอเพ่นซอร์สยอดนิยม Opus 5 พบสาเหตุที่แท้จริงและแก้ไขกรณีขอบที่แพตช์ของชุมชนพลาดไป ในขณะที่โมเดลที่แข่งขันกันแก้ไขเฉพาะอาการบนพื้นผิวและประกาศว่าจุดบกพร่องได้รับการแก้ไขแล้ว มีรายงานว่าวิศวกรของบริษัทการค้าใช้ Opus 5 เพื่อสร้างฟีดข้อมูลตลาดสำหรับการแลกเปลี่ยนใหม่ในเซสชันเดียว ซึ่งเป็นงานที่รุ่นก่อนหน้านี้ไม่สามารถทำได้เลย และเมื่อพบว่าไม่มีฟีดข้อมูลสดที่จะตรวจสอบ โมเดลจึงสร้างชุดทดสอบของตัวเองขึ้นมา
ต้อนรับลูกค้า
พันธมิตรที่ทดลองใช้ก่อนเปิดตัวเสนอการประเมินเชิงบวกเป็นส่วนใหญ่ Scott Wu ซีอีโอของ Cognition (ผู้ผลิตตัวแทนการเข้ารหัส Devin) กล่าวว่า Opus 5 "เข้าถึงประสิทธิภาพระดับ Fable ด้วยต้นทุนเพียงครึ่งเดียว" และแสดงให้เห็นถึง "จุดแข็งโดยเฉพาะในการแก้ไขจุดบกพร่องที่ยากลำบากและงานวิเคราะห์สาเหตุที่แท้จริง" Sualeh Asif ผู้ร่วมก่อตั้ง Cursor กล่าวว่าโมเดลดังกล่าวมอบ "ความฉลาดที่ใกล้เคียงกับ Fable 5 ด้วยความเร็วและราคาของ Opus"
Wade Foster ซีอีโอของ Zapier รายงานว่า Opus 5 "ติดอันดับกระดานผู้นำ AutomationBench ของ Zapier โดยไม่ต้องใช้โทเค็นมากกว่า Claude รุ่นก่อนๆ" ดำเนินการเวิร์กโฟลว์ป้องกันการเลิกใช้งานเต็มรูปแบบตั้งแต่ต้นจนจบ โดยแจ้งบัญชีที่มีความเสี่ยง แจ้งเตือนเจ้าของที่ถูกต้อง และสรุปสำหรับทีมเก็บรักษา รุ่นก่อนหน้าไม่ผ่าน Opus 5 สำเร็จ 100%
กำไรจากการวิจัยทางวิทยาศาสตร์
Anthropic ยังเน้นย้ำถึงการปรับปรุง Opus 5 สำหรับงานทางวิทยาศาสตร์ด้วย แบบจำลองนี้มีประสิทธิภาพเหนือกว่า Opus 4.8 ในทุกการประเมินด้านชีววิทยาศาสตร์ของ Anthropic ซึ่งครอบคลุมชีววิทยาเชิงโครงสร้าง เคมีอินทรีย์ และชีวสารสนเทศศาสตร์ บริษัทชี้ให้เห็นถึงการปรับปรุง 10.2 เปอร์เซ็นต์ในเกณฑ์มาตรฐานอินทรีย์เคมีภายใน (โดยอนุมานโครงสร้างโมเลกุลจากข้อมูลสเปกโทรสโกปี) และเพิ่มขึ้น 7.7 จุดในงานทำนายฟังก์ชันโปรตีน ลูกค้าด้านจีโนมิกส์รายหนึ่งอธิบายว่าโมเดลนี้มีพฤติกรรม "เหมือนนักวิทยาศาสตร์ที่ระมัดระวังมากกว่า" โดยพยายามเข้าถึงการทดสอบทางสถิติที่ถูกต้อง และตรวจสอบผลลัพธ์ของตัวเอง
กลยุทธ์การกำหนดราคา
ด้วยการกำหนดราคา Opus 5 ในระดับเดียวกับ Opus 4.8 ในขณะที่เข้าใกล้ความชาญฉลาดของ Fable 5 ทำให้ Anthropic สามารถลดช่องว่างระหว่างข้อเสนอระดับกลางและรุ่นเรือธงได้อย่างมีประสิทธิภาพ VentureBeat มองว่าการเปิดตัวครั้งนี้เป็น "โมเดล AI ที่ราคาถูกกว่าสำหรับการเขียนโค้ด ตัวแทน และเวิร์กโฟลว์ขององค์กร" และ Seeking Alpha ตั้งข้อสังเกตว่า Opus 5 "ใกล้กว่าและราคาถูกกว่ากับโมเดล Fable 5 ระดับแนวหน้า" บริษัทเสนอการตั้งค่า "ความพยายาม" ที่ปรับเปลี่ยนได้ ซึ่งช่วยให้ลูกค้าแลกเปลี่ยนข้อมูลอัจฉริยะเพื่อความรวดเร็วและลดต้นทุนโทเค็น โดยปรับอัตราส่วนต้นทุนต่อประสิทธิภาพต่องานอย่างละเอียด
ความหมายสำหรับการแข่งขัน AI
Opus 5 ตอกย้ำว่าต้นทุนของ AI ใกล้ชายแดนลดลงอย่างรวดเร็วเพียงใด โมเดลที่เข้ามาในระยะที่เห็นได้ชัดจากระบบที่มีความสามารถมากที่สุดที่มีอยู่ - ในราคาโทเค็นเพียงครึ่งเดียว - กดดันให้คู่แข่งปรับการกำหนดราคาระดับพรีเมียมเพื่อผลกำไรส่วนเพิ่ม เนื่องจาก Anthropic, OpenAI, Google และบริษัทอื่นๆ เร่งสร้างโมเดลที่มีความสามารถราคาไม่แพงเพียงพอสำหรับการใช้งานรายวันในขนาดใหญ่ คำถามสำหรับองค์กรจึงเปลี่ยนจาก "โมเดลใดฉลาดที่สุด" เป็น "รุ่นใดที่ให้ความฉลาดต่อดอลลาร์มากที่สุด"
สำหรับมานุษยวิทยา ข้อความนั้นชัดเจน: การใช้เหตุผลระดับสูงไม่ใช่สินค้าฟุ่มเฟือยอีกต่อไป Opus 5 นำความสามารถที่อยู่ติดกันระดับแนวหน้ามาสู่จุดราคาที่ทำให้การใช้งานจริงอย่างยั่งยืนและทุกวัน และอาจพิสูจน์ได้ว่าเป็นรายละเอียดที่เป็นผลสืบเนื่องมากที่สุด
ก้าวนำหน้า AI
Claude Opus 5 พร้อมใช้งานตั้งแต่วันนี้บน Claude Pro, Claude Max และผ่านทาง API ของ Anthropic หากต้องการข้อมูลเพิ่มเติมเกี่ยวกับเรื่องราวนี้และภาพรวมของปัญญาประดิษฐ์ที่กว้างขึ้น โปรดติดตาม ข่าวด่วน AI ที่เกิดขึ้น
อ่านข่าว AI เพิ่มเติม →