Anthropic ได้เปิดตัว Claude Sonnet 5 เรียกได้ว่าเป็นโมเดลระดับ Sonnet ที่ใช้งานได้จริงที่สุดที่บริษัทสร้างขึ้น เปิดตัวเมื่อวันที่ 30 มิถุนายน 2569 โมเดลใหม่สามารถวางแผน ใช้เครื่องมือ เช่น เบราว์เซอร์และเทอร์มินัล และทำงานอัตโนมัติในระดับที่เมื่อไม่กี่เดือนก่อน ต้องใช้โมเดลที่ใหญ่กว่าและมีราคาแพงกว่ามาก การเปิดตัวดังกล่าวเกิดขึ้นในช่วงเวลาที่อุตสาหกรรม AI ทั้งหมดกำลังแข่งขันกันที่จะเปลี่ยนแชทบอทให้เป็นตัวแทนที่มีความสามารถ ซึ่งสามารถดำเนินการในนามของผู้ใช้ แทนที่จะเพียงตอบคำถามเท่านั้น

สำหรับนักพัฒนาที่ติดตามการพัฒนาล่าสุด ข่าวดังกล่าวจะเพิ่มข่าวด่วน AI มากมายที่เปลี่ยนรูปแบบการแข่งขัน Anthropic กำหนดกรอบ Sonnet 5 ในขณะที่ความสามารถเอเจนต์มาถึงในราคาระดับกลางในที่สุด การเปลี่ยนแปลงที่อาจเปลี่ยนวิธีการจัดงบประมาณของทีมสำหรับเวิร์กโฟลว์อัตโนมัติ

ประสิทธิภาพที่ทัดเทียมเรือธง

จากข้อมูลของ Anthropic Sonnet 5 ช่วยลดช่องว่างระหว่างสาย Sonnet ระดับกลางและรุ่น Opus ระดับบนสุดของบริษัท ประสิทธิภาพใกล้เคียงกับ Opus 4.8 แต่มีราคาที่ต่ำกว่ามาก และแสดงถึงการปรับปรุงที่โดดเด่นเหนือ Sonnet 4.6 รุ่นก่อนในด้านการให้เหตุผล การใช้เครื่องมือ การเขียนโค้ด และงานองค์ความรู้

เส้นโค้งต้นทุน-ประสิทธิภาพที่เผยแพร่โดย Anthropic เปรียบเทียบโมเดลกับ Sonnet 4.6 และ Opus 4.8 ในการประเมินเอเจนต์สองรายการ: BrowseComp ซึ่งวัดการค้นหาเอเจนต์ และ OSWorld-Verified ซึ่งทดสอบการใช้งานคอมพิวเตอร์ บริษัทกล่าวว่า Sonnet 5 เสนอทางเลือกด้านความคุ้มทุนที่หลากหลายกว่า Sonnet 4.6 และในระดับความพยายามที่สูงกว่า ก็สามารถจับคู่ Opus 4.8 ในบางงานได้

ราคาเชิงรุกสำหรับตัวแทน

ราคาเป็นศูนย์กลางของสนาม Claude Sonnet 5 เปิดตัวด้วย ราคาเบื้องต้น 2 ดอลลาร์ต่อโทเค็นอินพุต 1 ล้านดอลลาร์ และ 10 ดอลลาร์ต่อโทเค็นเอาท์พุต 10 ล้านดอลลาร์ ใช้ได้จนถึงวันที่ 31 สิงหาคม 2569 หลังจากกรอบเวลาดังกล่าว ราคาจะย้ายไปที่ 3 ดอลลาร์ต่อโทเค็นอินพุตหนึ่งล้าน และ 15 ดอลลาร์ต่อโทเค็นเอาท์พุต 15 ดอลลาร์

สำหรับการเปรียบเทียบ Opus 4.8 มีราคาอยู่ที่ 5 ดอลลาร์ต่อโทเค็นอินพุตหนึ่งล้านรายการ และ 25 ดอลลาร์ต่อโทเค็นเอาท์พุตหนึ่งล้านรายการ เนื่องจากตัวแทนใช้โทเค็นจำนวนมากในขณะที่พวกเขาให้เหตุผลและเรียกใช้เครื่องมือหลายขั้นตอน ช่องว่างด้านราคาจึงมีความสำคัญอย่างมากต่องบประมาณขององค์กร ผู้ทดสอบการเข้าถึงก่อนเปิดตัวที่อ้างอิงโดย Anthropic อธิบายว่า Sonnet 5 เสร็จสิ้นงานที่ซับซ้อน โดยที่ Sonnet รุ่นก่อนหน้าจะหยุดทำงานชั่วคราว และตรวจสอบเอาต์พุตของตัวเองโดยไม่ได้รับการถามอย่างชัดเจน

ความพร้อมใช้งานในทุกแผน

Claude Sonnet 5 พร้อมให้ใช้งานในทุกแผนของ Anthropic นับตั้งแต่วันเปิดตัว เป็นโมเดลเริ่มต้นสำหรับผู้ใช้ ฟรีและ Pro และมีให้บริการสำหรับลูกค้า Max, Team และ Enterprise นักพัฒนาสามารถเข้าถึงได้ผ่าน Claude API โดยใช้ตัวระบุโมเดล `claude-sonnet-5` รวมถึงผ่าน Claude Code และ Claude Platform

การเปิดตัวในวงกว้างนี้มีความโดดเด่นเนื่องจากทำให้ประสิทธิภาพตัวแทนที่มีความสามารถอยู่ในมือของผู้ใช้ฟรี ไม่ใช่แค่การจ่ายเงินให้กับลูกค้าองค์กรเท่านั้น Anthropic กล่าวว่ากลุ่มผลิตภัณฑ์ Sonnet ในอดีตเป็นจุดเริ่มต้นของยุคตัวแทนสำหรับนักพัฒนาจำนวนมาก โดยชี้ไปที่ Claude Sonnet 3.5, 3.6 และ 3.7 เป็นรุ่นแรกที่แสดงทักษะการเขียนโค้ดและการใช้เครื่องมือที่แข็งแกร่ง

เรื่องราวด้านความปลอดภัยในตัว

ความปลอดภัยเป็นส่วนสำคัญของการประกาศ Anthropic กล่าวว่าการประเมินพบว่า Sonnet 5 แสดง อัตราพฤติกรรมไม่พึงประสงค์โดยรวมที่ต่ำกว่า กว่า Sonnet 4.6 และโดยทั่วไปจะปลอดภัยกว่าหากใช้ในบริบทตัวแทน บริษัทยังตั้งข้อสังเกตอีกว่าโมเดลดังกล่าวมีความสามารถในการทำงานด้านความปลอดภัยทางไซเบอร์ต่ำกว่าโมเดล Opus ในปัจจุบันมาก ซึ่งเป็นตัวเลือกการออกแบบโดยเจตนาซึ่งจะช่วยลดความเสี่ยงในการใช้งานในทางที่ผิดแม้ว่าความสามารถทั่วไปจะสูงขึ้นก็ตาม

การ์ดระบบ Claude Sonnet 5 ซึ่งเปิดตัวพร้อมกับโมเดลดังกล่าว รายงานชุดการประเมินที่กว้างขึ้นโดยละเอียด Anthropic วางตำแหน่งความโปร่งใสเกี่ยวกับการทดสอบความปลอดภัยในฐานะที่สร้างความแตกต่างทางการแข่งขัน เนื่องจากหน่วยงานกำกับดูแลในสหรัฐอเมริกาและยุโรปพิจารณาการเผยแพร่โมเดลชายแดนอย่างละเอียด

ช่วงเวลาตัวแทนที่กว้างขึ้น

การเปิดตัวเกิดขึ้นท่ามกลางการแข่งขันที่รุนแรง คู่แข่งอย่าง OpenAI, Google และกลุ่มแล็บของจีนที่เคลื่อนไหวอย่างรวดเร็ว ล้วนผลักดันไปสู่โมเดลที่สามารถดำเนินการได้หลายขั้นตอน แทนที่จะสร้างข้อความเพียงอย่างเดียว ด้วยการนำเสนอความสามารถเอเจนต์ที่อยู่ติดกันของ Opus ในราคา Sonnet Anthropic กำลังเดิมพันว่าสมรภูมิถัดไปไม่ใช่คะแนนมาตรฐานดิบ แต่เป็นค่าใช้จ่ายในการดำเนินการตัวแทนอย่างเชื่อถือได้ในงานที่ซับซ้อนและยาวนาน

เนื่องจากราคาช่วงแนะนำถูกล็อคไว้จนถึงสิ้นเดือนสิงหาคม ขณะนี้นักพัฒนาจึงมีช่วงเวลาในการทดสอบความเครียด Sonnet 5 กับเวิร์กโหลดเอเจนต์ที่มีความต้องการมากที่สุด ก่อนที่อัตราที่สูงขึ้นจะมีผล

ก้าวนำหน้า AI

ความเร็วของการเปิดตัวโมเดลไม่มีสัญญาณของการชะลอตัว หากต้องการความคุ้มครองอย่างต่อเนื่องเกี่ยวกับการเปิดตัวใหม่ รอบการระดมทุน และการเปลี่ยนแปลงนโยบาย โปรดไปที่ AI Buzz Wire เพื่อดูการพัฒนา AI ล่าสุดที่เกิดขึ้น

อ่านข่าว AI เพิ่มเติม →