Anthropic เปิดตัว Claude Fable 5.1 และ Claude Mythos 5.1 เมื่อวันที่ 1 กันยายน 2569 โดยแนะนำสิ่งที่บริษัทเรียกว่าโมเดลที่ล้ำหน้าที่สุดในโลกสำหรับการเขียนโค้ดและงานความรู้ พร้อมทั้งข้อมูลเบื้องต้นเกี่ยวกับวิธีที่ระบบ AI จะมีส่วนร่วมในการวิจัยทางวิทยาศาสตร์ได้อย่างไร ประกาศดังกล่าวซึ่งเผยแพร่บนเว็บไซต์ของ Anthropic มาพร้อมกับการเปลี่ยนแปลงด้านราคาและการจัดการข้อมูลที่ตอบสนองโดยตรงต่อความคิดเห็นของลูกค้าเกี่ยวกับต้นทุน ความเป็นส่วนตัว และการป้องกัน
การเปิดตัวสองชื่อที่ไม่ธรรมดานี้สะท้อนถึงโมเดลต้นแบบเดียวที่มีการกำหนดค่าการป้องกันสองแบบ โดยทั่วไป Fable 5.1 พร้อมให้ใช้งานสำหรับผู้ใช้ทุกคน ในขณะที่ Mythos 5.1 สงวนไว้สำหรับโปรแกรมการเข้าถึงที่เชื่อถือได้ของ Anthropic ซึ่งการป้องกันได้รับการออกแบบมาโดยเฉพาะเพื่อรองรับงานด้านความปลอดภัยทางไซเบอร์และวิทยาศาสตร์ชีวภาพ AWS ยืนยันในวันเดียวกับที่ Fable 5.1 พร้อมใช้งานบนแพลตฟอร์มในโพสต์เปิดตัวชื่อ "แนะนำ Claude Fable 5.1 บน AWS" และข่าวดังกล่าวก็ไต่ขึ้นสู่อันดับต้นๆ ของ Hacker News โดยได้รับคะแนนมากกว่า 600 คะแนนภายในไม่กี่ชั่วโมงหลังการเผยแพร่ หากต้องการทราบบริบทเพิ่มเติมเกี่ยวกับเรื่องราวนี้ โปรดดูการรายงานข่าว ข่าวด่วน AI ที่กำลังดำเนินอยู่
การลดราคาและสัมปทานการเก็บรักษาข้อมูล
การเปลี่ยนแปลงพาดหัวสำหรับลูกค้าส่วนใหญ่จะมีค่าใช้จ่าย จากข้อมูลของ Anthropic นั้น Fable 5.1 จะมีราคาต่ำกว่า Fable 5 ประมาณ 25% สำหรับปริมาณงานทั่วไปไม่ว่าจะเรียกเก็บเงินการใช้งานด้วยโทเค็นก็ตาม การลดลงนี้มาจากราคาที่ลดลงในการอ่านแคช เมื่อโมเดลอ่านอินพุตที่ได้รับการประมวลผลและจัดเก็บแล้ว สำหรับงานตัวแทนระดับสูง บริษัทกล่าวว่าการประหยัดมักจะมากขึ้น โดยสูงถึงประมาณ 45%
การเปลี่ยนแปลงโครงสร้างที่ใหญ่กว่าคือระบบใหม่ที่บริษัทเรียกว่า Enterprise Frontier Safeguards หรือ EFS Anthropic กล่าวว่า EFS ให้ความเป็นส่วนตัวแก่ลูกค้าองค์กรอย่างสมบูรณ์ เทียบเท่ากับนโยบายการเก็บรักษาข้อมูลเป็นศูนย์ ในขณะที่ยังคงรักษาการป้องกันที่ล้ำสมัยต่อการใช้งานของฝ่ายตรงข้าม กลไกนี้ทำงานโดยการจัดเก็บข้อมูลลูกค้าไว้ในโครงสร้างพื้นฐานคลาวด์ที่ควบคุมโดยลูกค้าทั้งหมด แทนที่จะควบคุมโดย Anthropic EFS จะเปิดตัวให้กับลูกค้าองค์กรเป็นระยะๆ โดยเริ่มในช่วงฤดูใบไม้ร่วงนี้ และจนกว่าจะพร้อมใช้งานโดยทั่วไป ลูกค้าที่เข้าเกณฑ์จะสามารถรัน Fable 5.1 โดยไม่มีการเก็บรักษาข้อมูลได้
สัมปทานความเป็นส่วนตัวเป็นไปตามการตอบกลับของลูกค้าที่มองเห็นได้ CNBC รายงานเมื่อวันที่ 1 กันยายนว่า Anthropic เปลี่ยนแปลงนโยบายการเก็บรักษาข้อมูลของตนหลังจากการคัดค้านจากลูกค้า และการประกาศของ EFS ถือเป็นการตอบสนองที่เป็นรูปธรรมที่สุดของบริษัทต่อองค์กรต่างๆ ที่ต้องการความสามารถด้านโมเดลขอบเขตโดยไม่มีข้อมูลอยู่บนโครงสร้างพื้นฐานของ Anthropic
เกณฑ์มาตรฐานได้รับจากการเข้ารหัสและวิทยาศาสตร์
การประเมินที่เผยแพร่โดย Anthropic แสดงให้เห็นถึงการก้าวกระโดดอย่างมากจากรุ่นก่อน แม้ว่าตัวเลขดังกล่าวจะมาจากการทดสอบของบริษัทเอง และควรอ่านตามนั้น
ใน Terminal-Bench-Science 0.1 ซึ่งเป็นเกณฑ์มาตรฐานการวิจัยทางวิทยาศาสตร์แบบตัวแทน Fable 5.1 ได้คะแนน 52.6% เทียบกับ 24.7% สำหรับ Fable 5 ในการตั้งค่าเดียวกัน Claude Opus 5 มีคะแนน 29.0% และ GPT-5.6 Sol ของ OpenAI ได้คะแนน 22.4% ในเกณฑ์มาตรฐานเดียวกัน บน Terminal-Bench 4.0 ซึ่งเป็นการทดสอบการเข้ารหัสเอเจนต์บนเทอร์มินัล Fable 5.1 ได้คะแนน 55.8% ในขณะที่ Mythos 5.1 ซึ่งมีการป้องกันการสัมผัสที่เบากว่านั้นสูงถึง 60.9% — เพิ่มขึ้นจาก Fable 5 ที่ 42.0%
การวัดความรู้-งานและการใช้คอมพิวเตอร์ได้รับการปรับปรุงเช่นกัน Fable 5.1 ได้คะแนน 1,853 คะแนนในการประเมิน GDPval-AA v2 เทียบกับ 1,723 คะแนนสำหรับ Fable 5 และสูงถึง 60.9% ในการทดสอบครั้งสุดท้ายของ Humanity โดยไม่ต้องใช้เครื่องมือ และ 65.0% เมื่อใช้เครื่องมือ บน CursorBench 3.2.0 ซึ่งเป็นเกณฑ์มาตรฐานการเข้ารหัส ได้คะแนน 73.4% เทียบกับ Fable 5 ที่ 70.5% ในการใช้งานคอมพิวเตอร์ ได้คะแนนบางส่วน 77.9% และเข้มงวด 41.7% บน OSWorld 2.0 และ 31.4% บน AutomationBench เพิ่มขึ้นจาก 17.1% ในรุ่นก่อน
Anthropic ยังเปิดเผยคำเตือนที่สำคัญอีกด้วย: Fable 5.1 ได้รับการประเมินโดยเปิดใช้งานการป้องกันการผลิต และในงานที่มีการป้องกันเหล่านั้นเข้ามาแทรกแซง โมเดลดังกล่าวได้คะแนนเป็นศูนย์ ซึ่งเป็นปัจจัยที่บริษัทกล่าวว่ามีแนวโน้มที่จะลดผลลัพธ์ในเกณฑ์มาตรฐานบางประการ
บริษัทตั้งข้อสังเกตว่าการตั้งค่าความพยายามมีความสำคัญต่อต้นทุน Fable 5.1 มีค่าเริ่มต้นเป็นความพยายามสูงใน Claude Code และความพยายามปานกลางใน Claude Cowork และบน Claude.ai และในระดับความพยายามที่ต่ำกว่า จะได้ผลลัพธ์ที่ใกล้เคียงหรือดีกว่า Fable 5 ด้วยต้นทุนที่ต่ำกว่ามาก
ลูกค้าในช่วงแรกรายงานการเพิ่มผลผลิต
คำรับรองที่เผยแพร่โดย Anthropic จากพันธมิตรที่เข้าถึงก่อนใครซึ่งเน้นทั้งความสามารถและเศรษฐศาสตร์ Cognition กล่าวว่ากำลังย้ายการรับส่งข้อมูล Opus 5 ใน Devin ไปยัง Fable 5.1 ในวันเปิดตัว "มันจับคู่หรือเอาชนะ Fable 5 ในการทดสอบของเราด้วยต้นทุนต่องานที่ต่ำกว่า และด้วยราคาการอ่านแคชใหม่ โมเดลคลาส Fable จึงประหยัดสำหรับเวิร์กโหลดที่เราเก็บไว้ใน Opus ในที่สุด โดยเริ่มจากการตรวจสอบโค้ด" Walden Yan ผู้ร่วมก่อตั้งและประธานเจ้าหน้าที่ฝ่ายผลิตภัณฑ์ของ Cognition กล่าว
บริษัทการค้าเชิงปริมาณ Millennium เสนอเกร็ดเล็กเกร็ดน้อยในการแก้ไขข้อบกพร่องที่น่าทึ่ง ผู้จัดการพอร์ตโฟลิโออาวุโสรายหนึ่งกล่าวว่าอุบัติเหตุที่เกิดขึ้นไม่บ่อยนัก ประมาณหนึ่งในล้านครั้งนั้น วิศวกรของบริษัทไม่สามารถอธิบายได้เป็นเวลาสี่ถึงห้าปีแล้ว และรถทุกรุ่นที่เขาลองก็พลาดไป Fable 5.1 แยกส่วนประกอบไลบรารีของผู้จำหน่ายภายนอก จับคู่กับคอร์ดัมพ์ และติดตามการแครชไปยังจุดบกพร่องในไลบรารีนั้น
Dan Shipper ซีอีโอของบริษัทสื่อ Every กล่าวว่าในการทดสอบโมเดลนี้เร็วกว่า Opus 5 ประมาณสองเท่าในขณะที่ใช้โทเค็นเพียงครึ่งเดียว และ Ramp ซึ่งเป็นบริษัทสตาร์ทอัพด้านบัตรองค์กร อธิบายถึงการดำเนินการ 38 ชั่วโมงโดยไม่มีใครดูแล โดยที่แบบจำลองวินิจฉัยผลลัพธ์การเรียนรู้ของเครื่องก่อนหน้านี้ว่าเป็นสิ่งประดิษฐ์ของฉลาก แก้ไขมัน เริ่มต้นการทดลองคู่ขนานหกครั้งในชั่วข้ามคืน และกลับมาพร้อมกับผลลัพธ์และขั้นตอนถัดไป
การป้องกันที่นุ่มนวลยิ่งขึ้นพร้อมสายที่แนบมา
ด้านความปลอดภัย Anthropic กล่าวว่าการป้องกันใหม่ล่าสุดสร้างผลบวกลวงด้านความปลอดภัยทางไซเบอร์น้อยลงกว่าเมื่อก่อนถึง 60% บริษัทยังได้เปิดการเปลี่ยนแปลงด้านความสามารถด้วย: ขณะนี้ Fable 5.1 สามารถใช้เพื่อค้นหาช่องโหว่ของซอฟต์แวร์ได้ แม้ว่าจะไม่พัฒนาช่องโหว่สำหรับช่องโหว่เหล่านี้ก็ตาม
ในด้านชีววิทยา การเข้าถึงความสามารถขั้นสูงของ Mythos 5.1 จะดำเนินการผ่านโปรแกรมที่พัฒนาร่วมกับรัฐบาลสหรัฐฯ โดยคาดว่าจะเปิดรับสมัครนักวิทยาศาสตร์เร็วๆ นี้ บริษัทได้เพิ่มความเข้มงวดในการปกป้อง Fable 5 ที่เกี่ยวข้องกับชีววิทยาเมื่อต้นปีนี้ ทำให้การเปิดตัวทั้งคู่เป็นการสานต่อนโยบายดังกล่าวมากกว่าการพลิกกลับ
ทำไมมันถึงสำคัญ
การเปิดตัวเกิดขึ้นในตลาดที่ราคาอนุมานลดลงอย่างรวดเร็ว – การวิเคราะห์ของ AI Buzz Wire เพิ่งพบว่าราคาโทเค็นแตะระดับต่ำสุดเป็นประวัติการณ์ และ Anthropic ก็เลือกที่จะแข่งขันในด้านประสิทธิภาพราคาสำหรับปริมาณงานตัวแทนอย่างชัดเจน แทนที่จะปกป้องอัตราพรีเมี่ยม ด้วยการเปรียบเทียบกับ GPT-5.6 Sol ของ OpenAI และกลุ่มผลิตภัณฑ์ Opus 5 ของบริษัทเอง บริษัทจึงวางตำแหน่ง Fable 5.1 เป็นตัวเลือกเริ่มต้นสำหรับการเขียนโค้ดและการวิจัยที่ใช้เวลานาน การประเมินโดยอิสระและการนำองค์กรไปใช้ยืนยันหรือไม่ว่าการเสนอขายจะมีความชัดเจนในอีกไม่กี่สัปดาห์ข้างหน้า
---
ก้าวนำหน้า AIรับข่าวสาร AI การวิเคราะห์ และความก้าวหน้าล่าสุด ทั้งหมดในที่เดียว
อ่านข่าว AI เพิ่มเติม →