โมเดล Frontier AI มีความแตกต่างอย่างมากในเรื่องความยากในการทำลาย ตามเกณฑ์มาตรฐานใหม่จาก FAR.AI ซึ่งเป็นองค์กรไม่แสวงผลกำไรด้านความปลอดภัย และช่องว่างนั้นใหญ่กว่าที่คิดไว้มาก

เมื่อวันที่ 29 กรกฎาคม FAR.AI ได้เปิดตัว AI Security Leaderboard โดยทดสอบการป้องกันของโมเดลชั้นนำ 4 รุ่นภายใต้เงื่อนไขที่เหมือนกัน Claude Fable 5 ของ Anthropic และ GPT-5.6 Sol ของ OpenAI ต่อต้านการโจมตีดังกล่าวได้ ในขณะที่ Grok 4.5 ของ xAI และ Gemini 3.1 Pro ของ Google ต่างมีราคาต่ำกว่า 300 ดอลลาร์สหรัฐฯ FAR.AI อธิบายความแตกต่างระหว่างโมเดลที่แข็งแกร่งที่สุดและน้อยที่สุดว่าเป็น "ช่องว่างร้อยเท่า" ในการป้องกัน For more context on this story, see our ongoing AI news.

นอกจากกระดานผู้นำแล้ว FAR.AI ยังแนะนำสิ่งที่เรียกว่า Minimal Standard for Safeguards ซึ่งเป็นพื้นฐานความปลอดภัยที่ใช้ร่วมกันที่รวบรวมมาจากการป้องกันที่นักพัฒนาระดับเดียวกันใช้งานอยู่แล้วในการผลิต เป้าหมายคือเพื่อให้ห้องปฏิบัติการมีพื้นคอนกรีตมาบรรจบกัน และเพื่อให้มองเห็นการป้องกันที่อ่อนแอได้

การค้นพบนี้สะท้อนถึงการทดสอบความเครียดก่อนหน้านี้ของ FAR.AI รายงานประจำเดือนพฤษภาคมพบว่าการป้องกันของ DeepSeek-V4-Pro "พังทลายลงเกือบทั้งหมด" โดยผู้โจมตีที่มีทักษะต่ำสามารถข้ามกลไกด้านความปลอดภัยได้ 98–100% ของเวลาในทุกโดเมนที่ทดสอบ การเจลเบรกที่เปิดเผยต่อสาธารณะซึ่งสร้างขึ้นสำหรับรุ่นก่อนนั้นทำงานโดยไม่มีการแก้ไขใดๆ เลย บ่งชี้ว่าช่องโหว่ที่ทราบนั้นไม่ได้รับการแพตช์

WIRED รายงานบนลีดเดอร์บอร์ด สรุปว่า "การเจลเบรคโมเดล AI ชายแดนบางรุ่นยังเป็นเรื่องง่ายอย่างน่ากลัว" เมื่อเจ้าหน้าที่ทำงานที่มีความละเอียดอ่อนมากขึ้น ความแตกต่างทำให้เกิดคำถามเร่งด่วนว่าระบบใดมีความปลอดภัยในการปรับใช้

เพื่อให้ครอบคลุมการวิจัยด้านความปลอดภัยและการรักษาความปลอดภัยของ AI อย่างต่อเนื่อง ผู้อ่านสามารถติดตาม AI Buzz Wire

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →