OpenAI ได้เพิ่มรางวัลสำหรับการค้นพบ "การแหกคุกสากล" ในโมเดล AI เป็น 50,000 ดอลลาร์ ซึ่งมากกว่าสองเท่าของค่าหัวก่อนหน้านี้ และส่งสัญญาณว่าบริษัทมองว่าการหลีกเลี่ยงความปลอดภัยบางประเภทนั้นร้ายแรงพอที่จะรับประกันการจ่ายเงินแบบพรีเมียม
โปรแกรม Bio Bug Bounty ที่อัปเดตซึ่งประกาศโดย OpenAI เมื่อวันที่ 9 กรกฎาคม 2569 ขอให้นักวิจัยด้านความปลอดภัยค้นหาคำแนะนำที่สามารถเจาะทะลุรั้วกั้นความปลอดภัยของโมเดลในระดับสากล โดยข้ามการทำงานในการสนทนาและบริบทที่หลากหลาย แทนที่จะเป็นกรณีขอบที่แยกเดี่ยว โปรแกรมนี้มุ่งเป้าไปที่การเจลเบรกที่เกี่ยวข้องกับภัยคุกคามทางชีวภาพโดยเฉพาะ โดยที่แบบจำลอง AI สามารถถูกบังคับให้ให้คำแนะนำที่นำไปปฏิบัติได้ในการสร้างเชื้อโรคหรืออาวุธที่เป็นอันตราย
หากต้องการทราบข่าวด่วนเกี่ยวกับ AI และการวิเคราะห์เชิงลึกเพิ่มเติม โปรดไปที่ AI Buzz Wire
ทำไมต้อง 50,000 ดอลลาร์?
เงินรางวัลที่เพิ่มขึ้นสะท้อนให้เห็นถึงความกังวลที่เพิ่มขึ้นเกี่ยวกับช่องว่างระหว่างสิ่งที่โมเดล AI ระดับแนวหน้าถูกสั่งไม่ให้ทำ และสิ่งที่ผู้ใช้กำหนดแล้วว่าจะสามารถดึงออกมาจากโมเดลเหล่านั้นได้จริง การเจลเบรกแบบสากลนั้นอันตรายอย่างยิ่ง เนื่องจากไม่เหมือนกับเคล็ดลับการฉีดทันทีที่ฉีดครั้งเดียว มันแสดงถึงจุดอ่อนที่เป็นระบบที่สามารถทำซ้ำและแบ่งปันได้
TechRepublic รายงานเมื่อวันที่ 10 กรกฎาคมว่าการเพิ่มรางวัลเกิดขึ้นท่ามกลางการตรวจสอบโมเดลที่ทรงพลังที่สุดของ OpenAI อย่างเข้มงวดมากขึ้น ก่อนหน้านี้ฝ่ายบริหารของทรัมป์ได้ขอให้ OpenAI จำกัดการเปิดตัวโมเดลที่มีความสามารถทางไซเบอร์ใหม่ล่าสุดให้กับกลุ่มผู้ใช้ที่ได้รับการคัดเลือก ตามรายงานของ National Technology News ซึ่งสะท้อนให้เห็นถึงความกังวลของรัฐบาลเกี่ยวกับศักยภาพเชิงรุกของระบบ AI ชายแดน
หน่วยงานในสหราชอาณาจักรพบว่าความสามารถทางไซเบอร์ของ AI กำลังเร่งตัวขึ้น
การประกาศรางวัลนี้เกิดขึ้นพร้อมกับคำเตือนโดยสิ้นเชิงจาก AI Security Institute (AISI) ของสหราชอาณาจักร ซึ่งได้ทำการประเมินความสามารถทางไซเบอร์ของโมเดล Frontier อย่างอิสระมาตั้งแต่ปี 2024
ในการประเมิน GPT-5.5 ของ OpenAI ในเดือนเมษายน 2026 AISI พบว่าโมเดลดังกล่าวมีอัตราการผ่าน 71.4% ในงานรักษาความปลอดภัยทางไซเบอร์ระดับผู้เชี่ยวชาญ ซึ่งสูงที่สุดในบรรดาโมเดลที่ทดสอบ ซึ่งเหนือกว่า Claude Mythos Preview ของ Anthropic ที่ 68.6%, GPT-5.4 ที่ 52.4% และ Opus 4.7 ที่ 48.6%
เกณฑ์มาตรฐานหนึ่งมีความโดดเด่นเป็นพิเศษ AISI ออกแบบความท้าทายด้านวิศวกรรมย้อนกลับของเครื่องเสมือนแบบกำหนดเอง ซึ่งเป็นงานหลายขั้นตอนที่ผู้โจมตีต้องสร้างตัวถอดรหัสคำสั่งแบบกำหนดเอง วิศวกรรมย้อนกลับสำหรับตัวตรวจสอบความถูกต้อง และกู้คืนรหัสผ่านที่ถูกต้อง ผู้ทดสอบการเล่นโดยมนุษย์ที่เชี่ยวชาญของ Crystal Peak Security สามารถแก้ไขความท้าทายได้ภายในเวลาประมาณ 12 ชั่วโมงโดยใช้เครื่องมือระดับมืออาชีพ GPT-5.5 แก้ไขได้ภายใน 10 นาที 22 วินาที โดยมีค่าใช้จ่าย 1.73 ดอลลาร์ในการใช้งาน API โดยไม่ต้องอาศัยความช่วยเหลือจากมนุษย์
เพิ่มขึ้นเป็นสองเท่าทุกๆ สองสามเดือน
ในการวิเคราะห์แยกต่างหากที่เผยแพร่ในเดือนพฤษภาคม พ.ศ. 2569 AISI พบว่าความยาวของโมเดล AI ที่อยู่ชายแดนด้านไซเบอร์สามารถดำเนินการได้โดยอัตโนมัตินั้นเพิ่มขึ้นเป็นสองเท่าทุกๆ 4.7 เดือนนับตั้งแต่ปลายปี พ.ศ. 2567 ซึ่งเพิ่มขึ้นจากประมาณการในเดือนพฤศจิกายน พ.ศ. 2568 ที่ 8 เดือน
“อัตราการเปลี่ยนแปลงในปัจจุบันบ่งชี้ถึงศักยภาพที่เพิ่มขึ้นสำหรับความสามารถทางไซเบอร์ของ AI ในการแปลงเป็นความเสี่ยงที่จับต้องได้ – ความเสี่ยงที่องค์กรในสหราชอาณาจักรจะต้องดำเนินการในอีกไม่กี่เดือนข้างหน้า” AISI เขียน
Claude Mythos Preview และ GPT-5.5 ต่างแซงหน้าแนวโน้มที่เพิ่มขึ้นสองเท่าก่อนหน้านี้อย่างมาก ทำให้เกิดคำถามว่าความเร็วจะเร็วขึ้นหรือไม่
Universal Jailbreaks: เดิมพันสูงสุด
ความแตกต่างระหว่างการเจลเบรคแบบแคบและการเจลเบรคแบบสากลเป็นสิ่งสำคัญ การเจลเบรกแบบแคบอาจหลอกโมเดลให้สร้างการตอบสนองที่ไม่ได้รับอนุญาตเพียงครั้งเดียวภายใต้เงื่อนไขเฉพาะ ในทางตรงกันข้าม การเจลเบรคแบบสากลแสดงถึงรอยแตกพื้นฐานในสถาปัตยกรรมความปลอดภัยของโมเดล ซึ่งเป็นวิธีการที่สามารถหลีกเลี่ยงรั้วกั้นในอินพุตที่หลากหลายได้อย่างน่าเชื่อถือ
การตัดสินใจของ OpenAI ที่จะเสนอเงิน 50,000 ดอลลาร์สำหรับการค้นพบดังกล่าว แสดงให้เห็นว่าบริษัทเชื่อว่าการเจลเบรกแบบสากลนั้นหาได้ยากพอที่จะพิสูจน์ให้เห็นถึงความโปรดปรานจำนวนมากและเป็นอันตรายเพียงพอที่จะรับประกันการลงทุน หากผู้ประสงค์ร้ายค้นพบการเจลเบรคสากลสำหรับคำถามที่เกี่ยวข้องกับภัยคุกคามทางชีวภาพก่อนที่จะทำการติดตั้ง ผลลัพธ์ที่ตามมาอาจรุนแรง
โปรแกรมยังทำหน้าที่ฟังก์ชั่นโปร่งใสอีกด้วย ด้วยการเชิญนักวิจัยภายนอกให้ตรวจสอบโมเดลของมัน OpenAI จึงสามารถระบุและแก้ไขช่องโหว่ก่อนที่จะถูกนำไปใช้ประโยชน์ในป่า โดยที่ค่าหัวนั้นมากพอที่จะดึงดูดบุคลากรที่มีความสามารถที่ต้องการ
การแข่งขันระหว่างการรุกและการป้องกัน
การพัฒนาคู่ขนาน - การเพิ่มค่าหัวของ OpenAI และการประเมินความสามารถของ AISI - แสดงให้เห็นถึงความตึงเครียดที่สำคัญในความปลอดภัยของ AI ในปัจจุบัน โมเดลต่างๆ มีความสามารถมากขึ้นอย่างมากในงานทางไซเบอร์ โดยมีขอบเขตเวลาของงานที่พวกเขาสามารถทำให้เสร็จเป็นสองเท่าทุกๆ สองสามเดือน ในเวลาเดียวกัน บริษัทต่างๆ กำลังเร่งแก้ไขช่องโหว่ที่ทำให้โมเดลของตนเป็นอันตราย
ค่าหัวและทีมสีแดงสามารถตามทันเส้นโค้งขีดความสามารถที่เพิ่มขึ้นได้หรือไม่ ยังคงเป็นคำถามเปิดอยู่ แต่ตัวเลข 50,000 ดอลลาร์ส่งสัญญาณที่ชัดเจน: OpenAI เชื่อว่าภัยคุกคามนั้นร้ายแรงพอที่จะจ่ายเงินให้กับใครก็ตามที่สามารถพิสูจน์ได้ว่ามีรอยร้าวอยู่
ก้าวนำหน้า AI
เมื่อโมเดลชายแดนมีพลังมากขึ้น การต่อสู้ระหว่างราวกั้นนิรภัยกับผู้ที่พยายามจะทำลายก็จะยิ่งเข้มข้นขึ้นเท่านั้น ติดตามความคืบหน้าล่าสุดได้ที่ AI Buzz Wire
อ่านเพิ่มเติม ความครอบคลุมอุตสาหกรรม AI ได้ที่ AI Buzz Wire


