OpenAI telah menaikkan ganjaran untuk menemui "jailbreak sejagat" dalam model AInya kepada $50,000, lebih daripada menggandakan hadiah sebelumnya dan menandakan bahawa syarikat itu melihat kelas pintasan keselamatan tertentu sebagai cukup serius untuk menjamin pembayaran premium.
Program Bio Bug Bounty yang dikemas kini, yang diumumkan oleh OpenAI pada 9 Julai 2026, meminta penyelidik keselamatan mencari gesaan yang boleh menembusi pagar keselamatan model secara universal — pintasan yang berfungsi merentas berbilang perbualan dan konteks berbanding kes tepi terpencil. Program ini secara khusus menyasarkan jailbreak yang berkaitan dengan ancaman biologi, di mana model AI boleh dipaksa untuk memberikan panduan yang boleh diambil tindakan untuk mencipta patogen atau senjata berbahaya.
Untuk berita terkini AI dan analisis mendalam, lawati AI Buzz Wire.
Mengapa $50,000?
Karunia yang meningkat mencerminkan kebimbangan yang semakin meningkat tentang jurang antara model AI sempadan yang tidak boleh dilakukan dan perkara yang sebenarnya boleh diambil oleh pengguna yang ditentukan daripada model tersebut. Jailbreak universal amat berbahaya kerana, tidak seperti helah suntikan segera sekali sahaja, ia mewakili kelemahan sistematik yang boleh ditiru dan dikongsi.
TechRepublic melaporkan pada 10 Julai bahawa peningkatan ganjaran datang di tengah-tengah penelitian yang lebih tinggi terhadap model OpenAI yang paling berkuasa. Pentadbiran Trump sebelum ini meminta OpenAI untuk mengehadkan keluaran model berkemampuan siber terbaharunya kepada kumpulan pengguna yang telah disemak, menurut National Technology News, mencerminkan kebimbangan kerajaan tentang potensi serangan sistem AI sempadan.
Agensi UK Menemui Keupayaan Siber AI Mempercepatkan
Pengumuman hadiah itu bertepatan dengan amaran keras daripada Institut Keselamatan AI (AISI) UK, yang telah menilai secara bebas keupayaan siber model sempadan sejak 2024.
Dalam penilaian April 2026 terhadap GPT-5.5 OpenAI, AISI mendapati bahawa model itu mencapai kadar kelulusan 71.4% pada tugas keselamatan siber peringkat Pakar — yang tertinggi daripada mana-mana model yang diuji, mengatasi Pratonton Claude Mythos Anthropic pada 68.6%, GPT-5.4% pada 52.4%, dan 52.48%.
Satu penanda aras amat menarik perhatian. AISI mereka bentuk cabaran kejuruteraan terbalik mesin maya tersuai — tugas berbilang langkah yang memerlukan penyerang membina penyahkod arahan tersuai, kejuruteraan terbalik pengesah dan mendapatkan semula kata laluan yang sah. Pakar penguji manusia pakar Crystal Peak Security menyelesaikan cabaran dalam kira-kira 12 jam menggunakan alat profesional. GPT-5.5 menyelesaikannya dalam 10 minit dan 22 saat dengan kos $1.73 dalam penggunaan API, tanpa bantuan manusia.
Berganda Setiap Beberapa Bulan
Dalam analisis berasingan yang diterbitkan pada Mei 2026, AISI mendapati bahawa tempoh model AI sempadan tugas siber yang boleh diselesaikan secara autonomi telah meningkat dua kali ganda setiap 4.7 bulan sejak lewat 2024 — pecutan daripada anggaran 8 bulan pada November 2025.
"Kadar perubahan semasa menunjukkan potensi yang semakin meningkat untuk keupayaan siber AI untuk diterjemahkan kepada risiko ketara - risiko organisasi UK perlu mengemudi dalam beberapa bulan akan datang," tulis AISI.
Claude Mythos Preview dan GPT-5.5 kedua-duanya melebihi aliran penggandaan sebelumnya, menimbulkan persoalan sama ada kadarnya semakin pantas.
Jailbreak Universal: Pertaruhan Tertinggi
Perbezaan antara jailbreak sempit dan universal adalah kritikal. Jailbreak yang sempit mungkin menipu model untuk menghasilkan satu tindak balas yang tidak dibenarkan dalam keadaan tertentu. Jailbreak universal, sebaliknya, mewakili retakan asas dalam seni bina keselamatan model — kaedah yang boleh memintas pagar merentasi pelbagai input.
Keputusan OpenAI untuk menawarkan $50,000 untuk penemuan sedemikian menunjukkan syarikat itu percaya jailbreak sejagat kedua-duanya cukup jarang untuk mewajarkan hadiah yang besar dan cukup berbahaya untuk menjamin pelaburan. Jika pemecahan penjara universal untuk pertanyaan berkaitan bioancaman ditemui oleh pelakon yang berniat jahat sebelum ditampal, akibatnya boleh menjadi teruk.
Program ini juga menyediakan fungsi ketelusan. Dengan menjemput penyelidik luar untuk menyiasat modelnya, OpenAI boleh mengenal pasti dan membetulkan kelemahan sebelum ia dieksploitasi di alam liar — dengan syarat hadiahnya cukup besar untuk menarik bakat berkaliber yang diperlukan.
Perlumbaan Antara Serangan dan Pertahanan
Perkembangan selari — peningkatan hadiah OpenAI dan penilaian keupayaan AISI — menggambarkan ketegangan utama dalam keselamatan AI hari ini. Model semakin berkebolehan secara mendadak dalam tugasan siber, dengan ufuk masa tugas yang boleh mereka selesaikan dua kali ganda setiap beberapa bulan. Pada masa yang sama, syarikat berlumba-lumba untuk menambal kelemahan yang menjadikan model mereka berbahaya.
Sama ada hadiah dan berpasukan merah boleh seiring dengan keluk keupayaan yang semakin pesat masih menjadi persoalan terbuka. Tetapi angka $50,000 menghantar isyarat yang jelas: OpenAI percaya ancaman itu cukup serius untuk membayar dolar tertinggi kepada sesiapa sahaja yang boleh membuktikan retakan itu wujud.
Kekal Mendahului AI
Apabila model sempadan semakin berkuasa, pertempuran antara pagar keselamatan dan mereka yang cuba memecahkannya hanya akan bertambah sengit. Jejaki perkembangan terkini di AI Buzz Wire.
Baca lebih lanjut liputan industri AI di AI Buzz Wire.


