Model-model Frontier AI sangat berbeda dalam hal seberapa sulitnya untuk ditembus, menurut tolok ukur baru dari organisasi nirlaba keselamatan FAR.AI – dan kesenjangannya jauh lebih besar dari perkiraan banyak orang.

Pada tanggal 29 Juli, FAR.AI meluncurkan Papan Peringkat Keamanan AI, yang menguji perlindungan empat model terkemuka dalam kondisi yang sama. Claude Fable 5 dari Anthropic dan GPT-5.6 Sol dari OpenAI bertahan terhadap serangan tersebut, sementara Grok 4.5 dari xAI dan Gemini 3.1 Pro dari Google masing-masing mengalami kegagalan dengan harga di bawah $300, kata organisasi itu. FAR.AI menggambarkan perbedaan antara model yang paling kuat dan paling tidak kuat sebagai “kesenjangan seratus kali lipat” dalam upaya perlindungan. For more context on this story, see our ongoing AI news.

Bersamaan dengan papan peringkat, FAR.AI memperkenalkan apa yang disebut Standar Minimal untuk Perlindungan, yaitu garis dasar keamanan bersama yang disusun seluruhnya dari pertahanan yang telah dijalankan oleh pengembang sejenis dalam tahap produksi. Tujuannya adalah memberikan laboratorium landasan yang kokoh untuk bertemu – dan membuat perlindungan yang lemah terlihat.

Temuan ini mencerminkan stress test yang dilakukan FAR.AI sebelumnya. Laporan pada bulan Mei menemukan bahwa pengamanan DeepSeek-V4-Pro telah "hampir sepenuhnya runtuh", dengan penyerang berketerampilan rendah melewati mekanisme keamanan sebanyak 98–100% di setiap domain yang diuji. Jailbreak yang tersedia untuk umum yang dibuat untuk model pendahulunya berfungsi tanpa modifikasi apa pun, menunjukkan bahwa kerentanan yang diketahui tidak ditambal.

WIRED, yang melaporkan di papan peringkat, menyimpulkan bahwa "sangat mudah untuk melakukan jailbreak pada beberapa model AI terdepan." Ketika agen mengambil tugas yang lebih sensitif, kesenjangan tersebut menimbulkan pertanyaan mendesak tentang sistem mana yang aman untuk diterapkan.

Untuk liputan berkelanjutan tentang penelitian keselamatan dan keamanan AI, pembaca dapat mengikuti AI Buzz Wire.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →