Anthropic pada hari Selasa mengumumkan perluasan besar-besaran dari upaya akses model yang berfokus pada keamanan, merestrukturisasi inisiatif akses yang telah diperiksa menjadi Program Verifikasi Siber (CVP) formal dengan tiga tingkatan berbeda untuk profesional keamanan siber. Langkah ini dilakukan ketika perusahaan mengungkapkan bahwa inisiatif Project Glasswing telah menemukan setidaknya 129.000 kerentanan perangkat lunak yang terverifikasi sejak bulan April.

Program yang direstrukturisasi ini memungkinkan tim keamanan yang terverifikasi untuk menjalankan model Anthropic yang paling mumpuni — termasuk Claude Opus 5.5, Claude Sonnet 5.5, dan Claude Mythos 5.1 — dengan pengurangan pengamanan dan pengklasifikasi pemblokiran, izin yang biasanya tidak tersedia untuk pengguna umum. Menurut Anthropic, tujuannya adalah untuk memberikan kemampuan AI terdepan ke tangan para pembela HAM sebelum pihak jahat menggunakan alat yang sama. For more context on this story, see our ongoing more AI stories.

Tiga Tingkat Akses, Tiga Skenario Ancaman

Program baru ini disusun dalam tiga tingkat akses, masing-masing disesuaikan dengan jenis pekerjaan keamanan yang berbeda:

  • Akses Pertahanan mencakup operasi defensif seperti respons insiden, rekayasa balik malware, serta analisis dan validasi kerentanan.
  • Akses Tim Merah menambahkan pengujian penetrasi resmi dan tim merah ke kasus penggunaan defensif, sehingga memungkinkan serangan simulasi terhadap sistem yang izin pengujiannya dimiliki oleh organisasi.
  • Akses Khusus memiliki perlindungan paling sedikit dan hanya diperuntukkan bagi sejumlah organisasi terverifikasi yang berwenang untuk menguji sendiri sistem keamanan AI.

Organisasi dan tim keamanan individu mengajukan permohonan untuk tingkat yang sesuai dengan pekerjaan mereka, dan Anthropic meninjau setiap aplikasi sebelum memberikan akses. Perusahaan mengatakan ketiga tingkatan tersebut mencakup akses ke model andalan saat ini serta model baru yang dirilis di masa mendatang.

Perlindungan Masih Menggigit — Secara Selektif

Anthropic memasangkan pengumuman tersebut dengan data evaluasi yang dimaksudkan untuk menunjukkan bahwa sistem tingkatan memisahkan pekerjaan pertahanan yang baik dari kemampuan yang benar-benar berbahaya. Dalam evaluasi CyScenarioBench pada Claude Opus 5.5, perusahaan melaporkan bahwa perlindungan memblokir 46 dari 50 tugas di tingkat Akses Pertahanan. Pada tingkat Akses Tim Merah pada model yang sama, tidak ada satu pun tugas yang diblokir, dan model tersebut menyelesaikan 34 dari 50 tugas — tingkat penyelesaian yang sama yang dicatat ketika tidak ada perlindungan yang diterapkan sama sekali.

Sebaliknya, tanpa akses CVP, setiap tugas diblokir pada perintah pertama, menurut Anthropic.

“Evaluasi ini memberi kami keyakinan bahwa kami dapat membuat kemampuan siber canggih tersedia dengan aman bagi kelompok pembela HAM yang lebih luas, memperluas upaya pertahanan yang kami mulai dengan Project Glasswing,” kata perusahaan itu dalam pengumumannya, yang dilaporkan secara luas oleh The Hacker News, Reuters, dan SecurityWeek.

Desain ini mencerminkan keyakinan bahwa sebagian besar pekerjaan keamanan defensif – patching, analisis log, triase malware – dapat dilakukan di bawah batasan yang ketat, sementara pengujian ofensif yang sah memerlukan koridor yang lebih luas. Hal ini juga mencerminkan bagaimana industri keamanan telah lama menangani alat yang dapat digunakan ganda: memeriksa praktisinya, bukan hanya alatnya saja.

Jejak Glasswing yang Berkembang

Perluasan program ini dipadukan erat dengan Project Glasswing, inisiatif Anthropic untuk menerapkan modelnya pada pengerasan perangkat lunak penting. Perusahaan tersebut mengatakan Glasswing menemukan setidaknya 129,000 kerentanan perangkat lunak yang terverifikasi antara bulan April dan Juli 2026, dan tambahan 5,500 kerentanan terverifikasi antara bulan April dan Oktober melalui upaya pemindaian sumber terbuka.

Dari kerentanan yang terverifikasi, lebih dari 33.000 sejauh ini telah dinilai sebagai kerentanan kritis atau tingkat keparahan tinggi – angka yang digambarkan oleh Anthropic sebagai angka yang mungkin terlalu rendah karena hanya menggunakan data survei dari sebagian mitra Glasswing. Perusahaan memperkirakan dampak sebenarnya setidaknya lima kali lebih tinggi.

Pandangan Terukur tentang Penemuan Kerentanan Berbasis AI

Analisis independen menunjukkan banyaknya kelemahan yang ditemukan oleh AI tidak berarti gelombang pelanggaran yang dieksploitasi. Dalam analisis yang diterbitkan akhir bulan lalu, peneliti VulnCheck Patrick Garrity menemukan bahwa hanya 2 dari 300 kerentanan yang ditemukan oleh Anthropic atau Project Glasswing – sekitar 0,67 persen – telah dieksploitasi di alam liar.

Dua kelemahan yang dieksploitasi adalah CVE-2026-26980, kerentanan injeksi SQL di Ghost CMS, dan CVE-2026-61500, kelemahan pemalsuan sesi di Rejetto HTTP File Server. Data tersebut mendukung nuansa yang telah ditekankan oleh para peneliti keamanan: AI menurunkan hambatan terhadap penemuan kerentanan, namun sebagian besar kelemahan yang muncul tidak pernah terdeteksi oleh radar penyerang.

Pengumuman ini juga muncul di tengah perdebatan yang lebih luas tentang pekerjaan keamanan yang dihasilkan oleh AI. Penelitian dari 1Password dan Veracode menunjukkan bahwa patch kerentanan yang dibuat oleh AI dapat menimbulkan kelemahan baru, yang menggarisbawahi bahwa otomatisasi membantu namun tidak menggantikan verifikasi manusia.

Apa Artinya bagi Industri Keamanan

Untuk tim keamanan, CVP menurunkan energi aktivasi untuk menggunakan model perbatasan dalam pekerjaan pertahanan nyata. Responden insiden mendapatkan jalur yang disetujui untuk mendapatkan bantuan analisis malware; penguji penetrasi mendapatkan lingkungan yang diatur untuk serangan yang dibantu AI; dan sejumlah kecil organisasi yang mengaudit sistem keamanan AI menerima akses yang paling sedikit pembatasannya.

Bagi Anthropic, program ini merupakan strategi keselamatan dan komersial. Hal ini menegaskan posisi perusahaan bahwa kemampuan siber yang kuat harus dilepaskan dengan sengaja, kepada para pembela HAM yang telah diperiksa, bukannya ditekan seluruhnya – hal ini berbeda dengan para pesaing yang menghadapi pengawasan ketat atas model-model yang memiliki kontrol siber yang lebih lemah. Hal ini juga memperdalam hubungan Anthropic dengan perusahaan-perusahaan yang paling mungkin membayar untuk akses model terdepan: pemerintah, operator infrastruktur penting, dan vendor keamanan besar.

Perusahaan tidak mengumumkan perubahan harga yang terkait dengan program tersebut, dan aplikasi diproses melalui saluran akses terverifikasi yang ada di Anthropic. Mengingat skala dari apa yang telah diungkapkan Glasswing – dan pengakuan perusahaan sendiri bahwa angka-angka tersebut kemungkinan besar tidak sesuai dengan kenyataan – industri keamanan akan mengamati berapa banyak dari 129.000 temuan tersebut yang diperbaiki sebelum penyerang menemukannya terlebih dahulu.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →