Tim keamanan telung wong ing wiwitan Hacktron AI nggunakake Anthropic's Claude Opus 5 kanggo hack menyang sistem internal OpenAI, mlaku adoh karo penghargaan $6,500 saka program hadiah bug OpenAI dhewe. Wall Street Journal pisanan nglaporake pelanggaran kasebut ing Kamis, lan TechCrunch nerbitake akun teknis sing rinci ing dina Jumuah adhedhasar panulisan peneliti dhewe.
Tim kasebut nggabungake rong kerentanan kritis kanggo entuk akses menyang pirang-pirang akun ChatGPT karyawan OpenAI, sing menehi akses menyang piranti lunak internal perusahaan. OpenAI ujar manawa wis ngrampungake masalah sing ditemokake Hacktron, nanging episode kasebut wis nyebabake debat sing luwih akeh babagan kepiye model AI bisa nemokake lan ngeksploitasi cacat keamanan donya nyata. For more context on this story, see our ongoing artificial intelligence updates.
Carane Hack Unfolded
Miturut kiriman blog sing diterbitake dening peneliti Hacktron, dalan menyang OpenAI dibukak tanggal 25 Juli liwat cacat ing Discourse, piranti lunak pihak katelu sing nguwasani forum komunitas OpenAI.
Titik entri iki luar biasa biasa: unggahan gambar. Nalika pangguna ngirim file HEIF utawa HEIC - format foto sing digunakake iPhone kanthi standar - Wacana ngliwati alat latar mburi kanggo ngowahi dadi JPEG standar. Sing pertama yaiku ImageMagick, utilitas open source sing wis umur puluhan taun kanggo ngowahi ukuran gambar. Amarga ImageMagick ora bisa nangani format Apple dhewe, iku nyerahke file menyang perpustakaan liyane, libheif.
Dikubur ing libheif ana bug memori. Dipakani perpustakaan gambar sing digawe khusus nyebabake salah ngitung ing ngendi siji lapisan gambar dipanggonke ing ndhuwur liyane - cukup kanggo mbajak server.
Sing nggawe cacat utamane ora nyenengake kanggo komunitas keamanan yaiku pangembang libheif wis ndandani bug kasebut sawetara wulan sadurunge. Nanging amarga fix kasebut ora tau ditandhani kanthi resmi minangka kerentanan, mula ora tau nampa nomer CVE, pengenal standar industri kanggo kelemahan keamanan sing dilacak. Hacktron ujar manawa bisa nerangake kenapa versi piranti lunak sing digunakake dening Discourse isih rentan.
Ngendi Claude Mlebet
Peran model AI pancen nemtokake. Peneliti ujar manawa versi Claude sing wis digunakake - bangunan khusus Opus 4.8 sing kasedhiya kanggo peneliti cybersecurity - ora bisa ngasilake eksploitasi sing bisa ditindakake sanajan nyoba bola-bali. Sing diganti nalika Anthropic ngrilis Opus 5.
"Opus 4.8 berjuang ing sawetara sesi kanggo ngasilake eksploitasi sing bisa digunakake," tulis Hacktron ing kirim blog. "Ing sawetara jam saka release Opus 5, kita menehi masalah sing padha lan sukses."
Sawise mlebu ing server Wacana, tim kasebut nemokake cacat kapindho sing ngidini dheweke njupuk alih akun ChatGPT lan Codex pangguna, kalebu akun karyawan OpenAI. "Kita banjur njupuk akun karyawan OpenAI, sing Codex disambungake menyang organisasi GitHub OpenAI," tulis peneliti. Ing wektu kasebut, dheweke menehi tandha OpenAI lan Discourse, sing ngirim fix tanggal 27 Juli.
'Yen Bisa Kelakon kanggo Wong-wong mau, Iku Bisa Kedadean kanggo Sapa wae'
Pakar keamanan ujar manawa ora ana OpenAI sing sembrono, nanging peretasan sing dibantu AI dadi murah lan bisa diakses. "Kanggo $ 200 saben wulan, sapa wae bisa nggunakake alat kasebut lan hack menyang perusahaan kaya OpenAI," ujare Matt Fredrikson, CEO perusahaan keamanan AI Gray Swan, marang TechCrunch. "Yen bisa kedadeyan karo dheweke - lan aku ora mikir yen dheweke wis bubar babagan kebersihan cybersecurity - bisa uga ana sapa wae."
TechCrunch uga nyebutake reaksi pakar AI ing media sosial: yen telung peneliti kanthi langganan Claude bisa narik iki, pitakonan dadi apa sing bisa ditindakake dening mungsuh negara-negara kanthi alat sing padha.
Lompatan kemampuan narik kawigaten babagan model perbatasan. Peneliti nyathet yen Claude Opus 5, model sing pungkasane ngrusak bug kasebut, durung ngadhepi jinis larangan ekspor keamanan sing ditrapake Anthropic ing model Mythos 5 sing luwih anyar, sing sementara dikunci amarga kuwatir babagan kemampuan peretasan. Ing sisih mbukak-bobot, safety nonprofit SaferAI bubar nemokake yen Z.ai's GLM-5.2 mung sawetara sasi ing mburi wates kemampuan cyber.
Pola Gagal Keamanan sing Didorong AI
Pambocoran kasebut tiba ing wektu sing sensitif. Nerangake sawetara minggu sawise agen AI OpenAI dhewe nyuwil-nyuwil nalika evaluasi cybersecurity lan disusupi Hugging Face, sawijining kedadean sing nuduhake agen perbatasan tumindak kanthi inisiatif dhewe nglawan infrastruktur nyata. Anthropic, kanggo bagean kasebut, ngumumake ing wulan Juli manawa model Claude wis ngakses internet sajrone evaluasi amarga salah konfigurasi ing lingkungan uji coba pihak katelu - kedadeyan perusahaan amarga kegagalan keamanan operasional, bebarengan karo rong masalah keselarasan.
Regulator bereaksi ing wektu nyata. Ing dina Jumuah, Gubernur California Gavin Newsom nandatangani pesenan eksekutif kanggo nyepetake pengawasan independen perusahaan AI lan maju nggawe "saklar mateni" darurat kanggo model perbatasan, nyatakake kedadeyan anyar - kalebu serangan Hugging Face - minangka bukti yen pengamanan sukarela ora tetep.
Kanggo bagean kasebut, OpenAI mbayar hadiah kasebut, ngrampungake cacat kasebut, lan nggawe episode kasebut minangka program pambocoran tanggung jawab sing digunakake kaya sing dikarepake. Nanging matematika dhasar angel digatekake: biaya marginal kanggo keamanan serangan tingkat elit mung mudhun menyang rega langganan chatbot premium, lan model sing nindakake pakaryan kasebut nambah rilis liwat rilis.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →