OpenAI menerbitkan postingan keamanan pada tanggal 30 September 2026 yang menjelaskan bagaimana OpenAI mengidentifikasi dan mengganggu kampanye terkoordinasi untuk mengekstraksi alasan yang dilindungi dari modelnya — dan menghubungkan kelompok inti aktivitas tersebut dengan individu yang terkait dengan Moonshot AI, laboratorium Tiongkok di balik keluarga model Kimi.

Pengungkapan ini terjadi pada saat yang sensitif bagi industri, dimana nilai dari model frontier semakin terletak tidak hanya pada jawabannya namun juga pada bagaimana alasan model tersebut. Bagi pembaca yang menelusuri perkembangan AI terbaru, kasus ini menawarkan gambaran mendetail yang luar biasa tentang bagaimana model IP diserang dalam skala besar — ​​dan bagaimana laboratorium meresponsnya.

Yang dimaksud dengan "distilasi permusuhan" di sini

OpenAI menggambarkan aktivitas tersebut sebagai konsisten dengan penyulingan permusuhan, yang didefinisikan sebagai penggunaan keluaran atau alasan suatu model secara sistematis dan tidak sah untuk membantu melatih, mereproduksi, atau meningkatkan model lain. "Penalaran yang dilindungi" adalah catatan internal model untuk mengerjakan suatu tugas — informasi yang biasanya disembunyikan dari jawaban akhir yang dilihat pengguna. Mengekstraksinya, menurut perusahaan, dapat membantu orang lain mereproduksi kemampuan yang tidak mereka bangun.

Yang penting, OpenAI mengatakan bahwa operator tidak merusak enkripsinya, menyusupi database, atau mendapatkan akses langsung ke percakapan pengguna yang tersimpan. Sebaliknya, mereka memanipulasi interaksi model sehingga alasan yang dilindungi dapat direproduksi dalam bentuk yang dapat dilihat oleh pemohon – sebuah penyalahgunaan produk itu sendiri secara terkoordinasi dan dalam jumlah besar, bukan peretasan tradisional.

Salah satu teknik yang didokumentasikan OpenAI melibatkan penyalinan jejak penalaran terenkripsi dari satu percakapan dan kemudian meminta model dalam percakapan terpisah untuk mendekripsi dan menyalin konten penalaran yang tersembunyi. Perusahaan menekankan bahwa manipulasi tersebut bukanlah kerentanan yang hanya terjadi pada model mereka sendiri, dan mengatakan bahwa mereka telah berbagi rincian dengan mitra industri melalui Frontier Model Forum untuk memperkuat pertahanan kolektif.

Garis waktu: 16.000 permintaan dalam dua hari

Menurut postingan tersebut, kampanye dimulai pada 1 Juli 2026 dengan volume yang relatif rendah. Hal ini meningkat tajam pada tanggal 24 dan 25 Juli, ketika OpenAI mengamati lonjakan volume tinggi sebanyak 16.000 permintaan menggunakan pola ekstraksi yang relevan, yang berasal dari lebih dari 4.000 pengguna. Catatan kaki di postingan tersebut memperingatkan bahwa angka-angka ini menggambarkan upaya ekstraksi – belum tentu berhasil.

Investigasi lebih lanjut mengungkap aktivitas pola cepat terkait di sekelompok lebih dari 15.000 pengguna. OpenAI mengatakan bahwa mereka sepenuhnya mengganggu kampanye tersebut pada tanggal 28 Juli 2026, dan bahwa aktivitas tersebut terus berkembang seiring berjalannya waktu, memperkuat pandangannya bahwa distilasi yang merugikan memerlukan pertahanan yang berlapis dan adaptif, bukan perbaikan yang hanya dilakukan satu kali saja.

Atribusi mengarah ke Moonshot AI

OpenAI berhati-hati dengan atribusinya. Dikatakan tidak jelas apakah semua operator yang diamati selama periode tersebut berasal dari satu aktor, namun mereka mengaitkan kelompok inti aktivitas tersebut dengan individu yang terkait dengan Moonshot AI, pengembang Kimi.

Klaim tersebut tidak datang dalam ruang hampa. Pada tanggal 8 September 2026, Badan Keamanan Nasional, Badan Keamanan Siber dan Infrastruktur, dan FBI merilis nasihat keamanan siber bersama yang menyatakan bahwa Moonshot AI telah melakukan kampanye penyulingan secara luas terhadap perusahaan AI di perbatasan AS setidaknya sejak pertengahan tahun 2025. Menurut saran tersebut, Moonshot mengekstraksi data penting Claude Fable 5 untuk melatih model Kimi-K3 dan data GPT-4o untuk melatih Kimi-K2, menggunakan model AS untuk menyaring kemampuan dalam penyempurnaan yang diawasi, pembelajaran penguatan, rekayasa perangkat lunak, dan matematika.

Penasihat tersebut melangkah lebih jauh dengan menyatakan bahwa – mungkin dengan kesadaran pemerintah Tiongkok – DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun, dan Z.AI telah secara kolektif mengekstraksi miliaran token di jutaan bursa dari model perbatasan AS, termasuk varian Claude, GPT, Gemini, dan Grok, setidaknya sejak akhir tahun 2024. Badan-badan tersebut menggambarkan jalur logistik API asli, penyedia cloud jarak jauh, dan agregator pihak ketiga, ditambah pasar abu-abu proxy API yang dikenal sebagai "stasiun transfer" digunakan untuk melewati batasan geografis dan persyaratan layanan. Penghematan biaya dilaporkan berasal dari pengadaan langganan premium dalam jumlah besar yang dibagikan ke seluruh tim pengembang.

Mengapa jejak penalaran layak untuk dicuri

Masalah keamanan lebih dari sekadar keunggulan kompetitif. OpenAI berpendapat bahwa penalaran yang diekstraksi dapat digunakan untuk melatih model lain tanpa mempertahankan perlindungan yang diterapkan pada keluaran model asli yang dapat dilihat pengguna — yang berarti distilasi dalam skala besar dapat mentransfer kemampuan tingkat lanjut tanpa investasi terkait pada keselamatan. Perusahaan mengatakan risiko tersebut meningkat seiring dengan bertambahnya kemampuan model dalam domain penggunaan ganda.

Peneliti independen juga menyuarakan kekhawatiran yang sama. Dalam makalah yang dikirimkan ke arXiv pada 10 Agustus 2026, sekelompok peneliti termasuk Alexander Panfilov, Ilia Shumailov, dan Maksym Andriushchenko melaporkan bahwa penyedia terkemuka tidak sepenuhnya menyembunyikan jejak alasan model mereka, dan menunjukkan kerentanan lintas-model dan pemadatan percakapan melalui pengungkapan yang bertanggung jawab. OpenAI mengatakan pihaknya menyelidiki temuan-temuan tersebut, mengonfirmasi bahwa jalur serangan itu nyata, dan menggunakan upaya tersebut untuk mempercepat mitigasinya.

Apa yang terjadi selanjutnya

OpenAI mengatakan pihaknya menyelidiki ruang lingkup kampanye dan potensi dampaknya sebelum dipublikasikan, menerapkan mitigasinya sendiri, dan membagikan temuannya dengan peneliti dan mitra industri untuk mendapatkan masukan. Pekerjaan mitigasi dan investigasi tambahan terus berlanjut, dan perusahaan menganggap penyulingan yang merugikan sebagai tantangan keamanan yang lebih luas untuk seluruh ekosistem laboratorium terdepan, bukan hanya satu insiden saja.

Episode ini juga mempertajam perdebatan kebijakan yang sedang berlangsung. Jika lembaga-lembaga AS secara resmi mengaitkan kampanye penyulingan dengan laboratorium Tiongkok, maka akan terjadi kontrol yang lebih ketat terhadap akses API, pembatasan jumlah dan pemeriksaan identitas yang lebih agresif, serta tekanan yang berkelanjutan terhadap pasar agregator dan proxy yang membuat penyalahgunaan dalam skala besar lebih mudah disembunyikan. Bagi perusahaan AI di kedua negara Pasifik, lapisan penalaran kini menjadi aset yang diperebutkan — dan melindunginya telah menjadi disiplin keamanan tersendiri.

---

Tetap Terdepan dalam AI

Dapatkan berita, analisis, dan terobosan AI terkini — semuanya di satu tempat.

Baca berita AI selengkapnya →