OpenAI, 30 Eylül 2026'da, modellerinden korumalı mantık çıkarmak için koordineli bir kampanyayı nasıl tespit ettiğini ve bozduğunu açıklayan bir güvenlik gönderisi yayınladı ve faaliyetin temel bir kümesini, Kimi model ailesinin arkasındaki Çin laboratuvarı olan Moonshot AI ile ilişkili kişilere atfetti.

Açıklama, sektör için hassas bir döneme denk geliyor; sınır modelinin değeri, yalnızca yanıtlarında değil, aynı zamanda nasıl akıl yürüttüğünde de giderek daha fazla yatıyor. En son yapay zeka gelişmelerini takip eden okuyucular için bu vaka, model IP'ye geniş ölçekte nasıl saldırıya uğradığına ve laboratuvarların nasıl tepki verdiğine alışılmadık derecede ayrıntılı bir bakış sunuyor.

Burada "karşıtlı damıtma" ne anlama geliyor?

OpenAI, etkinliği, bir modelin çıktılarının veya mantığının başka bir modeli eğitmeye, yeniden üretmeye veya geliştirmeye yardımcı olmak için sistematik ve yetkisiz kullanımı olarak tanımladığı çekişmeli damıtma ile tutarlı olarak tanımlıyor. "Korumalı akıl yürütme", modelin bir görev üzerinde çalışmaya ilişkin dahili kaydıdır; normalde kullanıcının gördüğü son yanıtta saklanan bilgilerdir. Şirket, bunu çıkarmanın başkalarının kendi oluşturmadıkları yetenekleri yeniden üretmelerine yardımcı olabileceğini savunuyor.

Daha da önemlisi OpenAI, operatörlerin şifrelemeyi bozmadığını, bir veritabanını tehlikeye atmadığını veya saklanan kullanıcı konuşmalarına doğrudan erişim sağlamadığını söylüyor. Bunun yerine, korumalı muhakemenin talep edenin görebileceği biçimlerde yeniden üretilebilmesi için model etkileşimlerini manipüle ettiler; geleneksel bir hackleme yerine ürünün kendisinin koordineli, yüksek hacimli bir şekilde kötüye kullanılması.

OpenAI'nin belgelediği tekniklerden biri, bir konuşmadan şifrelenmiş akıl yürütme izlerinin kopyalanmasını ve ardından ayrı bir konuşmadaki bir modelden gizli akıl yürütme içeriğinin şifresini çözüp yazıya dökmesini istemeyi içeriyordu. Şirket, manipülasyonun kendi modellerine özgü bir güvenlik açığı olmadığını vurguladı ve kolektif savunmayı güçlendirmek için ayrıntıları Frontier Model Forum aracılığıyla sektör ortaklarıyla paylaştığını söyledi.

Zaman çizelgesi: İki günde 16.000 istek

Gönderiye göre kampanya 1 Temmuz 2026'da nispeten düşük bir hacimle başladı. OpenAI'nin 4.000'den fazla kullanıcıdan gelen ilgili çıkarma modelini kullanarak 16.000 istekte yüksek hacimli ani artışlar gözlemlediği 24 ve 25 Temmuz'da bu durum keskin bir şekilde arttı. Gönderideki bir dipnot, bu rakamların, mutlaka başarılı olanları değil, çıkarma girişimlerini tanımladığı konusunda uyarıyor.

Daha ileri araştırmalar, 15.000'den fazla kullanıcıdan oluşan bir kümede ilgili bilgi istemi modeli etkinliğini ortaya çıkardı. OpenAI, kampanyayı 28 Temmuz 2026'ya kadar tamamen kesintiye uğrattığını ve faaliyetin zaman içinde gelişmeye devam ettiğini, bunun da rekabete dayalı damıtmanın tek seferlik bir düzeltme yerine katmanlı, uyarlanabilir savunmalar gerektirdiği görüşünü güçlendirdiğini söyledi.

Moonshot AI ile ilgili atıf noktaları

OpenAI, atıf konusunda dikkatlidir. Dönem boyunca gözlemlenen tüm operatörlerin tek bir aktörden gelip gelmediğinin belirsiz olduğu ancak faaliyetin çekirdek kümesinin Kimi'nin geliştiricisi Moonshot AI ile ilişkili kişilere atfedildiği belirtiliyor.

İddia bir boşlukta ortaya çıkmıyor. 8 Eylül 2026'da Ulusal Güvenlik Ajansı, Siber Güvenlik ve Altyapı Güvenliği Ajansı ve FBI, Moonshot AI'nin en azından 2025'in ortasından bu yana ABD'nin sınır yapay zeka şirketlerine karşı yaygın bir damıtma kampanyası yürüttüğünü belirten ortak bir siber güvenlik tavsiye belgesi yayınladı. Tavsiyeye göre Moonshot, denetimli ince ayar, takviyeli öğrenme, yazılım mühendisliği ve matematik yeteneklerini ayrıştırmak için ABD modellerini kullanarak Kimi-K3 modelini eğitmek için önemli Claude Fable 5 verilerini ve Kimi-K2'yi eğitmek için GPT-4o verilerini çıkardı.

Uyarı daha da ileri giderek DeepSeek, Moonshot AI, Alibaba, MiniMax, StepFun ve Z.AI'nin, muhtemelen Çin hükümetinin farkındalığıyla, en azından 2024'ün sonlarından bu yana Claude, GPT, Gemini ve Grok çeşitleri de dahil olmak üzere ABD sınır modellerinden milyonlarca borsada milyarlarca tokeni toplu olarak çıkardığını belirtiyor. Ajanslar, yerel API'lerden, uzak bulut sağlayıcılarından ve üçüncü taraf toplayıcılardan oluşan bir lojistik hattının yanı sıra gri bir pazar tanımlıyor. Coğrafi kısıtlamaları ve hizmet şartlarını atlamak için kullanılan "aktarım istasyonları" olarak bilinen API proxy'lerinin sayısı. Maliyet tasarruflarının, geliştirici ekipleri arasında paylaşılan premium aboneliklerin toplu olarak satın alınmasından sağlandığı bildirildi.

Neden muhakeme izleri çalınmaya değer?

Güvenlik kaygısı rekabet avantajının ötesine geçiyor. OpenAI, çıkarılan muhakemenin, orijinal modelin kullanıcıya yönelik çıktılarına uygulanan korumaları korumadan başka bir modeli eğitmek için kullanılabileceğini savunuyor; bu, ölçekteki damıtmanın, güvenliğe karşılık gelen yatırım olmadan gelişmiş yetenekleri aktarabileceği anlamına geliyor. Şirket, modeller çift kullanımlı alanlarda yetenek kazandıkça bu risklerin arttığını söylüyor.

Bağımsız araştırmacılar da aynı alarmı veriyor. 10 Ağustos 2026'da arXiv'e gönderilen bir makalede, Alexander Panfilov, Ilia Shumailov ve Maksym Andriushchenko'nun da aralarında bulunduğu bir grup araştırmacı, önde gelen sağlayıcıların modellerinin mantık izlerini tam olarak gizlemediklerini bildirdi ve ilgili modeller arası ve konuşma sıkıştırma güvenlik açıklarını sorumlu açıklama yoluyla gösterdi. OpenAI, bu bulguları araştırdığını, saldırı yollarının gerçek olduğunu doğruladığını ve bu çalışmayı saldırıların hafifletilmesini hızlandırmak için kullandığını söylüyor.

Sırada ne var

OpenAI, kampanyanın kapsamını ve potansiyel etkisini yayınlamadan önce araştırdığını, kendi önlemlerini uyguladığını ve bulgularını geri bildirim için araştırmacılar ve sektör ortaklarıyla paylaştığını söylüyor. Ek hafifletme ve araştırma çalışmaları devam ediyor ve şirket, çekişmeli damıtma işlemini tek bir olaydan ziyade tüm sınır laboratuvarı ekosistemi için daha geniş bir güvenlik sorunu olarak çerçeveliyor.

Bölüm aynı zamanda devam eden bir politika tartışmasını da keskinleştiriyor. ABD ajansları damıtma kampanyalarını resmi olarak Çin laboratuvarlarına atfediyorsa, API erişimi üzerinde daha sıkı kontroller, daha agresif oran sınırlamaları ve kimlik kontrolleri ve büyük ölçekli suistimallerin gizlenmesini kolaylaştıran toplayıcı ve vekil pazarlar üzerinde devam eden baskıyı bekleyebilirsiniz. Pasifik'in her iki yakasındaki yapay zeka şirketleri için muhakeme katmanı artık tartışmalı bir varlıktır ve onu korumak başlı başına bir güvenlik disiplini haline gelmiştir.

---

Yapay Zekanın Önünde Olun

En son yapay zeka haberlerini, analizlerini ve buluşlarını tek bir yerden alın.

Daha fazla AI haberini okuyun →