ओपनएआई ने 30 सितंबर, 2026 को एक सुरक्षा पोस्ट प्रकाशित की जिसमें बताया गया कि कैसे उसने अपने मॉडलों से संरक्षित तर्क निकालने के लिए एक समन्वित अभियान की पहचान की और उसे बाधित किया - और गतिविधि के एक मुख्य समूह को किमी मॉडल परिवार के पीछे की चीनी प्रयोगशाला मूनशॉट एआई से जुड़े व्यक्तियों को जिम्मेदार ठहराया।

यह खुलासा उद्योग के लिए एक संवेदनशील क्षण में आता है, जहां एक फ्रंटियर मॉडल का मूल्य न केवल इसके उत्तरों में बल्कि इसके कारणों में भी निहित है। नवीनतम एआई विकास पर नज़र रखने वाले पाठकों के लिए, यह मामला असामान्य रूप से विस्तृत रूप प्रदान करता है कि कैसे मॉडल आईपी पर बड़े पैमाने पर हमला किया जाता है - और प्रयोगशालाएं कैसे प्रतिक्रिया दे रही हैं।

यहाँ "प्रतिकूल आसवन" का क्या अर्थ है

ओपनएआई गतिविधि को प्रतिकूल आसवन के अनुरूप बताता है, जिसे यह एक मॉडल के आउटपुट के व्यवस्थित और अनधिकृत उपयोग के रूप में परिभाषित करता है या दूसरे मॉडल को प्रशिक्षित करने, पुन: पेश करने या सुधारने में मदद करता है। "संरक्षित तर्क" किसी कार्य के माध्यम से काम करने के लिए मॉडल का आंतरिक रिकॉर्ड है - वह जानकारी जो आम तौर पर उपयोगकर्ता द्वारा देखे जाने वाले अंतिम उत्तर से रोक दी जाती है। कंपनी का तर्क है कि इसे निकालने से दूसरों को उन क्षमताओं को पुन: उत्पन्न करने में मदद मिल सकती है जो उन्होंने नहीं बनाई हैं।

महत्वपूर्ण बात यह है कि ओपनएआई का कहना है कि ऑपरेटरों ने इसके एन्क्रिप्शन को नहीं तोड़ा, डेटाबेस से समझौता नहीं किया, या संग्रहीत उपयोगकर्ता वार्तालापों तक सीधी पहुंच हासिल नहीं की। इसके बजाय, उन्होंने मॉडल इंटरैक्शन में हेरफेर किया ताकि संरक्षित तर्क को अनुरोधकर्ता को दिखाई देने वाले रूपों में पुन: प्रस्तुत किया जा सके - पारंपरिक हैक के बजाय उत्पाद का एक समन्वित, उच्च मात्रा में दुरुपयोग।

OpenAI द्वारा प्रलेखित एक तकनीक में एक वार्तालाप से एन्क्रिप्टेड तर्क अंशों की प्रतिलिपि बनाना और फिर एक अलग वार्तालाप में एक मॉडल से छिपे हुए तर्क सामग्री को डिक्रिप्ट और ट्रांसक्रिप्ट करने के लिए कहना शामिल था। कंपनी ने इस बात पर जोर दिया कि हेरफेर उसके अपने मॉडलों के लिए अद्वितीय भेद्यता नहीं है, और कहा कि उसने सामूहिक सुरक्षा को मजबूत करने के लिए फ्रंटियर मॉडल फोरम के माध्यम से उद्योग भागीदारों के साथ विवरण साझा किया है।

समयरेखा: दो दिनों में 16,000 अनुरोध

पोस्ट के अनुसार, अभियान 1 जुलाई, 2026 को अपेक्षाकृत कम मात्रा में शुरू हुआ। यह 24 और 25 जुलाई को तेजी से बढ़ गया, जब ओपनएआई ने प्रासंगिक निष्कर्षण पैटर्न का उपयोग करते हुए 4,000 से अधिक उपयोगकर्ताओं से आने वाले 16,000 अनुरोधों की उच्च मात्रा में वृद्धि देखी। पोस्ट में एक फ़ुटनोट चेतावनी देता है कि ये आंकड़े निष्कर्षण के प्रयास का वर्णन करते हैं - जरूरी नहीं कि सफल हों।

आगे की जांच में 15,000 से अधिक उपयोगकर्ताओं के समूह में संबंधित प्रॉम्प्ट-पैटर्न गतिविधि का पता चला। ओपनएआई का कहना है कि उसने 28 जुलाई, 2026 तक अभियान को पूरी तरह से बाधित कर दिया और गतिविधि समय के साथ विकसित होती रही, जिससे उसके विचार को बल मिला कि प्रतिकूल आसवन के लिए एक बार के समाधान के बजाय स्तरित, अनुकूली सुरक्षा की आवश्यकता होती है।

एट्रिब्यूशन मूनशॉट एआई की ओर इशारा करता है

OpenAI अपने एट्रिब्यूशन को लेकर सावधान है। इसमें कहा गया है कि यह स्पष्ट नहीं है कि इस अवधि के दौरान देखे गए सभी ऑपरेटर एक ही अभिनेता से आए थे, लेकिन यह किमी के डेवलपर मूनशॉट एआई से जुड़े व्यक्तियों को गतिविधि का एक मुख्य समूह बताता है।

दावा शून्य में नहीं आता. 8 सितंबर, 2026 को, राष्ट्रीय सुरक्षा एजेंसी, साइबर सुरक्षा और बुनियादी ढांचा सुरक्षा एजेंसी और एफबीआई ने एक संयुक्त साइबर सुरक्षा सलाह जारी की जिसमें कहा गया कि मूनशॉट एआई ने कम से कम 2025 के मध्य से अमेरिकी सीमांत एआई कंपनियों के खिलाफ व्यापक आसवन अभियान चलाया है। एडवाइजरी के अनुसार, मूनशॉट ने अपने किमी-के3 मॉडल को प्रशिक्षित करने के लिए महत्वपूर्ण क्लाउड फैबल 5 डेटा और किमी-के2 को प्रशिक्षित करने के लिए जीपीटी-4ओ डेटा निकाला, जिसमें पर्यवेक्षित फाइन-ट्यूनिंग, सुदृढीकरण सीखने, सॉफ्टवेयर इंजीनियरिंग और गणित में क्षमताओं को बढ़ाने के लिए अमेरिकी मॉडल का उपयोग किया गया।

एडवाइजरी आगे कहती है कि - संभवतः चीनी सरकार की जागरूकता के साथ - डीपसीक, मूनशॉट एआई, अलीबाबा, मिनीमैक्स, स्टेपफन और जेड.एआई ने सामूहिक रूप से कम से कम 2024 के अंत से क्लाउड, जीपीटी, जेमिनी और ग्रोक के वेरिएंट सहित अमेरिकी फ्रंटियर मॉडल से लाखों एक्सचेंजों में अरबों टोकन निकाले हैं। एजेंसियां ​​नेटिव एपीआई, रिमोट क्लाउड प्रोवाइडर्स और थर्ड-पार्टी एग्रीगेटर्स की लॉजिस्टिक्स पाइपलाइन के साथ-साथ एपीआई के एक ग्रे मार्केट का वर्णन करती हैं। "ट्रांसफर स्टेशन" के रूप में जाने जाने वाले प्रॉक्सी का उपयोग भौगोलिक प्रतिबंधों और सेवा की शर्तों को बायपास करने के लिए किया जाता है। लागत बचत कथित तौर पर डेवलपर टीमों के बीच साझा की गई प्रीमियम सदस्यता की थोक खरीद से हुई।

तर्क के निशान चोरी करने लायक क्यों हैं

सुरक्षा संबंधी चिंता प्रतिस्पर्धात्मक लाभ से परे है। ओपनएआई का तर्क है कि निकाले गए तर्क का उपयोग मूल मॉडल के उपयोगकर्ता-सामना वाले आउटपुट पर लागू सुरक्षा उपायों को संरक्षित किए बिना किसी अन्य मॉडल को प्रशिक्षित करने के लिए किया जा सकता है - जिसका अर्थ है कि बड़े पैमाने पर आसवन सुरक्षा में संबंधित निवेश के बिना उन्नत क्षमताओं को स्थानांतरित कर सकता है। कंपनी का कहना है कि जैसे-जैसे मॉडल दोहरे उपयोग वाले डोमेन में क्षमता हासिल करते हैं, ये जोखिम बढ़ते हैं।

स्वतंत्र शोधकर्ता भी यही चेतावनी दे रहे हैं। 10 अगस्त, 2026 को arXiv को सौंपे गए एक पेपर में, अलेक्जेंडर पैन्फिलोव, इलिया शुमैलोव और मैक्सिम एंड्रीशचेंको सहित शोधकर्ताओं के एक समूह ने बताया कि अग्रणी प्रदाता अपने मॉडल के तर्क के निशान को पूरी तरह से नहीं छिपाते हैं, और जिम्मेदार प्रकटीकरण के माध्यम से संबंधित क्रॉस-मॉडल और वार्तालाप-संघनन कमजोरियों का प्रदर्शन करते हैं। ओपनएआई का कहना है कि उसने उन निष्कर्षों की जांच की, पुष्टि की कि हमले के रास्ते वास्तविक थे, और इसके शमन में तेजी लाने के लिए काम का इस्तेमाल किया।

आगे क्या होगा

ओपनएआई का कहना है कि उसने प्रकाशन से पहले अभियान के दायरे और संभावित प्रभाव की जांच की, अपने स्वयं के शमन उपायों को तैनात किया, और प्रतिक्रिया के लिए शोधकर्ताओं और उद्योग भागीदारों के साथ अपने निष्कर्षों को साझा किया। अतिरिक्त शमन और जांच कार्य जारी है, और कंपनी प्रतिकूल आसवन को एक घटना के बजाय पूरे फ्रंटियर-लैब पारिस्थितिकी तंत्र के लिए एक व्यापक सुरक्षा चुनौती के रूप में पेश करती है।

यह प्रकरण चल रही नीतिगत बहस को भी तेज करता है। यदि अमेरिकी एजेंसियां ​​औपचारिक रूप से आसवन अभियानों के लिए चीनी प्रयोगशालाओं को जिम्मेदार ठहरा रही हैं, तो एपीआई पहुंच पर सख्त नियंत्रण, अधिक आक्रामक दर-सीमित और पहचान जांच की उम्मीद है, और एग्रीगेटर और प्रॉक्सी बाजारों पर निरंतर दबाव है जो बड़े पैमाने पर दुरुपयोग को छिपाना आसान बनाता है। प्रशांत महासागर के दोनों किनारों पर एआई कंपनियों के लिए, तर्क परत अब एक विवादित संपत्ति है - और इसकी सुरक्षा करना अपने आप में एक सुरक्षा अनुशासन बन गया है।

---

एआई से आगे रहें

नवीनतम एआई समाचार, विश्लेषण और सफलताएँ प्राप्त करें - सभी एक ही स्थान पर।

अधिक AI समाचार पढ़ें →