OpenAI یک پست امنیتی در 30 سپتامبر 2026 منتشر کرد که در آن توضیح داد چگونه یک کمپین هماهنگ برای استخراج استدلال محافظت شده از مدلهای خود را شناسایی و مختل کرد - و یک خوشه اصلی از فعالیت را به افراد مرتبط با Moonshot AI، آزمایشگاه چینی پشت خانواده مدلهای Kimi نسبت داد.
این افشا در لحظه ای حساس برای صنعت قرار می گیرد، جایی که ارزش یک مدل مرزی به طور فزاینده ای نه تنها در پاسخ های آن بلکه در نحوه استدلال آن نهفته است. برای خوانندگانی که آخرین پیشرفتهای هوش مصنوعی را ردیابی میکنند، این پرونده نگاهی غیرمعمول به جزئیات نحوه حمله به IP مدل در مقیاس و نحوه پاسخ آزمایشگاهها ارائه میدهد.
«تقطیر مخالف» در اینجا به چه معناست
OpenAI این فعالیت را مطابق با تقطیر خصمانه توصیف می کند، که آن را به عنوان استفاده سیستماتیک و غیرمجاز از خروجی ها یا استدلال یک مدل برای کمک به آموزش، بازتولید یا بهبود مدل دیگر تعریف می کند. "استدلال محافظت شده" رکورد داخلی مدل برای انجام یک کار است - اطلاعاتی که معمولاً از پاسخ نهایی که کاربر می بیند پنهان می شود. این شرکت استدلال میکند که استخراج آن میتواند به دیگران کمک کند تا تواناییهایی را که ایجاد نکردهاند بازتولید کنند.
نکته مهم، OpenAI میگوید که اپراتورها رمزگذاری آن را شکستهاند، پایگاه داده را به خطر نینداختهاند، یا به مکالمات ذخیره شده کاربر دسترسی مستقیم پیدا نکردهاند. در عوض، آنها تعاملات مدل را به گونهای دستکاری کردند که استدلال محافظت شده میتواند در اشکال قابل مشاهده برای درخواستکننده بازتولید شود - سوء استفاده هماهنگ و با حجم بالا از خود محصول به جای هک سنتی.
یکی از تکنیکهای ثبت شده OpenAI شامل کپی کردن ردپای استدلال رمزگذاریشده از یک مکالمه و سپس درخواست از یک مدل در یک مکالمه جداگانه برای رمزگشایی و رونویسی محتوای استدلال پنهان است. این شرکت تاکید کرد که این دستکاری یک آسیب پذیری منحصر به فرد برای مدل های خود نیست و گفت که جزئیات را از طریق فروم Frontier Model با شرکای صنعتی به اشتراک گذاشته است تا دفاع جمعی را تقویت کند.
جدول زمانی: 16000 درخواست در دو روز
طبق این پست، این کمپین از اول ژوئیه 2026 با حجم نسبتا کم آغاز شد. در 24 و 25 ژوئیه، زمانی که OpenAI با استفاده از الگوی استخراج مربوطه، افزایش حجم بالای 16000 درخواست را مشاهده کرد، که از بیش از 4000 کاربر ارسال شده بود، به شدت افزایش یافت. پاورقی در پست هشدار می دهد که این ارقام تلاش برای استخراج را توصیف می کنند - نه لزوماً موارد موفقیت آمیز.
تحقیقات بیشتر فعالیتهای الگوی سریع مرتبط را در میان خوشهای متشکل از بیش از 15000 کاربر نشان داد. OpenAI میگوید تا 28 ژوئیه 2026 به طور کامل این کمپین را مختل کرد و این فعالیت در طول زمان به تکامل خود ادامه داد و این دیدگاه خود را تقویت کرد که تقطیر متخاصم به جای اصلاح یکباره نیاز به دفاع لایهای و تطبیقی دارد.
انتساب به هوش مصنوعی Moonshot
OpenAI مراقب انتساب خود است. این سازمان میگوید مشخص نیست که آیا همه اپراتورهای مشاهدهشده در طول دوره از یک بازیگر منفرد آمدهاند یا خیر، اما اینکه یک خوشه اصلی از فعالیت را به افراد مرتبط با Moonshot AI، توسعهدهنده Kimi نسبت میدهد.
ادعا در خلاء نمی رسد. در 8 سپتامبر 2026، آژانس امنیت ملی، آژانس امنیت سایبری و امنیت زیرساخت، و FBI یک مشاوره امنیت سایبری مشترک منتشر کردند که در آن بیان شد که Moonshot AI کمپین تقطیر گسترده ای را علیه شرکت های هوش مصنوعی مرزی ایالات متحده حداقل از اواسط سال 2025 انجام داده است. بر اساس این مشاوره، مون شات داده های کلود فابل 5 قابل توجهی را برای آموزش مدل Kimi-K3 و داده های GPT-4o برای آموزش Kimi-K2 با استفاده از مدل های ایالات متحده برای تقطیر قابلیت های تنظیم دقیق نظارت شده، یادگیری تقویتی، مهندسی نرم افزار و ریاضیات استخراج کرد.
این توصیه فراتر می رود و بیان می کند که – احتمالاً با آگاهی دولت چین – DeepSeek، Moonshot AI، Alibaba، MiniMax، StepFun و Z.AI مجموعاً میلیاردها توکن را در میلیون ها صرافی از مدل های مرزی ایالات متحده، از جمله انواع Claude، GPT، Gemini، و Grok استخراج کرده اند که حداقل از یک خط لوله 2024. APIهای بومی، ارائهدهندگان ابر از راه دور، و تجمیعکنندههای شخص ثالث، بهعلاوه بازار خاکستری پراکسیهای API معروف به «ایستگاههای انتقال» که برای دور زدن محدودیتهای جغرافیایی و شرایط خدمات استفاده میشوند. طبق گزارشها، صرفهجویی در هزینه از خرید انبوه اشتراکهای ممتاز که در بین تیمهای توسعهدهنده به اشتراک گذاشته شده بود، حاصل شد.
چرا ردپای استدلال ارزش دزدیدن دارد
نگرانی امنیتی فراتر از مزیت رقابتی است. OpenAI استدلال میکند که استدلال استخراجشده میتواند برای آموزش مدل دیگری بدون حفظ حفاظتهای اعمال شده بر خروجیهای رو به روی کاربر مدل اصلی استفاده شود - به این معنی که تقطیر در مقیاس میتواند قابلیتهای پیشرفته را بدون سرمایهگذاری مربوطه در ایمنی منتقل کند. این شرکت میگوید این ریسکها با افزایش تواناییهای مدلها در حوزههای استفاده دوگانه افزایش مییابد.
محققان مستقل نیز همین زنگ خطر را به صدا در آورده اند. در مقالهای که در 10 آگوست 2026 به arXiv ارسال شد، گروهی از محققان از جمله الکساندر پانفیلوف، ایلیا شومیلف و ماکسیم آندریوشچنکو گزارش دادند که ارائهدهندگان پیشرو ردپای استدلال مدلهای خود را کاملاً پنهان نمیکنند و آسیبپذیریهای مربوط به مدلهای متقابل و فشردهسازی مکالمه را از طریق افشای مسئولانه نشان دادند. OpenAI میگوید این یافتهها را بررسی کرده، مسیرهای حمله واقعی را تأیید کرده و از این کار برای تسریع در کاهش آن استفاده کرده است.
بعدی چه می شود
OpenAI می گوید که دامنه و تأثیر بالقوه کمپین را قبل از انتشار بررسی کرده است، اقدامات کاهشی خود را به کار گرفته و یافته های خود را برای بازخورد با محققان و شرکای صنعتی به اشتراک گذاشته است. کار کاهش و تحقیقات بیشتر ادامه دارد و این شرکت تقطیر متخاصم را بهعنوان یک چالش امنیتی گستردهتر برای کل اکوسیستم آزمایشگاه مرزی بهجای یک حادثه واحد در نظر میگیرد.
این اپیزود همچنین یک بحث سیاسی جاری را تشدید می کند. اگر آژانسهای ایالات متحده به طور رسمی کمپینهای تقطیر را به آزمایشگاههای چینی نسبت میدهند، انتظار میرود کنترلهای سختتر روی دسترسی به API، محدود کردن نرخ و بررسی هویت تهاجمیتر، و فشار مداوم بر بازارهای تجمیعکننده و پروکسی که مخفی کردن سوءاستفاده در مقیاس بزرگ را آسانتر میکند. برای شرکت های هوش مصنوعی در هر دو سوی اقیانوس آرام، لایه استدلال اکنون یک دارایی مورد مناقشه است - و حفاظت از آن به یک رشته امنیتی برای خودش تبدیل شده است.
---
از هوش مصنوعی جلوتر بمانیدآخرین اخبار، تحلیل ها و پیشرفت های هوش مصنوعی را دریافت کنید - همه در یک مکان.
بیشتر بخوانید اخبار هوش مصنوعی →