OpenAI یک پست امنیتی در 30 سپتامبر 2026 منتشر کرد که در آن توضیح داد چگونه یک کمپین هماهنگ برای استخراج استدلال محافظت شده از مدل‌های خود را شناسایی و مختل کرد - و یک خوشه اصلی از فعالیت را به افراد مرتبط با Moonshot AI، آزمایشگاه چینی پشت خانواده مدل‌های Kimi نسبت داد.

این افشا در لحظه ای حساس برای صنعت قرار می گیرد، جایی که ارزش یک مدل مرزی به طور فزاینده ای نه تنها در پاسخ های آن بلکه در نحوه استدلال آن نهفته است. برای خوانندگانی که آخرین پیشرفت‌های هوش مصنوعی را ردیابی می‌کنند، این پرونده نگاهی غیرمعمول به جزئیات نحوه حمله به IP مدل در مقیاس و نحوه پاسخ آزمایشگاه‌ها ارائه می‌دهد.

«تقطیر مخالف» در اینجا به چه معناست

OpenAI این فعالیت را مطابق با تقطیر خصمانه توصیف می کند، که آن را به عنوان استفاده سیستماتیک و غیرمجاز از خروجی ها یا استدلال یک مدل برای کمک به آموزش، بازتولید یا بهبود مدل دیگر تعریف می کند. "استدلال محافظت شده" رکورد داخلی مدل برای انجام یک کار است - اطلاعاتی که معمولاً از پاسخ نهایی که کاربر می بیند پنهان می شود. این شرکت استدلال می‌کند که استخراج آن می‌تواند به دیگران کمک کند تا توانایی‌هایی را که ایجاد نکرده‌اند بازتولید کنند.

نکته مهم، OpenAI می‌گوید که اپراتورها رمزگذاری آن را شکسته‌اند، پایگاه داده را به خطر نینداخته‌اند، یا به مکالمات ذخیره شده کاربر دسترسی مستقیم پیدا نکرده‌اند. در عوض، آنها تعاملات مدل را به گونه‌ای دستکاری کردند که استدلال محافظت شده می‌تواند در اشکال قابل مشاهده برای درخواست‌کننده بازتولید شود - سوء استفاده هماهنگ و با حجم بالا از خود محصول به جای هک سنتی.

یکی از تکنیک‌های ثبت شده OpenAI شامل کپی کردن ردپای استدلال رمزگذاری‌شده از یک مکالمه و سپس درخواست از یک مدل در یک مکالمه جداگانه برای رمزگشایی و رونویسی محتوای استدلال پنهان است. این شرکت تاکید کرد که این دستکاری یک آسیب پذیری منحصر به فرد برای مدل های خود نیست و گفت که جزئیات را از طریق فروم Frontier Model با شرکای صنعتی به اشتراک گذاشته است تا دفاع جمعی را تقویت کند.

جدول زمانی: 16000 درخواست در دو روز

طبق این پست، این کمپین از اول ژوئیه 2026 با حجم نسبتا کم آغاز شد. در 24 و 25 ژوئیه، زمانی که OpenAI با استفاده از الگوی استخراج مربوطه، افزایش حجم بالای 16000 درخواست را مشاهده کرد، که از بیش از 4000 کاربر ارسال شده بود، به شدت افزایش یافت. پاورقی در پست هشدار می دهد که این ارقام تلاش برای استخراج را توصیف می کنند - نه لزوماً موارد موفقیت آمیز.

تحقیقات بیشتر فعالیت‌های الگوی سریع مرتبط را در میان خوشه‌ای متشکل از بیش از 15000 کاربر نشان داد. OpenAI می‌گوید تا 28 ژوئیه 2026 به طور کامل این کمپین را مختل کرد و این فعالیت در طول زمان به تکامل خود ادامه داد و این دیدگاه خود را تقویت کرد که تقطیر متخاصم به جای اصلاح یک‌باره نیاز به دفاع لایه‌ای و تطبیقی ​​دارد.

انتساب به هوش مصنوعی Moonshot

OpenAI مراقب انتساب خود است. این سازمان می‌گوید مشخص نیست که آیا همه اپراتورهای مشاهده‌شده در طول دوره از یک بازیگر منفرد آمده‌اند یا خیر، اما اینکه یک خوشه اصلی از فعالیت را به افراد مرتبط با Moonshot AI، توسعه‌دهنده Kimi نسبت می‌دهد.

ادعا در خلاء نمی رسد. در 8 سپتامبر 2026، آژانس امنیت ملی، آژانس امنیت سایبری و امنیت زیرساخت، و FBI یک مشاوره امنیت سایبری مشترک منتشر کردند که در آن بیان شد که Moonshot AI کمپین تقطیر گسترده ای را علیه شرکت های هوش مصنوعی مرزی ایالات متحده حداقل از اواسط سال 2025 انجام داده است. بر اساس این مشاوره، مون شات داده های کلود فابل 5 قابل توجهی را برای آموزش مدل Kimi-K3 و ​​داده های GPT-4o برای آموزش Kimi-K2 با استفاده از مدل های ایالات متحده برای تقطیر قابلیت های تنظیم دقیق نظارت شده، یادگیری تقویتی، مهندسی نرم افزار و ریاضیات استخراج کرد.

این توصیه فراتر می رود و بیان می کند که – احتمالاً با آگاهی دولت چین – DeepSeek، Moonshot AI، Alibaba، MiniMax، StepFun و Z.AI مجموعاً میلیاردها توکن را در میلیون ها صرافی از مدل های مرزی ایالات متحده، از جمله انواع Claude، GPT، Gemini، و Grok استخراج کرده اند که حداقل از یک خط لوله 2024. APIهای بومی، ارائه‌دهندگان ابر از راه دور، و تجمیع‌کننده‌های شخص ثالث، به‌علاوه بازار خاکستری پراکسی‌های API معروف به «ایستگاه‌های انتقال» که برای دور زدن محدودیت‌های جغرافیایی و شرایط خدمات استفاده می‌شوند. طبق گزارش‌ها، صرفه‌جویی در هزینه از خرید انبوه اشتراک‌های ممتاز که در بین تیم‌های توسعه‌دهنده به اشتراک گذاشته شده بود، حاصل شد.

چرا ردپای استدلال ارزش دزدیدن دارد

نگرانی امنیتی فراتر از مزیت رقابتی است. OpenAI استدلال می‌کند که استدلال استخراج‌شده می‌تواند برای آموزش مدل دیگری بدون حفظ حفاظت‌های اعمال شده بر خروجی‌های رو به روی کاربر مدل اصلی استفاده شود - به این معنی که تقطیر در مقیاس می‌تواند قابلیت‌های پیشرفته را بدون سرمایه‌گذاری مربوطه در ایمنی منتقل کند. این شرکت می‌گوید این ریسک‌ها با افزایش توانایی‌های مدل‌ها در حوزه‌های استفاده دوگانه افزایش می‌یابد.

محققان مستقل نیز همین زنگ خطر را به صدا در آورده اند. در مقاله‌ای که در 10 آگوست 2026 به arXiv ارسال شد، گروهی از محققان از جمله الکساندر پانفیلوف، ایلیا شومیلف و ماکسیم آندریوشچنکو گزارش دادند که ارائه‌دهندگان پیشرو ردپای استدلال مدل‌های خود را کاملاً پنهان نمی‌کنند و آسیب‌پذیری‌های مربوط به مدل‌های متقابل و فشرده‌سازی مکالمه را از طریق افشای مسئولانه نشان دادند. OpenAI می‌گوید این یافته‌ها را بررسی کرده، مسیرهای حمله واقعی را تأیید کرده و از این کار برای تسریع در کاهش آن استفاده کرده است.

بعدی چه می شود

OpenAI می گوید که دامنه و تأثیر بالقوه کمپین را قبل از انتشار بررسی کرده است، اقدامات کاهشی خود را به کار گرفته و یافته های خود را برای بازخورد با محققان و شرکای صنعتی به اشتراک گذاشته است. کار کاهش و تحقیقات بیشتر ادامه دارد و این شرکت تقطیر متخاصم را به‌عنوان یک چالش امنیتی گسترده‌تر برای کل اکوسیستم آزمایشگاه مرزی به‌جای یک حادثه واحد در نظر می‌گیرد.

این اپیزود همچنین یک بحث سیاسی جاری را تشدید می کند. اگر آژانس‌های ایالات متحده به طور رسمی کمپین‌های تقطیر را به آزمایشگاه‌های چینی نسبت می‌دهند، انتظار می‌رود کنترل‌های سخت‌تر روی دسترسی به API، محدود کردن نرخ و بررسی هویت تهاجمی‌تر، و فشار مداوم بر بازارهای تجمیع‌کننده و پروکسی که مخفی کردن سوءاستفاده در مقیاس بزرگ را آسان‌تر می‌کند. برای شرکت های هوش مصنوعی در هر دو سوی اقیانوس آرام، لایه استدلال اکنون یک دارایی مورد مناقشه است - و حفاظت از آن به یک رشته امنیتی برای خودش تبدیل شده است.

---

از هوش مصنوعی جلوتر بمانید

آخرین اخبار، تحلیل ها و پیشرفت های هوش مصنوعی را دریافت کنید - همه در یک مکان.

بیشتر بخوانید اخبار هوش مصنوعی →