OpenAI پاداش کشف «جیل‌بریک جهانی» در مدل‌های هوش مصنوعی خود را به 50000 دلار افزایش داده است، که بیش از دو برابر جایزه قبلی است و نشان می‌دهد که این شرکت کلاس‌های خاصی از دور زدن ایمنی را به‌قدری جدی می‌بیند که پرداخت حق بیمه را تضمین کند.

برنامه به روز شده Bio Bug Bounty که توسط OpenAI در 9 ژوئیه 2026 اعلام شد، از محققان امنیتی می‌خواهد تا اعلان‌هایی را بیابند که می‌تواند به طور جهانی از نرده‌های محافظ ایمنی مدل عبور کند - دور زدن‌هایی که در چندین مکالمه و زمینه‌ها به جای موارد لبه جدا شده کار می‌کنند. این برنامه به طور خاص جیلبریک های مربوط به تهدیدات بیولوژیکی را هدف قرار می دهد، جایی که یک مدل هوش مصنوعی می تواند برای ارائه راهنمایی های عملی برای ایجاد پاتوژن ها یا سلاح های خطرناک مجبور شود.

برای اخبار جدید هوش مصنوعی و تجزیه و تحلیل عمیق، به [AI Buzz Wire] (https://aibuzzwire.news) مراجعه کنید.

چرا 50000 دلار؟

این جایزه افزایش یافته نشان دهنده نگرانی فزاینده در مورد شکاف بین آنچه به مدل های هوش مصنوعی مرزی گفته می شود انجام ندهند و آنچه کاربران مصمم می توانند واقعاً از آنها استخراج کنند را نشان می دهد. یک جیلبریک جهانی به ویژه خطرناک است، زیرا برخلاف ترفند تزریق سریع یکباره، نشان دهنده یک ضعف سیستماتیک است که می تواند تکرار شود و به اشتراک گذاشته شود.

TechRepublic در 10 ژوئیه گزارش داد که افزایش پاداش در بحبوحه بررسی دقیق قوی‌ترین مدل‌های OpenAI صورت می‌گیرد. به گزارش ملیت فناوری نیوز، دولت ترامپ قبلاً از OpenAI خواسته بود که انتشار جدیدترین مدل دارای قابلیت سایبری خود را به گروهی از کاربران بررسی شده محدود کند که نشان دهنده نگرانی دولت در مورد پتانسیل تهاجمی سیستم های هوش مصنوعی مرزی است.

آژانس بریتانیا قابلیت‌های سایبری هوش مصنوعی را در حال شتاب می‌بیند

اعلام جایزه مصادف با هشدار جدی موسسه امنیت هوش مصنوعی بریتانیا (AISI) است که به طور مستقل توانایی‌های سایبری مدل‌های مرزی را از سال 2024 ارزیابی می‌کند.

در ارزیابی آوریل 2026 از GPT-5.5 OpenAI، AISI دریافت که این مدل به 71.4% نرخ عبور در وظایف امنیت سایبری در سطح خبره دست یافته است - بالاترین میزان در بین هر مدل آزمایش شده، که از Anthropic's Claude Mythos Preview با 68.6%، GPT-5.4% و Opus 4.4% پیشی گرفته است.

یکی از معیارها به ویژه قابل توجه بود. AISI یک چالش مهندسی معکوس ماشین مجازی سفارشی طراحی کرد - یک کار چند مرحله ای که به مهاجم نیاز دارد تا یک رمزگشای دستورالعمل سفارشی بسازد، یک احراز هویت مهندسی معکوس کند و یک رمز عبور معتبر بازیابی کند. آزمایشگر انسانی متخصص Crystal Peak Security با استفاده از ابزارهای حرفه ای این چالش را در حدود 12 ساعت حل کرد. GPT-5.5 آن را در 10 دقیقه و 22 ثانیه با هزینه 1.73 دلار در استفاده از API و بدون کمک انسانی حل کرد.

هر چند ماه دوبرابر می شود

در تحلیل جداگانه‌ای که در ماه مه ۲۰۲۶ منتشر شد، AISI دریافت که طول وظایف سایبری که مدل‌های هوش مصنوعی مرزی می‌توانند به طور مستقل انجام شوند، از اواخر سال ۲۰۲۴ هر ۴.۷ ماه دو برابر شده است – شتابی نسبت به تخمین ۸ ماهه آن در نوامبر ۲۰۲۵.

AISI نوشت: «نرخ تغییرات فعلی نشان‌دهنده پتانسیل روبه‌رشد قابلیت‌های سایبری هوش مصنوعی برای تبدیل به ریسک‌های ملموس است – خطراتی که سازمان‌های بریتانیایی در ماه‌های آینده باید به آن‌ها بپردازند».

Claude Mythos Preview و GPT-5.5 هر دو به طور قابل ملاحظه ای از روند دو برابری قبلی فراتر رفتند و این سوال را مطرح کردند که آیا این سرعت حتی سریعتر می شود یا خیر.

جیلبریک های جهانی: بالاترین ریسک ها

تمایز بین جیلبریک باریک و جهانی بسیار مهم است. یک جیلبریک باریک ممکن است یک مدل را فریب دهد تا در شرایط خاص یک پاسخ غیر مجاز ایجاد کند. در مقابل، یک جیلبریک جهانی یک شکاف اساسی در معماری ایمنی مدل را نشان می‌دهد - روشی که به طور قابل اعتمادی نرده‌های محافظ را در طیف وسیعی از ورودی‌ها دور می‌زند.

تصمیم OpenAI برای ارائه 50000 دلار برای چنین اکتشافاتی نشان می دهد که این شرکت بر این باور است که جیلبریک های جهانی هم به اندازه کافی نادر هستند که یک جایزه بزرگ را توجیه کنند و هم به اندازه کافی خطرناک هستند که سرمایه گذاری را تضمین کنند. اگر یک جیلبریک جهانی برای جستارهای مربوط به تهدید زیستی توسط یک بازیگر مخرب قبل از وصله کشف شود، عواقب آن می تواند شدید باشد.

این برنامه همچنین عملکرد شفافیت را ارائه می دهد. با دعوت از محققان خارجی برای بررسی مدل‌های خود، OpenAI می‌تواند آسیب‌پذیری‌ها را قبل از بهره‌برداری در طبیعت شناسایی و برطرف کند - مشروط بر اینکه این جایزه به اندازه کافی بزرگ باشد تا استعدادهای مورد نیاز را جذب کند.

مسابقه بین حمله و دفاع

پیشرفت‌های موازی - افزایش پاداش OpenAI و ارزیابی‌های قابلیت AISI - تنش مرکزی در ایمنی هوش مصنوعی امروزی را نشان می‌دهد. مدل‌ها در کارهای سایبری به طرز چشمگیری توانمندتر می‌شوند، با افق زمانی وظایف که می‌توانند هر چند ماه یکبار دوبرابر شوند. در همان زمان، شرکت‌ها برای رفع آسیب‌پذیری‌هایی که مدل‌هایشان را خطرناک می‌کند، رقابت می‌کنند.

این که آیا بونت ها و تیم قرمز می توانند با منحنی قابلیت شتاب همگام شوند، یک سوال باز باقی می ماند. اما رقم 50000 دلار سیگنال واضحی را ارسال می کند: OpenAI معتقد است این تهدید به اندازه ای جدی است که بتواند به هر کسی که بتواند وجود شکاف ها را ثابت کند، دلار بالایی را پرداخت کند.

از هوش مصنوعی جلوتر بمانید

همانطور که مدل های مرزی قدرتمندتر می شوند، نبرد بین نرده های محافظ ایمنی و کسانی که سعی در شکستن آنها دارند تشدید می شود. آخرین پیشرفت‌ها را در [AI Buzz Wire] (https://aibuzzwire.news) دنبال کنید.

[پوشش صنعت AI] (https://aibuzzwire.news) را در AI Buzz Wire بخوانید.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →