قامت OpenAI برفع المكافأة مقابل اكتشاف "عمليات الهروب من السجن العالمية" في نماذج الذكاء الاصطناعي الخاصة بها إلى 50 ألف دولار، أي أكثر من ضعف المكافأة السابقة، مما يشير إلى أن الشركة تنظر إلى فئات معينة من تجاوزات الأمان على أنها خطيرة بما يكفي لتبرير دفع تعويضات متميزة.

يطلب برنامج Bio Bug Bounty المحدث، الذي أعلنت عنه OpenAI في 9 يوليو 2026، من الباحثين الأمنيين العثور على مطالبات يمكنها اختراق حواجز حماية السلامة الخاصة بالنموذج عالميًا - وهي تجاوزات تعمل عبر محادثات وسياقات متعددة بدلاً من حالات الحافة المعزولة. يستهدف البرنامج على وجه التحديد عمليات كسر الحماية المتعلقة بالتهديدات البيولوجية، حيث يمكن إجبار نموذج الذكاء الاصطناعي على تقديم إرشادات قابلة للتنفيذ بشأن إنشاء مسببات الأمراض أو الأسلحة الخطيرة.

لمزيد من الأخبار العاجلة والتحليلات المتعمقة حول الذكاء الاصطناعي، تفضل بزيارة AI Buzz Wire.

لماذا 50.000 دولار؟

تعكس المكافأة المتزايدة القلق المتزايد بشأن الفجوة بين ما يُطلب من نماذج الذكاء الاصطناعي الحدودية ألا تفعله وما يمكن للمستخدمين المصممين استخلاصه منها فعليًا. يعد كسر الحماية الشامل أمرًا خطيرًا بشكل خاص، لأنه، على عكس خدعة الحقن الفوري لمرة واحدة، يمثل نقطة ضعف منهجية يمكن تكرارها ومشاركتها.

ذكرت TechRepublic يوم 10 يوليو أن زيادة المكافأة تأتي وسط تدقيق متزايد لأقوى نماذج OpenAI. طلبت إدارة ترامب سابقًا من OpenAI قصر إصدار أحدث نموذج لها ذو قدرة إلكترونية على مجموعة مختارة بعناية من المستخدمين الذين تم فحصهم، وفقًا لأخبار التكنولوجيا الوطنية، مما يعكس قلق الحكومة بشأن الإمكانات الهجومية لأنظمة الذكاء الاصطناعي الحدودية.

وكالة المملكة المتحدة تجد تسارعًا في القدرات السيبرانية للذكاء الاصطناعي

ويتزامن إعلان المكافأة مع تحذير صارخ من معهد أمن الذكاء الاصطناعي (AISI) في المملكة المتحدة، والذي يقوم بشكل مستقل بتقييم القدرات السيبرانية للنماذج الحدودية منذ عام 2024.

في تقييم أبريل 2026 لـ OpenAI's GPT-5.5، وجد AISI أن النموذج حقق معدل نجاح قدره 71.4% في مهام الأمن السيبراني على مستوى الخبراء - وهي أعلى نسبة من أي نموذج تم اختباره، متجاوزًا Anthropic's Claude Mythos Preview بنسبة 68.6%، وGPT-5.4 بنسبة 52.4%، وOpus 4.7 بنسبة 48.6%.

وكان أحد المعايير ملفتا للنظر بشكل خاص. صممت AISI تحديًا مخصصًا للهندسة العكسية للآلة الافتراضية - وهي مهمة متعددة الخطوات تتطلب من المهاجم إنشاء وحدة فك ترميز تعليمات مخصصة، وإجراء هندسة عكسية للمصادق، واستعادة كلمة مرور صالحة. نجح أحد خبراء اختبار اللعب البشري لدى Crystal Peak Security في حل التحدي خلال 12 ساعة تقريبًا باستخدام أدوات احترافية. قام GPT-5.5 بحل المشكلة في 10 دقائق و22 ثانية بتكلفة 1.73 دولارًا أمريكيًا في استخدام واجهة برمجة التطبيقات (API)، دون أي مساعدة بشرية.

مضاعفة كل بضعة أشهر

وفي تحليل منفصل نُشر في مايو 2026، وجد AISI أن طول المهام السيبرانية التي يمكن لنماذج الذكاء الاصطناعي الحدودي إكمالها بشكل مستقل يتضاعف كل 4.7 شهرًا منذ أواخر عام 2024 - وهو تسارع من تقديراته في نوفمبر 2025 البالغة 8 أشهر.

وكتبت AISI: "يشير معدل التغيير الحالي إلى إمكانات متزايدة لترجمة القدرات السيبرانية للذكاء الاصطناعي إلى مخاطر ملموسة - وهي مخاطر ستحتاج المؤسسات البريطانية إلى التعامل معها في الأشهر المقبلة".

لقد تجاوز كل من Claude Mythos Preview وGPT-5.5 بشكل كبير الاتجاه المضاعفة السابق، مما يثير التساؤل حول ما إذا كانت الوتيرة تزداد سرعة.

عمليات الهروب من السجن العالمية: أعلى المخاطر

يعد التمييز بين كسر الحماية الضيق والكسر الشامل أمرًا بالغ الأهمية. قد يؤدي كسر الحماية الضيق إلى خداع النموذج لإنتاج استجابة واحدة غير مسموح بها في ظل ظروف محددة. على النقيض من ذلك، يمثل كسر الحماية الشامل صدعًا أساسيًا في بنية السلامة الخاصة بالنموذج - وهي طريقة تتحايل بشكل موثوق على حواجز الحماية عبر نطاق واسع من المدخلات.

يشير قرار OpenAI بتقديم 50 ألف دولار لمثل هذه الاكتشافات إلى أن الشركة تعتقد أن عمليات الهروب من السجن العالمية نادرة بما يكفي لتبرير مكافأة كبيرة وخطيرة بما يكفي لتبرير الاستثمار. إذا تم اكتشاف كسر حماية عالمي للاستفسارات المتعلقة بالتهديد البيولوجي من قبل جهة فاعلة ضارة قبل تصحيحه، فقد تكون العواقب وخيمة.

يخدم البرنامج أيضًا وظيفة الشفافية. ومن خلال دعوة باحثين خارجيين لاستكشاف نماذجها، تستطيع شركة OpenAI تحديد نقاط الضعف وإصلاحها قبل استغلالها على أرض الواقع - بشرط أن تكون المكافأة كبيرة بما يكفي لجذب مستوى المواهب المطلوبة.

##سباق بين الهجوم والدفاع

توضح التطورات الموازية - زيادة مكافآت OpenAI وتقييمات قدرة AISI - التوتر المركزي في سلامة الذكاء الاصطناعي اليوم. أصبحت النماذج أكثر قدرة بشكل كبير على تنفيذ المهام السيبرانية، مع تضاعف الأفق الزمني للمهام التي يمكنها إكمالها كل بضعة أشهر. وفي الوقت نفسه، تتسابق الشركات لتصحيح نقاط الضعف التي تجعل نماذجها خطيرة.

ما إذا كانت المكافآت والفرق الحمراء قادرة على مواكبة منحنى القدرة المتسارع يظل سؤالًا مفتوحًا. لكن رقم الـ 50 ألف دولار يرسل إشارة واضحة: تعتقد شركة OpenAI أن التهديد خطير بما يكفي لدفع مبلغ كبير لأي شخص يمكنه إثبات وجود الشقوق.

ابق في صدارة الذكاء الاصطناعي

ومع تزايد قوة النماذج الحدودية، فإن المعركة بين حواجز السلامة وأولئك الذين يحاولون كسرها سوف تشتد. تابع آخر التطورات على AI Buzz Wire.

اقرأ المزيد تغطية صناعة الذكاء الاصطناعي على AI Buzz Wire.