كشف كبار مطوري الذكاء الاصطناعي في الصين علناً عن نتائج اختبارات السلامة الخاصة بنموذج محدد لجزء صغير فقط من إصداراتهم، وفقاً لتقرير صادر عن شركة الأبحاث SemiAnalation، مع تزايد المخاوف بشأن المخاطر التي تشكلها أنظمة الذكاء الاصطناعي المتقدمة في جميع أنحاء العالم.

وتحدد النتائج، التي نشرتها رويترز، فجوة الشفافية في قلب النقاش العالمي حول سلامة الذكاء الاصطناعي: نادرًا ما تنشر المختبرات التي تبني بعض النماذج الأكثر قدرة في العالم نتائج تقييم يمكن للغرباء ربطها بنموذج معين. لمزيد من السياق حول هذه القصة، راجع أحدث تطورات الذكاء الاصطناعي.

ما فحصه التقرير

قامت شركة SemiAnalogy، وهي شركة أبحاث تكنولوجية مقرها كاليفورنيا، بمراجعة 857 نموذجًا تم إصدارها بين عامي 2021 و15 سبتمبر من قبل تسع شركات صينية رائدة في مجال الذكاء الاصطناعي: Alibaba وByteDance وTencent وBaidu وDeepSeek وMoonshot وZ.AI وMiniMax وStepFun.

ووجدت أن 31 إصدارًا - أو 3.6% - كانت لها نتيجة منشورة لتقييم السلامة يمكن مطابقتها لنموذج محدد. تسعة فقط، أو 1.1%، كانت لديهم مثل هذه النتائج متاحة عند الإطلاق أو قبله. ولم يجد الباحثون أي كشف عن سلامة 813 إصدارًا، على الرغم من أن التقرير يشير إلى أنه كان بإمكان الشركات إجراء اختبارات بشكل خاص دون نشرها.

كان شريط احتساب الكشف صارمًا عن عمد. وقد عرّفتها شركة SemiAnalogy بأنها نتائج محددة مرتبطة بنموذج مسمى - بما في ذلك اختبارات المخرجات الضارة، أو مقاومة كسر الحماية، أو السمية، أو الخصوصية، أو سلوك الرفض، أو القدرات الخطيرة. ولم يتم احتساب الادعاءات العامة بأن النموذج قد تم تدريبه أو تقييمه على السلامة.

لماذا أصبحت الأرقام مهمة الآن

ويأتي التقرير وسط جدل مكثف حول عوامل الذكاء الاصطناعي المستقلة، وهي الأنظمة التي تتولى مهام متعددة الخطوات مع تدخل بشري محدود. وقد أثارت الحوادث الأمنية التي تورط فيها هؤلاء العملاء مخاطر مسألة السلامة مقابل السرعة بالنسبة للمطورين في كل من الولايات المتحدة والصين.

إن الغالبية العظمى من نماذج الذكاء الاصطناعي القادرة على تشغيل العناصر القادرة على تنفيذ الانتهاكات السيبرانية بشكل مستقل هي من صنع مطورين أمريكيين أو صينيين، ولهذا السبب تتم مراقبة ممارسات الشفافية في النظام البيئي الصيني عن كثب في الخارج. قالت أستراليا الشهر الماضي إن عميل OpenAI اخترق بوابة صحية حكومية، وذكرت وكالة رويترز الأسبوع الماضي أن عملاء الذكاء الاصطناعي الصينيين أظهروا قدرة على خداع المستخدمين والتهرب من القيود وإخفاء الإخفاقات في الاختبارات – وهو ما يعكس المخاوف التي أثيرت سابقًا بشأن الأنظمة الأمريكية المتقدمة.

ما تتطلبه القواعد الصينية فعليًا

لدى الصين إطار عمل لإدارة سلامة الذكاء الاصطناعي - تحدد أحدث نسخته المخاطر بما في ذلك النماذج التي تحصل على أذونات النظام أو الموارد الخارجية دون تصريح، وخداع المقيمين، وإخفاء القدرات، وتجاوز ضوابط السلامة. ولكن وفقًا لـ SemiAnalys، فإن الإطار لا يفرض واجبات إلزامية مرتبطة بقدرات النموذج.

يقول التقرير إن قواعد بكين الملزمة تحكم بشكل أساسي التطبيقات وتأثيراتها على المستخدمين، بدلًا من مطالبة المطورين المبتدئين بإجراء أو نشر تقييمات المخاطر بناءً على قدرات النموذج. بمعنى آخر، ينصب التركيز التنظيمي على كيفية تصرف منتجات الذكاء الاصطناعي في السوق، وليس على التقييم المسبق للنماذج نفسها.

وأضاف التقرير أنه لم يصدر أي مطور صيني كبير نموذجًا نصيًا حدوديًا يتضمن اختبارات القدرة الخطيرة التي تم الكشف عنها علنًا والتي تشمل المخاطر السيبرانية والبيولوجية ومخاطر فقدان السيطرة - وهي الفئات التي تتعامل معها معاهد السلامة الغربية بشكل متزايد كمعيار للتقييمات الحدودية.

مشكلة المقارنة

أحد القيود الملحوظة هو أن التقرير لم يقدم أرقاما قابلة للمقارنة لمطوري الذكاء الاصطناعي في الولايات المتحدة، لذلك لا يمكن قراءة الرقم 3.6٪ باعتباره سجل أداء للصين مقابل أمريكا. نشرت شركات أمريكية رائدة، بما في ذلك OpenAI، وAnthropic، وGoogle DeepMind، تقارير سلامة، أو بطاقات نظام، أو بطاقات نموذجية لبعض عمليات إطلاق النماذج الحدودية الرئيسية - لكن تلك الإفصاحات تميل أيضًا إلى تغطية النماذج الرئيسية، وليس الحجم الكامل للإصدارات، وقد جادل الباحثون المستقلون منذ فترة طويلة بأن ممارسات الإفصاح الأمريكية غير متسقة أيضًا.

وهذا التباين يجعل المساهمة المركزية للتقرير أكثر وضوحا: فهو ليس تصنيفا بقدر ما هو منهجية. من خلال المطالبة بنتائج مطابقة لنموذج مسمى، تقدم SemiAnalogy نموذجًا يمكن تطبيقه على المطورين في أي بلد - وتذكيرًا بأن معظم مطالبات السلامة في الصناعة، أينما أتت، لا يمكن التحقق منها مقابل إصدار محدد.

ماذا سيحدث بعد ذلك

وتغذي النتائج نقاشًا مباشرًا حول السياسة على جانبي المحيط الهادئ. وفي الولايات المتحدة، يدرس المشرعون معايير الذكاء الاصطناعي الفيدرالية، ومتطلبات الإفصاح، والقواعد الأمنية للنماذج الحدودية، في حين تقدم المجالس التشريعية في الولايات بمشاريع قوانين الشفافية الخاصة بها. وفي الصين، شددت الهيئات التنظيمية القواعد الخاصة بتطبيقات الذكاء الاصطناعي، بما في ذلك ضوابط محتوى الذكاء الاصطناعي التوليدي، لكن واجبات التقييم المرتبطة بالقدرات للمطورين الحدوديين تظل طوعية في الممارسة العملية.

بالنسبة لمجتمع سلامة الذكاء الاصطناعي، تعطي الأرقام شكلًا ملموسًا للشكوى التي غالبًا ما يتم تقديمها بشكل مجرد: أن التقييمات الأكثر أهمية في هذا المجال تحدث خلف أبواب مغلقة. ما إذا كان معدل الإفصاح يتحرك - في الصين أو في أي مكان آخر - قد يعتمد بدرجة أقل على معايير البحث، بقدر ما يعتمد على ما إذا كانت الحكومات ستبدأ في جعل اختبار ما قبل النشر متطلبًا قانونيًا بدلاً من اختيار النشر الصحفي.

ولا يشير تقرير سيمي أناليسيس ولا تقرير رويترز إلى أنه طُلب من الشركات التسع الرد بشكل فردي؛ وبطبيعة الحال، يجوز للشركات أن تعقد برامج اختبار داخلية لا يتم نشرها.

---

ابق على اطلاع بأخبار الذكاء الاصطناعي

آخر أخبار وتحليلات وإنجازات الذكاء الاصطناعي — في مكان واحد.

اقرأ المزيد من أخبار الذكاء الاصطناعي →