تم وضع معيار جديد لما تعنيه كلمة "مفتوح" في الذكاء الاصطناعي يوم الخميس. أصدر معهد النماذج الأساسية (IFM)، وهو معهد للذكاء الاصطناعي مقره أبو ظبي، K2 Horizon، وهو أسطول متصل من ستة نماذج لغات تأتي مع كل شيء بدءًا من الأوزان النهائية وحتى بيانات التدريب ونقاط التفتيش الوسيطة وكود التدريب والسجلات الدقيقة - وهي حزمة وصفتها رويترز بأنها نماذج مفتوحة المصدر بالكامل تم إصدارها مع بيانات التدريب والتعليمات البرمجية الخاصة بها.
لا تزال معظم الإصدارات ذات الوزن المفتوح تتوقف عند الأوزان، مما يترك الغرباء يخمنون كيفية بناء النماذج فعليًا. تتخذ K2 Horizon النهج المعاكس، ويعد وصولها لحظة مهمة لأي شخص يتتبع [نماذج الذكاء الاصطناعي ذات الوزن المفتوح] (https://aibuzzwire.news) عبر الصناعة.
ستة نماذج، من الساعة إلى المؤسسة
يضم الأسطول ستة أحجام: 375B-A23B، و36B-A4B، و32B، و7B، و3.7B، و0.9B. وفقًا لإعلان IFM، تم تصميم النماذج كنظام واحد متصل بدلاً من ستة إصدارات غير مرتبطة.
يستهدف الطراز الأصغر البيئات المقيدة بشدة مثل الساعات والنظارات، بينما يتم وضع الطرازين 3.7B و7B للهواتف والتطبيقات الأخرى الموجودة على الجهاز. يستهدف الطراز 32B الكثيف والطراز 36B-A4B المتناثر محطات العمل المحلية والخدمة الفعالة، ويحمل الطراز 375B-A23B الرائد أقوى قدرات الأسطول في عمليات النشر المؤسسية الصعبة. تأتي جميع الطرز الستة مزودة بدعم التكميم.
تشترك النماذج في البنية الأساسية والمفردات ومنهجية التدريب والواجهات والبنية التحتية للتقييم وأدوات النشر، حيث يستخدم نموذج 0.9B مفردات أصغر. تقول IFM أن الاتساق يجعل من السهل التنقل بين الأحجام، وتوجيه العمل ديناميكيًا عبر الأسطول، ودراسة كيفية قياس القدرات.
ما يغطيه "المفتوح بالكامل" بالفعل
هذا هو المكان الذي تبتعد فيه K2 Horizon عن معايير الصناعة. بالنسبة لكل طراز في الأسطول، تقول IFM إنها تفتح دورة حياة التدريب بدءًا من التدريب المسبق وحتى التفكير المنطقي وما بعد التدريب.
يتضمن الإصدار نقاط فحص وسيطة، وبيانات تدريب أو وصفات تفصيلية لبناء البيانات، ووثائق البنية المفتوحة، وتركيبات الخليط، وكود التدريب، والتكوينات، وسجلات التدريب الدقيقة، ونتائج التقييم، والأوزان النهائية. يتم إصدار النماذج والتعليمات البرمجية بموجب ترخيص Apache 2.0، وهو أحد أكثر التراخيص المسموح بها في الاستخدام التجاري. يتم إصدار مجموعات البيانات بموجب تراخيصها المعمول بها، مثل ODC-BY، وتلتزم IFM بالكشف عن كيفية إنشاء البيانات وخلطها في الحالات التي لا تكون فيها إعادة التوزيع ممكنة.
تقوم IFM أيضًا بتأطير الإصدار باعتباره أول عائلة نموذجية مفتوحة تعرض عملية التطوير الكاملة من خلال التدريب اللاحق للوكيل. ومن الناحية العملية، يعني هذا أن الباحثين يمكنهم دراسة كيفية ظهور التفكير، واستخدام الأدوات، والتخطيط، والسلوكيات الفاعلية أثناء التدريب، وإعادة إنتاج الأساليب، وتكييفها مع الأدوات والمجالات الجديدة، وهو عمل يكون مستحيلًا عادةً عند نشر الأوزان النهائية فقط.
مطالبات الأداء
تقول IFM أن النماذج الأصغر للأسطول حققت نتائج جديدة على أحدث طراز وفقًا لمقاييسها الخاصة. يقال إن نماذج 0.9B و3.7B و7B تقود فئات الحجم الخاصة بها عبر الرياضيات والاستدلال والقدرات العامة والترميز والمهام الوكيلة.
بعض التفاصيل الواردة في الإعلان: سجل K2 Horizon 0.9B أعلى من 48 في AIME 2026، وهو معيار رياضيات المنافسة الذي يظل وحشيًا بالنسبة للنماذج الصغيرة. تم تسليط الضوء على الطرازين 3.7B و7B للحصول على نتائج SWE-bench وBrowseComp القوية، مع الإشارة إلى هندسة البرمجيات وإمكانية التصفح متعدد الخطوات غير المعتادة بالنسبة لحجمها. يقدم نموذج 36B-A4B آلية جديدة لمزيج قيمة الاهتمام (MoVA)، والتي تنسب إليها IFM الفضل في القدرة التي تتجاوز ما قد يقترحه عدد المعلمات النشطة. تم وصف الطرازين 32B و375B-A23B على أنهما من بين أفضل النماذج في فئتيهما.
كما هو الحال مع أي تقييم منشور في المختبر، يتم الإبلاغ عن هذه الأرقام ذاتيًا وسيستغرق التحقق المستقل وقتًا. ولكن إذا استمرت الأرقام، فإن مستويات الأسطول المبتدئة والمتوسطة الحجم يمكن أن تعيد تشكيل ما يتوقعه المطورون من النماذج التي تعمل على الأجهزة الاستهلاكية.
لماذا تستمر أبوظبي في الظهور في الذكاء الاصطناعي المفتوح
ويعزز هذا الإصدار البصمة المتنامية لدولة الإمارات العربية المتحدة في مجال تطوير النماذج المفتوحة. إن النظام البيئي للذكاء الاصطناعي في أبو ظبي - الذي ترتكز عليه مؤسسات بما في ذلك MBZUAI، التي أطلقت نظام الاستدلال K2 Think مع G42 في عام 2025 - قد وضع باستمرار النشر المفتوح باعتباره تمييزًا استراتيجيًا، وهو النمط الذي رصدته رويترز في تغطيتها لإصدار يوم الخميس.
ويهبط التوقيت أيضًا في سوق متغير للنماذج المفتوحة. أكدت اتفاقية Nvidia للاستحواذ على Hugging Face مقابل 12.9 مليار دولار تقريبًا، والتي تم الإعلان عنها هذا الأسبوع، على مقدار القيمة التجارية المتراكمة حول منصات توزيع النماذج المفتوحة. وفي الوقت نفسه، اصطفت شركات Hyperscalers لترخيص نماذج الوزن المفتوح من المختبرات الصينية، ونشرت شركات الذكاء الاصطناعي الغربية رسالة تحذر من فرض قيود سابقة لأوانها على الأوزان المفتوحة.
وفي ظل هذه الخلفية، فإن الأسطول المتاخم للحدود والذي ينشر كامل خط التدريب الخاص به يمنح الباحثين والشركات الناشئة والحكومات بديلاً للاعتماد على واجهات برمجة التطبيقات المغلقة من حفنة من مقدمي الخدمات الأمريكيين.
ما يجب مشاهدته بعد ذلك
هناك ثلاثة أسئلة ستحدد ما إذا كانت K2 Horizon مهمة خارج نطاق العناوين الرئيسية. فأولا، هل يمكن إعادة إنتاج النتائج المرجعية بواسطة مقيمين مستقلين، وخاصة بالنسبة للنماذج الصغيرة حيث تكون المطالبات أكثر وضوحا؟ ثانيًا، ما مدى سماحية تراخيص مجموعة البيانات في الممارسة العملية، نظرًا لأن IFM تعترف بأنه لا يمكن إعادة توزيع بعض بيانات التدريب ويتم توثيقها عن طريق الوصفة بدلاً من ذلك؟ ثالثًا، هل ستنشر المؤسسات فعليًا نموذجًا متناثرًا 375B خارج السحابة الرئيسية، أم أن التأثير العملي سيتركز في الطبقة 7B وما دونها التي تعمل على الهواتف وأجهزة الكمبيوتر المحمولة؟
التأثير الفوري الأكثر ترجيحًا هو على شفافية البحث. من خلال نقاط التفتيش والسجلات ووصفات البيانات العامة، تقدم K2 Horizon للميدان مثالًا عمليًا كاملاً لكيفية بناء عائلة نموذجية قادرة على التفكير الحديث والوكيل - وهو شيء لم يسبق للمجتمع أن حصل عليه على هذا النطاق.
ابق في صدارة كل التطورات الرئيسية في مجال الذكاء الاصطناعي
إصدارات النماذج تأتي بشكل أسرع كل شهر. مواكبة كل عملية إطلاق ومعيار قبل أن يهم.
---
ابقَ في طليعة الذكاء الاصطناعياحصل على آخر الأخبار والتحليلات والإنجازات في مجال الذكاء الاصطناعي — كل ذلك في مكان واحد.
اقرأ المزيد من أخبار الذكاء الاصطناعي →