أعلنت Google عن Gemini 4 Argon يوم الثلاثاء، وهو أحدث نموذج حدودي لها تم تصميمه للعمل الاحترافي طويل المدى في هندسة البرمجيات ومهام المعرفة المؤسسية والدفاع عن الأمن السيبراني. وقال كوراي كافوكوغلو، النائب الأول لرئيس Google DeepMind ورئيس مهندسي الذكاء الاصطناعي، في مدونة Google الرسمية، إن النموذج يتم طرحه في البداية لمجموعة من المدافعين السيبرانيين الموثوقين من خلال برنامج Fairwind من Google، مع إمكانية وصول أوسع للمتابعة بمجرد تعزيز حواجز الحماية.
يأتي هذا الإعلان خلال واحدة من أكثر فترات العام ازدحامًا بإصدارات الذكاء الاصطناعي الحدودي. للحصول على تغطية مستمرة لعمليات إطلاق النماذج ومعارك السياسات وجولات التمويل، يتتبع موقع AI Buzz Wire التطورات المهمة فور حدوثها.
طرح تدريجي تم تشكيله بحذر
على عكس إطلاق الطراز الرئيسي النموذجي، لا يستطيع معظم المستخدمين تجربة Argon اليوم. قالت Google إنها منخرطة في العملية التطوعية للحكومة الأمريكية للوصول إلى نموذج ما قبل الإصدار وستقوم بتوسيع نطاق التوفر تدريجيًا حيث تشكل التعليقات الواردة من المختبرين الأوائل حواجز الحماية الخاصة بها. ذكرت رويترز أن الرائد يصل بعد أشهر من التأخير، وأشار VentureBeat إلى أن استراتيجية الإصدار المحدود لا تزال تسمح لشركة Google بالمطالبة باستعادة الصدارة المعيارية على OpenAI و Anthropic. وأفادت بلومبرج بوجود شكوك كبيرة حول النموذج الجديد بين موظفي جوجل قبل إطلاقه.
عندما يأتي الوصول على نطاق أوسع، قالت جوجل إنها ستبدأ مع عملاء API المدفوعين ومشتركي Google AI Ultra.
ما يقول Google أن الأرجون يمكنه فعله
التغيير الرئيسي في القدرة هو القدرة على التحمل. تم توسيع الحد الأقصى لرموز إنتاج Argon إلى مليون رمز رائد في الصناعة، مقارنة بـ 64 ألفًا سابقًا. تجادل Google بأن منح النموذج مساحة للتفكير عبر مئات الآلاف من الرموز المميزة في مسار واحد يتيح له حل المشكلات الصعبة في مسار واحد بدلاً من تجزئة العمل عبر الجلسات.
نشرت Google نتائج مرجعية لدعم المطالبة الحدودية:
- DeepSWE v1.1: 77.9% — حالة جديدة من التقدم في معيار هندسة البرمجيات الواقعي
- مؤشر فالس: رقم 1 — أداء رائد في مجالات التمويل والتشفير والأعمال القانونية والضريبية مرجحًا بالمساهمة في الناتج المحلي الإجمالي للولايات المتحدة
- AutomationBench: 51.3% — المركز الأول في معيار تنفيذ الأعمال الشامل من Zapier
- LVBench: 91.7% — أحدث ما توصلت إليه التكنولوجيا في فهم مقاطع الفيديو الطويلة
- CWE-bench v1: 68% — حصل على المركز الأول في معالجة الثغرات الأمنية
داخل سير عمل Google
يعمل أرجون بالفعل على تعزيز العمل الداخلي في شركة جوجل، وقد قدمت الشركة أمثلة ملموسة على نحو غير عادي. في الحوسبة الكمومية، قام النموذج بتحسين موارد الزمكان من أجل الإجراءات الفرعية لعنق الزجاجة، متجاوزًا خط الأساس المنشور بنسبة 40% في دقائق. من خلال تحليل القياس عن بعد لملف التعريف على مستوى الأسطول، حددت فرق من وكلاء Argon تحسينات الذاكرة وطبقتها عبر مراكز بيانات Google والتي حرر ما يزيد عن 300 تيرابايت بمجرد طرحها، مع ما يقدر بـ 500 تيرا بايت إلى 1 بي بايت في إجمالي التوفير.
يقود النموذج أيضًا عمليات ترحيل التعليمات البرمجية على نطاق واسع من C/C++ إلى Rust، ويتوسع من عشرات الآلاف من الأسطر في المكتبات الأساسية مثل re2 وlibgav1 إلى أكثر من 800000 سطر في نواة Fuchsia Zircon. بالنسبة إلى libgav1، وهو برنامج فك ترميز الفيديو مفتوح المصدر من Google، استبدل عملاء Argon 32000 سطر من كود SIMD بـ Rust الآمن الصديق للمترجم، مما أدى إلى إنتاج وحدة فك ترميز آمنة للذاكرة تعمل أسرع 2.7 مرة من منفذ Rust السابق بمخرجات مماثلة.
الدفاع عن الأمن السيبراني يأتي أولاً
تم تدريب Argon بشكل واضح على العمل السيبراني الدفاعي: العثور بشكل مستقل على نقاط الضعف المهمة في البرامج والتحقق من صحتها وتصحيحها. بالنسبة للمدافعين الموثوق بهم والفرق الداخلية في Google، ستقوم الشركة بإصدار النموذج بدون حواجز حماية إلكترونية حتى يحصل المدافعون على القدرة الكاملة. في CWE-bench v1، الذي يقيس معالجة الثغرات الأمنية، احتل Argon المركز الأول بنسبة 68%، بناءً على الأداء الحدودي لـ 3.8 Flash Cyber، وتقول Google إن Argon تفوق على هذا النموذج في اكتشاف سطح الهجوم وتوليد إثبات المفهوم على معيار اختبار اختراق الصندوق الأسود الداخلي لـ Wiz.
وتستخدم شركة الأمن Wiz بالفعل Argon من خلال مبادرة Scan for Good، التي تحمي البنية التحتية العامة الحيوية مجانًا. وفي عرض توضيحي مبكر، قالت جوجل إن النموذج كشف عن ثغرة أمنية حرجة تكشف معلومات شخصية حساسة عبر برامج الرعاية الصحية التي تستخدمها المستشفيات في جميع أنحاء العالم - وهو خطر غاب عن النماذج الحدودية السابقة.
أربع طبقات من ضمانات الحدود
قبل التوفر على نطاق واسع، تعمل Google على تعزيز الضمانات في أربعة مجالات. ضد سوء الاستخدام، تم تصميم Argon لرفض طلبات الهجوم السيبراني والكيميائي والبيولوجي والإشعاعي والنووي مع الحفاظ على الأبحاث المشروعة ذات الاستخدام المزدوج، مع تقنيات جديدة تراقب التنشيط الداخلي للنموذج لاكتشاف إساءة الاستخدام. ضد الحقن الفوري، أدى التدريب على المواجهة إلى جعل نموذج Argon Google الأكثر مرونة حتى الآن، متفوقًا على معيار الحقن الفوري غير المباشر الخاص بـ Gray Swan.
بالنسبة إلى المحاذاة غير الصحيحة، تنشر Google وسائل تخفيف تراقب سلسلة أفكار وإجراءات Argon، وتوقف التنفيذ عند الضرورة، مع توجيه التنبيهات إلى فريق مخصص للاستجابة للحوادث. كما قامت الشركة أيضًا بتقوية بيئات التدريب والتقييم الخاصة بها، وإغلاقها قبل عمليات التشغيل عالية المخاطر. ومن الجدير بالذكر أن جوجل حثت بقية الصناعة على الحفاظ على شفافية الاستدلال بحيث تظل الأفكار النموذجية مفيدة لتشخيص الاختلال.
التسعير والتوافر
سيتم إطلاق Argon بسعر تمهيدي قدره 2 دولار لكل مليون رمز إدخال و10 دولارات لكل مليون رمز مميز للمخرج، مع خصم 95% على سعر الإدخال لرموز الإدخال المخزنة مؤقتًا. بعد الفترة التمهيدية، يرتفع السعر إلى 4 دولارات لكل مليون رمز إدخال و20 دولارًا لكل مليون رمز مخرج - مما يضع Argon بقوة في مواجهة العروض الحدودية المنافسة.
يعكس العرض المسرحي لأول مرة واقعًا جديدًا للإصدارات الحدودية: أصبحت القدرة الآن على المحك، وأداة التمييز تُظهِر السيطرة. تراهن Google على أن المدافعين السيبرانيين، وبرامج المستشفيات، وعمليات ترحيل Rust هي العرض الصحيح - وأن الطرح العام الأبطأ يكلف أقل من حادث سلامة آخر. يجب على المطورين والمؤسسات مراقبة واجهة برمجة التطبيقات المدفوعة ونافذة الوصول إلى AI Ultra، والتي تقول Google إنها ستفتح بمجرد أن يسمح اختبار الدرابزين بذلك.
---
ابقَ في طليعة الذكاء الاصطناعياحصل على آخر الأخبار والتحليلات والإنجازات في مجال الذكاء الاصطناعي — كل ذلك في مكان واحد.
اقرأ المزيد من أخبار الذكاء الاصطناعي →