أصدرت Inception Labs Mercury 2.5 يوم الثلاثاء، وهو إصدار جديد من نموذج لغة الانتشار التجاري الذي تصفه الشركة بأنه أكثر برامج النشر قدرة في السوق، وعلى حد علمها، فهو أكبر نموذج لغة نشر تم تدريبه على الإطلاق. وفقًا لإعلان الشركة، يوفر النموذج زيادة بنسبة 40% في الذكاء مقارنةً بسابقه، Mercury 2، مع الاحتفاظ بنفس ملف تعريف الخدمة منخفض التكلفة وزمن الوصول المنخفض الذي جعل بنية الانتشار جذابة لأحمال العمل كبيرة الحجم.
تدعي الشركة، بقيادة الرئيس التنفيذي ستيفانو إرمون، أن Mercury 2.5 يمكن مقارنته بالنماذج الحدودية ذات التكلفة المحسنة بما في ذلك GPT-5.6 Luna (Low)، وGemini 3.5 Flash-Lite، وClaude Haiku 4.5. يتم الإبلاغ عن هذه المقارنات من قبل البائعين ولم يتم التحقق منها بعد من خلال معايير مستقلة، لكنها تضع نموذج الانتشار - الذي كان بمثابة فضول بحثي لفترة طويلة - كبديل إنتاجي لشاغلي الانحدار الذاتي. للحصول على أحدث أخبار نماذج الذكاء الاصطناعي، تابع التغطية المستمرة لنموذج AI Buzz Wire. آخر أخبار نماذج الذكاء الاصطناعي
السرعة والسياق والسعر
الأرقام الرئيسية عدوانية. تقول Inception Labs إن Mercury 2.5 يولد 1,107 رمزًا في الثانية على وحدات معالجة الرسوميات NVIDIA المتاحة على نطاق واسع، مع نافذة سياق تبلغ 260,000 رمزًا. تم تحديد السعر عند 0.20 دولارًا أمريكيًا لكل مليون رمز إدخال و0.75 دولارًا أمريكيًا لكل مليون رمزًا مميزًا للمخرجات، مع خصم ترويجي للإطلاق على النموذج بنسبة 80% إلى 0.04 دولار أمريكي لكل مليون إدخال و0.15 دولار أمريكي لكل مليون مخرج.
من ناحية القدرة، يأتي النموذج مع منطق قابل للضبط - مما يسمح للمطورين باستبدال زمن الوصول للعمق على أساس كل طلب - إلى جانب استدعاءات الأدوات المتوازية ومخرجات JSON المحاذية للمخطط من أجل إنشاء منظم. تضع الشركة الإصدار على أنه النتيجة الأولى لحلقة تدريب مدفوعة بقياس الإنتاج عن بعد: منذ إطلاق Mercury 2، قام الآلاف من المطورين بتصميمه باستخدامه، ونشرته عشرات المؤسسات، وزاد الاستخدام بأكثر من ترتيب من حيث الحجم.
لماذا تولد نماذج الانتشار النص بشكل أسرع
إن برامج LLM السائدة من OpenAI وGoogle وAnthropic هي انحدار ذاتي: فهي تولد رمزًا نصيًا واحدًا في كل مرة، مع شرط كل رمز مميز لكل شيء تم إنشاؤه قبله. تضع هذه التبعية التسلسلية أرضية صلبة أمام سرعة التوليد. بدلاً من ذلك، تبدأ نماذج لغة الانتشار بكتلة من الضوضاء وتقوم بتحسين جميع الرموز المميزة بشكل متكرر بالتوازي، مما يسمح بإنتاجية أعلى بكثير على أجهزة GPU التقليدية بمجرد تدريب النموذج على التقارب بشكل نظيف.
تاريخياً، كانت المقايضة هي الجودة: فقد تأخرت نماذج الانتشار عن نماذج الانحدار الذاتي فيما يتعلق بالاستدلال ومعايير اتباع التعليمات. الرهان الأساسي لشركة Inception Labs - والادعاء الكامن وراء Mercury 2.5 - هو أن هذه الفجوة قد ضاقت إلى النقطة التي يفوز فيها الانتشار على المحور الذي يشعر به معظم العملاء فعليًا: الكمون والتكلفة في حجم الإنتاج.
مطالبات الإنتاج من العملاء الأوائل
يعتمد الإعلان بشكل كبير على عمليات نشر العملاء بدلاً من الجداول القياسية. ذكرت شركة OpenCall، التي تبني وكلاء هاتف مدعمين بالذكاء الاصطناعي لإجراء مكالمات مباشرة للعملاء، أن الانتقال إلى Mercury أدى إلى رفع متوسط زمن الاستجابة للنموذج إلى حوالي 170 مللي ثانية. قال أوليفر سيلفرشتاين، المؤسس المشارك والرئيس التنفيذي لشركة OpenCall، إن زمن استجابة الشركة P99 انخفض من عدة دقائق إلى ثانية واحدة، ومتوسطه من 0.4 ثانية إلى أقل من 0.2 - وهي أرقام وصفها بأنها أسرع بكثير من أي مزود آخر اختبرته الشركة، بما في ذلك مع تمكين الاستدلال.
يستخدم Augment Code، وهو صانع مساعد ترميز يعمل بالذكاء الاصطناعي، Mercury لضغط السياق وتوجيه النماذج والبحث عن أدوات MCP. وفقًا لـ Inception Labs، أدى نقل أحمال عمل الضغط إلى Mercury إلى تقليل زمن الوصول لتلك الخطوة بنسبة 82%، من 150 ثانية تقريبًا إلى 27 ثانية، وخفض تكلفتها بنسبة 90% مع الحفاظ على الجودة. توضح حالة الاستخدام مدى تأثير الاقتصاد: حيث يقوم وكلاء التشفير بإجراء العديد من استدعاءات النماذج الداعمة الصغيرة حول كل جيل أساسي، ومركب زمن الوصول والتكلفة عبر تلك الاستدعاءات.
NVIDIA، التي تدير أجهزتها النموذج، شاركت أيضًا. قال شروتي كوباركار، مدير أول للمنتج في مجموعة الحوسبة المتسارعة في NVIDIA، إن Inception لديها نماذج لغة متقدمة قائمة على الانتشار على البنية التحتية لـ NVIDIA AI، وأن زيادة جودة Mercury 2.5 بسرعات مستدامة توضح مدى سرعة نضج البنى الجديدة إلى أنظمة جاهزة للإنتاج.
معاينات Mercury Voice وMercury Router
وإلى جانب النموذج، أعلنت شركة Inception Labs عن معاينات لاثنين من المنتجات الجديدة. Mercury Voice هو برنامج LLM للنشر تم تحسينه لوكلاء الصوت الذين لديهم ميزانيات زمن استجابة محدودة، ووقت الإعلان عن أول رمز مميز أقل من 170 مللي ثانية. يستخدم Mercury Router نموذج نشر لفهم المطالبات الواردة وتوجيهها إلى أي نموذج - مفتوح أو مغلق - يقدم أفضل مزيج من الجودة والسرعة والتكلفة، مما يضع Inception كطبقة فوق منافسيها بالإضافة إلى واحدة منهم.
يتوفر Mercury 2.5 من خلال واجهة برمجة التطبيقات الخاصة بشركة Inception وكذلك من خلال Baseten وOpenRouter. تضيف عمليات النشر المؤسسية سعة مخصصة وقياسًا تلقائيًا وعناصر تحكم في الامتثال والاحتفاظ بالبيانات القابلة للتكوين. تقدم الشركة 100 مليون رمز مجاني للمطورين الذين يحاولون واجهة برمجة التطبيقات.
وقالت الشركة أيضًا إنها بدأت بالفعل في تدريب نموذجها التالي - وهو الأكبر على الإطلاق، والمستهدف للإصدار في الأشهر المقبلة - والذي تصفه بأنه قفزة في القدرة لا تتخلى عن سرعة النشر أو كفاءة الرمز. إذا صح هذا الادعاء، فإن الضغوط المفروضة على الشركات القائمة ذات الانحدار الذاتي سوف تظهر أولاً في مستويات السلع الأساسية في السوق، حيث يحدد السعر وزمن الوصول معظم العقود.
ابق في صدارة الذكاء الاصطناعي
تابع أحدث تطورات الذكاء الاصطناعي وأخبار الذكاء الاصطناعي العاجلة مع تسارع تصميمات النماذج الجديدة إلى الإنتاج.
اقرأ المزيد من أخبار الذكاء الاصطناعي →