وضعت Nvidia مسرع الاستدلال التفاعلي Groq 3 LPX في مرحلة الإنتاج الكامل، حسبما أعلنت الشركة في 24 أغسطس 2026، خلال مؤتمر Hot Chips. قدمت الشريحة، وهي امتداد لمنصة Vera Rubin من Nvidia، رقمًا قياسيًا قدره 3400 رمزًا مميزًا للإخراج في الثانية في قياس التحليل الاصطناعي أثناء تشغيل نموذج Gemma 4 31B مفتوح المصدر مع نافذة سياق نشطة تحتوي على 100000 رمز مميز - وهو أسرع أداء تم تسجيله على الإطلاق لهذا النموذج.
يمثل الإطلاق أهم معلم منتج حتى الآن من استحواذ Nvidia على شركة Groq المتخصصة في الاستدلال بقيمة 20 مليار دولار، وهي صفقة تتحرك الشركة الآن للاستفادة منها مع ارتفاع الطلب على الاستدلال منخفض زمن الوصول. ذكرت CNBC أن Nvidia تقول إن رفوف Groq الأولى ستكون متاحة على الإنترنت قبل نهاية العام. لمزيد من السياق حول هذه القصة، راجع [تغطية صناعة الذكاء الاصطناعي] المستمرة لدينا (https://aibuzzwire.news).
ما أهمية سرعة إنشاء الرمز المميز؟
تعمل أنظمة الذكاء الاصطناعي الوكيل - وهي البرامج التي تفكر وتستدعي الأدوات وتكتب وتختبر التعليمات البرمجية، وتتكرر عبر مئات أو آلاف خطوات الاستدلال - على توليد كميات هائلة من رموز الإخراج. وتحدد السرعة التي يتم بها إنتاج هذه الرموز المميزة، والمعروفة بالتفاعلية أو فك التشفير، مدى سرعة قيام الوكيل بإكمال كل خطوة من خطوات عمله.
تقول Nvidia أن Groq 3 LPX يوفر استجابة أسرع 4 مرات للوكلاء وأحمال العمل الحساسة لزمن الوصول مقارنة بأقرب منصة بديلة. في عمليات النشر غير المتجانسة، تتعامل أنظمة Vera Rubin NVL72 مع استيعاب السياق وحساب التعبئة المسبقة، بينما تقوم وحدات Groq 3 LPX بمعالجة مرحلة إنشاء الرمز المميز الحساسة لزمن الاستجابة.
وقال جنسن هوانغ، المؤسس والرئيس التنفيذي لشركة Nvidia، في هذا الإعلان: "الاستدلال هو محرك نمو الذكاء الاصطناعي". "توسّع Vera Rubin تلك الرؤية من خلال تكوينات مصنع الذكاء الاصطناعي المُحسّنة لأعباء العمل والمصممة لعصر الذكاء الاصطناعي الوكيل، مما يؤدي إلى تطوير حدود الأداء باستخدام LPX لتوليد الرموز فائقة السرعة."
داخل الأجهزة
وفقًا للتحليل الفني لـ StorageReview، فإن كل درج حوسبة مبرد بالسوائل مكون من وحدتين يحمل ستة عشر وحدة LPU من نوع Groq 3 جنبًا إلى جنب مع وحدة المعالجة المركزية المضيفة، ومنطق توسيع النسيج، وذاكرة DRAM، بالإضافة إلى إما BlueField-4 DPU أو بطاقة شبكة ConnectX-9. تتميز الدرج بوجود 32 وصلة ضوئية من شريحة إلى شريحة LPU وشبكة إيثرنت بسرعة 400 جيجابت/ثانية على اللوحة الأمامية.
على نطاق الحامل، يتضمن نشر Groq 3 LPX ما يصل إلى 256 مسرعًا LP30 مرتبطًا من خلال وصلات بينية مباشرة عالية السرعة من شريحة إلى شريحة. يتم فتح الرفوف في البنية التحتية الأوسع لمصنع Vera Rubin AI من Nvidia، والتي تصفها الشركة بأنها النظام الأساسي الأكثر شمولاً على الإطلاق: سبع شرائح منفصلة عبر خمسة تكوينات للحامل مصممة لهذا الغرض، بما في ذلك BlueField-4 DPUs، ورفوف Vera CPU، وتخزين Vera BlueField-4 STX، وشبكات Spectrum-6 SPX Ethernet.
قامت Nvidia أيضًا بتحديث مطالباتها المتعلقة بالأداء على مستوى النظام الأساسي، مشيرة إلى أن Vera Rubin NVL72 توفر ما يصل إلى 30 مرة من إنتاجية الرمز المميز لكل ميجاوات مقارنةً بـ GB300 NVL72 على عبء عمل تشفير وكيل يبلغ 140,000 رمزًا مميزًا، مع اتساع الميزة مع ارتفاع أهداف التفاعل لكل مستخدم.
علامة مرجعية بعلامة النجمة
يأتي الرقم الرئيسي البالغ 3400 رمزًا في الثانية مع تحذير جدير بالملاحظة. كما أشارت StorageReview، تم قياس نتيجة Nvidia على نقطة نهاية خاصة للإصدار المسبق في 21 أغسطس، في حين أن الأرقام المنافسة التي تمت مقارنتها بها تأتي من نقاط نهاية الإنتاج المباشر بدون خادم. قد يختلف الأداء الحقيقي للخدمات المتاحة بشكل عام عن التكوين القياسي لإعداد السجلات.
مع ذلك، سجلت منظمة التحليل الاصطناعي المستقلة النتيجة باعتبارها أسرع نتيجة تم قياسها على الإطلاق لـ Gemma 4 31B عند هذا السياق، والادعاء الأساسي - أن السيليكون المصمم لهذا الغرض يمكن أن يسرع بشكل كبير مرحلة فك التشفير للاستدلال - يتماشى مع كيفية إعادة تصميم الصناعة لأعباء العمل الوكيلة.
بدء اعتماد السحابة
تُعد شركة Nebius، وهي سحابة الذكاء الاصطناعي التي يقع مقرها الرئيسي في أمستردام، أول مزود يلتزم بنشر Groq 3 LPX، وتخطط لجلبها إلى Nebius Token Factory، منصة استدلال الإنتاج الخاصة بها.
قالت دانيلا شتان، كبيرة مسؤولي التكنولوجيا في Nebius: "إن الجيل هو مرحلة الاستدلال التي تحدد مدى استجابة نظام الذكاء الاصطناعي فعليًا، وهذا هو بالضبط ما تم تصميم NVIDIA Groq 3 LPX لتسريعه". "باعتبارنا أول سحابة ذكاء اصطناعي يتم إنتاجها عبر Nebius Token Factory، فإننا نتأكد من أن كل خطوة في حلقة الوكيل تبدو فورية - من خلال نفس واجهة برمجة التطبيقات التي يستخدمها المطورون بالفعل، دون الترحيل إلى مكدس جديد."
يخطط مزود الاستدلال Groq، الذي أصبح الآن جزءًا من عائلة Nvidia، ليكون من بين أوائل مستخدمي النظام الأساسي.
الصورة الأكبر
يشير إعلان الإنتاج الكامل إلى مدى تحول سوق البنية التحتية للذكاء الاصطناعي من التدريب إلى الاستدلال. مع قيام الشركات بتحويل ميزانياتها من التدريب الأولي للنموذج الأولي إلى التفكير في الوقت الفعلي وتنسيق الوكيل المستقل، أصبحت اقتصاديات العملة الرمزية - مدى سرعة توليدها وبأي تكلفة للطاقة - أصبحت ساحة المعركة التنافسية المركزية.
بالنسبة لـ Nvidia، تعمل Groq 3 LPX على توسيع نطاق الدفاع عن امتياز مصنع الذكاء الاصطناعي الخاص بها في الوقت الذي يطارد فيه السيليكون المخصص من موفري الخدمات السحابية والشركات الناشئة على حد سواء نفس أعباء عمل الاستدلال الوكيل. الرفوف التي سيتم طرحها عبر الإنترنت هذا العام، كما ذكرت CNBC، ستضع أنظمة الإنتاج الأولى في أيدي العملاء بعد أشهر من إغلاق عملية الاستحواذ - وهو تكامل سريع وفقًا لمعايير صناعة أشباه الموصلات.
ولم تكشف الشركة عن أسعار الأنظمة الجديدة. سيتم تقديم Groq 3 LPX على أساس متى وإذا كان متاحًا من خلال شركاء سحابة الذكاء الاصطناعي، ومن المتوقع أن يكون Nebius أول من يوفر الوصول إلى المطورين من خلال نقاط نهاية API الحالية الخاصة به.
---
ابقَ في طليعة الذكاء الاصطناعياحصل على آخر الأخبار والتحليلات والإنجازات في مجال الذكاء الاصطناعي — كل ذلك في مكان واحد.
اقرأ المزيد من أخبار الذكاء الاصطناعي →