شاركت Cerebras Systems وOpenAI نظرة مبكرة على وضع Ultrafast، وهو مستوى خدمة جديد تم إطلاقه لأول مرة في OpenAI API ويتم تشغيله بواسطة تقنية Cerebras على نطاق الرقاقة. تمكن هذه الشراكة GPT-5.6 Sol من العمل بما يصل إلى 750 رمزًا مميزًا للإخراج في الثانية، مما يوفر ذكاءً على المستوى الحدودي بسرعات في الوقت الفعلي. للحصول على أحدث أخبار أجهزة الذكاء الاصطناعي، تفضل بزيارة AI Buzz Wire.
القضاء على مقايضة السرعة والذكاء
لقد واجه مطورو الذكاء الاصطناعي منذ فترة طويلة مقايضة أساسية: مع زيادة حجم النماذج وذكائها، فإنها تتكبد تكاليف حسابية أعلى وتكاليف نقل البيانات، مما يؤدي إلى إبطاء أوقات الاستجابة. واضطر المطورون إلى الاختيار بين انتظار نتائج عالية الجودة أو قبول نتائج أقل جودة في وقت أقل.
تم تصميم GPT-5.6 Sol في وضع Ultrafast لحل هذه المعضلة. وفقًا لـ Cerebras، تعمل الخدمة بشكل أسرع 11 مرة من Anthropic's Claude Fable 5 و5 مرات أسرع من Opus 4.8 في الوضع السريع، استنادًا إلى سرعات الإخراج التي أبلغ عنها التحليل الاصطناعي.
الاختبار الأخير للإنسانية: اختبار السرعة
قامت شركة Cerebras باختبار السرعة الفائقة مقابل النماذج المنافسة في الاختبار الأخير للإنسانية (HLE)، وهو اختبار صعب يتكون من 2500 سؤال لا يمكن الإجابة عليها عادةً إلا من قبل أولئك الذين يحملون درجة الدكتوراه في مجالات مثل الكيمياء والاقتصاد والأدب.
في التقييمات التي أجرتها Cerebras، أجاب GPT-5.6 Sol في الوضع فائق السرعة على جميع أسئلة HLE البالغ عددها 2500 سؤال في 11 ساعة و11 دقيقة. تطلبت لعبة Claude Fable 5 78 ساعة و27 دقيقة، أي أكثر من ثلاثة أيام من الحساب المتواصل، للوصول إلى نفس الاستنتاجات. بمعنى آخر، عالجت تقنية Ultrafast حدود المعرفة البشرية في يوم عمل واحد، وحققت دقة قابلة للمقارنة أسرع بنحو سبع مرات.
تم إجراء القياس بواسطة Cerebras باستخدام GPT-5.6 Sol Ultrafast مع Codex على إعدادات الاستدلال العالي في 10 يوليو، وClaude Fable 5 مع Claude Code على إعدادات الاستدلال العالي في الفترة من 13 إلى 15 يوليو.
تأثير الأعمال في العالم الحقيقي
وفقًا لـGDP-Val، وهو معيار لمهام العمل المعرفي ذات القيمة الاقتصادية، قدمت Ultrafast سرعة شاملة تبلغ 5.6x دون أي تدهور في الجودة. يوضح هذا كيف يمكن للاستدلال الأسرع أن يسرع العمل ذي القيمة الاقتصادية دون التضحية بجودة المخرجات.
تتصور شركة Cerebras أن تقنية Ultrafast هي أداة للسيناريوهات التي تكون فيها كل ثانية مهمة. يمكن للشركات التي تقوم بتشغيل خدمات الويب استخدام التكنولوجيا لمعالجة الأسباب الجذرية لانقطاع الإنتاج ومعالجته بسرعة أكبر، والحفاظ على ثقة العملاء ومنع فقدان الإيرادات. في مواقف الأمن السيبراني عالية المخاطر، يمكن لفرق الأمن الاستفادة من تقنية Ultrafast للكشف عن الهجمات والرد عليها بسرعة.
التكنولوجيا وراء السرعة
تنبع ميزة الأداء من بنية محرك Wafer-Scale Engine من Cerebras، والتي تم تصميمها خصيصًا لأحمال عمل الذكاء الاصطناعي الحدودية. التحدي الأساسي للاستدلال الحدودي السريع هو مشكلة حركة البيانات: في وحدات معالجة الرسوميات التقليدية، يعوق الاستدلال على النماذج الكبيرة عرض النطاق الترددي للذاكرة، حيث يجب نقل أوزان النماذج بشكل متكرر بين الذاكرة الموجودة على الرقاقة والتخزين خارج الرقاقة لإنشاء رموز مميزة متتالية.
يأخذ Cerebras نهجا مختلفا جذريا. تحتوي كل شريحة بحجم الرقاقة على 44 جيجابايت من ذاكرة الوصول العشوائي (SRAM) مباشرة على السيليكون. تظل أوزان النماذج على الرقاقة، وتتدفق الرموز المميزة دون انقطاع عبر طبقات النموذج التي يتم توصيلها عبر الرقاقات. يؤدي هذا إلى التخلص من حركة البيانات غير الفعالة التي تؤدي إلى إبطاء الاستدلال المستند إلى وحدة معالجة الرسومات والقياس بسلاسة مع حجم النموذج، مما يمهد الطريق لميزة السرعة المستمرة في النماذج الحدودية المستقبلية.
التوفر وتحديد المواقع في السوق
يتوفر GPT-5.6 Sol في وضع Ultrafast حاليًا في معاينة محدودة لمجموعة مختارة من العملاء، مع توسيع إمكانية الوصول بمرور الوقت مع نمو السعة. تصف Cerebras الشراكة بأنها تدعم الموجة التالية من ابتكارات الذكاء الاصطناعي وترفع سقف ما يمكن للمؤسسات تحقيقه من خلال الذكاء الاصطناعي سريع الاستجابة.
يمثل هذا التعاون علامة بارزة بالنسبة لشركة Cerebras، التي سعت منذ فترة طويلة إلى تحقيق الحوسبة على نطاق الرقاقات كبديل لسوق أجهزة الذكاء الاصطناعي التي تهيمن عليها وحدة معالجة الرسومات. من خلال الشراكة المباشرة مع OpenAI لتسريع أحد النماذج الرائدة الأكثر قدرة المتاحة، تقدم Cerebras حجة قوية مفادها أن بنيتها توفر ميزة تنافسية حقيقية لأحمال عمل الاستدلال عالية السرعة.
مع استمرار نمو النماذج بشكل أكبر وأكثر ذكاءً، يمكن أن تصبح القدرة على خدمتها بسرعات في الوقت الفعلي عاملاً تنافسيًا محددًا في سوق البنية التحتية للذكاء الاصطناعي. تشير شراكة Cerebras-OpenAI إلى أن السباق على سرعة الاستدلال أصبح الآن بنفس أهمية السباق على الذكاء النموذجي.
البقاء في صدارة الذكاء الاصطناعي
لمزيد من أخبار أجهزة الذكاء الاصطناعي، وتحليل أداء النماذج، وتطورات الصناعة، ضع إشارة مرجعية على AI Buzz Wire.
اقرأ المزيد من أخبار الذكاء الاصطناعي →