أعطت Cerebras وOpenAI للعالم نظرة مبكرة على Ultrafast Mode، وهي طبقة خدمة جديدة يتم إطلاقها أولاً في OpenAI API ويتم تشغيلها بواسطة أجهزة Cerebras. وفقًا لإعلان Cerebras المنشور في 13 أغسطس 2026، يوفر GPT-5.6 Sol الذي يعمل على Ultrafast ما يصل إلى 750 رمزًا مميزًا للإخراج في الثانية - دون أي تنازل في الجودة.

الطبقة متاحة في البداية لمجموعة مختارة من العملاء، مع توسيع إمكانية الوصول بمرور الوقت. الإعلان، الذي كتبته جويس إير من شركة Cerebras، يضع العرض كحل للمقايضة التي حددت تطوير منتجات الذكاء الاصطناعي لسنوات: كان على البناة الاختيار بين السرعة والذكاء، لأن النماذج الأكبر والأكثر ذكاءً تتكبد تكاليف حسابية وتكاليف نقل بيانات أعلى مما يؤدي إلى إبطاء أوقات الاستجابة. يمكن للقراء الذين يتابعون السباق لتسريع النماذج الرائدة متابعة آخر التطورات على [AI Buzz Wire] (https://aibuzzwire.news).

ما مدى سرعة السرعة الفائقة بالضبط؟

إن رقم الإنتاجية الخام مذهل في حد ذاته، لكن Cerebras قدمت أيضًا سياقًا مقارنًا. وفقًا لسرعات الإخراج التي أبلغت عنها Artificial Analysis، وهي خدمة قياس أداء مستقلة، يعمل GPT-5.6 Sol على الوضع فائق السرعة:

  • 11x أسرع من Fable 5
  • 5x أسرع من Opus 4.8 في الوضع السريع

ولتأكيد هذا الادعاء، أجرت شركة سيريبراس النموذج وجهًا لوجه ضد منافسين مشهورين في الاختبار الأخير للإنسانية (HLE)، وهو معيار صعب يتكون من 2500 سؤال لا يمكن الإجابة عليها عادةً إلا من قبل الأشخاص الحاصلين على درجة الدكتوراه في مجالات مثل الكيمياء والاقتصاد والأدب.

النتيجة: أجاب GPT-5.6 Sol على Ultrafast على جميع أسئلة HLE البالغ عددها 2500 سؤال في 11 ساعة و11 دقيقة. احتاج Claude Fable 5 إلى 78 ساعة و27 دقيقة — أكثر من ثلاثة أيام من الحوسبة المستمرة — للوصول إلى نفس الاستنتاجات. بمعنى آخر، نجحت تقنية Ultrafast في تجاوز حدود المعرفة البشرية في يوم عمل واحد، وحققت دقة قابلة للمقارنة أسرع بنحو 7 مرات.

أشارت شركة Cerebras إلى منهجيتها في القياس: تم اختبار GPT-5.6 Sol Ultrafast باستخدام Codex على استدلال xhigh في 10 يوليو، بينما تم اختبار Claude Fable 5 باستخدام Claude Code على استدلال xhigh في الفترة من 13 إلى 15 يوليو.

أعباء العمل في العالم الحقيقي، وليس فقط المعايير

يمكن أن تكون معايير السرعة مضللة إذا تدهورت الجودة على طول الطريق، ولهذا السبب سلطت Cerebras الضوء أيضًا على النتائج الخاصة بـ GDP-Val، وهو معيار لمهام العمل المعرفي ذات القيمة الاقتصادية. في إجمالي الناتج المحلي-Val، قدمت Ultrafast 5.6x تسريعًا شاملاً دون أي تدهور في الجودة، وفقًا للاختبارات التي أجرتها Cerebras في 31 يوليو 2026 باستخدام GPT-5.6 Sol وGPT-5.6 Sol Ultrafast على الاستدلال المتوسط ​​داخل Codex.

تقول الشركة إن GPT-5.6 Sol هو أفضل نموذج لـ OpenAI حتى الآن للملخصات القانونية والنماذج المالية والتقارير الهندسية - وهي المجالات التي تحمل فيها جودة الإنتاج ووقت التنفيذ عواقب مالية مباشرة.

لماذا تغير السرعة معادلة الوكيل

قد يكون التحول الأكثر أهمية هو كيفية عمل عملاء الذكاء الاصطناعي. يؤدي الاستدلال الأسرع إلى تغيير ما هو ممكن بالنسبة للأفراد والمؤسسات، لأنه يمكن وضع الوكلاء على المسار الحرج للمشاكل حيث تكون كل ثانية لها أهميتها.

قال روهان فارما، المنتج في OpenAI، في بيان مقتبس في الإعلان: "مع GPT-5.6 Sol Ultrafast، تتيح Cerebras الذكاء الاصطناعي الذي يواكب طريقة تفكيرك وبرمجتك وتعاونك". "نحن متحمسون لرؤية كيف يتم تحويل سير العمل والتطبيقات من خلال الاستدلال فائق السرعة."

أوجزت شركة Cerebras عدة سيناريوهات عالية المخاطر حيث يكون التسريع مهمًا:

الاستجابة للحوادث

يمكن للشركات التي تقوم بتشغيل خدمات الويب استخدام Ultrafast لمعالجة السبب الجذري لانقطاعات الإنتاج ومعالجتها، والحفاظ على ثقة العملاء، ومنع فقدان الإيرادات، وتوفير دقائق التوقف عن العمل مقابل اتفاقيات مستوى الخدمة الخاصة بها.

الأمن السيبراني

في الهجمات الإلكترونية العدائية عالية المخاطر، يجب على فرق الأمن اكتشاف العناصر السيئة والاستجابة لها بسرعة لاحتواء الخسائر الكارثية - وهي مهمة يؤثر فيها زمن الوصول الاستدلالي بشكل مباشر على التحكم في الأضرار.

إنتاجية الوكيل

تتيح السرعة الفائقة أنماطًا جديدة للعمل مع الوكلاء من خلال تقديم رؤى وتحديثات في الوقت الفعلي، مما يقلل الحاجة إلى تبديل السياق عبر الجلسات المتوازية.

وقال جيفري وانج، الباحث في OpenAI، في الإعلان: "في السابق، كنت أضطر إلى الانتظار بضع دقائق حتى تنتهي المهمة، لكنها تنتهي الآن بالنسبة لي قبل أن تتاح لي الفرصة لتبديل السياق. وهذا يجعلني أكثر إنتاجية".

الإستراتيجية وراء الشراكة

بالنسبة لشركة Cerebras، تمثل الصفقة علامة فارقة أخرى في جهودها لتسويق تسريع على نطاق الرقاقة لاستدلال الذكاء الاصطناعي. بالنسبة لـ OpenAI، يضيف وضع Ultrafast مستوى سرعة متميز إلى واجهة برمجة التطبيقات (API) الخاصة به في الوقت الذي أصبح فيه زمن استجابة الاستدلال عامل تمييز تنافسي - خاصة بالنسبة للتطبيقات الوكيلة التي تربط العديد من مكالمات النماذج معًا، حيث تتراكم تأخيرات كل مكالمة إلى دقائق من الانتظار.

تضع الشركات هذا المستوى كميزة مستمرة للمؤسسات التي تستخدم الذكاء الاصطناعي الحدودي للاستجابة بسرعة للمعلومات الواردة، وربط المعالجة فائقة السرعة للعمل الحساس للوقت مع المعالجة القياسية لمهام السلع التي يمكن موازنتها في الخلفية.

يتم طرح إمكانية الوصول تدريجيًا. يمكن للمطورين المهتمين مراقبة وثائق OpenAI API للتأكد من توفرها، حيث تقول Cerebras إن الوصول سيتوسع بمرور الوقت من المجموعة الأولية المحددة من العملاء.

ابق في صدارة الذكاء الاصطناعي

لمزيد من التغطية لسباق الأجهزة والبنية التحتية الذي يعيد تشكيل الذكاء الاصطناعي، ضع إشارة مرجعية على AI Buzz Wire وتابع خلاصة أخبار أجهزة الذكاء الاصطناعي.

اقرأ المزيد من أخبار الذكاء الاصطناعي →