Cerebras Systems و OpenAI نگاهی اولیه به حالت Ultrafast Mode به اشتراک گذاشته اند، یک ردیف سرویس جدید که برای اولین بار در OpenAI API راه اندازی شده و با فناوری ویفر در مقیاس Cerebras راه اندازی شده است. این مشارکت GPT-5.6 Sol را قادر میسازد تا با حداکثر ۷۵۰ توکن خروجی در ثانیه اجرا شود و اطلاعات سطح مرزی را با سرعت واقعی ارائه دهد. برای آخرین اخبار سخت افزار هوش مصنوعی، به [AI Buzz Wire] (https://aibuzzwire.news) مراجعه کنید.
حذف معاوضه سرعت و هوش
سازندگان هوش مصنوعی مدتهاست که با یک معاوضه اساسی روبرو بودهاند: با افزایش اندازه و هوشمندی مدلها، هزینههای محاسباتی و جابجایی دادهها بالاتری را متحمل میشوند و زمان پاسخ را کاهش میدهند. توسعه دهندگان مجبور شدند بین انتظار برای نتایج با کیفیت بالا یا پذیرش نتایج ضعیف در زمان کمتر یکی را انتخاب کنند.
GPT-5.6 Sol در حالت Ultrafast برای حل این معضل طراحی شده است. به گفته Cerebras، این سرویس 11 برابر سریعتر از Anthropic's Claude Fable 5 و 5 برابر سریعتر از Opus 4.8 در حالت Fast، بر اساس سرعت های خروجی گزارش شده توسط Artificial Analysis، اجرا می شود.
آخرین امتحان انسانیت: تست سرعت
Cerebras Ultrafast را در برابر مدلهای رقیب در آخرین امتحان انسانیت (HLE) آزمایش کرد، یک معیار چالش برانگیز شامل 2500 سؤال که معمولاً فقط توسط افرادی که دارای مدرک دکترا در رشتههایی مانند شیمی، اقتصاد و ادبیات هستند قابل پاسخگویی است.
در ارزیابی های انجام شده توسط Cerebras، GPT-5.6 Sol در حالت فوق سریع به تمام ۲۵۰۰ سوال HLE در ۱۱ ساعت و ۱۱ دقیقه پاسخ داد. کلود فابل 5 به 78 ساعت و 27 دقیقه، بیش از سه روز محاسبه مداوم نیاز داشت تا به نتایج یکسانی برسد. به عبارت دیگر، Ultrafast مرز دانش بشری را در یک روز کاری پردازش کرد و به دقت قابل مقایسه ای نزدیک به هفت برابر سریعتر دست یافت.
بنچمارک توسط Cerebras با استفاده از GPT-5.6 Sol Ultrafast با Codex در تنظیمات استدلال بالا در 10 جولای و Claude Fable 5 با Claude Code در تنظیمات استدلال بالا از 13 تا 15 جولای انجام شد.
تاثیر تجارت در دنیای واقعی
در GDP-Val، معیاری برای وظایف کاری دانش با ارزش اقتصادی، Ultrafast سرعت 5.6 برابری را بدون افت کیفیت ارائه کرد. این نشان می دهد که چگونه استنتاج سریعتر می تواند کار با ارزش اقتصادی را بدون به خطر انداختن کیفیت خروجی تسریع کند.
Cerebras Ultrafast را به عنوان ابزاری برای سناریوهایی در نظر می گیرد که هر ثانیه اهمیت دارد. شرکتهایی که خدمات وب را ارائه میکنند میتوانند از این فناوری برای ریشهیابی و رسیدگی سریعتر به قطعهای تولید، حفظ اعتماد مشتری و جلوگیری از از دست رفتن درآمد استفاده کنند. در موقعیتهای امنیت سایبری پر خطر، تیمهای امنیتی میتوانند از Ultrafast برای شناسایی و پاسخ سریع به حملات استفاده کنند.
تکنولوژی پشت سرعت
مزیت عملکرد ناشی از معماری ویفر مقیاس موتور Cerebras است که برای بارهای کاری هوش مصنوعی مرزی ساخته شده است. چالش اصلی استنتاج مرزی سریع یک مشکل جابجایی داده است: در GPU های سنتی، استنتاج در مدل های بزرگ با پهنای باند حافظه با تنگنا مواجه می شود، زیرا وزن مدل باید به طور مکرر بین حافظه روی تراشه و ذخیره سازی خارج از تراشه منتقل شود تا توکن های متوالی تولید شود.
Cerebras رویکردی اساسا متفاوت دارد. هر تراشه به اندازه ویفر 44 گیگابایت SRAM را مستقیماً روی سیلیکون قرار می دهد. وزنهای مدل روی تراشه باقی میمانند و توکنها بدون وقفه در لایههای مدل خط لوله در سراسر ویفرها جریان مییابند. این حرکت ناکارآمد داده را که استنتاج مبتنی بر GPU را کند میکند حذف میکند و به آرامی با اندازه مدل مقیاس میشود، و راه را برای مزیت سرعت مداوم در مدلهای مرزی آینده هموار میکند.
در دسترس بودن و موقعیتیابی در بازار
GPT-5.6 Sol در حالت Ultrafast در حال حاضر در یک پیشنمایش محدود برای گروهی از مشتریان در دسترس است و با افزایش ظرفیت، دسترسی به مرور زمان گسترش مییابد. سربراس این مشارکت را به عنوان قدرت بخشیدن به موج بعدی نوآوری هوش مصنوعی و افزایش سقف آنچه که سازمان ها می توانند با هوش مصنوعی پاسخگو انجام دهند، توصیف می کند.
این همکاری نشاندهنده نقطه عطف مهمی برای Cerebras است، که مدتهاست محاسبات در مقیاس ویفر را به عنوان جایگزینی برای بازار سختافزار هوش مصنوعی تحت سلطه GPU دنبال میکند. با مشارکت مستقیم با OpenAI برای سرعت بخشیدن به یکی از توانمندترین مدل های مرزی موجود، Cerebras در حال اثبات این موضوع است که معماری آن یک مزیت رقابتی واقعی برای بارهای کاری استنتاج با سرعت بالا ارائه می دهد.
از آنجایی که مدلها به بزرگتر شدن و هوشمندتر شدن ادامه میدهند، توانایی ارائه خدمات به آنها با سرعت واقعی میتواند به یک عامل رقابتی تعیینکننده در بازار زیرساختهای هوش مصنوعی تبدیل شود. مشارکت Cerebras-OpenAI نشان می دهد که رقابت برای سرعت استنتاج اکنون به اندازه رقابت برای هوش مدل مهم است.
از هوش مصنوعی جلوتر بمانید
برای اخبار سخت افزاری بیشتر هوش مصنوعی، تجزیه و تحلیل عملکرد مدل، و پیشرفت های صنعت، [AI Buzz Wire] (https://aibuzzwire.news) را نشانک کنید.
بیشتر بخوانید اخبار هوش مصنوعی →