Cerebras Systems و OpenAI نگاهی اولیه به حالت Ultrafast Mode به اشتراک گذاشته اند، یک ردیف سرویس جدید که برای اولین بار در OpenAI API راه اندازی شده و با فناوری ویفر در مقیاس Cerebras راه اندازی شده است. این مشارکت GPT-5.6 Sol را قادر می‌سازد تا با حداکثر ۷۵۰ توکن خروجی در ثانیه اجرا شود و اطلاعات سطح مرزی را با سرعت واقعی ارائه دهد. برای آخرین اخبار سخت افزار هوش مصنوعی، به [AI Buzz Wire] (https://aibuzzwire.news) مراجعه کنید.

حذف معاوضه سرعت و هوش

سازندگان هوش مصنوعی مدت‌هاست که با یک معاوضه اساسی روبرو بوده‌اند: با افزایش اندازه و هوشمندی مدل‌ها، هزینه‌های محاسباتی و جابجایی داده‌ها بالاتری را متحمل می‌شوند و زمان پاسخ را کاهش می‌دهند. توسعه دهندگان مجبور شدند بین انتظار برای نتایج با کیفیت بالا یا پذیرش نتایج ضعیف در زمان کمتر یکی را انتخاب کنند.

GPT-5.6 Sol در حالت Ultrafast برای حل این معضل طراحی شده است. به گفته Cerebras، این سرویس 11 برابر سریعتر از Anthropic's Claude Fable 5 و 5 برابر سریعتر از Opus 4.8 در حالت Fast، بر اساس سرعت های خروجی گزارش شده توسط Artificial Analysis، اجرا می شود.

آخرین امتحان انسانیت: تست سرعت

Cerebras Ultrafast را در برابر مدل‌های رقیب در آخرین امتحان انسانیت (HLE) آزمایش کرد، یک معیار چالش برانگیز شامل 2500 سؤال که معمولاً فقط توسط افرادی که دارای مدرک دکترا در رشته‌هایی مانند شیمی، اقتصاد و ادبیات هستند قابل پاسخگویی است.

در ارزیابی های انجام شده توسط Cerebras، GPT-5.6 Sol در حالت فوق سریع به تمام ۲۵۰۰ سوال HLE در ۱۱ ساعت و ۱۱ دقیقه پاسخ داد. کلود فابل 5 به 78 ساعت و 27 دقیقه، بیش از سه روز محاسبه مداوم نیاز داشت تا به نتایج یکسانی برسد. به عبارت دیگر، Ultrafast مرز دانش بشری را در یک روز کاری پردازش کرد و به دقت قابل مقایسه ای نزدیک به هفت برابر سریعتر دست یافت.

بنچمارک توسط Cerebras با استفاده از GPT-5.6 Sol Ultrafast با Codex در تنظیمات استدلال بالا در 10 جولای و Claude Fable 5 با Claude Code در تنظیمات استدلال بالا از 13 تا 15 جولای انجام شد.

تاثیر تجارت در دنیای واقعی

در GDP-Val، معیاری برای وظایف کاری دانش با ارزش اقتصادی، Ultrafast سرعت 5.6 برابری را بدون افت کیفیت ارائه کرد. این نشان می دهد که چگونه استنتاج سریعتر می تواند کار با ارزش اقتصادی را بدون به خطر انداختن کیفیت خروجی تسریع کند.

Cerebras Ultrafast را به عنوان ابزاری برای سناریوهایی در نظر می گیرد که هر ثانیه اهمیت دارد. شرکت‌هایی که خدمات وب را ارائه می‌کنند می‌توانند از این فناوری برای ریشه‌یابی و رسیدگی سریع‌تر به قطع‌های تولید، حفظ اعتماد مشتری و جلوگیری از از دست رفتن درآمد استفاده کنند. در موقعیت‌های امنیت سایبری پر خطر، تیم‌های امنیتی می‌توانند از Ultrafast برای شناسایی و پاسخ سریع به حملات استفاده کنند.

تکنولوژی پشت سرعت

مزیت عملکرد ناشی از معماری ویفر مقیاس موتور Cerebras است که برای بارهای کاری هوش مصنوعی مرزی ساخته شده است. چالش اصلی استنتاج مرزی سریع یک مشکل جابجایی داده است: در GPU های سنتی، استنتاج در مدل های بزرگ با پهنای باند حافظه با تنگنا مواجه می شود، زیرا وزن مدل باید به طور مکرر بین حافظه روی تراشه و ذخیره سازی خارج از تراشه منتقل شود تا توکن های متوالی تولید شود.

Cerebras رویکردی اساسا متفاوت دارد. هر تراشه به اندازه ویفر 44 گیگابایت SRAM را مستقیماً روی سیلیکون قرار می دهد. وزن‌های مدل روی تراشه باقی می‌مانند و توکن‌ها بدون وقفه در لایه‌های مدل خط لوله در سراسر ویفرها جریان می‌یابند. این حرکت ناکارآمد داده را که استنتاج مبتنی بر GPU را کند می‌کند حذف می‌کند و به آرامی با اندازه مدل مقیاس می‌شود، و راه را برای مزیت سرعت مداوم در مدل‌های مرزی آینده هموار می‌کند.

در دسترس بودن و موقعیت‌یابی در بازار

GPT-5.6 Sol در حالت Ultrafast در حال حاضر در یک پیش‌نمایش محدود برای گروهی از مشتریان در دسترس است و با افزایش ظرفیت، دسترسی به مرور زمان گسترش می‌یابد. سربراس این مشارکت را به عنوان قدرت بخشیدن به موج بعدی نوآوری هوش مصنوعی و افزایش سقف آنچه که سازمان ها می توانند با هوش مصنوعی پاسخگو انجام دهند، توصیف می کند.

این همکاری نشان‌دهنده نقطه عطف مهمی برای Cerebras است، که مدت‌هاست محاسبات در مقیاس ویفر را به عنوان جایگزینی برای بازار سخت‌افزار هوش مصنوعی تحت سلطه GPU دنبال می‌کند. با مشارکت مستقیم با OpenAI برای سرعت بخشیدن به یکی از توانمندترین مدل های مرزی موجود، Cerebras در حال اثبات این موضوع است که معماری آن یک مزیت رقابتی واقعی برای بارهای کاری استنتاج با سرعت بالا ارائه می دهد.

از آنجایی که مدل‌ها به بزرگ‌تر شدن و هوشمندتر شدن ادامه می‌دهند، توانایی ارائه خدمات به آن‌ها با سرعت واقعی می‌تواند به یک عامل رقابتی تعیین‌کننده در بازار زیرساخت‌های هوش مصنوعی تبدیل شود. مشارکت Cerebras-OpenAI نشان می دهد که رقابت برای سرعت استنتاج اکنون به اندازه رقابت برای هوش مدل مهم است.

از هوش مصنوعی جلوتر بمانید

برای اخبار سخت افزاری بیشتر هوش مصنوعی، تجزیه و تحلیل عملکرد مدل، و پیشرفت های صنعت، [AI Buzz Wire] (https://aibuzzwire.news) را نشانک کنید.

بیشتر بخوانید اخبار هوش مصنوعی →