Cerebras و OpenAI به دنیا نگاهی اولیه به حالت فوق سریع داده اند، یک سطح سرویس جدید که ابتدا در OpenAI API راه اندازی می شود و توسط سخت افزار Cerebras پشتیبانی می شود. طبق اعلامیه Cerebras که در 13 آگوست 2026 منتشر شد، GPT-5.6 Sol که روی Ultrafast اجرا می‌شود تا 750 توکن خروجی در ثانیه را ارائه می‌کند - بدون افت کیفیت.

این ردیف در ابتدا برای گروهی از مشتریان در دسترس است و دسترسی آن به مرور زمان گسترش می‌یابد. این اعلامیه که توسط Joyce Er از Cerebras نوشته شده است، این پیشنهاد را به عنوان راه حلی برای معامله ای قرار می دهد که توسعه محصول هوش مصنوعی را برای سال ها تعریف کرده است: سازندگان مجبور بودند بین سرعت و هوشمندی یکی را انتخاب کنند، زیرا مدل های بزرگتر و هوشمندتر هزینه های محاسباتی و انتقال داده بالاتری را متحمل می شوند که زمان پاسخ را کاهش می دهد. خوانندگانی که مسابقه سرعت بخشیدن به مدل‌های مرزی را دنبال می‌کنند می‌توانند آخرین پیشرفت‌ها را در [AI Buzz Wire] (https://aibuzzwire.news) دنبال کنند.

سرعت اولترافست دقیقا چقدر است؟

عدد خروجی خام به خودی خود قابل توجه است، اما Cerebras نیز زمینه مقایسه ای را ارائه کرد. با توجه به سرعت های خروجی گزارش شده توسط Artificial Analysis، یک سرویس محک مستقل، GPT-5.6 Sol در حالت Ultrafast اجرا می شود:

  • 11 برابر سریعتر از Fable 5
  • 5 برابر سریعتر از Opus 4.8 در حالت سریع

برای آزمایش استرس این ادعا، Cerebras این مدل را در مقابل رقبای محبوب در آخرین امتحان انسانیت (HLE) اجرا کرد، معیاری چالش برانگیز متشکل از 2500 سؤال که معمولاً فقط توسط افرادی که دارای مدرک دکترا در زمینه هایی مانند شیمی، اقتصاد و ادبیات هستند، پاسخ داده می شود.

نتیجه: GPT-5.6 Sol در Ultrafast به تمام 2500 سؤال HLE در 11 ساعت و 11 دقیقه پاسخ داد. کلود فابل 5 به 78 ساعت و 27 دقیقه - بیش از سه روز محاسبه مداوم - نیاز داشت تا به نتایج یکسانی برسد. به عبارت دیگر، Ultrafast در یک روز کاری از مرز دانش بشری عبور کرد و دقت قابل مقایسه ای را تقریباً 7 برابر سریعتر به دست آورد.

Cerebras متدولوژی معیار خود را یادآور شد: GPT-5.6 Sol Ultrafast با Codex در استدلال xhigh در 10 ژوئیه آزمایش شد، در حالی که Claude Fable 5 با Claude Code بر اساس استدلال xhigh در 13 تا 15 ژوئیه آزمایش شد.

بارهای کاری در دنیای واقعی، نه فقط معیارها

اگر کیفیت در طول مسیر کاهش یابد، معیارهای سرعت ممکن است گمراه کننده باشند، به همین دلیل است که Cerebras نتایج را روی GDP-Val، معیاری برای وظایف کاری دانش با ارزش اقتصادی، برجسته کرده است. بر اساس آزمایش‌هایی که Cerebras در 31 ژوئیه 2026 با استفاده از GPT-5.6 Sol و GPT-5.6 Sol Ultrafast با استدلال متوسط ​​در Codex انجام داد، در GDP-Val، Ultrafast سرعت 5.6 برابری سرتاسر بدون افت کیفیت را ارائه داد.

این شرکت می‌گوید GPT-5.6 Sol بهترین مدل OpenAI تاکنون برای خلاصه‌های حقوقی، مدل‌های مالی و گزارش‌های مهندسی است - حوزه‌هایی که کیفیت خروجی و زمان چرخش هر دو پیامدهای مالی مستقیم دارند.

چرا سرعت معادله عامل را تغییر می دهد

تغییر پیامدتر ممکن است در نحوه عملکرد عوامل هوش مصنوعی باشد. استنتاج سریع‌تر آنچه را که برای افراد و سازمان‌ها ممکن است تغییر می‌دهد، زیرا عوامل می‌توانند در مسیر بحرانی مشکلات قرار بگیرند، جایی که هر ثانیه اهمیت دارد.

روهان وارما، محصول OpenAI، در بیانیه‌ای که در این اطلاعیه نقل شده است، گفت: با GPT-5.6 Sol Ultrafast، Cerebras هوش مصنوعی را فعال می‌کند که با نحوه تفکر، کدنویسی و همکاری شما هماهنگی دارد. "ما هیجان زده هستیم که ببینیم چگونه جریان کار و برنامه ها توسط استنتاج Ultrafast تغییر می کنند."

Cerebras چندین سناریو با ریسک بالا را که در آن افزایش سرعت اهمیت دارد، ترسیم کرد:

پاسخ حادثه

شرکت‌هایی که خدمات وب را ارائه می‌کنند می‌توانند از Ultrafast برای ریشه‌یابی و رفع قطعی‌های تولید، حفظ اعتماد مشتری، جلوگیری از از دست رفتن درآمد و صرفه‌جویی در زمان‌های خرابی در مقابل SLA خود استفاده کنند.

امنیت سایبری

در حملات سایبری خصمانه و پرمخاطره، تیم‌های امنیتی باید به سرعت عوامل بد را شناسایی کرده و به آنها پاسخ دهند تا خسارات فاجعه‌بار را مهار کنند - وظیفه‌ای که تأخیر استنتاج مستقیماً بر کنترل آسیب تأثیر می‌گذارد.

بهره وری عامل

Ultrafast حالت‌های جدید کار با عوامل را با ارائه بینش‌ها و به‌روزرسانی‌های هم‌زمان فعال می‌کند و نیاز به جابجایی متن در جلسات موازی را کاهش می‌دهد.

جفری وانگ، محقق OpenAI، در این اطلاعیه می‌گوید: «در حالی که قبلاً ممکن بود مجبور باشم چند دقیقه صبر کنم تا یک کار تمام شود، اکنون قبل از اینکه فرصتی برای تغییر متن داشته باشم، برای من تمام می‌شود.

استراتژی در پشت شراکت

برای Cerebras، این معامله نشان دهنده نقطه عطف دیگری در تلاش برای تجاری سازی شتاب در مقیاس ویفر برای استنتاج هوش مصنوعی است. برای OpenAI، حالت Ultrafast در لحظه‌ای که تأخیر استنتاج به یک تمایز رقابتی تبدیل شده است، یک ردیف سرعت ممتاز به API اضافه می‌کند - به‌ویژه برای برنامه‌های کاربردی که بسیاری از تماس‌های مدل را به هم متصل می‌کنند، که در آن هر تماس به چند دقیقه انتظار تبدیل می‌شود.

شرکت‌ها این ردیف را به عنوان یک لبه پایدار برای سازمان‌هایی که از هوش مصنوعی مرزی برای پاسخ سریع به اطلاعات دریافتی استفاده می‌کنند، جفت می‌کنند و پردازش فوق سریع را برای کارهای حساس به زمان با پردازش استاندارد برای وظایف کالایی که می‌توان در پس‌زمینه موازی کرد، جفت کرد.

دسترسی به تدریج در حال گسترش است. توسعه دهندگان علاقه مند می توانند اسناد OpenAI API را برای در دسترس بودن نظارت کنند، زیرا Cerebras می گوید دسترسی به مرور زمان از گروه اولیه مشتریان منتخب گسترش می یابد.

از هوش مصنوعی جلوتر بمانید

برای پوشش بیشتر مسابقه سخت‌افزاری و زیرساخت‌های تغییر شکل هوش مصنوعی، [AI Buzz Wire] (https://aibuzzwire.news) را نشانک‌گذاری کنید و فید [اخبار سخت‌افزار AI] (https://aibuzzwire.news) ما را دنبال کنید.

اخبار هوش مصنوعی را بیشتر بخوانید →