Cerebras و OpenAI به دنیا نگاهی اولیه به حالت فوق سریع داده اند، یک سطح سرویس جدید که ابتدا در OpenAI API راه اندازی می شود و توسط سخت افزار Cerebras پشتیبانی می شود. طبق اعلامیه Cerebras که در 13 آگوست 2026 منتشر شد، GPT-5.6 Sol که روی Ultrafast اجرا میشود تا 750 توکن خروجی در ثانیه را ارائه میکند - بدون افت کیفیت.
این ردیف در ابتدا برای گروهی از مشتریان در دسترس است و دسترسی آن به مرور زمان گسترش مییابد. این اعلامیه که توسط Joyce Er از Cerebras نوشته شده است، این پیشنهاد را به عنوان راه حلی برای معامله ای قرار می دهد که توسعه محصول هوش مصنوعی را برای سال ها تعریف کرده است: سازندگان مجبور بودند بین سرعت و هوشمندی یکی را انتخاب کنند، زیرا مدل های بزرگتر و هوشمندتر هزینه های محاسباتی و انتقال داده بالاتری را متحمل می شوند که زمان پاسخ را کاهش می دهد. خوانندگانی که مسابقه سرعت بخشیدن به مدلهای مرزی را دنبال میکنند میتوانند آخرین پیشرفتها را در [AI Buzz Wire] (https://aibuzzwire.news) دنبال کنند.
سرعت اولترافست دقیقا چقدر است؟
عدد خروجی خام به خودی خود قابل توجه است، اما Cerebras نیز زمینه مقایسه ای را ارائه کرد. با توجه به سرعت های خروجی گزارش شده توسط Artificial Analysis، یک سرویس محک مستقل، GPT-5.6 Sol در حالت Ultrafast اجرا می شود:
- 11 برابر سریعتر از Fable 5
- 5 برابر سریعتر از Opus 4.8 در حالت سریع
برای آزمایش استرس این ادعا، Cerebras این مدل را در مقابل رقبای محبوب در آخرین امتحان انسانیت (HLE) اجرا کرد، معیاری چالش برانگیز متشکل از 2500 سؤال که معمولاً فقط توسط افرادی که دارای مدرک دکترا در زمینه هایی مانند شیمی، اقتصاد و ادبیات هستند، پاسخ داده می شود.
نتیجه: GPT-5.6 Sol در Ultrafast به تمام 2500 سؤال HLE در 11 ساعت و 11 دقیقه پاسخ داد. کلود فابل 5 به 78 ساعت و 27 دقیقه - بیش از سه روز محاسبه مداوم - نیاز داشت تا به نتایج یکسانی برسد. به عبارت دیگر، Ultrafast در یک روز کاری از مرز دانش بشری عبور کرد و دقت قابل مقایسه ای را تقریباً 7 برابر سریعتر به دست آورد.
Cerebras متدولوژی معیار خود را یادآور شد: GPT-5.6 Sol Ultrafast با Codex در استدلال xhigh در 10 ژوئیه آزمایش شد، در حالی که Claude Fable 5 با Claude Code بر اساس استدلال xhigh در 13 تا 15 ژوئیه آزمایش شد.
بارهای کاری در دنیای واقعی، نه فقط معیارها
اگر کیفیت در طول مسیر کاهش یابد، معیارهای سرعت ممکن است گمراه کننده باشند، به همین دلیل است که Cerebras نتایج را روی GDP-Val، معیاری برای وظایف کاری دانش با ارزش اقتصادی، برجسته کرده است. بر اساس آزمایشهایی که Cerebras در 31 ژوئیه 2026 با استفاده از GPT-5.6 Sol و GPT-5.6 Sol Ultrafast با استدلال متوسط در Codex انجام داد، در GDP-Val، Ultrafast سرعت 5.6 برابری سرتاسر بدون افت کیفیت را ارائه داد.
این شرکت میگوید GPT-5.6 Sol بهترین مدل OpenAI تاکنون برای خلاصههای حقوقی، مدلهای مالی و گزارشهای مهندسی است - حوزههایی که کیفیت خروجی و زمان چرخش هر دو پیامدهای مالی مستقیم دارند.
چرا سرعت معادله عامل را تغییر می دهد
تغییر پیامدتر ممکن است در نحوه عملکرد عوامل هوش مصنوعی باشد. استنتاج سریعتر آنچه را که برای افراد و سازمانها ممکن است تغییر میدهد، زیرا عوامل میتوانند در مسیر بحرانی مشکلات قرار بگیرند، جایی که هر ثانیه اهمیت دارد.
روهان وارما، محصول OpenAI، در بیانیهای که در این اطلاعیه نقل شده است، گفت: با GPT-5.6 Sol Ultrafast، Cerebras هوش مصنوعی را فعال میکند که با نحوه تفکر، کدنویسی و همکاری شما هماهنگی دارد. "ما هیجان زده هستیم که ببینیم چگونه جریان کار و برنامه ها توسط استنتاج Ultrafast تغییر می کنند."
Cerebras چندین سناریو با ریسک بالا را که در آن افزایش سرعت اهمیت دارد، ترسیم کرد:
پاسخ حادثه
شرکتهایی که خدمات وب را ارائه میکنند میتوانند از Ultrafast برای ریشهیابی و رفع قطعیهای تولید، حفظ اعتماد مشتری، جلوگیری از از دست رفتن درآمد و صرفهجویی در زمانهای خرابی در مقابل SLA خود استفاده کنند.امنیت سایبری
در حملات سایبری خصمانه و پرمخاطره، تیمهای امنیتی باید به سرعت عوامل بد را شناسایی کرده و به آنها پاسخ دهند تا خسارات فاجعهبار را مهار کنند - وظیفهای که تأخیر استنتاج مستقیماً بر کنترل آسیب تأثیر میگذارد.بهره وری عامل
Ultrafast حالتهای جدید کار با عوامل را با ارائه بینشها و بهروزرسانیهای همزمان فعال میکند و نیاز به جابجایی متن در جلسات موازی را کاهش میدهد.جفری وانگ، محقق OpenAI، در این اطلاعیه میگوید: «در حالی که قبلاً ممکن بود مجبور باشم چند دقیقه صبر کنم تا یک کار تمام شود، اکنون قبل از اینکه فرصتی برای تغییر متن داشته باشم، برای من تمام میشود.
استراتژی در پشت شراکت
برای Cerebras، این معامله نشان دهنده نقطه عطف دیگری در تلاش برای تجاری سازی شتاب در مقیاس ویفر برای استنتاج هوش مصنوعی است. برای OpenAI، حالت Ultrafast در لحظهای که تأخیر استنتاج به یک تمایز رقابتی تبدیل شده است، یک ردیف سرعت ممتاز به API اضافه میکند - بهویژه برای برنامههای کاربردی که بسیاری از تماسهای مدل را به هم متصل میکنند، که در آن هر تماس به چند دقیقه انتظار تبدیل میشود.
شرکتها این ردیف را به عنوان یک لبه پایدار برای سازمانهایی که از هوش مصنوعی مرزی برای پاسخ سریع به اطلاعات دریافتی استفاده میکنند، جفت میکنند و پردازش فوق سریع را برای کارهای حساس به زمان با پردازش استاندارد برای وظایف کالایی که میتوان در پسزمینه موازی کرد، جفت کرد.
دسترسی به تدریج در حال گسترش است. توسعه دهندگان علاقه مند می توانند اسناد OpenAI API را برای در دسترس بودن نظارت کنند، زیرا Cerebras می گوید دسترسی به مرور زمان از گروه اولیه مشتریان منتخب گسترش می یابد.
از هوش مصنوعی جلوتر بمانید
برای پوشش بیشتر مسابقه سختافزاری و زیرساختهای تغییر شکل هوش مصنوعی، [AI Buzz Wire] (https://aibuzzwire.news) را نشانکگذاری کنید و فید [اخبار سختافزار AI] (https://aibuzzwire.news) ما را دنبال کنید.
اخبار هوش مصنوعی را بیشتر بخوانید →