Cerebras i OpenAI umożliwiły światu wgląd w Tryb Ultraszybki, nowy poziom usług, który uruchamia się jako pierwszy w interfejsie API OpenAI i jest obsługiwany przez sprzęt Cerebras. Zgodnie z ogłoszeniem Cerebras opublikowanym 13 sierpnia 2026 r., GPT-5.6 Sol działający na platformie Ultrafast zapewnia do 750 tokenów wyjściowych na sekundę – bez kompromisów w jakości.
Poziom ten jest początkowo dostępny dla wybranej grupy klientów, a z biegiem czasu dostęp jest coraz większy. W ogłoszeniu, napisanym przez Joyce Er z Cerebras, oferta stanowi rozwiązanie kompromisu, który od lat definiował rozwój produktów AI: konstruktorzy musieli wybierać między szybkością a inteligencją, ponieważ większe i inteligentniejsze modele wiążą się z wyższymi kosztami obliczeniowymi i przepływem danych, co spowalnia czas reakcji. Czytelnicy śledzący wyścig o przyspieszenie modeli pionierskich mogą śledzić najnowsze osiągnięcia w AI Buzz Wire.
Jak szybko oznacza ultraszybko?
Surowa liczba przepustowości sama w sobie jest uderzająca, ale Cerebras dostarczył również kontekst porównawczy. Według prędkości wyjściowych podanych przez Artificial Analysis, niezależną usługę testowania, GPT-5.6 Sol w trybie Ultrafast działa:
- 11x szybciej niż Fable 5
- 5x szybszy niż Opus 4.8 w trybie Fast
Aby przetestować tę tezę, Cerebras bezpośrednio porównał model z popularnymi konkurentami w Ostatnim egzaminie ludzkości (HLE) – wymagającym teście porównawczym składającym się z 2500 pytań, na które zazwyczaj odpowiadają tylko osoby posiadające stopień doktora w takich dziedzinach, jak chemia, ekonomia i literatura.
Wynik: GPT-5.6 Sol na Ultrafast odpowiedział na wszystkie 2500 pytań HLE w 11 godzin i 11 minut. Claude Fable 5 potrzebował 78 godzin i 27 minut – ponad trzech dni ciągłych obliczeń – aby dojść do tych samych wniosków. Innymi słowy, Ultrafast przekroczył granicę ludzkiej wiedzy w ciągu jednego dnia roboczego, osiągając porównywalną dokładność prawie 7 razy szybciej.
Cerebras zwrócił uwagę na swoją metodologię benchmarkingu: GPT-5.6 Sol Ultrafast został przetestowany przy użyciu Codexu przy użyciu rozumowania xhigh w dniach 10 lipca, natomiast Claude Fable 5 został przetestowany przy użyciu Claude Code przy użyciu rozumowania xhigh w dniach 13–15 lipca.
Obciążenia w świecie rzeczywistym, a nie tylko testy porównawcze
Testy porównawcze prędkości mogą wprowadzać w błąd, jeśli po drodze jakość ulegnie pogorszeniu, dlatego Cerebras podkreślił również wyniki dotyczące GDP-Val, punktu odniesienia dla zadań związanych z pracą związaną z wiedzą o wartości ekonomicznej. Zgodnie z testami przeprowadzonymi przez Cerebras 31 lipca 2026 r. przy użyciu GPT-5.6 Sol i GPT-5.6 Sol Ultrafast na poziomie PKB-Val, Ultrafast zapewnił 5,6-krotne przyspieszenie od początku do końca bez pogorszenia jakości przy średnim wnioskowaniu w ramach Codexu.
Firma twierdzi, że GPT-5.6 Sol to najlepszy jak dotąd model OpenAI do sporządzania wycen prawnych, modeli finansowych i raportów inżynierskich – dziedzin, w których zarówno jakość wyników, jak i czas realizacji mają bezpośrednie konsekwencje finansowe.
Dlaczego prędkość zmienia równanie agenta
Bardziej konsekwentna zmiana może dotyczyć sposobu działania agentów AI. Szybsze wnioskowanie zmienia możliwości poszczególnych osób i organizacji, ponieważ agentów można umieścić na krytycznej ścieżce problemów, gdzie liczy się każda sekunda.
„Dzięki GPT-5.6 Sol Ultrafast Cerebras umożliwia sztuczną inteligencję, która dotrzymuje kroku Twojemu sposobowi myślenia, kodowania i współpracy” – powiedział Rohan Varma, produkt w OpenAI, w oświadczeniu cytowanym w ogłoszeniu. „Jesteśmy podekscytowani możliwością zmiany przepływów pracy i aplikacji dzięki ultraszybkiemu wnioskowaniu”.
Cerebras nakreślił kilka scenariuszy, w których stawka jest wysoka, w których liczy się przyspieszenie:
Reakcja na incydent
Firmy obsługujące usługi internetowe mogą używać Ultrafast do pierwotnego powodowania i eliminowania przestojów w produkcji, zachowując zaufanie klientów, zapobiegając utracie przychodów i oszczędzając minuty przestojów w ramach umów SLA.Cyberbezpieczeństwo
W przypadku kontradyktoryjnych cyberataków o dużej stawce zespoły ds. bezpieczeństwa muszą szybko wykrywać i reagować na złe osoby, aby zapobiec katastrofalnym stratom. Jest to zadanie, w którym opóźnienie wnioskowania bezpośrednio wpływa na kontrolę szkód.Produktywność agenta
Ultrafast umożliwia nowe tryby pracy z agentami, dostarczając wgląd w informacje i aktualizacje w czasie rzeczywistym, redukując potrzebę przełączania kontekstu między równoległymi sesjami.„Podczas gdy wcześniej musiałem czekać kilka minut na zakończenie zadania, teraz kończy się ono, zanim w ogóle zdążę zmienić kontekst. Dzięki temu jestem znacznie bardziej produktywny” – powiedział w ogłoszeniu Jeffrey Wang, badacz w OpenAI.
Strategia leżąca u podstaw partnerstwa
Dla Cerebras transakcja stanowi kolejny kamień milowy w wysiłkach na rzecz komercjalizacji akceleracji w skali płytki na potrzeby wnioskowania AI. W przypadku OpenAI tryb Ultrafast dodaje do interfejsu API warstwę najwyższej prędkości w momencie, gdy opóźnienia w wnioskowaniu stały się wyróżnikiem konkurencyjnym — szczególnie w przypadku aplikacji agentowych, które łączą ze sobą wiele wywołań modelowych, gdzie opóźnienia w poszczególnych połączeniach składają się na minuty oczekiwania.
Firmy postrzegają tę warstwę jako trwałą przewagę dla organizacji wykorzystujących pionierską sztuczną inteligencję do szybkiego reagowania na przychodzące informacje, łącząc ultraszybkie przetwarzanie do pracy, w której liczy się czas, ze standardowym przetwarzaniem zadań związanych z towarami, które można wykonywać równolegle w tle.
Dostęp jest wprowadzany stopniowo. Zainteresowani programiści mogą monitorować dostępność dokumentacji OpenAI API, ponieważ Cerebras twierdzi, że dostęp będzie z czasem rozszerzany w przypadku początkowej wybranej grupy klientów.
Wyprzedź sztuczną inteligencję
Aby uzyskać więcej informacji na temat wyścigu sprzętu i infrastruktury przekształcającego sztuczną inteligencję, dodaj zakładkę AI Buzz Wire i śledź nasz kanał Wiadomości dotyczące sprzętu AI.
Przeczytaj więcej aktualności o sztucznej inteligencji →