Cerebras Systems i OpenAI podzieliły się wczesnym spojrzeniem na tryb Ultrafast, nowy poziom usług uruchamiany jako pierwszy w interfejsie API OpenAI i oparty na technologii płytek Cerebras. Dzięki partnerstwu GPT-5.6 Sol może działać z szybkością do 750 tokenów wyjściowych na sekundę, zapewniając inteligencję na najwyższym poziomie z szybkością w czasie rzeczywistym. Najnowsze wiadomości na temat sprzętu AI można znaleźć na stronie AI Buzz Wire.
Eliminacja kompromisu między szybkością a inteligencją
Twórcy sztucznej inteligencji od dawna stoją w obliczu zasadniczego kompromisu: w miarę zwiększania rozmiaru i inteligencji modeli zwiększają się koszty obliczeń i przenoszenia danych, co spowalnia czas reakcji. Programiści byli zmuszeni wybierać między oczekiwaniem na wyniki wysokiej jakości a akceptowaniem gorszych wyników w krótszym czasie.
GPT-5.6 Sol w trybie ultraszybkim ma na celu rozwiązanie tego dylematu. Według Cerebras usługa działa 11 razy szybciej niż Claude Fable firmy Anthropic i 5 razy szybciej niż Opus 4.8 w trybie Fast, na podstawie prędkości wyjściowych zgłoszonych przez sztuczną analizę.
Ostatni egzamin ludzkości: test szybkości
Cerebras poddał Ultrafast testowi w porównaniu z konkurencyjnymi modelami w ramach ostatniego egzaminu ludzkości (HLE), wymagającego testu porównawczego składającego się z 2500 pytań, na które zazwyczaj odpowiadają tylko osoby posiadające stopień doktora w takich dziedzinach, jak chemia, ekonomia i literatura.
W ocenach przeprowadzonych przez Cerebras, GPT-5.6 Sol w trybie ultraszybkim odpowiedział na wszystkie 2500 pytań HLE w 11 godzin i 11 minut. Claude Fable 5 potrzebował 78 godzin i 27 minut, czyli ponad trzech dni ciągłych obliczeń, aby dojść do tych samych wniosków. Innymi słowy, Ultrafast przetworzył granicę ludzkiej wiedzy w ciągu jednego dnia roboczego, osiągając porównywalną dokładność prawie siedem razy szybciej.
Testy porównawcze przeprowadziła firma Cerebras przy użyciu GPT-5.6 Sol Ultrafast z Codexem na wysokich ustawieniach rozumowania 10 lipca oraz Claude Fable 5 z Claude Code na wysokich ustawieniach rozumowania od 13 do 15 lipca.
Wpływ na biznes w świecie rzeczywistym
W przypadku PKB-Val, punktu odniesienia dla ekonomicznie cennych zadań opartych na wiedzy, Ultrafast zapewnił kompleksowe przyspieszenie 5,6x bez pogorszenia jakości. Pokazuje to, jak szybsze wnioskowanie może przyspieszyć ekonomicznie cenną pracę bez utraty jakości wydruku.
Cerebras postrzega Ultrafast jako narzędzie do scenariuszy, w których liczy się każda sekunda. Firmy obsługujące usługi sieciowe mogłyby wykorzystać tę technologię do szybszego powodowania i eliminowania przestojów w produkcji, zachowując zaufanie klientów i zapobiegając utracie przychodów. W sytuacjach wymagających cyberbezpieczeństwa zespoły ds. bezpieczeństwa mogą wykorzystać technologię Ultrafast do szybkiego wykrywania ataków i reagowania na nie.
Technologia kryjąca się za szybkością
Przewaga wydajności wynika z architektury Wafer-Scale Engine firmy Cerebras, która została stworzona specjalnie z myślą o pionierskich obciążeniach AI. Głównym wyzwaniem szybkiego wnioskowania granicznego jest problem z przenoszeniem danych: w przypadku tradycyjnych procesorów graficznych wnioskowanie na dużych modelach jest wąskim gardłem ze względu na przepustowość pamięci, ponieważ wagi modeli muszą być wielokrotnie przesyłane między pamięcią w chipie a pamięcią poza chipem, aby wygenerować kolejne tokeny.
Cerebras przyjmuje zasadniczo odmienne podejście. Każdy chip wielkości płytki zawiera 44 GB pamięci SRAM bezpośrednio na krzemie. Wagi modeli pozostają na chipie, a tokeny przepływają nieprzerwanie przez warstwy modeli rozmieszczone potokowo na płytkach. Eliminuje to nieefektywny przepływ danych, który spowalnia wnioskowanie oparte na GPU i płynnie skaluje się wraz z rozmiarem modelu, torując drogę do dalszej przewagi szybkości w przyszłych modelach pionierskich.
Dostępność i pozycjonowanie na rynku
GPT-5.6 Sol w trybie ultraszybkim jest obecnie dostępny w ograniczonej wersji zapoznawczej dla wybranej grupy klientów, a dostęp będzie się zwiększał wraz ze wzrostem pojemności. Cerebras opisuje to partnerstwo jako źródło energii dla kolejnej fali innowacji w zakresie sztucznej inteligencji i podniesienia pułapu tego, co organizacje mogą osiągnąć dzięki responsywnej sztucznej inteligencji.
Współpraca stanowi znaczący kamień milowy dla firmy Cerebras, która od dawna poszukuje rozwiązań obliczeniowych w skali płytki jako alternatywy dla rynku sprzętu AI zdominowanego przez procesory graficzne. Współpracując bezpośrednio z OpenAI w celu przyspieszenia jednego z najwydajniejszych dostępnych modeli pionierskich, Cerebras mocno udowadnia, że jego architektura oferuje rzeczywistą przewagę konkurencyjną w przypadku obciążeń wymagających szybkiego wnioskowania.
W miarę jak modele stają się coraz większe i coraz bardziej inteligentne, możliwość obsługi ich z szybkością w czasie rzeczywistym może stać się decydującym czynnikiem konkurencyjnym na rynku infrastruktury sztucznej inteligencji. Partnerstwo Cerebras-OpenAI sygnalizuje, że wyścig o szybkość wnioskowania jest teraz równie ważny jak wyścig o inteligencję modeli.
Wyprzedź sztuczną inteligencję
Więcej aktualności na temat sprzętu AI, analizy wydajności modeli i rozwoju branży znajdziesz w zakładce AI Buzz Wire.
Przeczytaj więcej aktualności o sztucznej inteligencji →