Tajemniczy model, który przez tydzień czarował programistów pod anonimową nazwą Ox Alpha, ma teraz oficjalną tożsamość. Chińska firma Z.AI wypuściła GLM-5.3-Flash, natywnie multimodalny model o otwartej wadze wydany na liberalnej licencji MIT. Firma twierdzi, że cała wersja zapoznawcza w trybie stealth była obsługiwana na chipach AI wyprodukowanych w Chinach. Premiera zamyka jedną z najchętniej obserwowanych gier w zgadywanie w branży AI w tym roku. Więcej informacji na temat rozwoju tej historii znajdziesz w naszych najnowszych osiągnięciach w zakresie sztucznej inteligencji.
Co faktycznie wysłał Z.ai
GLM-5.3-Flash to model będący połączeniem ekspertów, posiadający 320 miliardów parametrów całkowitych i 18 miliardów parametrów aktywnych — co stanowi zauważalny spadek w porównaniu z 32 miliardami aktywnych parametrów jego poprzednika GLM-4.5. Jest to pierwszy natywnie multimodalny model w rodzinie GLM-5, akceptujący tekst i obrazy oraz obsługujący okno kontekstowe o pojemności sięgającej miliona tokenów, zgodnie z zapowiedzią Z.ai.
Model został wyszkolony na multimodalnym korpusie zawierającym 30 bilionów tokenów, a jego architektura łączy liniową uwagę na lokalne zależności z niewielką uwagą na kontekst globalny. Komponent Z.ai wywołuje IndexPool, kompresuje grupy wektorów kluczy indeksatora, aby ograniczyć opóźnienia i wykorzystanie pamięci przy długich kontekstach. Firma zgłasza trzykrotnie mniejszą wydajność obliczeniową i 4,4-krotne zmniejszenie rozmiaru pamięci podręcznej KV w porównaniu z GLM-5.3.
Oświadczenia i ceny porównawcze
W indeksie Artificial Analysis Intelligence Index v4.1.1 moduł GLM-5.3-Flash uzyskał 57 punktów, co plasuje go na szczycie aktualnych rankingów modeli Artificial Analysis, znacznie powyżej mediany porównania wynoszącej 18. Z.ai twierdzi, że przewyższa GLM-5.2 w zgłoszonych testach kodowania i agentyczności za jedną dziesiątą ceny i zbliża się do Claude Opus 4.8 firmy Anthropic w wewnętrznym benchmarku kodowania. W DeepSWE v1.1 model uzyskał 63,4 w porównaniu do 46,2 w przypadku GLM-5.2; w AutomationBench osiągnął on wynik 48,8 wobec 26,2. Jak zauważył TestingCatalog, różne wiązki ewaluacyjne, ograniczenia kontekstu i ustawienia generowania oznaczają, że porównania między testami zależą w dużym stopniu od każdej konfiguracji.
Ceny sprawiają, że model jest agresywnie tani: 0,15 dolara za milion tokenów wejściowych i 0,50 dolara za milion tokenów wyjściowych, z 83% zniżką na pamięć podręczną, zgodnie z Sztuczną Analizą. Z.ai podaje obniżony koszt 0,045 dolara na zadanie w ramach indeksu inteligencji.
Chiński kąt chipa
Najbardziej strategicznie istotnym szczegółem jest infrastruktura, a nie inteligencja. Przed premierą model działał anonimowo jako „ox-alpha” na OpenRouter i OpenCode od 20 sierpnia, a Z.ai twierdzi, że stał się najpopularniejszym modelem tygodnia w tych usługach – z ruchem obsługiwanym wyłącznie przez krajowe chińskie akceleratory. Aby to wesprzeć, Z.ai zbudował stos obsługujący oparty na SGLang, który oddziela kodowanie, wstępne wypełnianie i dekodowanie, odnotowując trzykrotny wzrost wydajności kompleksowej obsługi w dziesiątkach tysięcy chińskich chipów AI.
To ma znaczenie nie tylko dla jednego dostawcy. Jest to publiczna demonstracja, że chiński model z pogranicza może być obsługiwany na dużą skalę bez sprzętu Nvidia, a zachodni decydenci i producenci chipów nie zignorują tego punktu danych. The New Stack podsumował wydanie jako tanie, dobre i podawane na chińskich chipsach — trzy cechy, które do tej pory rzadko łączyły się w jedną całość.
Otwarte ciężary, prawdziwe rozmieszczenie
Wagi są dostępne w Hugging Face na licencji MIT, z lokalnym wdrożeniem obsługiwanym przez SGLang, vLLM i TokenSpeed. Abonenci GLM Coding Plan natychmiast otrzymują GLM-5.3-Flash z trzykrotnie większym limitem użytkowym niż GLM-5.3, a jego multimodalne możliwości są ujawniane w ZCode poprzez integrację użycia przeglądarki i komputera.
Rozumowanie wizualne ma kluczowe znaczenie w wydaniu: Z.ai przeszkolił model pod kątem sprawdzania renderowanych interfejsów, rozgrywki i wyników 3D, a następnie oceniania i korygowania własnej pracy na podstawie wizualnych informacji zwrotnych. To samo podejście rozciąga się na dokumenty, arkusze kalkulacyjne, prezentacje i pulpity nawigacyjne — podstawowe artefakty pracy biurowej, i to właśnie w tym miejscu konkurencyjna wersja Qwen, wydana tego samego dnia, również odnotowuje największe zyski.
Decyzja o otwartych ciężarkach ma znaczenie dla ekosystemu nie tylko dla hobbystów. Licencja MIT jest najbardziej liberalną powszechną licencją w dziedzinie sztucznej inteligencji: komercyjne wykorzystanie, modyfikacja i redystrybucja nie wiążą się z zobowiązaniami typu copyleft. Niezależni hosty mogą obsługiwać GLM-5.3-Flash na własnym sprzęcie, dostrajać go do zastosowań w branżach, od kontroli prawnej po automatyzację przemysłową, i osadzać go w produktach bez negocjowania warunków – opcja niedostępna dla granicznych modeli wykorzystujących wyłącznie API.
Dlaczego ukryte uruchomienie zadziałało
Anonimowe wdrożenie dało Z.ai coś, czego nie można kupić za budżety marketingowe: weryfikację niezależną od marki. Deweloperzy przyjęli Ox Alpha ze względu na zalety, bez porównywania chińskiego laboratorium z amerykańskimi konkurentami. Zanim Bloomberg potwierdził, że Z.AI jest twórcą, a Business Insider ogłosił „rozwiązanie tajemnicy”, model znajdował się już na czołowych miejscach rankingów społeczności na neutralnym gruncie.
Presja konkurencyjna jest teraz wyraźna. Model multimodalny z kontekstem miliona tokenów, wagami na licencji MIT i cenami produkcji poniżej dolara zmusza każdego operatora zasiedziałego do uzasadnienia swojego cennika. Granica Pareto w zakresie stosunku ceny do wydajności – co tak naprawdę uważają deweloperzy za kompromis – została przerysowana, jak ujął to szeroko obserwowany komentator sztucznej inteligencji, Andrew Curran, na X.
Otwartym pytaniem jest trwałość: czy wzorcowe wzorce wytrzymują trudne warunki w warunkach rzeczywistych i jak szybko zachodnie laboratoria reagują na cenę. Tak czy inaczej, tydzień anonimowych spekulacji zakończył się pojawieniem się nazwanego modelu, ciężarków do pobrania i floty obsługującej, która nie korzysta z amerykańskiego krzemu.
---
Wyprzedź sztuczną inteligencjęOtrzymuj najnowsze wiadomości, analizy i przełomowe informacje dotyczące sztucznej inteligencji — wszystko w jednym miejscu.
Przeczytaj więcej aktualności o sztucznej inteligencji →