Z.ai, čínská laboratoř umělé inteligence dříve známá jako Zhipu AI, zveřejnila plné váhy svého modelu GLM-5.3 na Hugging Face, čímž se jeden z nejsilnějších kódovacích a agentních modelů, které jsou k dispozici, staly volně ke stažení. Vydání bylo spuštěno 28. srpna, jen pár dní poté, co laboratoř potvrdila, že virový stealth model známý jako „Ox Alpha“ byl ve skutečnosti jeho vlastní GLM-5.3-Flash a splňuje slib otevřených vah, který komunita celý týden pozorně sledovala.
Stránka modelu rychle shromáždila více než 1 100 lajků a vlákno Hacker News oznamující vydání se vyšplhalo přes 600 bodů, když vývojáři strávili to, co nyní leží ve veřejném úložišti: 141 souborů safetenzorů, dodávaných v FP8, zahrnujících možná dosud nejschopnější model kódování s otevřeným stažením. For more context on this story, see our ongoing artificial intelligence updates.
Co Z.ai skutečně odeslal
GLM-5.3 je model Mixture-of-Experts postavený na architektuře, kterou Z.ai nazývá glm_moe_dsa. Podle konfigurace zveřejněné spolu s váhami má síť na sobě 78 vrstev s 256 směrovanými experty, což aktivuje 8 expertů na token plus jednoho sdíleného experta. Kontextové okno zahrnuje 1 048 576 tokenů – celý milion – a model podporuje parametr „reasoning_effort“ s nízkým, vysokým a maximálním nastavením, přičemž výchozí hodnota je max.
Možná nejzajímavější poznámka na kartě modelu je upřímnost o tom, kde se vylepšení vzalo: GLM-5.3 používá stejný základní model jako GLM-5.2 a každý zisk pochází z následného školení. Laboratoř výstižně popisuje výsledek jako „nejschopnější model s otevřenými váhami pro kódování“.
Benchmarky: Open-Weights SOTA na Agentické kódování
Publikovaná hodnotící tabulka je rozsáhlá a neobvykle specifická, pokud jde o její metodologii, uvádí výsledky proti Kimi K3, DeepSeek-V4 Pro-0813, Qwen3.8-Max, Anthropic's Opus 4.8, Google's Fable 5 a GPT-5.6 Sol od OpenAI.
Na Terminal Bench 3.0 má GLM-5.3 skóre 28,3 — open source stav techniky a skok ze 4.6 pro GLM-5.2, i když stále za uzavřenou hranicí Fable 5 na 33,7 a GPT-5,6 Sol na 34,6. Na Terminal Bench 2.1 je to 88,2, v podstatě na úrovni Kimi K3 a GPT-5.6 Sol a před Opus 4.8 85,0. Výsledky DeepSWE mezi verzemi vyskočily z 46,2 na 66,9 a GLM-5.3 je na vrcholu tabulky na AutomationBench na 48,2 a na GDPval-AA v2 na 1769, posledně jmenovaný hodnocený umělou analýzou.
Z.ai také hlásí 50% zlepšení oproti GLM-5.2 na svém interním Code Bench, spolu s nejlepšími výsledky open-weights v benchmarcích, jako je Agents' Last Exam.
Otázka kybernetických schopností
Karta modelu je pozoruhodně přímočará ohledně vývoje, který bezpečnostní výzkumníci sledovali měsíce: „Jak jsme škálovali po školení, kybernetické schopnosti se rozvíjely rychleji, než jsme očekávali,“ uvádí karta. GLM-5.3 je nejmodernější na CyberGym pro zjišťování zranitelnosti na 84,5, převyšuje každý model na stole včetně GPT-5.6 Sol a více než zdvojnásobuje GLM-5.2 ve srovnávacích testech využití – 54,4 oproti 24,4 na ExploitBench a 105/139 na Exploit oproti rozpočtu 105/139.
AI Buzz Wire pokryl tyto schopnosti, když se objevily s vydáním pouze API v polovině srpna. Nyní se mění distribuce: váhy jsou ke stažení, kvantovaná komunitní sestavení budou pravděpodobně rychle následovat a každý, kdo má dostatek paměti, může model spustit lokálně. V diskuzi o Hacker News si někteří uživatelé všimli, že se tento model cítil méně omezující, pokud jde o úkoly související se zabezpečením, než alternativy hostované v USA – spíše dojmy komunity než oficiální prohlášení o politice, ale odráží to, proč se o tomto vydání diskutuje v bezpečnostních kruzích stejně jako v kruzích vývojářů.
Licence zaměřená na Hyperscalery
Na rozdíl od GLM-5.3-Flash, který je dodáván pod čistou licencí MIT, GLM-5.3 přichází s vlastní "GLM-5.3 licencí." The New Stack to charakterizoval jako zaměřený na hyperscalery a text to potvrzuje. Téměř pro každého jsou podmínky fakticky přípustné: používat, kopírovat, upravovat, slučovat, publikovat, distribuovat, licencovat a prodávat, pouze s požadavkem zahrnout upozornění.
Výjimka se zaměřuje na jeden konkrétní obchodní model. Pokud nabyvatel licence nebo jeho přidružené společnosti provozují obchod typu „Model as a Service“ – který nabízí třetím stranám odvození nebo dolaďovací přístup – a jejich kombinované příjmy překročí 10 miliard USD za jakýchkoli po sobě jdoucích 12 měsíců, musí před jakýmkoli komerčním využitím modelu nebo jeho derivátů projít bezpečnostní kontrolou Z.ai. Tato klauzule přesně vykresluje kruh kolem největších poskytovatelů cloudu, přičemž startupy, výzkumníky, podniky a středně velké hostitele nechává nedotčené.
Dvoukolejný přístup je výmluvný. Varianta Flash, nyní odhalená jako model Ox Alpha, který se stal virálním, než TechCrunch odhalil jeho původ, běží výhradně na čínském křemíku a nese vlajku MIT pro maximální přijetí. Vlajková loď získává zakázkovou licenci, která udržuje nasazení hyperscaleru – zejména v amerických cloudech – uzavřené za vlastním procesem kontroly Z.ai.
Spusťte to sami
Pro ty, kteří chtějí vyzkoušet, karta modelu uvádí podporu nasazení napříč vLLM, SGLang, KTransformers, Unsloth a Hugging Face Transformers s recepty na kuchařky pro několik z nich. Je pozoruhodné, že nasazení Huawei Ascend NPU je zdokumentováno prostřednictvím vLLM-Ascend, xLLM a SGLang – pokračuje v úsilí laboratoře dokázat, že hraniční modely běží na hardwaru jiného výrobce než Nvidia. V komunitě byla DeepInfra první, která nabídla koncový bod třetí strany otevřeného modelu na OpenRouter.
Z.ai také zveřejnil technickou zprávu o arXiv nazvanou „GLM-5: od Vibe Coding k Agentic Engineering“, která popisuje vývoj modelové rodiny.
Proč na tom záleží
Vydání komprimuje mezeru mezi uzavřenou hranicí a otevřenou hranicí na zaokrouhlovací chybu v mnoha testech agentního kódování – týdny, nikoli roky. V kombinaci s Kimi K3 a DeepSeek-V4 to znamená, že vývojáři mimo největší laboratoře mají nyní důvěryhodné alternativy, které mohou vlastnit, auditovat a vylaďovat.
Signalizuje to také posun v tom, jak jsou řízena otevřená vydání. Rozdělení mezi MIT a vlastními licencemi v rámci jedné modelové rodiny naznačuje, že čínské laboratoře se učí používat licencování jako strategickou infrastrukturu: otevřenost tam, kde buduje ekosystém, pákový efekt tam, kde chrání pozici. Dalším testem bude, zda se kterýkoli operátor MaaS v hodnotě 10 miliard dolarů skutečně podrobí bezpečnostní kontrole Z.ai – nebo zda klauzule jednoduše zadrží největší mračna, zatímco všichni ostatní staví na vrcholu.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →