Z.ai, makmal AI China yang dahulunya dikenali sebagai Zhipu AI, telah mengeluarkan berat penuh model GLM-5.3nya pada Hugging Face, menjadikan salah satu model pengekodan dan agenik terkuat yang tersedia kepada muat turun percuma. Keluaran itu disiarkan secara langsung pada 28 Ogos, hanya beberapa hari selepas makmal mengesahkan bahawa model siluman tular yang dikenali sebagai "Ox Alpha" sebenarnya adalah GLM-5.3-Flashnya sendiri, dan ia memenuhi janji wajaran terbuka yang membuatkan masyarakat menonton dengan teliti sepanjang minggu.

Halaman model dengan cepat mengumpul lebih daripada 1,100 suka, dan urutan Berita Hacker yang mengumumkan keluaran itu meningkat melepasi 600 mata apabila pembangun mencerna apa yang kini ada dalam repositori awam: 141 fail safetensors, dihantar dalam FP8, yang terdiri daripada model pengekodan yang boleh dimuat turun secara terbuka yang paling berkebolehan setakat ini. For more context on this story, see our ongoing more AI stories.

Apa yang Z.ai Dihantar Sebenarnya

GLM-5.3 ialah model Campuran Pakar yang dibina pada seni bina Z.ai memanggil glm_moe_dsa. Menurut konfigurasi yang diterbitkan bersama pemberat, rangkaian menyusun 78 lapisan dengan 256 pakar yang dihalakan, mengaktifkan 8 pakar setiap token ditambah satu pakar yang dikongsi. Tetingkap konteks merangkumi 1,048,576 token — sejuta penuh — dan model menyokong parameter "reasoning_effort" dengan tetapan rendah, tinggi dan maks, lalai kepada maks.

Mungkin nota yang paling menarik dalam kad model ialah keterbukaan tentang dari mana penambahbaikan itu datang: GLM-5.3 menggunakan model asas yang sama seperti GLM-5.2, dan setiap keuntungan datang daripada pasca latihan. Makmal dengan jelas menerangkan hasilnya sebagai "model pemberat terbuka yang paling berkebolehan untuk pengekodan."

Penanda Aras: SOTA Wajaran Terbuka pada Pengekodan Agen

Jadual penilaian yang diterbitkan adalah luas dan luar biasa khusus tentang metodologinya, menyenaraikan keputusan terhadap Kimi K3, DeepSeek-V4 Pro-0813, Qwen3.8-Max, Anthropic's Opus 4.8, Google's Fable 5 dan OpenAI's GPT-5.6 Sol.

Pada Terminal Bench 3.0, GLM-5.3 mendapat markah 28.3 — sumber terbuka terkini, dan melonjak daripada 4.6 untuk GLM-5.2, walaupun masih di belakang sempadan tertutup Fable 5 pada 33.7 dan GPT-5.6 Sol pada 34.6. Pada Bangku Terminal 2.1 ia mencatatkan 88.2, pada asasnya setaraf dengan Kimi K3 dan GPT-5.6 Sol dan mendahului 85.0 Opus 4.8. Keputusan DeepSWE melonjak daripada 46.2 kepada 66.9 antara versi, dan GLM-5.3 mendahului jadual di AutomationBench pada 48.2 dan pada GDPval-AA v2 pada 1769, yang terakhir dinilai oleh Analisis Buatan.

Z.ai juga melaporkan peningkatan 50% berbanding GLM-5.2 pada Bangku Kod dalamannya, di samping keputusan terbaik wajaran terbuka pada penanda aras seperti Peperiksaan Terakhir Ejen.

Soalan Keupayaan Siber

Kad model itu sangat jelas tentang perkembangan yang telah dijejaki oleh penyelidik keselamatan selama berbulan-bulan: "Ketika kami meningkatkan pasca latihan, keupayaan siber berkembang lebih cepat daripada yang kami jangkakan," kata kad itu. GLM-5.3 adalah terkini di CyberGym untuk penemuan kerentanan pada 84.5, mengetepikan setiap model di atas meja termasuk GPT-5.6 Sol, dan ia lebih daripada menggandakan GLM-5.2 pada penanda aras eksploitasi — 54.4 berbanding 24.4 pada ExploitBench, dan 105/290m pada ExploitBench dan 105/290s belanjawan.

AI Buzz Wire merangkumi keupayaan ini apabila ia muncul dengan keluaran API sahaja pada pertengahan bulan Ogos. Apa yang berubah sekarang ialah pengedaran: pemberat boleh dimuat turun, binaan komuniti terkuantiti mungkin akan mengikuti dengan cepat, dan sesiapa yang mempunyai memori yang mencukupi boleh menjalankan model secara setempat. Dalam perbincangan Hacker News, sesetengah pengguna menyatakan model itu berasa kurang ketat di sekitar tugas bersebelahan keselamatan berbanding alternatif yang dihoskan oleh AS — tanggapan komuniti dan bukannya tuntutan dasar rasmi, tetapi mencerminkan mengapa keluaran ini dibincangkan dalam kalangan keselamatan sama seperti tanggapan pembangun.

Lesen yang ditujukan kepada Hyperscalers

Tidak seperti GLM-5.3-Flash, yang dihantar di bawah lesen MIT yang bersih, GLM-5.3 tiba dengan "Lesen GLM-5.3" tersuai. The New Stack mencirikannya sebagai menyasarkan kepada hyperscalers, dan teks tersebut membuktikannya. Bagi hampir semua orang, terma adalah permisif dengan berkesan: menggunakan, menyalin, mengubah suai, menggabungkan, menerbitkan, mengedar, mensublesenkan dan menjual, dengan hanya satu keperluan untuk memasukkan notis.

Pengecualian menyasarkan satu model perniagaan tertentu. Jika pemegang lesen atau ahli gabungannya mengendalikan perniagaan "Model sebagai Perkhidmatan" — menawarkan inferens pihak ketiga atau akses penalaan halus — dan hasil gabungan mereka melebihi $10 bilion dalam mana-mana 12 bulan berturut-turut, mereka mesti lulus semakan keselamatan Z.ai sebelum sebarang penggunaan komersial model atau terbitannya. Klausa itu menarik bulatan tepat di sekeliling penyedia awan terbesar, sambil membiarkan syarikat pemula, penyelidik, perusahaan dan hos skala pertengahan tidak disentuh.

Pendekatan dua landasan adalah memberitahu. Varian Flash, kini didedahkan sebagai model Ox Alpha yang menjadi viral sebelum TechCrunch mendedahkan asal-usulnya, berjalan sepenuhnya pada silikon Cina dan membawa bendera MIT untuk penggunaan maksimum. Perdana mendapat lesen yang dipesan lebih dahulu yang mengekalkan penggunaan hyperscaler - terutamanya oleh awan Amerika - berpagar di belakang proses semakan Z.ai sendiri.

Menjalankannya Sendiri

Bagi mereka yang ingin mencuba, kad model menyenaraikan sokongan penggunaan merentas vLLM, SGLang, KTransformers, Unsloth dan Hugging Face Transformers, dengan resipi buku masakan untuk beberapa daripadanya. Terutamanya, penggunaan Huawei Ascend NPU didokumenkan melalui vLLM-Ascend, xLLM dan SGLang — meneruskan usaha makmal untuk membuktikan model sempadan dijalankan pada perkakasan bukan Nvidia. Dalam komuniti, DeepInfra adalah yang pertama menawarkan titik akhir pihak ketiga bagi model terbuka pada OpenRouter.

Z.ai juga menerbitkan laporan teknikal mengenai arXiv, bertajuk "GLM-5: from Vibe Coding to Agentic Engineering," yang meliputi pembangunan keluarga model.

Mengapa Ia Penting

Keluaran memampatkan jurang antara sempadan tertutup dan sempadan terbuka kepada ralat pembulatan pada banyak penanda aras pengekodan agen - minggu, bukan tahun. Digabungkan dengan Kimi K3 dan DeepSeek-V4, ini bermakna pembangun di luar makmal terbesar kini mempunyai alternatif yang boleh dipercayai yang boleh mereka miliki, diaudit dan diperhalusi.

Ia juga menandakan peralihan dalam cara keluaran terbuka ditadbir. Pemisahan MIT-vs-custom-lesen dalam keluarga model tunggal mencadangkan makmal China sedang belajar menggunakan pelesenan sebagai infrastruktur strategik: keterbukaan apabila ia membina ekosistem, memanfaatkan tempat ia melindungi kedudukan. Ujian seterusnya ialah sama ada mana-mana pengendali MaaS bernilai $10 bilion lebih benar-benar menyerahkan kepada semakan keselamatan Z.ai — atau sama ada klausa itu hanya memastikan awan terbesar keluar sementara orang lain membina di atas.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →