Model misteri yang menghabiskan masa seminggu pembangun menawan di bawah nama tanpa nama Ox Alpha kini mempunyai identiti rasmi. Z.AI China telah melancarkan GLM-5.3-Flash, model multimodal asli, berat terbuka yang dikeluarkan di bawah lesen MIT yang permisif — dan syarikat itu berkata keseluruhan pratonton siluman dijalankan pada cip AI buatan China. Pelancaran itu menutup salah satu permainan meneka yang paling diperhatikan dalam industri AI tahun ini. Untuk latar belakang tentang bagaimana cerita itu berlaku, lihat [perkembangan AI terkini] kami(https://aibuzzwire.news).

Apa yang Z.ai hantar sebenarnya

GLM-5.3-Flash ialah model campuran pakar dengan 320 bilion jumlah parameter dan 18 bilion parameter aktif — penurunan ketara daripada 32 bilion parameter aktif GLM-4.5 pendahulunya. Ia merupakan model multimodal asli pertama dalam keluarga GLM-5, menerima input teks dan imej, dan ia menyokong tetingkap konteks yang mencapai satu juta token, menurut pengumuman Z.ai.

Model ini telah dilatih pada korpus multimodal 30 trilion token, dan seni binanya mencampurkan perhatian linear untuk kebergantungan tempatan dengan perhatian yang jarang untuk konteks global. Komponen Z.ai memanggil IndexPool memampatkan kumpulan vektor kunci pengindeks untuk mengehadkan kependaman dan penggunaan memori pada panjang konteks yang panjang. Syarikat itu melaporkan tiga kali kurang perhatian pengiraan dan pengurangan 4.4 kali ganda dalam saiz cache KV berbanding dengan GLM-5.3.

Tuntutan dan harga penanda aras

Pada Indeks Kecerdasan Analisis Buatan v4.1.1, GLM-5.3-Flash mendapat markah 57 — angka yang meletakkannya di bahagian atas kedudukan model semasa Analisis Buatan, jauh di atas median perbandingan 18. Z.ai berkata ia mengatasi prestasi GLM-5.2 merentas ujian pengekodan dan agenik yang dilaporkan pada satu persepuluh harga, dan mendekati 4 persepuluh harga Opus, dan pendekatan 4 Clauderopic dalamannya. penanda aras. Pada DeepSWE v1.1, model itu mendapat markah 63.4 berbanding 46.2 untuk GLM-5.2; pada AutomationBench ia mencapai 48.8 berbanding 26.2. Seperti yang dinyatakan TestingCatalog, abah-abah penilaian yang berbeza, had konteks dan tetapan penjanaan bermakna perbandingan ujian silang sangat bergantung pada setiap persediaan.

Harga meletakkan model sebagai murah secara agresif: $0.15 setiap juta token input dan $0.50 setiap juta token keluaran, dengan diskaun cache segera 83%, menurut Analisis Buatan. Z.ai memetik kos diskaun sebanyak $0.045 bagi setiap tugas Indeks Perisikan.

Sudut cip Cina

Perincian yang paling penting secara strategik ialah infrastruktur, bukan kecerdasan. Sebelum pelancaran, model itu dijalankan tanpa nama sebagai `ox-alpha` pada OpenRouter dan OpenCode mulai 20 Ogos, dan Z.ai berkata ia menjadi model paling popular minggu ini pada perkhidmatan tersebut — dengan trafik disediakan sepenuhnya pada pemecut Cina domestik. Untuk menyokongnya, Z.ai membina tindanan penyajian berasaskan SGLang yang memisahkan pengekodan, praisi dan penyahkodan, melaporkan peningkatan tiga kali ganda dalam prestasi penyajian hujung ke hujung merentas puluhan ribu cip AI China.

Itu penting melebihi satu vendor. Ia adalah demonstrasi awam bahawa model Cina bersebelahan sempadan boleh dihidangkan secara berskala tanpa perkakasan Nvidia, titik data pembuat dasar dan pembuat cip Barat tidak akan mengabaikannya. The New Stack meringkaskan keluaran sebagai murah, bagus dan disajikan pada kerepek Cina — tiga kualiti jarang dituntut bersama sehingga kini.

Wajaran terbuka, penggunaan sebenar

Pemberat tersedia pada Wajah Memeluk di bawah lesen MIT, dengan penggunaan tempatan disokong melalui SGLang, vLLM dan TokenSpeed. Pelanggan Pelan Pengekodan GLM mendapat GLM-5.3-Flash secara langsung dengan tiga kali ganda kuota boleh guna GLM-5.3, dan keupayaan multimodalnya didedahkan dalam ZCode melalui Penggunaan Penyemak Imbas dan integrasi Penggunaan Komputer.

Penaakulan visual adalah penting kepada keluaran: Z.ai melatih model untuk memeriksa antara muka yang diberikan, permainan dan output 3D, kemudian menilai dan menyemak kerjanya sendiri daripada maklum balas visual. Pendekatan yang sama meliputi dokumen, hamparan, pembentangan dan papan pemuka — artifak roti dan mentega kerja pejabat, yang mana saingan Qwen keluaran pada hari yang sama juga menuntut keuntungan terbesarnya.

Keputusan wajaran terbuka penting untuk ekosistem melangkaui penggemar. Pelesenan MIT ialah lesen biasa yang paling permisif dalam AI: penggunaan komersil, pengubahsuaian dan pengedaran semula tidak membawa kewajipan copyleft. Hos bebas boleh menyediakan GLM-5.3-Flash pada perkakasan mereka sendiri, memperhalusinya untuk menegak daripada semakan undang-undang kepada automasi industri dan membenamkannya dalam produk tanpa merundingkan syarat — pilihan yang ditutup oleh model sempadan API sahaja.

Sebab pelancaran senyap itu berjaya

Pelancaran tanpa nama memberi Z.ai sesuatu yang tidak dapat dibeli oleh belanjawan pemasaran: pengesahan agnostik jenama. Pembangun menggunakan Ox Alpha atas meritnya, tanpa pembingkaian makmal China berbanding penyandang Amerika. Pada masa Bloomberg mengesahkan Z.AI sebagai pembuat dan Business Insider mengisytiharkan "misteri terpecahkan," model itu telah pun mendahului papan pendahulu komuniti di kawasan neutral.

Tekanan persaingan kini jelas. Model multimodal dengan konteks satu juta token, pemberat berlesen MIT dan penentuan harga output sub-dolar memaksa setiap penyandang untuk mewajarkan senarai harganya. Sempadan Pareto untuk harga-berbanding-prestasi — yang sebenarnya dirasai oleh pembangun pertukaran — telah dilukis semula, seperti yang diikut secara meluas oleh pengulas AI Andrew Curran meletakkannya pada X.

Persoalan terbuka ialah ketahanan: sama ada petunjuk penanda aras bertahan di bawah penggunaan dunia sebenar yang bertentangan, dan seberapa cepat makmal Barat bertindak balas terhadap harga. Walau apa pun, minggu spekulasi tanpa nama berakhir dengan model bernama, pemberat boleh dimuat turun dan armada perkhidmatan yang tidak menggunakan silikon Amerika.

---

Kekal Mendahului AI

Dapatkan berita, analisis dan penemuan terkini AI — semuanya di satu tempat.

Baca lebih banyak berita AI →