Z.ai, phòng thí nghiệm AI của Trung Quốc trước đây gọi là Zhipu AI, đã công bố toàn bộ trọng số của mô hình GLM-5.3 trên Hugging Face, biến một trong những mô hình mã hóa và tác nhân mạnh nhất hiện có thành bản tải xuống miễn phí. Bản phát hành được phát hành trực tiếp vào ngày 28 tháng 8, chỉ vài ngày sau khi phòng thí nghiệm xác nhận rằng mô hình tàng hình lan truyền có tên "Ox Alpha" trên thực tế là GLM-5.3-Flash của riêng họ và nó đáp ứng lời hứa về trọng lượng mở được cộng đồng theo dõi chặt chẽ suốt cả tuần.
Trang mô hình nhanh chóng thu thập được hơn 1.100 lượt thích và chủ đề Hacker News thông báo về bản phát hành đã vượt qua 600 điểm khi các nhà phát triển tiếp thu những gì hiện đang có trong kho lưu trữ công cộng: 141 tệp safetensors, được vận chuyển trong FP8, bao gồm những gì có thể là mô hình mã hóa có thể tải xuống công khai có khả năng nhất cho đến nay. For more context on this story, see our ongoing artificial intelligence updates.
Những gì Z.ai thực sự đã vận chuyển
GLM-5.3 là mô hình Hỗn hợp các chuyên gia được xây dựng trên kiến trúc mà Z.ai gọi là glm_moe_dsa. Theo cấu hình được công bố cùng với các trọng số, mạng xếp chồng 78 lớp với 256 chuyên gia được định tuyến, kích hoạt 8 chuyên gia trên mỗi mã thông báo cộng với một chuyên gia được chia sẻ. Cửa sổ ngữ cảnh trải dài 1.048.576 mã thông báo — một triệu đầy đủ — và mô hình hỗ trợ tham số "reasoning_effort" với các cài đặt thấp, cao và tối đa, mặc định là tối đa.
Có lẽ lưu ý thú vị nhất trong thẻ mô hình là sự thẳng thắn về nguồn gốc của những cải tiến: GLM-5.3 sử dụng cùng một mô hình cơ sở như GLM-5.2 và mọi lợi ích đều đến từ quá trình đào tạo sau. Phòng thí nghiệm mô tả rõ ràng kết quả này là "mô hình trọng lượng mở có khả năng nhất để mã hóa".
Điểm chuẩn: SOTA trọng lượng mở về mã hóa tác nhân
Bảng đánh giá được công bố rất rộng rãi và cụ thể một cách bất thường về phương pháp của nó, liệt kê các kết quả so với Kimi K3, DeepSeek-V4 Pro-0813, Qwen3.8-Max, Anthropic's Opus 4.8, Google's Fable 5 và OpenAI's GPT-5.6 Sol.
Trên Terminal Bench 3.0, GLM-5.3 đạt điểm 28,3 — trạng thái nguồn mở tiên tiến nhất và tăng từ 4,6 cho GLM-5.2, mặc dù vẫn xếp sau biên giới đóng của Fable 5 là 33,7 và GPT-5.6 Sol ở 34,6. Trên Terminal Bench 2.1, nó đăng 88.2, về cơ bản ngang bằng với Kimi K3 và GPT-5.6 Sol và cao hơn 85.0 của Opus 4.8. Kết quả DeepSWE đã tăng từ 46,2 lên 66,9 giữa các phiên bản và GLM-5.3 đứng đầu bảng trên AutomationBench ở 48,2 và trên GDPval-AA v2 ở 1769, phiên bản sau được đánh giá bởi Phân tích nhân tạo.
Z.ai cũng báo cáo mức cải thiện 50% so với GLM-5.2 trên Code Bench nội bộ của mình, cùng với kết quả tốt nhất ở hạng cân mở về điểm chuẩn như Bài kiểm tra cuối cùng của đại lý.
Câu hỏi về Năng lực Mạng
Thẻ mô hình rất thẳng thắn về một sự phát triển mà các nhà nghiên cứu an toàn đã theo dõi trong nhiều tháng: “Khi chúng tôi mở rộng quy mô sau đào tạo, khả năng mạng đã phát triển nhanh hơn chúng tôi mong đợi”, thẻ nêu rõ. GLM-5.3 là công nghệ tiên tiến trên CyberGym về khả năng phát hiện lỗ hổng ở mức 84,5, vượt xa mọi mô hình trên bảng bao gồm GPT-5.6 Sol và nó cao hơn gấp đôi GLM-5.2 về điểm chuẩn khai thác — 54,4 so với 24,4 trên ExploitBench và 105/130 so với 29/39 trên hai ngân sách thời gian của ExploitGym.
AI Buzz Wire đã đề cập đến những khả năng này khi chúng xuất hiện với bản phát hành chỉ dành cho API vào giữa tháng 8. Những thay đổi hiện nay là sự phân phối: trọng số có thể tải xuống, các bản dựng cộng đồng được lượng tử hóa có thể sẽ được thực hiện nhanh chóng và bất kỳ ai có đủ bộ nhớ đều có thể chạy mô hình cục bộ. Trong cuộc thảo luận về Hacker News, một số người dùng lưu ý rằng mô hình này ít hạn chế hơn đối với các tác vụ liên quan đến bảo mật so với các lựa chọn thay thế do Hoa Kỳ lưu trữ - ấn tượng của cộng đồng hơn là yêu cầu chính sách chính thức, nhưng phản ánh lý do tại sao bản phát hành này lại được thảo luận trong giới bảo mật nhiều như giới phát triển.
Giấy phép dành cho Hyperscaler
Không giống như GLM-5.3-Flash, được cung cấp theo giấy phép rõ ràng của MIT, GLM-5.3 đi kèm với "Giấy phép GLM-5.3" tùy chỉnh. New Stack đã mô tả nó là nhằm vào các công cụ siêu quy mô và văn bản đã chứng minh điều đó. Đối với hầu hết mọi người, các điều khoản này thực sự cho phép: sử dụng, sao chép, sửa đổi, hợp nhất, xuất bản, phân phối, cấp phép lại và bán, chỉ với yêu cầu đưa vào thông báo.
Ngoại lệ nhắm vào một mô hình kinh doanh cụ thể. Nếu người được cấp phép hoặc các đơn vị liên kết của họ vận hành một doanh nghiệp "Mô hình dưới dạng dịch vụ" — cung cấp cho bên thứ ba quyền truy cập suy luận hoặc tinh chỉnh — và tổng doanh thu của họ vượt quá 10 tỷ USD trong 12 tháng liên tiếp bất kỳ, thì họ phải vượt qua đánh giá bảo mật của Z.ai trước bất kỳ hoạt động sử dụng thương mại nào đối với mô hình hoặc các sản phẩm phái sinh của nó. Điều khoản đó vẽ ra một vòng tròn chính xác xung quanh các nhà cung cấp đám mây lớn nhất, đồng thời không ảnh hưởng đến các công ty khởi nghiệp, nhà nghiên cứu, doanh nghiệp và máy chủ quy mô trung bình.
Cách tiếp cận hai chiều đang nói lên điều đó. Biến thể Flash, hiện được tiết lộ là mẫu Ox Alpha đã lan truyền trước khi TechCrunch phát hiện ra nguồn gốc của nó, chạy hoàn toàn bằng silicon của Trung Quốc và mang cờ MIT để được áp dụng tối đa. Flagship này nhận được giấy phép riêng để đảm bảo việc triển khai siêu quy mô — đặc biệt là bởi các đám mây của Mỹ — tuân theo quy trình đánh giá riêng của Z.ai.
Tự mình điều hành
Đối với những người muốn thử, thẻ mô hình liệt kê hỗ trợ triển khai trên vLLM, SGLang, KTransformers, Unsloth và Hugging Face Transformers, cùng với các công thức nấu ăn trong sách nấu ăn cho một số trong số đó. Đáng chú ý, việc triển khai NPU Huawei Ascend được ghi lại thông qua vLLM-Ascend, xLLM và SGLang — tiếp tục nỗ lực của phòng thí nghiệm nhằm chứng minh các mô hình tiên tiến chạy trên phần cứng không phải của Nvidia. Trong cộng đồng, DeepInfra là công ty đầu tiên cung cấp điểm cuối của bên thứ ba cho mô hình mở trên OpenRouter.
Z.ai cũng đã xuất bản một báo cáo kỹ thuật về arXiv, có tiêu đề "GLM-5: từ Vibe Coding đến Agentic Engineering", đề cập đến quá trình phát triển của dòng mô hình.
Tại sao nó lại quan trọng
Bản phát hành đã thu hẹp khoảng cách giữa biên giới đóng và biên giới mở thành sai số làm tròn trên nhiều điểm chuẩn mã hóa tác nhân - tuần chứ không phải năm. Kết hợp với Kimi K3 và DeepSeek-V4, điều đó có nghĩa là các nhà phát triển bên ngoài các phòng thí nghiệm lớn nhất hiện có các lựa chọn thay thế đáng tin cậy mà họ có thể sở hữu, kiểm tra và tinh chỉnh.
Nó cũng báo hiệu một sự thay đổi trong cách quản lý các bản phát hành mở. Sự phân chia giấy phép MIT và giấy phép tùy chỉnh trong một nhóm mô hình duy nhất cho thấy các phòng thí nghiệm Trung Quốc đang học cách sử dụng giấy phép làm cơ sở hạ tầng chiến lược: tính cởi mở khi xây dựng hệ sinh thái, tận dụng khi bảo vệ vị thế. Thử nghiệm tiếp theo sẽ là liệu có nhà điều hành MaaS trị giá hơn 10 tỷ USD nào thực sự gửi bản đánh giá bảo mật Z.ai hay không – hay liệu điều khoản này chỉ đơn giản là loại bỏ những đám mây lớn nhất trong khi những người khác xây dựng trên đầu.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →