Danh tính của Ox Alpha, mô hình AI không có thương hiệu đã thống trị các cuộc trò chuyện của nhà phát triển kể từ khi xuất hiện trên OpenRouter và OpenCode vào ngày 20 tháng 8, không còn là điều bí ẩn. Z.AI của Trung Quốc đã xác nhận với Bloomberg News hôm thứ Tư rằng mẫu này là phiên bản mới của dòng GLM - và cho biết họ sẽ công bố trọng lượng của mẫu vào tối nay, để mọi người có thể tải xuống và sử dụng.
Việc xác nhận kết thúc một trong những trò chơi phỏng đoán điên cuồng nhất mà cộng đồng AI từng thấy trong năm nay và nó đưa một mô hình hàng đầu của Trung Quốc vào cuộc cạnh tranh với các phòng thí nghiệm phương Tây vốn định giá các khả năng tương đương ở mức cao hơn. For more context on this story, see our ongoing AI trends.
Một vụ phóng lén lút hoạt động đúng như thiết kế
Ox Alpha đưa ra một danh sách mô tả mọi thứ về những gì nó có thể làm và không nói gì về người đã xây dựng nó. OpenRouter gán nó cho "một nhà cung cấp bên thứ ba đã chọn ẩn danh trong bản xem trước này" và định vị nó như một mô hình lý luận được xây dựng cho mã hóa, công việc tác nhân được duy trì và khối lượng công việc sản xuất.
Chỉ riêng các thông số kỹ thuật cũng đủ khiến mọi người phải ngoái nhìn: một cửa sổ ngữ cảnh chỉ có hơn một triệu mã thông báo, hỗ trợ nhập văn bản, hình ảnh và video cũng như quyền truy cập hoàn toàn miễn phí thông qua cả OpenRouter và OpenCode. OpenCode đã quảng cáo khả năng phục vụ 100 nghìn tỷ token mỗi ngày cho mô hình này và Nous Research tuyên bố cổng thông tin riêng của họ có thể vượt qua một triệu triệu token.
Việc chạy ẩn danh một mô hình liền kề biên giới trên cơ sở hạ tầng trung lập cho phép Z.AI thu thập dữ liệu sử dụng thực tế và các cuộc trò chuyện về điểm chuẩn chưa được lọc trước khi gắn thương hiệu của mình - một cuốn sách giúp tránh câu chuyện giảm giá theo sau mỗi bản phát hành mở của Trung Quốc, như OfficeChai đã lưu ý trong phân tích về buổi ra mắt.
Cuộc chạy benchmark đã thắp sáng cầu chì
Cơn hưng cảm quay trở lại một điểm dữ liệu duy nhất. Trong vòng một ngày kể từ khi phát hành, nhà phát triển Ben Davis đã thực hiện đánh giá mười nhiệm vụ không chính thức trên điểm chuẩn DeepSWE và báo cáo độ chính xác trong lần vượt qua đầu tiên là 80% cho Ox Alpha - trước Claude Fable 5 ở mức 65% và GPT-5.6 Sol ở mức 52%.
Kết quả đó đủ để khiến mô hình trở nên lan truyền và chấm dứt chuỗi 56 ngày của DeepSeek ở vị trí đầu bảng xếp hạng OpenCode. Nó cũng thu hút sự phản đối ngay lập tức. Trên Hacker News, nơi xác nhận của Bloomberg đã thu hút hàng trăm bình luận, các nhà phát triển kêu gọi thận trọng, lưu ý rằng việc chạy mười tác vụ là một mẫu quá nhỏ để giải quyết bất cứ điều gì và kết quả của mô hình trên các bảng xếp hạng khác rõ ràng là hỗn tạp hơn.
Internet đã phá vụ án đầu tiên như thế nào
Rất lâu trước khi xác nhận vào thứ Tư, công việc thám tử cộng đồng đã xác định Z.AI – trước đây gọi là Zhipu AI – là ứng cử viên hàng đầu. Một nhà phát triển có tên là "dax" đã chạy thử nghiệm lấy dấu vân tay của mã thông báo qua 25 lời nhắc và nhận thấy rằng số lượng mã thông báo thô của Ox Alpha khớp với mã thông báo của GLM trên 11 trên 11 đầu dò, trong khi không có mô hình phòng thí nghiệm nào khác đạt được bốn. Trong cuộc thăm dò một chữ số, mã thông báo của DeepSeek đã đốt 98 mã thông báo trong đó GLM sử dụng 29 mã thông báo.
Phân tích riêng biệt cho thấy Ox Alpha đã vấp phải cùng một "mã thông báo bẩn" từng từng gây vấp ngã cho các mô hình gia đình Qwen và GLM, từ đó thu hẹp lĩnh vực sang phòng thí nghiệm Trung Quốc từ rất sớm. Giả thuyết nổi bật khác – Xiaomi, đội ngũ MiMo của họ trước đây đã thực hiện một chiến thuật phóng lén lút giống hệt với MiMo-V2-Pro với bí danh Hunter Alpha – giờ đây dường như chỉ là mồi nhử.
Cổ phần của tiết lộ vượt ra ngoài quyền khoe khoang. Tờ New York Times hôm thứ Ba đưa tin rằng bản phát hành mô hình của phòng thí nghiệm Trung Quốc có thể kiểm tra mức độ sẵn sàng về an ninh mạng của thế giới, nhấn mạnh mức độ chặt chẽ của các chính phủ phương Tây đang theo dõi các bản phát hành mở rộng tầm cỡ này.
Tại sao tạ mở lại làm thay đổi phép tính
Việc Z.AI xác nhận rằng các cuộc cân nhắc sẽ diễn ra vào tối nay là phần quan trọng đối với thị trường. GLM 5.3 hiện tại của công ty có giá 1,40 USD trên một triệu mã thông báo đầu vào và 4,40 USD trên một triệu mã thông báo đầu ra trên API của bên thứ nhất, với mức chiết khấu bộ đệm 81%. Theo OfficeChai, mẫu máy mới dự kiến sẽ được xuất xưởng theo cùng giấy phép MIT mà Z.AI đã sử dụng kể từ GLM 5.
Hiệu suất tác nhân và mã hóa liền kề biên giới, được phát hành công khai với mức giá bằng một phần nhỏ so với mức giá API của phương Tây, chính xác là điểm áp lực mà các phòng thí nghiệm cao cấp đã dành hai năm để cố gắng tránh. Nó cũng giúp Z.AI cạnh tranh với DeepSeek ở khía cạnh trọng lượng mở của thị trường Trung Quốc, nơi các mô hình có thể tải xuống miễn phí đã trở thành kỳ vọng mặc định cho bất kỳ thứ gì nằm ngoài ranh giới tuyệt đối của phòng thí nghiệm.
Xem gì tiếp theo
Các chi tiết chính vẫn chưa được xác nhận — quan trọng nhất là số lượng tham số và kích thước mô hình, những yếu tố này sẽ quyết định mức độ thực tế của bản phát hành đối với việc triển khai cục bộ. Cuộc thảo luận của cộng đồng đã tập trung vào cách mô hình phản ứng với lượng tử hóa và tốc độ chạy trên phần cứng của người tiêu dùng thay vì GPU của trung tâm dữ liệu.
Điều chắc chắn là một tuần suy đoán ẩn danh đã mang lại cho Z.AI thứ mà không ngân sách tiếp thị nào có thể mua được: sự xác nhận khách quan, bất khả tri về thương hiệu trên cơ sở trung lập. Bây giờ mô hình đã có tên, các điểm chuẩn sắp trở nên đông đúc hơn - và khắt khe hơn rất nhiều.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →