Năm ngày sau khi một mô hình AI miễn phí, đẳng cấp nhất có tên Ox Alpha xuất hiện trên OpenRouter mà không có người sáng tạo nào được nêu tên, whodunit yêu thích trên Internet cuối cùng có thể đã có nghi phạm chính. Một phân tích độc lập do công ty tư vấn tìm kiếm Dejan công bố lập luận rằng mô hình bí ẩn là GLM, dòng mô hình được xây dựng bởi phòng thí nghiệm AI Trung Quốc Zhipu AI, giao dịch với tên Z.ai - và bằng chứng rõ ràng hơn hầu hết các phỏng đoán lưu hành trên mạng.
Tuyên bố này được Dan Petrovic của Dejan đưa ra vào ngày 23 tháng 8, dựa trên hai kỹ thuật: một thao tác tiêm nhắc nhở đã dụ mô hình rò rỉ các chi tiết về dấu nhắc hệ thống ẩn của chính nó và một phương pháp lấy dấu vân tay dựa trên nén để so sánh mức độ hiệu quả mà các đầu ra của mô hình nén với nhau. Họ cùng nhau đưa ra vụ án công khai mạnh mẽ nhất về ai thực sự phục vụ Ox Alpha. For more context on this story, see our ongoing artificial intelligence updates.
Người mẫu tiết lộ điều gì về bản thân
Bước đầu tiên là kỹ thuật xã hội. Bằng cách hỏi Sửu Alpha một câu hỏi tưởng chừng như vô hại - tin nhắn trước đó có bao nhiêu từ? - dấu vết suy luận có thể nhìn thấy của mô hình đi qua các hướng dẫn hệ thống của chính nó trong khi đếm chúng. Lời nhắc ẩn đó, được trích dẫn trong bài viết của Dejan, hướng dẫn người mẫu "xác định chính mình một cách nghiêm ngặt là mô hình 'ox-alpha', được phát triển bởi một tổ chức bí mật" và "không tự nhận mình là bất kỳ người mẫu nào khác".
Trong thử nghiệm thứ hai, các nhà nghiên cứu đã đưa lời nhắc hệ thống được trích xuất đó trở lại mô hình dưới dạng thông báo người dùng thông thường. Theo bản ghi được công bố, người mẫu lý luận rằng việc sử dụng danh tính giả sẽ là lừa đảo, sau đó tuyên bố rõ ràng: danh tính thực sự của nó là "GLM, do Z.ai tạo ra". Bản tự báo cáo của một mô hình không phải là bằng chứng - các mô hình biên giới thường xuyên nhận dạng sai bản thân khi được đào tạo về dữ liệu về các mô hình khác - nhưng nó đã thu hẹp phạm vi tìm kiếm một cách đáng kể.
Dấu vân tay nén
Kỹ thuật thứ hai khó tranh luận hơn. Dejan đã áp dụng một trình phân loại không có tham số được xây dựng trên Khoảng cách nén chuẩn hóa (NCD), một phương pháp học thuật từ nghiên cứu phân loại văn bản nhằm đo lường mức độ hai văn bản nén lại với nhau. Các văn bản có chung phong cách DNA sẽ nén hiệu quả hơn khi được ghép nối, do đó, phương pháp này không cần trọng số mô hình và không cần nhúng - chỉ cần xuất các mẫu.
Nhóm đã tạo ra 293 văn bản tham khảo bằng cách sử dụng năm mô hình đã biết - GPT-5.5, Claude Opus 5, Gemini 3.7 Flash, Gemini 3.1 Pro Preview và GLM-5.3 - trả lời 60 lời nhắc bao gồm các bài tiểu luận, mã, email, hội thoại và thơ. Ox Alpha đã trả lời 14 lời nhắc giống nhau và một cuộc bỏ phiếu k-láng giềng gần nhất đã chỉ định mỗi câu trả lời cho trận đấu nén gần nhất của nó. GLM-5.3 đã giành được 7 trong số 14 phân loại, với Claude Opus 5 giây ở vị trí 3 trên 14, Gemini 3.7 Flash ở vị trí 2, và GPT-5.5 và Gemini 3.1 Pro Preview ở mỗi vị trí 1. GLM-5.3 luôn dẫn đầu ở mọi quy mô vùng lân cận được thử nghiệm.
Trường hợp chống lại - và các lý thuyết đối thủ
Không phải ai cũng bị thuyết phục. Một cuộc thảo luận của Hacker News về phân tích đã thu hút sự phản đối mạnh mẽ từ các nhà phát triển, những người lưu ý rằng GLM-5.3 hàng đầu của Zhipu là mẫu chỉ có văn bản, trong khi danh sách OpenRouter của Ox Alpha chấp nhận văn bản, hình ảnh và video làm đầu vào. Họ cho rằng trừ khi Zhipu lặng lẽ bổ sung một bộ mã hóa thị giác có khả năng, nếu không dấu vân tay có thể gây hiểu nhầm. Các dự đoán thay thế trong chủ đề này bao gồm Kimi K3.5 của Moonshot, M3 của MiniMax, MiMO của Xiaomi và thậm chí cả một mô hình tùy chỉnh được đào tạo dựa trên ngăn xếp của GLM.
Quầy theo sau một cách nhanh chóng. Zhipu đã xuất xưởng các mô hình đa phương thức trước đó - dòng GLM-5V và CogVLM trước đó - và phòng thí nghiệm đối thủ DeepSeek gần đây đã bổ sung tầm nhìn vào một mô hình chỉ có văn bản trước đây của chính họ. Một số người bình luận cũng báo cáo rằng Ox Alpha trả về các thông báo lỗi phụ trợ giống hệt với thông báo từ các điểm cuối khác của Zhipu, một chi tiết chỉ ra cơ sở hạ tầng phục vụ dùng chung bất kể trọng lượng liên quan. Zhipu được cho là đã bảo đảm một cụm tính toán mới lớn trong năm nay, điều này sẽ giúp giải thích ai có đủ khả năng đưa ra nhiều suy luận như vậy.
Quy mô là đầu mối khác. Theo số liệu được các nhà phát triển trích dẫn trong chủ đề Hacker News, OpenRouter cho biết họ đang định tuyến theo thứ tự sáu nghìn tỷ token mỗi ngày thông qua Ox Alpha, khiến đây trở thành lần ra mắt lớn nhất của nền tảng cho đến nay. Cung cấp miễn phí khối lượng đó ngụ ý năng lực dự phòng khổng lồ hoặc kiến trúc hiệu quả bất thường - và rất ít tổ chức đủ điều kiện.
Từ bí ẩn diễn đàn đến câu chuyện chính thống
Những gì bắt đầu như một chủ đề Hacker News gồm 263 điểm vào ngày 20 tháng 8 đã trở thành một sự kiện tin tức được đưa tin rộng rãi. TechCrunch hỏi "Ai đứng đằng sau 'mô hình tàng hình' Ox Alpha mới?", Business Insider đưa tin rằng "một mô hình AI miễn phí bí ẩn đang gây ấn tượng với các nhà phát triển" mà không có nhà sản xuất nào biết đến, và The Independent gọi đó là "hệ thống AI bí ẩn, cực kỳ mạnh mẽ" xuất hiện trực tuyến. Danh sách riêng của mô hình, được xác minh thông qua API của OpenRouter, mô tả nó là "một mô hình lý luận được thiết kế để mã hóa, công việc tác nhân bền vững và khối lượng công việc sản xuất" với cửa sổ ngữ cảnh một triệu mã thông báo, đầu ra tối đa 131.072 mã thông báo và lý do bắt buộc được đặt ở nỗ lực tối đa theo mặc định. Giá bằng 0 cho cả lời nhắc và lần hoàn thành.
Cả Zhipu và OpenRouter đều không xác nhận hay từ chối ghi công và các điều khoản của danh sách ẩn chỉ nêu rõ rằng mô hình "được phát triển và vận hành bởi nhà cung cấp bên thứ ba, người đã chọn ẩn danh trong bản xem trước này." Cho đến khi nhà cung cấp bước tiếp, GLM vẫn là giả thuyết hàng đầu chứ không phải là một sự thật đã được giải quyết - nhưng nếu dấu vân tay nén được giữ vững, Ox Alpha có thể trở thành màn ra mắt yên tĩnh ồn ào nhất từ trước đến nay của Zhipu.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →