هویت Ox Alpha، مدل هوش مصنوعی بدون نام تجاری که از زمانی که در 20 آگوست در OpenRouter و OpenCode ظاهر شد، بر مکالمات توسعه دهندگان تسلط داشت، دیگر یک راز نیست. Z.AI چین روز چهارشنبه به بلومبرگ نیوز تأیید کرد که این مدل نسخه جدیدی از سری GLM آن است - و گفت که وزن های مدل را امشب منتشر می کند و آنها را برای دانلود و اجرا در دسترس همه قرار می دهد.

این تایید به یکی از دیوانه‌کننده‌ترین بازی‌های حدس‌زنی که جامعه هوش مصنوعی در سال جاری دیده است، پایان می‌دهد و یک مدل چینی درجه یک را در مسیر برخورد با آزمایشگاه‌های غربی قرار می‌دهد که توانایی‌های قابل‌مقایسه‌ای را با قیمتی بسیار بالا ارائه می‌کند. For more context on this story, see our ongoing AI trends.

پرتاب مخفی کاری که دقیقاً همانطور که طراحی شده بود کار می کرد

Ox Alpha با فهرستی وارد شد که همه چیز را در مورد کارهایی که می توانست انجام دهد و هیچ چیز در مورد اینکه چه کسی آن را ساخته است توضیح می داد. OpenRouter آن را به «یک ارائه‌دهنده شخص ثالث که انتخاب کرده است در طول این پیش‌نمایش ناشناس بماند» نسبت داد و آن را به عنوان یک مدل استدلالی که برای کدنویسی، کار عاملی پایدار و حجم‌های کاری تولید ساخته شده است، قرار داد.

این مشخصات به تنهایی برای تغییر ذهن کافی بود: یک پنجره زمینه با بیش از یک میلیون توکن، پشتیبانی از ورودی متن، تصویر، و ویدئو و دسترسی کاملا رایگان از طریق OpenRouter و OpenCode. OpenCode ظرفیت سرویس دهی 100 تریلیون توکن در روز را برای این مدل تبلیغ کرد، و Nous Research ادعا کرد که پورتال خودش می تواند از طریق یک کوادریلیون توکن عبور کند.

اجرای یک مدل مجاور مرزی به‌طور ناشناس در زیرساخت‌های خنثی به Z.AI این امکان را می‌دهد تا قبل از پیوست کردن نام تجاری خود، داده‌های استفاده واقعی و گپ‌های معیار بدون فیلتر را جمع‌آوری کند - کتاب بازی که از روایت تخفیف‌هایی که هر نسخه چینی با وزن باز را دنبال می‌کند، نادیده می‌گیرد، همانطور که OfficeChai در تحلیل خود از راه‌اندازی اشاره کرد.

اجرای محک که فیوز را روشن کرد

شیدایی به یک نقطه داده منفرد باز می گردد. در عرض یک روز پس از انتشار، بن دیویس، توسعه‌دهنده، ارزیابی غیررسمی ده وظیفه‌ای را بر روی بنچمارک DeepSWE انجام داد و 80 درصد دقت گذر اول را برای Ox Alpha گزارش کرد – بالاتر از Claude Fable 5 با 65 درصد و GPT-5.6 Sol با 52 درصد.

این نتیجه برای ویروسی شدن مدل و پایان دادن به رگه 56 روزه DeepSeek در صدر جدول امتیازات OpenCode کافی بود. همچنین فوراً با فشار مواجه شد. در هکر نیوز، جایی که تأیید بلومبرگ صدها نظر را به همراه داشت، توسعه‌دهندگان خواستار احتیاط شدند و خاطرنشان کردند که اجرای ده کار نمونه بسیار کوچکی برای حل و فصل هر چیزی است و نتایج این مدل در سایر تابلوهای امتیازات به طور قابل‌توجهی متفاوت‌تر بود.

چگونه اینترنت ابتدا پرونده را شکست

مدت‌ها قبل از تایید روز چهارشنبه، کارآگاهی اجتماعی قبلاً روی Z.AI - که قبلاً به نام Zhipu AI شناخته می‌شد - به‌عنوان نامزد اصلی مشخص شده بود. توسعه‌دهنده‌ای که از «dax» استفاده می‌کند، یک آزمایش اثر انگشت توکنایزر را روی 25 درخواست انجام داد و متوجه شد که تعداد توکن‌های خام Ox Alpha با توکنایزر GLM در 11 مورد از 11 کاوشگر مطابقت دارد، در حالی که هیچ مدل آزمایشگاهی دیگری چهار پروب را پاک نکرد. در کاوشگر یک رقمی، توکنایزر DeepSeek 98 توکن را سوزاند و GLM از 29 توکن استفاده کرد.

تجزیه و تحلیل جداگانه نشان داد که Ox Alpha به همان «ژتون کثیف» برخورد کرده است که در طول تاریخ مدل‌های خانواده Qwen و GLM را تحت تأثیر قرار داده است، و میدان را به یک آزمایشگاه چینی محدود کرده است. نظریه برجسته دیگر - شیائومی، که تیم MiMo آن قبلاً یک کتاب راه اندازی مخفیانه مشابه با MiMo-V2-Pro تحت نام مستعار Hunter Alpha اجرا می کرد - اکنون به نظر می رسد که یک طعمه بوده است.

مخاطرات افشاگری فراتر از حقوق لاف زدن است. نیویورک تایمز روز سه‌شنبه گزارش داد که انتشار مدل یک آزمایشگاه چینی می‌تواند آمادگی امنیت سایبری جهان را آزمایش کند، و تأکید می‌کند که دولت‌های غربی تا چه اندازه به‌دقت نسخه‌های با وزن باز با این کالیبر را تماشا می‌کنند.

چرا وزن های باز حساب را تغییر می دهند

تایید Z.AI مبنی بر اینکه وزن‌ها امشب می‌آیند، بخشی است که برای بازار مهم است. قیمت GLM 5.3 فعلی این شرکت 1.40 دلار به ازای هر میلیون توکن ورودی و 4.40 دلار به ازای هر میلیون توکن خروجی در API شخص اول است، با 81 درصد تخفیف کش. طبق گفته OfficeChai، انتظار می‌رود مدل جدید تحت همان مجوز MIT که Z.AI از GLM 5 استفاده کرده است، عرضه شود.

برنامه نویسی و عملکرد عاملی مجاور مرزی، که آشکارا با کسری از قیمت API غربی منتشر شده است، دقیقاً نقطه فشاری است که آزمایشگاه های برتر دو سال تلاش کرده اند از آن اجتناب کنند. همچنین Z.AI را در رقابت با DeepSeek در بازار چین باز نگه می‌دارد، جایی که مدل‌های قابل دانلود رایگان به انتظار پیش‌فرض برای هر چیزی غیر از مرز مطلق آزمایشگاه تبدیل شده‌اند.

بعدی چه چیزی را تماشا کنیم

جزئیات کلیدی تایید نشده باقی می‌مانند - مهم‌تر از همه تعداد پارامترها و اندازه مدل، که مشخص می‌کند انتشار برای استقرار محلی چقدر عملی است. بحث جامعه قبلاً در مورد نحوه پاسخگویی مدل به کوانتیشن و سرعت اجرای آن بر روی سخت افزار مصرف کننده به جای GPU های مرکز داده به صفر رسیده است.

آنچه مسلم است این است که یک هفته گمانه زنی های ناشناس چیزی را به Z.AI داده است که هیچ بودجه بازاریابی نمی تواند آن را بخرد: اعتبار بی طرفانه و ناشناس برند در زمینه بی طرف. اکنون که این مدل نام دارد، معیارها بسیار شلوغ‌تر و بسیار دقیق‌تر می‌شوند.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →