هویت Ox Alpha، مدل هوش مصنوعی بدون نام تجاری که از زمانی که در 20 آگوست در OpenRouter و OpenCode ظاهر شد، بر مکالمات توسعه دهندگان تسلط داشت، دیگر یک راز نیست. Z.AI چین روز چهارشنبه به بلومبرگ نیوز تأیید کرد که این مدل نسخه جدیدی از سری GLM آن است - و گفت که وزن های مدل را امشب منتشر می کند و آنها را برای دانلود و اجرا در دسترس همه قرار می دهد.
این تایید به یکی از دیوانهکنندهترین بازیهای حدسزنی که جامعه هوش مصنوعی در سال جاری دیده است، پایان میدهد و یک مدل چینی درجه یک را در مسیر برخورد با آزمایشگاههای غربی قرار میدهد که تواناییهای قابلمقایسهای را با قیمتی بسیار بالا ارائه میکند. For more context on this story, see our ongoing AI trends.
پرتاب مخفی کاری که دقیقاً همانطور که طراحی شده بود کار می کرد
Ox Alpha با فهرستی وارد شد که همه چیز را در مورد کارهایی که می توانست انجام دهد و هیچ چیز در مورد اینکه چه کسی آن را ساخته است توضیح می داد. OpenRouter آن را به «یک ارائهدهنده شخص ثالث که انتخاب کرده است در طول این پیشنمایش ناشناس بماند» نسبت داد و آن را به عنوان یک مدل استدلالی که برای کدنویسی، کار عاملی پایدار و حجمهای کاری تولید ساخته شده است، قرار داد.
این مشخصات به تنهایی برای تغییر ذهن کافی بود: یک پنجره زمینه با بیش از یک میلیون توکن، پشتیبانی از ورودی متن، تصویر، و ویدئو و دسترسی کاملا رایگان از طریق OpenRouter و OpenCode. OpenCode ظرفیت سرویس دهی 100 تریلیون توکن در روز را برای این مدل تبلیغ کرد، و Nous Research ادعا کرد که پورتال خودش می تواند از طریق یک کوادریلیون توکن عبور کند.
اجرای یک مدل مجاور مرزی بهطور ناشناس در زیرساختهای خنثی به Z.AI این امکان را میدهد تا قبل از پیوست کردن نام تجاری خود، دادههای استفاده واقعی و گپهای معیار بدون فیلتر را جمعآوری کند - کتاب بازی که از روایت تخفیفهایی که هر نسخه چینی با وزن باز را دنبال میکند، نادیده میگیرد، همانطور که OfficeChai در تحلیل خود از راهاندازی اشاره کرد.
اجرای محک که فیوز را روشن کرد
شیدایی به یک نقطه داده منفرد باز می گردد. در عرض یک روز پس از انتشار، بن دیویس، توسعهدهنده، ارزیابی غیررسمی ده وظیفهای را بر روی بنچمارک DeepSWE انجام داد و 80 درصد دقت گذر اول را برای Ox Alpha گزارش کرد – بالاتر از Claude Fable 5 با 65 درصد و GPT-5.6 Sol با 52 درصد.
این نتیجه برای ویروسی شدن مدل و پایان دادن به رگه 56 روزه DeepSeek در صدر جدول امتیازات OpenCode کافی بود. همچنین فوراً با فشار مواجه شد. در هکر نیوز، جایی که تأیید بلومبرگ صدها نظر را به همراه داشت، توسعهدهندگان خواستار احتیاط شدند و خاطرنشان کردند که اجرای ده کار نمونه بسیار کوچکی برای حل و فصل هر چیزی است و نتایج این مدل در سایر تابلوهای امتیازات به طور قابلتوجهی متفاوتتر بود.
چگونه اینترنت ابتدا پرونده را شکست
مدتها قبل از تایید روز چهارشنبه، کارآگاهی اجتماعی قبلاً روی Z.AI - که قبلاً به نام Zhipu AI شناخته میشد - بهعنوان نامزد اصلی مشخص شده بود. توسعهدهندهای که از «dax» استفاده میکند، یک آزمایش اثر انگشت توکنایزر را روی 25 درخواست انجام داد و متوجه شد که تعداد توکنهای خام Ox Alpha با توکنایزر GLM در 11 مورد از 11 کاوشگر مطابقت دارد، در حالی که هیچ مدل آزمایشگاهی دیگری چهار پروب را پاک نکرد. در کاوشگر یک رقمی، توکنایزر DeepSeek 98 توکن را سوزاند و GLM از 29 توکن استفاده کرد.
تجزیه و تحلیل جداگانه نشان داد که Ox Alpha به همان «ژتون کثیف» برخورد کرده است که در طول تاریخ مدلهای خانواده Qwen و GLM را تحت تأثیر قرار داده است، و میدان را به یک آزمایشگاه چینی محدود کرده است. نظریه برجسته دیگر - شیائومی، که تیم MiMo آن قبلاً یک کتاب راه اندازی مخفیانه مشابه با MiMo-V2-Pro تحت نام مستعار Hunter Alpha اجرا می کرد - اکنون به نظر می رسد که یک طعمه بوده است.
مخاطرات افشاگری فراتر از حقوق لاف زدن است. نیویورک تایمز روز سهشنبه گزارش داد که انتشار مدل یک آزمایشگاه چینی میتواند آمادگی امنیت سایبری جهان را آزمایش کند، و تأکید میکند که دولتهای غربی تا چه اندازه بهدقت نسخههای با وزن باز با این کالیبر را تماشا میکنند.
چرا وزن های باز حساب را تغییر می دهند
تایید Z.AI مبنی بر اینکه وزنها امشب میآیند، بخشی است که برای بازار مهم است. قیمت GLM 5.3 فعلی این شرکت 1.40 دلار به ازای هر میلیون توکن ورودی و 4.40 دلار به ازای هر میلیون توکن خروجی در API شخص اول است، با 81 درصد تخفیف کش. طبق گفته OfficeChai، انتظار میرود مدل جدید تحت همان مجوز MIT که Z.AI از GLM 5 استفاده کرده است، عرضه شود.
برنامه نویسی و عملکرد عاملی مجاور مرزی، که آشکارا با کسری از قیمت API غربی منتشر شده است، دقیقاً نقطه فشاری است که آزمایشگاه های برتر دو سال تلاش کرده اند از آن اجتناب کنند. همچنین Z.AI را در رقابت با DeepSeek در بازار چین باز نگه میدارد، جایی که مدلهای قابل دانلود رایگان به انتظار پیشفرض برای هر چیزی غیر از مرز مطلق آزمایشگاه تبدیل شدهاند.
بعدی چه چیزی را تماشا کنیم
جزئیات کلیدی تایید نشده باقی میمانند - مهمتر از همه تعداد پارامترها و اندازه مدل، که مشخص میکند انتشار برای استقرار محلی چقدر عملی است. بحث جامعه قبلاً در مورد نحوه پاسخگویی مدل به کوانتیشن و سرعت اجرای آن بر روی سخت افزار مصرف کننده به جای GPU های مرکز داده به صفر رسیده است.
آنچه مسلم است این است که یک هفته گمانه زنی های ناشناس چیزی را به Z.AI داده است که هیچ بودجه بازاریابی نمی تواند آن را بخرد: اعتبار بی طرفانه و ناشناس برند در زمینه بی طرف. اکنون که این مدل نام دارد، معیارها بسیار شلوغتر و بسیار دقیقتر میشوند.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →