Z.ai، چینی AI لیب جو پہلے Zhipu AI کے نام سے جانا جاتا تھا، نے Hugging Face پر اپنے GLM-5.3 ماڈل کے مکمل وزن جاری کیے ہیں، جو ایک مضبوط ترین کوڈنگ اور ایجنٹی ماڈلز میں سے ایک کو مفت ڈاؤن لوڈ میں تبدیل کر دیا ہے۔ یہ ریلیز 28 اگست کو لائیو ہوا، جب لیب نے تصدیق کی کہ وائرل سٹیلتھ ماڈل "Ox Alpha" کے نام سے جانا جاتا ہے، درحقیقت اس کا اپنا GLM-5.3-Flash تھا، اور یہ کھلے وزن کے اس وعدے کو پورا کرتا ہے جس پر کمیونٹی پورے ہفتے قریب سے دیکھتی تھی۔

ماڈل پیج نے فوری طور پر 1,100 سے زیادہ لائکس اکٹھے کیے، اور ریلیز کا اعلان کرنے والا ہیکر نیوز تھریڈ 600 پوائنٹس سے تجاوز کر گیا کیونکہ ڈویلپرز نے جو کچھ اب عوامی ذخیرے میں بیٹھا ہے اسے ہضم کر لیا: 141 سیفٹینسرز فائلیں، جو FP8 میں بھیجی گئی ہیں، اس پر مشتمل ہے جو آج تک سب سے زیادہ قابل کھلے عام ڈاؤن لوڈ کے قابل کوڈنگ ماڈل ہو سکتا ہے۔ For more context on this story, see our ongoing AI news.

Z.ai اصل میں کیا بھیج دیا

GLM-5.3 ماہرین کا ایک مرکب ہے جو ایک فن تعمیر پر بنایا گیا ہے Z.ai جسے glm_moe_dsa کہتے ہیں۔ وزن کے ساتھ شائع کردہ ترتیب کے مطابق، نیٹ ورک 256 روٹڈ ماہرین کے ساتھ 78 تہوں کو اسٹیک کرتا ہے، فی ٹوکن 8 ماہرین کے علاوہ ایک مشترکہ ماہر کو فعال کرتا ہے۔ سیاق و سباق کی ونڈو 1,048,576 ٹوکنز پر محیط ہے — ایک مکمل ملین — اور ماڈل کم، اعلی اور زیادہ سے زیادہ ترتیبات کے ساتھ ایک "reasoning_effort" پیرامیٹر کو سپورٹ کرتا ہے، پہلے سے زیادہ سے زیادہ۔

شاید ماڈل کارڈ میں سب سے دلچسپ نوٹ یہ ہے کہ بہتری کہاں سے آئی ہے: GLM-5.3 وہی بیس ماڈل استعمال کرتا ہے جو GLM-5.2 ہے، اور ہر فائدہ پوسٹ ٹریننگ سے حاصل ہوتا ہے۔ لیب نے واضح طور پر نتیجہ کو "کوڈنگ کے لیے سب سے زیادہ قابل اوپن ویٹ ماڈل" کے طور پر بیان کیا ہے۔

بینچ مارکس: ایجنٹ کوڈنگ پر اوپن ویٹ SOTA

شائع شدہ تشخیصی جدول اس کے طریقہ کار کے بارے میں وسیع اور غیر معمولی طور پر مخصوص ہے، جس میں Kimi K3، DeepSeek-V4 Pro-0813، Qwen3.8-Max، Anthropic's Opus 4.8، Google's Fable 5، اور OpenAI کے GPT-5.6 Sol کے خلاف نتائج کی فہرست ہے۔

ٹرمینل بنچ 3.0 پر، GLM-5.3 نے 28.3 اسکور کیا — اوپن سورس اسٹیٹ آف دی آرٹ، اور GLM-5.2 کے لیے 4.6 سے چھلانگ، حالانکہ ابھی بھی Fable 5 کے بند فرنٹیئر کے پیچھے 33.7 پر اور GPT-5.6 Sol 34.6 پر ہے۔ ٹرمینل بنچ 2.1 پر یہ 88.2 پوسٹ کرتا ہے، بنیادی طور پر Kimi K3 اور GPT-5.6 Sol کے ساتھ اور Opus 4.8 کے 85.0 سے آگے۔ ڈیپ ایس ڈبلیو ای کے نتائج ورژنز کے درمیان 46.2 سے بڑھ کر 66.9 پر آگئے، اور GLM-5.3 آٹومیشن بینچ پر 48.2 پر اور GDPval-AA v2 پر 1769 پر ٹیبل میں سرفہرست ہے، مؤخر الذکر کا مصنوعی تجزیہ سے جائزہ لیا گیا۔

Z.ai نے اپنے اندرون خانہ کوڈ بنچ پر GLM-5.2 کے مقابلے میں 50% بہتری کی اطلاع بھی دی ہے، ساتھ ہی ایجنٹوں کے آخری امتحان جیسے بینچ مارکس پر اوپن ویٹ بہترین نتائج کے ساتھ۔

سائبر صلاحیت کا سوال

ماڈل کارڈ اس پیشرفت کے بارے میں قابل ذکر طور پر دو ٹوک ہے جس کا حفاظتی محقق مہینوں سے سراغ لگا رہے ہیں: "جیسے ہی ہم نے تربیت کے بعد کی پیمائش کی، سائبر کی صلاحیت ہماری توقع سے زیادہ تیزی سے تیار ہوئی،" کارڈ میں کہا گیا ہے۔ GLM-5.3 سائبر جیم پر 84.5 پر کمزوری کی دریافت کے لیے جدید ترین ہے، جس میں GPT-5.6 Sol سمیت میز پر موجود ہر ماڈل کو آگے بڑھایا جاتا ہے، اور یہ استحصالی بینچ مارکس پر GLM-5.2 کو دگنا کرتا ہے — 54.4 بمقابلہ 24.4 ایکسپلوٹ بینچ پر، اور 130/139 پر ایکسپلائٹ جیم کے دو وقتی بجٹ۔

AI Buzz Wire نے ان صلاحیتوں کا احاطہ کیا جب وہ اگست کے وسط میں صرف API کی ریلیز کے ساتھ سامنے آئیں۔ اب جو تبدیلیاں آتی ہیں وہ تقسیم ہے: وزن ڈاؤن لوڈ کے قابل ہیں، کوانٹائزڈ کمیونٹی بلڈز کی تیزی سے پیروی کرنے کا امکان ہے، اور کافی میموری رکھنے والا کوئی بھی ماڈل کو مقامی طور پر چلا سکتا ہے۔ ہیکر نیوز کے مباحثے میں، کچھ صارفین نے نوٹ کیا کہ ماڈل نے امریکی میزبانی کے متبادل کے مقابلے میں سیکیورٹی سے ملحقہ کاموں کے بارے میں کم پابندی محسوس کی - ایک سرکاری پالیسی کے دعوے کے بجائے کمیونٹی کے تاثرات، لیکن اس بات کی عکاسی کرتی ہے کہ اس ریلیز پر سیکیورٹی حلقوں میں اتنی ہی بحث کیوں کی جا رہی ہے جتنا کہ ڈویلپرز۔

ایک لائسنس جس کا مقصد ہائپر اسکیلرز ہے۔

GLM-5.3-Flash کے برعکس، جو صاف MIT لائسنس کے تحت بھیج دیا جاتا ہے، GLM-5.3 اپنی مرضی کے "GLM-5.3 لائسنس" کے ساتھ آتا ہے۔ نیو اسٹیک نے اسے ہائپر اسکیلرز کو نشانہ بنانے کے طور پر نمایاں کیا، اور متن اس کو ظاہر کرتا ہے۔ تقریباً سبھی کے لیے، شرائط مؤثر طریقے سے قابل اجازت ہیں: نوٹس کو شامل کرنے کی ضرورت کے ساتھ، استعمال، کاپی، ترمیم، ضم، شائع، تقسیم، ذیلی لائسنس، اور فروخت۔

استثناء کا ہدف ایک مخصوص کاروباری ماڈل ہے۔ اگر لائسنس دہندہ یا اس سے وابستہ افراد "ماڈل بطور سروس" کاروبار چلاتے ہیں - جو فریق ثالث کا اندازہ یا فائن ٹیوننگ رسائی کی پیشکش کرتے ہیں - اور ان کی مشترکہ آمدنی کسی بھی مسلسل 12 مہینوں میں $10 بلین سے تجاوز کر جاتی ہے، تو انہیں ماڈل یا اس کے مشتقات کے تجارتی استعمال سے پہلے Z.ai سیکیورٹی جائزہ پاس کرنا ہوگا۔ یہ شق بالکل سب سے بڑے کلاؤڈ فراہم کنندگان کے گرد ایک دائرہ کھینچتی ہے، جبکہ اسٹارٹ اپس، محققین، کاروباری اداروں اور درمیانے درجے کے میزبانوں کو اچھوتا چھوڑتا ہے۔

دو ٹریک اپروچ بتا رہا ہے۔ فلیش ویرینٹ، جو اب آکس الفا ماڈل کے طور پر سامنے آیا ہے جو TechCrunch کی جانب سے اپنی اصلیت کا پردہ فاش کرنے سے پہلے وائرل ہو گیا تھا، مکمل طور پر چینی سلیکون پر چلتا ہے اور زیادہ سے زیادہ اپنانے کے لیے MIT جھنڈا رکھتا ہے۔ فلیگ شپ کو ایک مخصوص لائسنس ملتا ہے جو ہائپر اسکیلر کی تعیناتی کو برقرار رکھتا ہے - خاص طور پر امریکن کلاؤڈز کے ذریعہ - Z.ai کے اپنے جائزے کے عمل کے پیچھے لگا ہوا ہے۔

اسے خود چلانا

کوشش کرنے کی طرف مائل افراد کے لیے، ماڈل کارڈ vLLM، SGLang، KTransformers، Unsloth، اور Hugging Face Transformers میں تعیناتی سپورٹ کی فہرست دیتا ہے، ان میں سے کئی کے لیے کک بک کی ترکیبیں کے ساتھ۔ خاص طور پر، Huawei Ascend NPU کی تعیناتی کو vLLM-Ascend، xLLM، اور SGLang کے ذریعے دستاویزی شکل دی گئی ہے - یہ ثابت کرنے کے لیے کہ فرنٹیئر ماڈلز غیر Nvidia ہارڈ ویئر پر چلتے ہیں۔ کمیونٹی میں، DeepInfra OpenRouter پر اوپن ماڈل کا تھرڈ پارٹی اینڈ پوائنٹ پیش کرنے والا پہلا تھا۔

Z.ai نے arXiv پر ایک تکنیکی رپورٹ بھی شائع کی، جس کا عنوان تھا "GLM-5: Vibe Coding سے Agentic Engineering تک"، جس میں ماڈل فیملی کی ترقی کا احاطہ کیا گیا ہے۔

یہ کیوں اہمیت رکھتا ہے۔

ریلیز بند فرنٹیئر اور اوپن فرنٹیئر کے درمیان فرق کو بہت سے ایجنٹی کوڈنگ بینچ مارکس پر راؤنڈنگ ایرر تک دبا دیتی ہے — ہفتوں، سال نہیں۔ Kimi K3 اور DeepSeek-V4 کے ساتھ مل کر، اس کا مطلب ہے کہ سب سے بڑی لیبز سے باہر کے ڈویلپرز کے پاس اب قابل بھروسہ متبادل موجود ہیں جو وہ مالک، آڈٹ اور فائن ٹیون کر سکتے ہیں۔

یہ اس تبدیلی کا بھی اشارہ کرتا ہے کہ کھلی ریلیز کو کس طرح کنٹرول کیا جاتا ہے۔ ایک ماڈل فیملی میں MIT-بمقابلہ-کسٹم-لائسنس کی تقسیم سے پتہ چلتا ہے کہ چینی لیبز لائسنسنگ کو اسٹریٹجک انفراسٹرکچر کے طور پر استعمال کرنا سیکھ رہی ہیں: کھلا پن جہاں یہ ایک ماحولیاتی نظام بناتا ہے، جہاں یہ پوزیشن کی حفاظت کرتا ہے۔ اگلا امتحان یہ ہوگا کہ آیا کوئی بھی $10-بلین سے زیادہ MaaS آپریٹر حقیقت میں Z.ai سیکیورٹی کے جائزے کے لیے پیش کرتا ہے - یا یہ شق صرف سب سے بڑے بادلوں کو دور رکھتی ہے جب کہ باقی سب اوپر کی تعمیر کرتے ہیں۔

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →