Z.ai, चीनी AI लैब जिसे पहले Zhipu AI के नाम से जाना जाता था, ने हगिंग फेस पर अपने GLM-5.3 मॉडल का पूरा वजन जारी किया है, जो उपलब्ध सबसे मजबूत कोडिंग और एजेंटिक मॉडल में से एक को मुफ्त डाउनलोड में बदल देता है। यह रिलीज़ 28 अगस्त को लाइव हो गई, इसके कुछ ही दिन बाद लैब ने पुष्टि की कि "ऑक्स अल्फा" के नाम से जाना जाने वाला वायरल स्टील्थ मॉडल वास्तव में इसका अपना जीएलएम-5.3-फ्लैश है, और यह ओपन-वेट के वादे को पूरा करता है जिस पर समुदाय पूरे सप्ताह करीब से नजर रखता था।

मॉडल पेज ने तुरंत ही 1,100 से अधिक लाइक प्राप्त कर लिए, और रिलीज की घोषणा करने वाला हैकर न्यूज थ्रेड 600 अंक से ऊपर चढ़ गया क्योंकि डेवलपर्स ने पचा लिया कि अब सार्वजनिक रिपॉजिटरी में क्या है: 141 सेफटेंसर फाइलें, एफपी 8 में भेजी गईं, जिसमें अब तक का सबसे सक्षम खुले तौर पर डाउनलोड करने योग्य कोडिंग मॉडल शामिल हो सकता है। For more context on this story, see our ongoing artificial intelligence updates.

Z.ai ने वास्तव में क्या भेजा

GLM-5.3 एक मिक्सचर-ऑफ़-एक्सपर्ट मॉडल है जिसे Z.ai आर्किटेक्चर पर बनाया गया है जिसे glm_moe_dsa कहा जाता है। वज़न के साथ प्रकाशित कॉन्फ़िगरेशन के अनुसार, नेटवर्क 256 रूट किए गए विशेषज्ञों के साथ 78 परतों को ढेर करता है, प्रति टोकन 8 विशेषज्ञों और एक साझा विशेषज्ञ को सक्रिय करता है। संदर्भ विंडो 1,048,576 टोकन तक फैली हुई है - एक पूर्ण मिलियन - और मॉडल कम, उच्च और अधिकतम सेटिंग्स के साथ "reasoning_effort" पैरामीटर का समर्थन करता है, अधिकतम पर डिफ़ॉल्ट।

शायद मॉडल कार्ड में सबसे दिलचस्प नोट यह स्पष्टता है कि सुधार कहाँ से आए: GLM-5.3 GLM-5.2 के समान बेस मॉडल का उपयोग करता है, और प्रत्येक लाभ प्रशिक्षण के बाद से आता है। प्रयोगशाला स्पष्ट रूप से परिणाम को "कोडिंग के लिए सबसे सक्षम ओपन-वेट मॉडल" के रूप में वर्णित करती है।

बेंचमार्क: एजेंटिक कोडिंग पर ओपन-वेट SOTA

प्रकाशित मूल्यांकन तालिका अपनी कार्यप्रणाली के बारे में व्यापक और असामान्य रूप से विशिष्ट है, जिसमें किमी K3, डीपसीक-वी4 प्रो-0813, क्वेन3.8-मैक्स, एंथ्रोपिक के ओपस 4.8, गूगल के फैबल 5 और ओपनएआई के जीपीटी-5.6 सोल के परिणामों को सूचीबद्ध किया गया है।

टर्मिनल बेंच 3.0 पर, जीएलएम-5.3 का स्कोर 28.3 है - कला का ओपन-सोर्स राज्य, और जीएलएम-5.2 के लिए 4.6 से छलांग, हालांकि अभी भी 33.7 पर फैबल 5 और 34.6 पर जीपीटी-5.6 सोल की बंद सीमा से पीछे है। टर्मिनल बेंच 2.1 पर यह 88.2 पोस्ट करता है, जो अनिवार्य रूप से किमी के3 और जीपीटी-5.6 सोल के स्तर पर है और ओपस 4.8 के 85.0 से आगे है। डीपएसडब्ल्यूई के परिणाम संस्करणों के बीच 46.2 से बढ़कर 66.9 हो गए, और जीएलएम-5.3 ऑटोमेशनबेंच पर 48.2 पर और जीडीपीवल-एए वी2 पर 1769 पर तालिका में सबसे ऊपर है, बाद में कृत्रिम विश्लेषण द्वारा मूल्यांकन किया गया।

Z.ai ने एजेंटों की अंतिम परीक्षा जैसे बेंचमार्क पर ओपन-वेट-सर्वोत्तम परिणामों के साथ-साथ अपने इन-हाउस कोड बेंच पर GLM-5.2 पर 50% सुधार की भी रिपोर्ट दी है।

साइबर क्षमता का प्रश्न

मॉडल कार्ड उस विकास के बारे में उल्लेखनीय रूप से स्पष्ट है जिसे सुरक्षा शोधकर्ता महीनों से ट्रैक कर रहे हैं: "जैसे-जैसे हमने प्रशिक्षण के बाद स्केल किया, साइबर क्षमता हमारी अपेक्षा से अधिक तेजी से विकसित हुई," कार्ड में कहा गया है। जीएलएम-5.3 84.5 पर भेद्यता खोज के लिए साइबरजिम पर अत्याधुनिक है, जो जीपीटी-5.6 सोल सहित तालिका में हर मॉडल को पीछे छोड़ देता है, और यह शोषण बेंचमार्क पर जीएलएम-5.2 को दोगुना कर देता है - एक्सप्लॉइटबेंच पर 54.4 बनाम 24.4, और एक्सप्लॉइटजिम के दो समय के बजट पर 105/130 बनाम 29/39।

एआई बज़ वायर ने इन क्षमताओं को तब कवर किया जब वे अगस्त के मध्य में केवल एपीआई रिलीज के साथ सामने आए। अब जो परिवर्तन हो रहा है वह वितरण है: वजन डाउनलोड करने योग्य हैं, परिमाणित समुदाय निर्माण शीघ्रता से होने की संभावना है, और पर्याप्त मेमोरी वाला कोई भी व्यक्ति मॉडल को स्थानीय रूप से चला सकता है। हैकर न्यूज़ चर्चा में, कुछ उपयोगकर्ताओं ने नोट किया कि मॉडल को यूएस-होस्ट किए गए विकल्पों की तुलना में सुरक्षा-आसन्न कार्यों के आसपास कम प्रतिबंधात्मक महसूस हुआ - एक आधिकारिक नीति दावे के बजाय सामुदायिक इंप्रेशन, लेकिन यह प्रतिबिंबित करता है कि इस रिलीज़ की सुरक्षा हलकों में उतनी ही चर्चा क्यों हो रही है जितनी डेवलपर लोगों में।

हाइपरस्केलर्स के उद्देश्य से एक लाइसेंस

जीएलएम-5.3-फ्लैश के विपरीत, जो एक स्वच्छ एमआईटी लाइसेंस के तहत भेजा जाता है, जीएलएम-5.3 एक कस्टम "जीएलएम-5.3 लाइसेंस" के साथ आता है। न्यू स्टैक ने इसे हाइपरस्केलर्स पर लक्ष्य करने के रूप में चित्रित किया है, और पाठ इस बात को दर्शाता है। लगभग सभी के लिए, शर्तें प्रभावी रूप से अनुमेय हैं: केवल नोटिस शामिल करने की आवश्यकता के साथ, उपयोग करें, प्रतिलिपि बनाएं, संशोधित करें, विलय करें, प्रकाशित करें, वितरित करें, उपलाइसेंस दें और बेचें।

अपवाद एक विशिष्ट व्यवसाय मॉडल को लक्षित करता है। यदि कोई लाइसेंसधारी या उसके सहयोगी "एक सेवा के रूप में मॉडल" व्यवसाय संचालित करते हैं - तीसरे पक्ष को अनुमान या फाइन-ट्यूनिंग पहुंच की पेशकश करते हैं - और उनका संयुक्त राजस्व लगातार 12 महीनों में $ 10 बिलियन से अधिक है, तो उन्हें मॉडल या उसके डेरिवेटिव के किसी भी व्यावसायिक उपयोग से पहले Z.ai सुरक्षा समीक्षा पास करनी होगी। यह खंड सबसे बड़े क्लाउड प्रदाताओं के चारों ओर एक घेरा खींचता है, जबकि स्टार्टअप, शोधकर्ताओं, उद्यमों और मध्य-स्तरीय होस्ट को अछूता छोड़ देता है।

दो-ट्रैक दृष्टिकोण बता रहा है। फ्लैश संस्करण, जिसे अब ऑक्स अल्फा मॉडल के रूप में प्रकट किया गया है, जो टेकक्रंच द्वारा अपनी उत्पत्ति का खुलासा करने से पहले वायरल हो गया था, पूरी तरह से चीनी सिलिकॉन पर चलता है और अधिकतम अपनाने के लिए एमआईटी ध्वज रखता है। फ्लैगशिप को एक विशेष लाइसेंस मिलता है जो हाइपरस्केलर तैनाती को रखता है - विशेष रूप से अमेरिकी बादलों द्वारा - Z.ai की अपनी समीक्षा प्रक्रिया के पीछे।

इसे स्वयं चलाना

कोशिश करने के इच्छुक लोगों के लिए, मॉडल कार्ड में वीएलएलएम, एसजीलैंग, केट्रांसफॉर्मर्स, अनस्लोथ और हगिंग फेस ट्रांसफॉर्मर्स में तैनाती समर्थन सूचीबद्ध है, जिनमें से कई के लिए कुकबुक रेसिपी भी शामिल है। विशेष रूप से, Huawei Ascend NPU परिनियोजन को vLLM-Ascend, xLLM और SGLang के माध्यम से प्रलेखित किया गया है - यह साबित करने के लिए लैब का प्रयास जारी है कि फ्रंटियर मॉडल गैर-एनवीडिया हार्डवेयर पर चलते हैं। समुदाय में, डीपइन्फ्रा ओपनराउटर पर ओपन मॉडल के तीसरे पक्ष के समापन बिंदु की पेशकश करने वाला पहला था।

Z.ai ने मॉडल परिवार के विकास को कवर करते हुए arXiv पर "GLM-5: फ्रॉम वाइब कोडिंग टू एजेंटिक इंजीनियरिंग" शीर्षक से एक तकनीकी रिपोर्ट भी प्रकाशित की।

यह क्यों मायने रखता है

रिलीज़ बंद सीमा और खुली सीमा के बीच के अंतर को कई एजेंटिक कोडिंग बेंचमार्क पर एक राउंडिंग त्रुटि में संपीड़ित करता है - सप्ताह, वर्ष नहीं। किमी K3 और डीपसीक-V4 के साथ संयुक्त, इसका मतलब है कि सबसे बड़ी प्रयोगशालाओं के बाहर के डेवलपर्स के पास अब विश्वसनीय विकल्प हैं, जिन्हें वे अपना सकते हैं, ऑडिट कर सकते हैं और फाइन-ट्यून कर सकते हैं।

यह खुली रिलीज़ को नियंत्रित करने के तरीके में बदलाव का भी संकेत देता है। एकल मॉडल परिवार के भीतर एमआईटी-बनाम-कस्टम-लाइसेंस विभाजन से पता चलता है कि चीनी प्रयोगशालाएं लाइसेंसिंग को रणनीतिक बुनियादी ढांचे के रूप में उपयोग करना सीख रही हैं: खुलापन जहां यह एक पारिस्थितिकी तंत्र बनाता है, उत्तोलन जहां यह स्थिति की रक्षा करता है। अगला परीक्षण यह होगा कि क्या कोई $10 बिलियन से अधिक का MAS ऑपरेटर वास्तव में Z.ai सुरक्षा समीक्षा के लिए प्रस्तुत होता है - या क्या यह खंड केवल सबसे बड़े बादलों को बाहर रखता है जबकि बाकी सभी शीर्ष पर बने रहते हैं।

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →