Z.ai, पूर्वी Zhipu AI म्हणून ओळखल्या जाणाऱ्या चायनीज एआय लॅबने, हगिंग फेसवर त्याच्या GLM-5.3 मॉडेलचे संपूर्ण वजन प्रकाशित केले आहे, जे सर्वात मजबूत कोडिंग आणि एजंटिक मॉडेल्सपैकी एक विनामूल्य डाउनलोडमध्ये बदलले आहे. "ऑक्स अल्फा" म्हणून ओळखले जाणारे व्हायरल स्टेल्थ मॉडेल खरेतर त्याचे स्वतःचे GLM-5.3-फ्लॅश असल्याचे प्रयोगशाळेने पुष्टी केल्याच्या काही दिवसांनंतर, 28 ऑगस्ट रोजी प्रकाशन लाइव्ह झाले आणि हे ओपन-वेट वचन पूर्ण करते ज्यावर समुदायाने आठवडाभर बारकाईने लक्ष ठेवले होते.

मॉडेल पेजने त्वरीत 1,100 पेक्षा जास्त लाईक्स गोळा केले आणि रिलीजची घोषणा करणाऱ्या हॅकर न्यूज थ्रेडने 600 पॉईंट्सच्या पुढे वाढ केली कारण डेव्हलपर्सने आता सार्वजनिक भांडारात जे आहे ते पचवले: 141 सेफटेन्सर फाइल्स, FP8 मध्ये पाठवल्या गेल्या, ज्यामध्ये आजपर्यंतचे सर्वात सक्षम उघडपणे डाउनलोड करण्यायोग्य कोडिंग मॉडेल काय असू शकते. For more context on this story, see our ongoing AI news.

Z.ai प्रत्यक्षात काय पाठवले

GLM-5.3 हे एका आर्किटेक्चरवर तयार केलेले तज्ञांचे मिश्रण आहे Z.ai ज्याला glm_moe_dsa म्हणतात. वेट्सच्या बाजूने प्रकाशित केलेल्या कॉन्फिगरेशननुसार, नेटवर्क 256 राउटेड तज्ञांसह 78 स्तरांचे स्टॅक करते, प्रति टोकन 8 तज्ञ आणि एक सामायिक तज्ञ सक्रिय करते. संदर्भ विंडो 1,048,576 टोकन व्यापते — पूर्ण दशलक्ष — आणि मॉडेल कमी, उच्च आणि कमाल सेटिंग्जसह "reasoning_effort" पॅरामीटरला समर्थन देते, कमाल ते डीफॉल्टिंग.

कदाचित मॉडेल कार्डमधील सर्वात मनोरंजक टीप ही सुधारणा कोठून आली याबद्दल स्पष्टपणे सांगणे आहे: GLM-5.3 हे GLM-5.2 सारखेच बेस मॉडेल वापरते आणि प्रत्येक फायदा प्रशिक्षणानंतर होतो. प्रयोगशाळेने "कोडिंगसाठी सर्वात सक्षम ओपन-वेट मॉडेल" म्हणून परिणामाचे स्पष्टपणे वर्णन केले आहे.

बेंचमार्क: एजंटिक कोडिंगवर ओपन-वेट्स SOTA

प्रकाशित मूल्यमापन सारणी त्याच्या कार्यपद्धतीबद्दल विस्तृत आणि असामान्यपणे विशिष्ट आहे, Kimi K3, DeepSeek-V4 Pro-0813, Qwen3.8-Max, Anthropic's Opus 4.8, Google's Fable 5, आणि OpenAI's GPT-5.6 Sol विरुद्ध परिणाम सूचीबद्ध करते.

टर्मिनल बेंच 3.0 वर, GLM-5.3 ने 28.3 स्कोअर - ओपन-सोर्स स्टेट ऑफ द आर्ट, आणि GLM-5.2 साठी 4.6 वरून झेप घेतली, तरीही 33.7 वर Fable 5 आणि GPT-5.6 Sol 34.6 वर क्लोज्ड फ्रंटियरच्या मागे आहे. टर्मिनल बेंच 2.1 वर ते 88.2 पोस्ट करते, अनिवार्यपणे किमी K3 आणि GPT-5.6 सोलसह आणि Opus 4.8 च्या 85.0 च्या पुढे. डीपएसडब्ल्यूईचे निकाल आवृत्त्यांमधील 46.2 वरून 66.9 वर गेले आणि GLM-5.3 AutomationBench वर 48.2 वर आणि GDPval-AA v2 वर 1769 वर, नंतरचे कृत्रिम विश्लेषणाद्वारे मूल्यांकन केले गेले.

Z.ai त्याच्या इन-हाउस कोड बेंचवर GLM-5.2 पेक्षा 50% सुधारणा नोंदवते, तसेच एजंट्सच्या शेवटच्या परीक्षेसारख्या बेंचमार्कवर ओपन-वेट-सर्वोत्तम परिणामांसह.

सायबर क्षमता प्रश्न

सुरक्षा संशोधक अनेक महिन्यांपासून मागोवा घेत असलेल्या विकासाबद्दल मॉडेल कार्ड उल्लेखनीयपणे स्पष्ट आहे: "जसे आम्ही प्रशिक्षणोत्तर स्केल केले, सायबर क्षमता आमच्या अपेक्षेपेक्षा वेगाने विकसित झाली," कार्ड म्हणते. GLM-5.3 हे 84.5 वर असुरक्षिततेच्या शोधासाठी सायबरजिमवर अत्याधुनिक आहे, जीपीटी-5.6 सोलसह टेबलवरील प्रत्येक मॉडेलला बाहेर काढते, आणि ते शोषण बेंचमार्कवर GLM-5.2 च्या दुप्पट - 54.4 विरुद्ध 24.4 एक्सप्लोइटबेंच वर, आणि 19/319/319 वर ExploitGym चे दोन वेळचे बजेट.

AI Buzz Wire ने या क्षमतांचा अंतर्भाव केला जेव्हा ते ऑगस्टच्या मध्यात API-केवळ रिलीझसह उदयास आले. आता वितरणात काय बदल होतो: वजने डाउनलोड करण्यायोग्य आहेत, क्वांटाइज्ड कम्युनिटी बिल्ड त्वरीत फॉलो करण्याची शक्यता आहे आणि पुरेशी मेमरी असलेले कोणीही मॉडेल स्थानिक पातळीवर चालवू शकतात. हॅकर न्यूज चर्चेत, काही वापरकर्त्यांनी असे नमूद केले की यूएस-होस्ट केलेल्या पर्यायांपेक्षा सुरक्षा-संलग्न कार्यांमध्ये मॉडेल कमी प्रतिबंधित आहे - अधिकृत धोरण दाव्यापेक्षा समुदाय इंप्रेशन, परंतु विकासकांप्रमाणेच सुरक्षा मंडळांमध्ये या प्रकाशनाची चर्चा का केली जात आहे हे प्रतिबिंबित करते.

हायपरस्केलर्ससाठी एक परवाना

GLM-5.3-फ्लॅशच्या विपरीत, जे स्वच्छ MIT परवान्याअंतर्गत पाठवले जाते, GLM-5.3 हे सानुकूल "GLM-5.3 परवाना" घेऊन येते. न्यू स्टॅकने ते हायपरस्केलर्सवर लक्ष केंद्रित केले आहे आणि मजकूर ते दर्शवितो. जवळजवळ प्रत्येकासाठी, अटी प्रभावीपणे अनुज्ञेय आहेत: वापरा, कॉपी करा, सुधारित करा, विलीन करा, प्रकाशित करा, वितरण करा, उपपरवाना करा आणि विक्री करा, फक्त सूचना समाविष्ट करणे आवश्यक आहे.

अपवाद एका विशिष्ट व्यवसाय मॉडेलला लक्ष्य करतो. जर एखादा परवानाधारक किंवा त्याचे सहयोगी "सेवा म्हणून मॉडेल" व्यवसाय चालवतात — तृतीय पक्ष अनुमान किंवा फाइन-ट्यूनिंग ऍक्सेस देतात — आणि त्यांचा एकत्रित महसूल कोणत्याही सलग 12 महिन्यांत $10 अब्ज पेक्षा जास्त असेल, तर त्यांनी मॉडेलचा किंवा त्याच्या डेरिव्हेटिव्ह्जचा कोणताही व्यावसायिक वापर करण्यापूर्वी Z.ai सुरक्षा पुनरावलोकन पास करणे आवश्यक आहे. हे कलम स्टार्टअप्स, संशोधक, उपक्रम आणि मध्यम-स्तरीय यजमानांना अस्पर्श सोडताना, सर्वात मोठ्या क्लाउड प्रदात्यांभोवती अचूकपणे एक वर्तुळ काढते.

दोन-ट्रॅक दृष्टिकोन सांगत आहे. फ्लॅश व्हेरिएंट, आता ऑक्स अल्फा मॉडेल म्हणून उघड झाले आहे जे TechCrunch ने त्याचे मूळ उलगडण्याआधी व्हायरल केले आहे, पूर्णपणे चीनी सिलिकॉनवर चालते आणि जास्तीत जास्त स्वीकारण्यासाठी MIT ध्वज ठेवते. फ्लॅगशिपला बेस्पोक परवाना मिळतो जो हायपरस्केलर तैनात ठेवतो — विशेषत: अमेरिकन क्लाउडद्वारे — Z.ai च्या स्वतःच्या पुनरावलोकन प्रक्रियेच्या मागे आहे.

स्वतः चालवणे

प्रयत्न करण्यास इच्छुक असलेल्यांसाठी, मॉडेल कार्ड vLLM, SGLang, KTransformers, Unsloth, आणि Hugging Face Transformers वर तैनाती समर्थन सूचीबद्ध करते, त्यापैकी अनेकांसाठी कूकबुक रेसिपीसह. विशेष म्हणजे, Huawei Ascend NPU तैनाती vLLM-Ascend, xLLM, आणि SGLang द्वारे दस्तऐवजीकरण केली जाते — फ्रंटियर मॉडेल्स नॉन-एनव्हीडिया हार्डवेअरवर चालतात हे सिद्ध करण्यासाठी प्रयोगशाळेचा प्रयत्न सुरू ठेवतो. समुदायामध्ये, DeepInfra ने OpenRouter वर ओपन मॉडेलचा थर्ड-पार्टी एंडपॉइंट ऑफर करणारी पहिली होती.

Z.ai ने arXiv वर "GLM-5: Vibe Coding to Agentic Engineering" नावाचा एक तांत्रिक अहवाल देखील प्रकाशित केला आहे, ज्यात मॉडेल कुटुंबाच्या विकासाचा समावेश आहे.

हे महत्त्वाचे का आहे

रिलीझ बंद सीमा आणि खुल्या सीमांमधील अंतर अनेक एजंटिक कोडिंग बेंचमार्कवर गोलाकार त्रुटीपर्यंत संकुचित करते — आठवडे, वर्षे नाही. Kimi K3 आणि DeepSeek-V4 सह एकत्रित, याचा अर्थ सर्वात मोठ्या लॅबच्या बाहेरील विकसकांकडे आता विश्वासार्ह पर्याय आहेत जे त्यांच्या मालकीचे, ऑडिट आणि छान-ट्यून करू शकतात.

हे ओपन रिलीझ कसे नियंत्रित केले जाते त्यामध्ये बदल देखील सूचित करते. MIT-वि-सानुकूल-परवाना एकल मॉडेल कुटुंबातील विभाजन सूचित करते की चिनी प्रयोगशाळा धोरणात्मक पायाभूत सुविधा म्हणून परवाना वापरण्यास शिकत आहेत: मोकळेपणा जेथे ते एक इकोसिस्टम तयार करते, जेथे ते स्थान संरक्षित करते. कोणतीही $10-अब्ज-अधिक MaaS ऑपरेटर खरोखर Z.ai सुरक्षा पुनरावलोकनास सबमिट करते की नाही याची पुढील चाचणी असेल - किंवा इतर प्रत्येकजण शीर्षस्थानी तयार असताना कलम फक्त सर्वात मोठे ढग दूर ठेवते का.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →