ऑक्स अल्फा या अनामिक नावाखाली एक आठवडा मोहक विकसक घालवलेल्या रहस्य मॉडेलची आता अधिकृत ओळख आहे. चीनच्या Z.AI ने GLM-5.3-Flash लाँच केले आहे, एक मूळ मल्टीमोडल, ओपन-वेट मॉडेल परवानगी असलेल्या MIT लायसन्स अंतर्गत जारी केले आहे — आणि कंपनी म्हणते की संपूर्ण स्टिल्थ प्रीव्ह्यू रन चायनीज-निर्मित AI चिप्सवर सर्व्ह करण्यात आला होता. लॉन्चने या वर्षी AI उद्योगातील सर्वात जवळून पाहिलेला अंदाज लावणारा गेम बंद केला. कथा कशी उलगडली याच्या पार्श्वभूमीसाठी, आमचे नवीनतम एआय घडामोडी पहा.

Z.ai ने प्रत्यक्षात काय पाठवले

GLM-5.3-फ्लॅश हे 320 अब्ज एकूण पॅरामीटर्स आणि 18 अब्ज सक्रिय पॅरामीटर्ससह तज्ञांचे मिश्रण असलेले मॉडेल आहे - जीएलएम-4.5 च्या पूर्ववर्ती 32 अब्ज सक्रिय पॅरामीटर्समधील लक्षणीय घट. हे GLM-5 कुटुंबातील पहिले नेटिव्हली मल्टीमोडल मॉडेल आहे, जे मजकूर आणि प्रतिमा इनपुट स्वीकारते, आणि Z.ai च्या घोषणेनुसार, दहा लाख टोकन्सपर्यंत पोहोचणाऱ्या संदर्भ विंडोला समर्थन देते.

मॉडेलला 30-ट्रिलियन-टोकन मल्टीमोडल कॉर्पसवर प्रशिक्षित केले गेले होते, आणि त्याचे आर्किटेक्चर जागतिक संदर्भासाठी विरळ लक्ष देऊन स्थानिक अवलंबनांसाठी रेखीय लक्ष मिसळते. एक घटक Z.ai कॉल करतो इंडेक्सपूल इंडेक्सर की व्हेक्टर्सच्या गटांना संकुचित करतो जेणेकरून दीर्घ संदर्भ लांबीवर विलंबता आणि मेमरी वापर मर्यादित होईल. कंपनीने GLM-5.3 च्या तुलनेत तिप्पट कमी लक्ष दिलेली गणना आणि KV कॅशे आकारात 4.4 पट घट नोंदवली आहे.

बेंचमार्क दावे आणि किंमत

आर्टिफिशियल ॲनालिसिस इंटेलिजेंस इंडेक्स v4.1.1 वर, GLM-5.3-Flash ने 57 स्कोअर केले - एक आकृती जी त्याला आर्टिफिशियल ॲनालिसिसच्या सध्याच्या मॉडेल रँकिंगमध्ये शीर्षस्थानी ठेवते, 18 च्या तुलनात्मक मध्यापेक्षा खूप वर आहे. Z.ai म्हणते की ते GLM-5.2 वर नोंदवलेले कोडींग आणि एजंट चाचणीच्या किंमती आणि एक-एक पध्दतीच्या किंमतीवर मागे टाकते. क्लॉड ओपस 4.8 त्याच्या अंतर्गत कोडिंग बेंचमार्कवर. DeepSWE v1.1 वर, GLM-5.2 साठी मॉडेलने 63.4 विरुद्ध 46.2 गुण मिळवले; AutomationBench वर ते 26.2 च्या विरुद्ध 48.8 वर पोहोचले. TestingCatalog ने नमूद केल्याप्रमाणे, भिन्न मूल्यमापन हार्नेस, संदर्भ मर्यादा आणि जनरेशन सेटिंग्ज म्हणजे क्रॉस-टेस्ट तुलना प्रत्येक सेटअपवर मोठ्या प्रमाणात अवलंबून असतात.

प्राइसिंग मॉडेलला आक्रमकपणे स्वस्त म्हणून स्थान देते: $0.15 प्रति दशलक्ष इनपुट टोकन आणि $0.50 प्रति दशलक्ष आउटपुट टोकन, 83% प्रॉम्प्ट-कॅशे सवलतीसह, कृत्रिम विश्लेषणानुसार. Z.ai प्रति इंटेलिजेंस इंडेक्स टास्क $0.045 च्या सवलतीच्या दराचा उल्लेख करते.

चीनी चिप कोन

सर्वात धोरणात्मकदृष्ट्या महत्त्वपूर्ण तपशील म्हणजे पायाभूत सुविधा, बुद्धिमत्ता नव्हे. लॉन्च होण्यापूर्वी, हे मॉडेल 20 ऑगस्टपासून OpenRouter आणि OpenCode वर अज्ञातपणे `ox-alpha` म्हणून धावले आणि Z.ai म्हणते की ते त्या सेवांवर आठवड्याचे सर्वात लोकप्रिय मॉडेल बनले आहे — ट्रॅफिक संपूर्णपणे देशांतर्गत चायनीज ऍक्सिलरेटर्सवर सर्व्ह केले जाते. त्यास समर्थन देण्यासाठी, Z.ai ने SGLang-आधारित सर्व्हिंग स्टॅक तयार केले जे एन्कोडिंग, प्रीफिल आणि डीकोडिंग वेगळे करते, हजारो चीनी AI चिप्समध्ये एंड-टू-एंड सर्व्हिंग कार्यप्रदर्शनात तिप्पट वाढ नोंदवते.

हे एका विक्रेत्याच्या पलीकडे महत्त्वाचे आहे. हे एक सार्वजनिक प्रात्यक्षिक आहे की सीमावर्ती-लगतचे चीनी मॉडेल Nvidia हार्डवेअरशिवाय मोठ्या प्रमाणावर दिले जाऊ शकते, डेटा पॉइंट पाश्चात्य धोरणकर्ते आणि चिपमेकर दुर्लक्ष करणार नाहीत. नवीन स्टॅकने रीलिझचा सारांश स्वस्त, चांगला आणि चायनीज चिप्सवर दिला आहे - तीन गुणांचा आतापर्यंत क्वचितच एकत्र दावा केला गेला आहे.

खुले वजन, वास्तविक तैनाती

SGLang, vLLM आणि TokenSpeed द्वारे स्थानिक तैनाती समर्थित असलेल्या MIT परवान्याअंतर्गत हगिंग फेसवर वजन उपलब्ध आहेत. GLM कोडिंग प्लॅन सदस्यांना GLM-5.3 च्या तिप्पट वापरण्यायोग्य कोट्यासह लगेच GLM-5.3-फ्लॅश लाइव्ह मिळतो आणि त्याची मल्टीमोडल क्षमता ZCode मध्ये ब्राउझर वापर आणि संगणक वापर एकत्रीकरणाद्वारे उघड केली जाते.

व्हिज्युअल रिझनिंग हे रिलीझचे केंद्रस्थान आहे: Z.ai ने मॉडेलला प्रस्तुत इंटरफेस, गेमप्ले आणि 3D आउटपुटचे निरीक्षण करण्यासाठी प्रशिक्षित केले, नंतर व्हिज्युअल फीडबॅकमधून स्वतःच्या कामाचे मूल्यांकन आणि सुधारणा करा. हाच दृष्टिकोन दस्तऐवज, स्प्रेडशीट, सादरीकरणे आणि डॅशबोर्ड्सपर्यंत विस्तारित आहे — ऑफिसच्या कामाच्या ब्रेड-अँड-बटर आर्टिफॅक्ट्स, त्याच दिवशी क्वेनच्या प्रतिस्पर्ध्याने त्याच दिवशी रिलीज केलेल्या सर्वात मोठ्या नफ्याचा दावाही केला आहे.

खुल्या वजनाचा निर्णय इकोसिस्टमसाठी छंदांच्या पलीकडे महत्त्वाचा आहे. एमआयटी परवाना हा AI मधील सर्वात अनुज्ञेय सामान्य परवाना आहे: व्यावसायिक वापर, सुधारणा आणि पुनर्वितरण यांमध्ये कोणतीही कॉपीलिफ्ट बंधने नाहीत. स्वतंत्र यजमान त्यांच्या स्वतःच्या हार्डवेअरवर GLM-5.3-Flash सर्व्ह करू शकतात, कायदेशीर पुनरावलोकनापासून ते औद्योगिक ऑटोमेशनपर्यंतच्या अनुलंबांसाठी ते छान-ट्यून करू शकतात आणि अटींशी बोलणी न करता उत्पादनांमध्ये एम्बेड करू शकतात — API-केवळ फ्रंटियर मॉडेल्सद्वारे बंद केलेला पर्याय.

स्टेल्थ लॉन्च का चालले

निनावी रोलआउटने Z.ai ला काहीतरी दिले जे मार्केटिंग बजेट खरेदी करू शकत नाही: ब्रँड-अज्ञेयवादी प्रमाणीकरण. डेव्हलपर्सनी ऑक्स अल्फाला त्याच्या गुणवत्तेनुसार, अमेरिकन पदाधिकाऱ्यांच्या विरुद्ध चिनी प्रयोगशाळेची रचना न करता स्वीकारले. ब्लूमबर्गने Z.AI ची पुष्टी केली तेव्हा निर्माता आणि बिझनेस इनसाइडरने "रहस्य सोडवले" घोषित केले तेव्हा मॉडेलने तटस्थ जमिनीवर समुदाय लीडरबोर्डमध्ये आधीच अव्वल स्थान मिळवले होते.

स्पर्धात्मक दबाव आता स्पष्ट आहे. एक-दशलक्ष-टोकन संदर्भासह मल्टीमॉडल मॉडेल, MIT-परवानाकृत वजन आणि सब-डॉलर आउटपुट किंमत प्रत्येक पदावर असलेल्या व्यक्तीला त्याच्या किंमत सूचीचे समर्थन करण्यास भाग पाडते. किंमत-विरुद्ध-कार्यप्रदर्शनासाठी पॅरेटो फ्रंटियर - ट्रेड-ऑफ डेव्हलपर्सना प्रत्यक्षात वाटते - पुन्हा रेखाटले गेले आहे, जसे की व्यापकपणे अनुसरण केलेले AI समालोचक अँड्र्यू कुरन यांनी X वर ठेवले आहे.

टिकाऊपणाचा खुला प्रश्न आहे: प्रतिद्वंद्वी वास्तविक जगाच्या वापराखाली बेंचमार्क लीड्स टिकून राहतात की नाही आणि पाश्चात्य लॅब किमतीला किती लवकर प्रतिसाद देतात. कोणत्याही प्रकारे, अनामित सट्टेबाजीचा आठवडा एका नामांकित मॉडेल, डाउनलोड करण्यायोग्य वजन आणि अमेरिकन सिलिकॉन नसलेल्या सर्व्हिंग फ्लीटसह संपला.

---

एआयच्या पुढे राहा

नवीनतम AI बातम्या, विश्लेषण आणि यश मिळवा — सर्व एकाच ठिकाणी.

अधिक AI बातम्या वाचा →