ऑक्स अल्फा, 20 ऑगस्ट रोजी OpenRouter आणि OpenCode वर दिसू लागल्यापासून विकसकांच्या संभाषणांवर वर्चस्व गाजवणारे अनब्रँडेड AI मॉडेल, ची ओळख आता गूढ राहिलेली नाही. चीनच्या Z.AI ने बुधवारी ब्लूमबर्ग न्यूजला पुष्टी केली की हे मॉडेल त्याच्या GLM मालिकेचे एक नवीन पुनरावृत्ती आहे — आणि सांगितले की ते आज रात्री मॉडेलचे वजन प्रकाशित करेल, ते कोणालाही डाउनलोड आणि चालविण्यासाठी उपलब्ध करून देईल.
पुष्टीकरणामुळे AI समुदायाने या वर्षी पाहिलेला सर्वात उन्मादपूर्ण अंदाज लावणारा गेम संपतो आणि ते एक फ्लॅगशिप-ग्रेड चिनी मॉडेल पाश्चात्य लॅबच्या टक्कर कोर्सवर ठेवते ज्यात तुलनात्मक क्षमतांची किंमत खूप जास्त आहे. For more context on this story, see our ongoing artificial intelligence updates.
एक स्टिल्थ लॉन्च जे अगदी डिझाइन केल्याप्रमाणे कार्य करते
ऑक्स अल्फा एक सूची घेऊन आला ज्यामध्ये ते काय करू शकते याबद्दल सर्व काही वर्णन केले आहे आणि ते कोणी बांधले याबद्दल काहीही नाही. OpenRouter ने याचे श्रेय "तृतीय-पक्ष प्रदात्याला दिले ज्याने या पूर्वावलोकनादरम्यान निनावी राहणे निवडले आहे," आणि ते कोडिंग, टिकाऊ एजंटिक कार्य आणि उत्पादन वर्कलोडसाठी तयार केलेले तर्कसंगत मॉडेल म्हणून ठेवले.
एकट्याची वैशिष्ट्ये डोके फिरवण्यासाठी पुरेशी होती: फक्त एक दशलक्ष टोकनची कॉन्टेक्स्ट विंडो, मजकूर, प्रतिमा आणि व्हिडिओ इनपुटसाठी समर्थन आणि OpenRouter आणि OpenCode दोन्हीद्वारे पूर्णपणे विनामूल्य प्रवेश. OpenCode ने मॉडेलसाठी प्रतिदिन 100 ट्रिलियन टोकन्सची सेवा करण्याची क्षमता जाहीर केली आणि नॉस रिसर्चने दावा केला की त्याचे स्वतःचे पोर्टल चतुर्भुज टोकन्सद्वारे पुढे जाऊ शकते.
तटस्थ पायाभूत सुविधांवर अज्ञातपणे फ्रंटियर-समीप मॉडेल चालवणे Z.AI ला त्याचा ब्रँड जोडण्यापूर्वी वास्तविक वापर डेटा आणि अनफिल्टर्ड बेंचमार्क बडबड संकलित करू देते — एक प्लेबुक जे प्रत्येक ओपन-वेट चायनीज रिलीझचे अनुसरण करणारे डिस्काउंट वर्णन बाजूला ठेवते, जसे OfficeChai ने त्याच्या लॉन्चच्या विश्लेषणात नमूद केले आहे.
बेंचमार्क रन ज्याने फ्यूज पेटवला
उन्माद एका डेटा पॉइंटवर परत येतो. रिलीजच्या एका दिवसात, डेव्हलपर बेन डेव्हिसने DeepSWE बेंचमार्कवर अनौपचारिक दहा-टास्क मूल्यांकन केले आणि ऑक्स अल्फासाठी 80 टक्के प्रथम-पास अचूकता नोंदवली - क्लॉड फेबल 5 च्या पुढे 65 टक्के आणि GPT-5.6 सोल 52 टक्के.
तो परिणाम मॉडेल व्हायरल पाठवण्यासाठी आणि OpenCode लीडरबोर्डच्या शीर्षस्थानी DeepSeek च्या 56-दिवसांच्या स्ट्रीकचा शेवट करण्यासाठी पुरेसा होता. याने त्वरित पुशबॅक देखील काढला. हॅकर न्यूजवर, जेथे ब्लूमबर्गच्या पुष्टीकरणाने शेकडो टिप्पण्यांचा रॅक केला, विकासकांनी सावधगिरी बाळगण्याचे आवाहन केले, हे लक्षात घेतले की दहा-टास्क रन कोणत्याही गोष्टीचे निराकरण करण्यासाठी खूप लहान नमुना आहे आणि इतर लीडरबोर्डवरील मॉडेलचे परिणाम लक्षणीयपणे अधिक मिश्रित होते.
इंटरनेटने प्रथम प्रकरण कसे क्रॅक केले
बुधवारच्या पुष्टीकरणाच्या खूप आधी, समुदाय गुप्तहेर कार्य Z.AI वर आधीच स्थायिक झाले होते — पूर्वी Zhipu AI म्हणून ओळखले जाणारे — आघाडीचे उमेदवार म्हणून. "डॅक्स" द्वारे जाणाऱ्या एका विकसकाने 25 प्रॉम्प्ट्सवर टोकनायझर फिंगरप्रिंटिंग चाचणी केली आणि आढळले की ऑक्स अल्फा ची रॉ टोकन संख्या 11 पैकी 11 प्रोबवर GLM च्या टोकनायझरशी जुळते, तर इतर कोणत्याही लॅबच्या मॉडेलने चार क्लिअर केले नाहीत. एका अंकी तपासणीवर, DeepSeek च्या टोकनायझरने 98 टोकन बर्न केले जेथे GLM ने 29 वापरले.
वेगळ्या विश्लेषणात असे आढळून आले की ऑक्स अल्फा त्याच "डर्टी टोकन" वर अडखळत आहे ज्याने ऐतिहासिकदृष्ट्या क्वेन आणि GLM-फॅमिली मॉडेल्सला ट्रिप केले आहे आणि हे फील्ड लवकर चिनी प्रयोगशाळेत संकुचित केले आहे. इतर प्रमुख सिद्धांत — Xiaomi, ज्यांच्या MiMo टीमने पूर्वी MiMo-V2-Pro सह उर्फ हंटर अल्फा या नावाने एकसारखे स्टेल्थ-लाँच प्लेबुक चालवले होते — आता एक फसवणूक झाल्याचे दिसते.
प्रकटीकरणाचे दावे फुशारकी मारण्याच्या अधिकारांच्या पलीकडे विस्तारित आहेत. न्यू यॉर्क टाईम्सने मंगळवारी अहवाल दिला की चीनी लॅबचे मॉडेल रिलीझ जगातील सायबरसुरक्षा तयारीची चाचणी घेऊ शकते, पाश्चात्य सरकार या कॅलिबरच्या ओपन-वेट रिलीझवर किती बारकाईने लक्ष देत आहेत हे अधोरेखित करते.
खुल्या वजनाने कॅल्क्युलस का बदलतो
आज रात्री वजन येत असल्याची Z.AI ची पुष्टी हा बाजारासाठी महत्त्वाचा भाग आहे. कंपनीच्या सध्याच्या GLM 5.3 ची किंमत $1.40 प्रति दशलक्ष इनपुट टोकन आणि $4.40 प्रति दशलक्ष आउटपुट टोकन त्याच्या प्रथम-पक्ष API वर आहे, 81 टक्के कॅशे सवलत आहे. नवीन मॉडेल त्याच MIT परवान्याअंतर्गत पाठवण्याची अपेक्षा आहे Z.AI ने GLM 5 पासून वापरला आहे, OfficeChai नुसार.
सीमावर्ती-समीप कोडिंग आणि एजंटिक कार्यप्रदर्शन, उघडपणे वेस्टर्न API किंमतीच्या एका अंशाने जाहीर केले गेले, हे तंतोतंत दबाव बिंदू आहे जे प्रीमियम लॅब्सने टाळण्यासाठी दोन वर्षे घालवली आहेत. हे Z.AI ला चिनी मार्केटच्या ओपन-वेट बाजूने DeepSeek सोबत स्पर्धात्मक ठेवते, जेथे मुक्तपणे डाउनलोड करण्यायोग्य मॉडेल्स लॅबच्या परिपूर्ण सीमांपेक्षा कमी असलेल्या कोणत्याही गोष्टीसाठी डीफॉल्ट अपेक्षा बनल्या आहेत.
पुढे काय बघायचे
मुख्य तपशील अपुष्ट राहतात — सर्वात महत्त्वाचे म्हणजे पॅरामीटर संख्या आणि मॉडेल आकार, जे स्थानिक तैनातीसाठी रिलीझ किती व्यावहारिक आहे हे निर्धारित करेल. मॉडेल क्वांटायझेशनला कसा प्रतिसाद देते आणि डेटा-सेंटर GPU ऐवजी ग्राहक हार्डवेअरवर किती वेगाने चालते यावर समुदाय चर्चेने आधीच शून्य केले आहे.
हे निश्चित आहे की निनावी अनुमानांच्या एका आठवड्याने Z.AI ला असे काहीतरी दिले आहे जे कोणतेही विपणन बजेट खरेदी करू शकत नाही: तटस्थ आधारावर निष्पक्ष, ब्रँड-अज्ञेयवादी प्रमाणीकरण. आता मॉडेलचे नाव आहे, बेंचमार्क खूप जास्त गर्दी करणार आहेत — आणि बरेच कठोर.
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →