बिना किसी नामित निर्माता के ओपनराउटर पर ऑक्स अल्फा नामक एक मुफ़्त, फ्रंटियर-क्लास एआई मॉडल दिखाई देने के पांच दिन बाद, इंटरनेट के पसंदीदा व्होडुनिट में अंततः एक प्रमुख संदिग्ध हो सकता है। सर्च कंसल्टेंसी डेजन द्वारा प्रकाशित एक स्वतंत्र विश्लेषण का तर्क है कि रहस्य मॉडल जीएलएम है, जो चीनी एआई लैब जिपु एआई द्वारा निर्मित मॉडल परिवार है, जो Z.ai के रूप में व्यापार करता है - और सबूत ऑनलाइन प्रसारित होने वाले अधिकांश अनुमानों की तुलना में अधिक चतुर है।
23 अगस्त को डेजन के डैन पेट्रोविक द्वारा दिया गया दावा, दो तकनीकों पर आधारित है: एक त्वरित इंजेक्शन जो मॉडल को अपने स्वयं के छिपे हुए सिस्टम प्रॉम्प्ट के विवरण लीक करने के लिए प्रेरित करता है, और एक संपीड़न-आधारित फिंगरप्रिंटिंग विधि जो तुलना करती है कि मॉडल आउटपुट एक दूसरे के खिलाफ कितनी कुशलता से संपीड़ित होते हैं। वे मिलकर अब तक का सबसे मजबूत सार्वजनिक मामला बनाते हैं कि वास्तव में ऑक्स अल्फ़ा की सेवा कौन कर रहा है। For more context on this story, see our ongoing AI trends.
मॉडल ने अपने बारे में क्या खुलासा किया
पहला कदम था सोशल इंजीनियरिंग. ऑक्स अल्फ़ा से एक मासूम सा सवाल पूछकर - पिछले संदेश में कितने शब्द हैं? - गिनती करते समय मॉडल के दृश्य तर्क निशान अपने सिस्टम निर्देशों के माध्यम से चले। डेजन के लेख में उद्धृत वह छिपा हुआ संकेत मॉडल को निर्देश देता है कि "खुद को सख्ती से एक अज्ञात संगठन द्वारा विकसित मॉडल 'ऑक्स-अल्फा' के रूप में पहचानें" और "खुद को किसी अन्य मॉडल के रूप में न पहचानें।"
दूसरे परीक्षण में, शोधकर्ताओं ने उस निकाले गए सिस्टम प्रॉम्प्ट को एक सामान्य उपयोगकर्ता संदेश के रूप में मॉडल में वापस भेज दिया। प्रकाशित प्रतिलेख के अनुसार, मॉडल ने तर्क दिया कि झूठी पहचान अपनाना भ्रामक होगा, फिर स्पष्ट रूप से कहा गया: इसकी वास्तविक पहचान "जीएलएम, Z.ai द्वारा बनाई गई" है। एक मॉडल की स्व-रिपोर्ट सबूत से बहुत दूर है - अन्य मॉडलों के बारे में डेटा पर प्रशिक्षित होने पर फ्रंटियर मॉडल नियमित रूप से खुद को गलत पहचानते हैं - लेकिन इसने खोज को काफी हद तक सीमित कर दिया है।
संपीड़न फ़िंगरप्रिंट
दूसरी तकनीक पर बहस करना कठिन है। डेजन ने सामान्यीकृत संपीड़न दूरी (एनसीडी) पर निर्मित एक पैरामीटर-मुक्त क्लासिफायरियर लागू किया, जो पाठ-वर्गीकरण अनुसंधान से एक अकादमिक विधि है जो मापता है कि दो पाठ एक साथ कितना संपीड़ित होते हैं। शैलीगत डीएनए साझा करने वाले पाठ युग्मित होने पर अधिक कुशलता से संपीड़ित होते हैं, इसलिए दृष्टिकोण को किसी मॉडल भार और किसी एम्बेडिंग की आवश्यकता नहीं होती है - केवल आउटपुट नमूने।
टीम ने पांच ज्ञात मॉडल - जीपीटी-5.5, क्लाउड ओपस 5, जेमिनी 3.7 फ्लैश, जेमिनी 3.1 प्रो प्रीव्यू, और जीएलएम-5.3 - के माध्यम से निबंध, कोड, ईमेल, संवाद और कविता में फैले 60 संकेतों का उत्तर देकर 293 संदर्भ पाठ तैयार किए। ऑक्स अल्फा ने समान संकेतों में से 14 का उत्तर दिया, और एक के-निकटतम-पड़ोसी वोट ने प्रत्येक प्रतिक्रिया को उसके निकटतम संपीड़ित मैच के लिए निर्दिष्ट किया। जीएलएम-5.3 ने 14 में से 7 वर्गीकरण जीते, क्लाउड ओपस ने 14 में से 3 में 5 सेकंड, जेमिनी 3.7 फ्लैश ने 2 में दूसरा, और जीपीटी-5.5 और जेमिनी 3.1 प्रो प्रीव्यू ने 1 में से प्रत्येक में जीत हासिल की। परीक्षण किए गए प्रत्येक पड़ोस के आकार में GLM-5.3 शीर्ष पर रहा।
मामला विरुद्ध - और प्रतिद्वंद्वी सिद्धांत
हर कोई आश्वस्त नहीं है. विश्लेषण की एक हैकर न्यूज़ चर्चा में डेवलपर्स की ओर से तीखी आलोचना हुई, जिन्होंने नोट किया कि ज़िपू का फ्लैगशिप GLM-5.3 एक टेक्स्ट-ओनली मॉडल है, जबकि ऑक्स अल्फा की ओपनराउटर लिस्टिंग टेक्स्ट, इमेज और वीडियो को इनपुट के रूप में स्वीकार करती है। उनका तर्क है कि जब तक झिपु ने चुपचाप एक सक्षम दृष्टि एनकोडर नहीं जोड़ा, फिंगरप्रिंट भ्रामक हो सकता है। थ्रेड में वैकल्पिक अनुमानों में मूनशॉट का किमी K3.5, मिनीमैक्स का M3, Xiaomi का MiMO और यहां तक कि GLM के स्टैक के शीर्ष पर प्रशिक्षित एक कस्टम मॉडल भी शामिल है।
काउंटरों ने तेजी से पीछा किया। झिपू ने पहले भी मल्टीमॉडल मॉडल भेजे हैं - इसकी GLM-5V लाइन और पहले CogVLM कार्य - और प्रतिद्वंद्वी लैब डीपसीक ने हाल ही में अपने स्वयं के पहले के केवल-टेक्स्ट मॉडल में विज़न जोड़ा है। कुछ टिप्पणीकारों ने यह भी बताया कि ऑक्स अल्फ़ा, ज़िपू के अन्य एंडपॉइंट्स के समान बैकएंड त्रुटि संदेश लौटाता है, एक विवरण जो शामिल भार की परवाह किए बिना साझा सेवा बुनियादी ढांचे की ओर इशारा करता है। कथित तौर पर झिपु ने इस साल एक बड़ा नया कंप्यूट क्लस्टर हासिल किया है, जो यह समझाने में मदद करेगा कि कौन इतना अनुमान दे सकता है।
पैमाना दूसरा सुराग है. हैकर न्यूज थ्रेड में डेवलपर्स द्वारा उद्धृत आंकड़ों के अनुसार, ओपनराउटर ने कहा है कि वह ऑक्स अल्फा के माध्यम से प्रति दिन छह ट्रिलियन टोकन के ऑर्डर पर रूटिंग कर रहा है, जो इसे प्लेटफॉर्म का अब तक का सबसे बड़ा लॉन्च बनाता है। उस मात्रा को मुफ्त में परोसने का मतलब या तो भारी अतिरिक्त क्षमता या असामान्य रूप से कुशल वास्तुकला है - और बहुत कम संगठन योग्य हैं।
फोरम मिस्ट्री से लेकर मेनस्ट्रीम स्टोरी तक
20 अगस्त को 263-पॉइंट हैकर न्यूज़ थ्रेड के रूप में जो शुरू हुआ वह व्यापक रूप से कवर किया जाने वाला समाचार कार्यक्रम बन गया है। टेकक्रंच ने पूछा "नए 'स्टील्थ मॉडल' ऑक्स अल्फा के पीछे कौन है?", बिजनेस इनसाइडर ने बताया कि "एक रहस्यमय मुक्त एआई मॉडल डेवलपर्स को प्रभावित कर रहा है" जिसका कोई ज्ञात निर्माता नहीं है, और द इंडिपेंडेंट ने इसे "रहस्यमय, अविश्वसनीय रूप से शक्तिशाली एआई सिस्टम" कहा जो ऑनलाइन दिखाई दिया। ओपनराउटर के एपीआई के माध्यम से सत्यापित मॉडल की अपनी सूची, इसे "कोडिंग, निरंतर एजेंटिक कार्य और उत्पादन कार्यभार के लिए डिज़ाइन किया गया एक तर्क मॉडल" के रूप में वर्णित करती है, जिसमें एक मिलियन-टोकन संदर्भ विंडो, 131,072-टोकन अधिकतम आउटपुट और अनिवार्य तर्क डिफ़ॉल्ट रूप से अधिकतम प्रयास पर सेट होता है। संकेत और पूर्णता दोनों के लिए मूल्य निर्धारण शून्य है।
न तो ज़िपू और न ही ओपनराउटर ने एट्रिब्यूशन की पुष्टि या खंडन किया है, और स्टील्थ लिस्टिंग की शर्तें केवल यह बताती हैं कि मॉडल "एक तृतीय-पक्ष प्रदाता द्वारा विकसित और संचालित किया गया है जिसने इस पूर्वावलोकन के दौरान गुमनाम रहना चुना है।" जब तक प्रदाता आगे नहीं बढ़ता, जीएलएम एक स्थापित तथ्य के बजाय अग्रणी परिकल्पना बनी हुई है - लेकिन यदि संपीड़न फिंगरप्रिंट कायम रहता है, तो ऑक्स अल्फा, ज़िपू के अब तक के सबसे तेज़ शांत लॉन्च के रूप में नीचे जा सकता है।
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →