मीटुआन, चीनी प्रौद्योगिकी समूह जो अंतरराष्ट्रीय स्तर पर अपने खाद्य-वितरण साम्राज्य के लिए जाना जाता है, ने एजेंटिक सॉफ्टवेयर इंजीनियरिंग के उद्देश्य से निर्मित 1.6 ट्रिलियन-पैरामीटर कृत्रिम बुद्धिमत्ता मॉडल लॉन्गकैट-2.0 जारी और ओपन-सोर्स किया है। 30 जून, 2026 को घोषित रिलीज़, न केवल अपने पैमाने के लिए उल्लेखनीय है, बल्कि इसे कैसे प्रशिक्षित किया गया था: पूरी तरह से घरेलू स्तर पर उत्पादित चीनी चिप्स पर, पाइपलाइन में कोई एनवीडिया या एएमडी त्वरक नहीं है।
इस कदम को अब तक के सबसे मजबूत संकेत के रूप में पढ़ा जा रहा है कि उन्नत एआई सिलिकॉन पर अमेरिकी निर्यात नियंत्रण चीनी कंपनियों को फ्रंटियर-क्लास मॉडल बनाने से रोकने में विफल हो रहे हैं। साउथ चाइना मॉर्निंग पोस्ट, रॉयटर्स और वेंचरबीट सहित कई आउटलेट्स ने लॉन्च की सूचना दी, जिसमें क्रिप्टो ब्रीफिंग ने लॉन्गकैट-2.0 को अब तक बनाए गए सबसे बड़े ओपन-सोर्स कोडिंग मॉडल में से एक बताया। For more context on this story, see our ongoing AI trends.
एजेंटों के लिए बनाया गया विशेषज्ञों का मिश्रण मॉडल
LongCat-2.0 मिक्सचर-ऑफ-एक्सपर्ट्स (MoE) आर्किटेक्चर का उपयोग करता है, जिसका अर्थ है कि यह प्रत्येक अनुरोध पर सभी 1.6 ट्रिलियन मापदंडों को सक्रिय नहीं करता है। इसके बजाय, यह प्रत्येक टोकन को लगभग 33 बिलियन से 56 बिलियन सक्रिय मापदंडों के माध्यम से गतिशील रूप से रूट करता है, जिससे प्राप्त करने के लिए एक विशाल ज्ञान आधार को बनाए रखते हुए इसे तुलनात्मक आकार के घने मॉडल की तुलना में कहीं अधिक कुशल रखा जाता है।
वह दक्षता लागत के लिए मायने रखती है। MoE डिज़ाइन बड़े पैमाने के मॉडल के लिए प्रमुख वास्तुकला बन गए हैं क्योंकि वे प्रति-क्वेरी गणना से कुल क्षमता को कम कर देते हैं, जिससे प्रयोगशालाओं को प्रत्येक कॉल पर प्रत्येक पैरामीटर के लिए ग्राहकों से शुल्क लिए बिना बहुत बड़े मॉडल भेजने की अनुमति मिलती है।
मॉडल 1 मिलियन टोकन की संदर्भ विंडो का समर्थन करता है, जो एक ही पास में संपूर्ण पर्याप्त कोडबेस और तर्क को समाहित करने के लिए पर्याप्त बड़ी है - स्वायत्त कोडिंग एजेंटों द्वारा तेजी से मांग की जाने वाली क्षमता जिसमें फ़ाइल दर फ़ाइल काम करने के बजाय संपूर्ण रिपॉजिटरी को ध्यान में रखना चाहिए।
बेंचमार्क और वास्तविक दुनिया में उपयोग
क्रिप्टो ब्रीफिंग के अनुसार, वास्तविक दुनिया की सॉफ्टवेयर इंजीनियरिंग को मापने के लिए डिज़ाइन किए गए बेंचमार्क पर, LongCat-2.0 ने SWE-बेंच प्रो पर 59.5 और टर्मिनल-बेंच पर 70.8 का स्कोर पोस्ट किया। ये मूल्यांकन सूट परीक्षण करते हैं कि मॉडल वास्तविक विकास कार्य की गड़बड़, बहु-चरणीय चुनौतियों को कितनी अच्छी तरह संभालते हैं - बग्स को ठीक करना, फीचर्स लिखना, मौजूदा कोड को नेविगेट करना - सरल एक-शॉट प्रोग्रामिंग पहेली के बजाय।
वेंचरबीट ने अलग से नोट किया कि मॉडल अपने औपचारिक ओपन-सोर्स रिलीज से पहले एजेंटिक कोडिंग रैंकिंग में लोकप्रिय मल्टी-मॉडल एपीआई गेटवे "अग्रणी ओपनराउटर" रहा था। ओपनराउटर 60 से अधिक प्रदाताओं से 400 से अधिक मॉडल एकत्र करता है और इसके उपयोग डेटा को व्यापक रूप से उद्योग बैरोमीटर के रूप में माना जाता है कि कौन से मॉडल डेवलपर्स वास्तव में चलाने के लिए चुनते हैं।
50,000 घरेलू चिप्स पर प्रशिक्षित
सबसे अधिक ध्यान खींचने वाला विवरण हार्डवेयर है। मीटुआन ने कहा कि इसने लॉन्गकैट-2.0 को 50,000-कार्ड घरेलू कंप्यूट क्लस्टर पर प्रशिक्षित और चलाया, जो पूरी तरह से चीनी निर्मित एक्सेलेरेटर से निर्मित है। क्रिप्टो ब्रीफिंग के अनुसार, इसका मतलब है कि प्रशिक्षण के किसी भी चरण में किसी भी Nvidia A100s या H100s और किसी भी AMD MI300X इकाइयों का उपयोग नहीं किया गया था - यह उस हार्डवेयर से बिल्कुल अलग है जिसने दुनिया भर में अधिकांश बड़े-मॉडल विकास को संचालित किया है।
मीटुआन का दावा है कि 50,000-कार्ड क्लस्टर घरेलू चीनी हार्डवेयर के लिए इस पैमाने पर पहला प्रतिनिधित्व करता है। अमेरिकी निर्यात नियंत्रणों के बावजूद प्रशिक्षण कार्यक्रम पूरा हो गया, जिसने 2022 के अंत से अत्याधुनिक एआई चिप्स तक चीन की पहुंच को व्यवस्थित रूप से प्रतिबंधित कर दिया है। विश्लेषकों का कहना है कि इसका निहितार्थ यह है कि नियंत्रण का लाभ कम हो रहा है क्योंकि चीनी चिप निर्माता और उनके ग्राहक प्रदर्शन अंतर को कम कर रहे हैं।
गले लगाने वाले चेहरे पर वजन उपलब्ध है
ओपन-सोर्स फ़्रेमिंग को ध्यान में रखते हुए, मितुआन ने "मीतुआन-लॉन्गकैट" संगठन के तहत हगिंग फेस पर मॉडल वेट और सहायक संसाधन प्रकाशित किए हैं। यह उन डेवलपर्स और शोधकर्ताओं के लिए बाधा को कम करता है जो एंटरप्राइज़ कोडबेस, सुरक्षा ऑडिटिंग या स्वचालित डिबगिंग के लिए मॉडल को ठीक करना चाहते हैं लेकिन स्क्रैच से तुलनीय कुछ प्रशिक्षित करने का जोखिम कभी नहीं उठा सकते हैं।
ओपन रिलीज़ सीधे एजेंटिक-कोडिंग इकोसिस्टम में भी फीड होती है, जहां ओपन-वेट मॉडल को प्रति-टोकन लागत और मालिकाना एपीआई के साथ आने वाली डेटा-हैंडलिंग चिंताओं के बिना स्व-होस्ट, ऑडिट और संशोधित किया जा सकता है - तीसरे पक्ष के क्लाउड पर मालिकाना कोड भेजने से सावधान रहने वाले उद्यमों के लिए एक महत्वपूर्ण विचार।
एक तीव्र मॉडल वंश
LongCat-2.0 रातोरात प्रकट नहीं हुआ। यह वंश सितंबर 2025 में जारी 560 बिलियन-पैरामीटर मॉडल लॉन्गकैट-फ्लैश से जुड़ा है, इसके बाद मार्च 2026 में लॉन्गकैट-नेक्स्ट, एक मल्टीमॉडल वेरिएंट जारी किया गया। नई रिलीज एक साल से भी कम समय में अपने पूर्ववर्ती की पैरामीटर गिनती को लगभग तीन गुना कर देती है, जो उस ख़तरनाक गति को दर्शाती है जिस पर चीनी प्रयोगशालाएं अब फाउंडेशन मॉडल पर पुनरावृत्ति कर रही हैं।
यह लॉन्च वैश्विक मॉडल लीडरबोर्ड के व्यापक फेरबदल के बीच भी हुआ है, जिसमें चीनी सिस्टम वास्तविक दुनिया के डेवलपर उपयोग में बढ़ गए हैं और अब एग्रीगेटर प्लेटफार्मों पर शीर्ष टोकन-खपत रैंकिंग में हैं।
चिप-नियंत्रण बहस के लिए इसका क्या अर्थ है
वाशिंगटन में नीति निर्माताओं के लिए, लॉन्गकैट-2.0 एक असुविधाजनक डेटा बिंदु है। निर्यात-नियंत्रण रणनीति का केंद्रीय आधार यह रहा है कि अग्रणी चिप्स तक पहुंच से इनकार करने से चीन की एआई प्रगति धीमी हो जाएगी। घरेलू हार्डवेयर पर सफलतापूर्वक प्रशिक्षित प्रत्येक मॉडल उस आधार को कमजोर करता है, यह सुझाव देता है कि प्रतिबंध उस आत्मनिर्भरता को तेज कर सकते हैं जिसे वे रोकने के लिए थे।
मितुआन ने स्वयं एक नपे-तुले सार्वजनिक स्वर पर प्रहार किया है। फ़ुटू द्वारा प्रकाशित रिपोर्टों के अनुसार, संस्थापक और मुख्य कार्यकारी वांग ज़िंग ने हाल ही में एआई निवेश के लिए कंपनी की प्रतिबद्धता दोहराई, जबकि इस बात पर जोर दिया कि वह "अपनी वित्तीय क्षमता से अधिक आँख मूंदकर निवेश नहीं करेगी"।
अभी के लिए, डेवलपर्स के लिए टेकअवे ठोस है: एक निकट-सीमांत, मिलियन-टोकन कोडिंग मॉडल स्वतंत्र रूप से डाउनलोड करने योग्य है, और इसे एक भी प्रतिबंधित अमेरिकी चिप के बिना बनाया गया था। चाहे अमेरिकी प्रयोगशालाएं सस्ते खुले वजन, सख्त नियंत्रण, या कच्चे प्रदर्शन के लिए नए सिरे से दबाव के साथ प्रतिक्रिया दें, प्रतिस्पर्धी परिदृश्य फिर से बदल गया।
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →



