ByteDance 10 ट्रिलियन पॅरामीटर्ससह कृत्रिम बुद्धिमत्ता मॉडेलचे प्रशिक्षण देत आहे, एक प्रणाली जी अँथ्रोपिकच्या अत्याधुनिक मिथॉस मॉडेलच्या स्केलपर्यंत पोहोचू शकते आणि जागतिक AI शर्यतीत नाटकीयरित्या वाढ करू शकते. फायनान्शिअल टाईम्स ने 7 ऑगस्ट 2026 रोजी या योजनेची माहिती दिली, या प्रकरणाची माहिती असलेल्या लोकांचा हवाला देऊन, रॉयटर्स आणि इतर आउटलेट्स नंतर तपशीलांची पुष्टी करतात.

बिल्ड हा नवीनतम सिग्नल आहे की चीनी तंत्रज्ञान कंपन्या त्यांच्या अमेरिकन प्रतिस्पर्ध्यांना फ्रंटियर-मॉडेल शर्यत स्वीकारण्यास नकार देत आहेत. सतत ब्रेकिंग एआय न्यूज आणि प्रत्येक लॅब कुठे आहे याचे विश्लेषण करण्यासाठी, AI Buzz Wire ही कथा विकसित होत असताना त्याचा मागोवा घेत आहे.

10-ट्रिलियन-पॅरामीटर आकृतीचा अर्थ काय आहे

मॉडेलचे पॅरामीटर्स हे नमुने ओळखण्यासाठी, मजकूर तयार करण्यासाठी आणि कार्ये पार पाडण्यासाठी प्रशिक्षण डेटामधून शिकत असलेले संख्यात्मक वजन असतात. ते स्केलसाठी उग्र प्रॉक्सी म्हणून मोठ्या प्रमाणावर वापरले जातात, जरी संशोधक सावध करतात की केवळ पॅरामीटर मोजणे हे मॉडेल किती सक्षम आहे हे निर्धारित करत नाही. प्रशिक्षण पद्धती, डेटा गुणवत्ता आणि आर्किटेक्चर तितकेच महत्त्वाचे आहे.

तरीही, 10-ट्रिलियन-पॅरामीटर लक्ष्य महत्त्वपूर्ण आहे. त्या आकारात, ByteDance चे मॉडेल Moonshot AI च्या Kimi K3 पेक्षा तिप्पट मोठे असेल, जे 2.8 ट्रिलियन पॅरामीटर्स मोजते आणि सध्याच्या सर्वात महत्वाकांक्षी चीनी प्रयत्नांपैकी एक आहे.

Kimi K3 च्या रिलीजपूर्वी, Meituan च्या LongCat-2.0 आणि DeepSeek च्या V4-Pro ने चीनच्या देशांतर्गत क्षेत्राचे नेतृत्व अंदाजे 1.6 ट्रिलियन पॅरामीटर्ससह केले होते, तर इतर अनेक चीनी प्रयोगशाळांनी ट्रिलियन-पॅरामीटर थ्रेशोल्ड ओलांडला होता. बाइटडान्सची नियोजित प्रणाली त्या सर्वांना मोठ्या फरकाने मागे सोडेल.

अँथ्रोपिकच्या मिथॉससह अंतर बंद करणे

अग्रगण्य अमेरिकन मॉडेल्सशी थेट तुलना करणे कठीण आहे कारण Anthropic आणि OpenAI सारख्या कंपन्या Fable, Mythos, किंवा GPT-5.5 सह सिस्टीमसाठी पॅरामीटर संख्या सार्वजनिकपणे उघड करत नाहीत. तथापि, फायनान्शिअल टाईम्स ने उद्योगाचा अंदाज उद्धृत केला आहे की अँथ्रोपिकचे सर्वात प्रगत मायथॉस 5 अंदाजे आठ ट्रिलियन पॅरामीटर्स आहेत आणि फेबल 5 सुमारे पाच ट्रिलियन आहेत.

ते ByteDance चे आगामी मॉडेल Mythos च्या आकाराच्या जवळ ठेवेल, ही प्रणाली मोठ्या प्रमाणावर उपलब्ध असलेल्या सर्वात शक्तिशाली फ्रंटियर मॉडेल्समध्ये मानली जाते. त्या स्केलपर्यंत पोहोचणे चीनी प्रयोगशाळेसाठी मैलाचा दगड ठरेल आणि यूएस आणि चिनी फ्रंटियर मॉडेल्समधील पॅरामीटर अंतर शेवटी कमी होत आहे की नाही याबद्दल प्रश्न तीव्र होतील.

बाइटडान्सने टिप्पणीसाठी केलेल्या विनंत्यांना त्वरित प्रतिसाद दिला नाही, असे अहवालात नमूद केले आहे.

पूर्व प्रशिक्षण आधीच सुरू आहे

फायनान्शिअल टाइम्स नुसार, ByteDance मॉडेल सध्या पूर्व-प्रशिक्षण घेत आहे. प्री-ट्रेनिंग हा मोठ्या मॉडेलच्या विकासाचा सर्वात कम्प्युट-केंद्रित टप्पा आहे आणि सिस्टमला फाईन-ट्यून आणि रिलीझ करण्याआधी प्रक्रिया साधारणपणे तीन ते सहा महिने चालते.

ती टाइमलाइन सूचित करते की कोणतीही सार्वजनिक प्रकाशन अद्याप काही महिने दूर आहे, जरी या प्रमाणात पूर्व-प्रशिक्षण सुरू करण्याचा निर्णय गंभीर, चांगल्या प्रकारे संसाधनित वचनबद्धतेचे प्रतिबिंबित करतो. 10-ट्रिलियन-पॅरामीटर मॉडेलच्या प्री-ट्रेनिंगसाठी विशेष चिप्सचे प्रचंड क्लस्टर आणि मोठ्या प्रमाणात विजेची आवश्यकता असते, ज्याचा खर्च जगातील काही मोजक्या कंपन्याच शोषून घेऊ शकतात.

TikTok आणि Douyin ची मूळ कंपनी म्हणून ओळखल्या जाणाऱ्या ByteDance ने यापूर्वी 2026 च्या चार धोरणात्मक प्राधान्यांपैकी एक म्हणून कृत्रिम बुद्धिमत्तेची रूपरेषा मांडली आहे. कंपनी तिच्या Doubao चॅटबॉट आणि Seedance व्हिडिओ मॉडेलद्वारे जनरेटिव्ह AI मध्ये ढकलत आहे, परंतु एक सीमावर्ती-प्रमाणात भाषा मॉडेलचे प्रतिनिधित्व करण्यासाठी सर्वात जास्त प्रयत्नशील आहे. अग्रगण्य प्रयोगशाळा.

पॅरामीटर आर्म्स रेस का महत्त्वाचा आहे

चिनी टेक फर्म्स त्यांच्या मॉडेल रिलीझ सायकलला गती देत आहेत, यूएस प्रतिस्पर्ध्यांशी लढा देत अधिक शक्तिशाली सिस्टीम चालविणे त्यांना प्रतिबंधात्मकपणे महाग न बनवता तयार केल्यामुळे हा धक्का बसला आहे. रणनीतीने 2026 मध्ये मूनशॉटच्या किमी K3 ते अलीबाबाच्या Qwen3 लाइन आणि DeepSeek च्या V4 मालिकेपर्यंत अनेक रिलीझ तयार केले आहेत.

त्याच वेळी, व्यापक धोरण वातावरण बदलत आहे. बीजिंग त्याच्या शीर्ष AI मॉडेल्स आणि चिप्सवर कडक निर्यात नियंत्रणाचे वजन करत आहे, ही एक अशी हालचाल आहे जी आता बाइटडान्स तयार करत असलेल्या सीमावर्ती प्रणालींवर परदेशात प्रवेश प्रतिबंधित करू शकते. त्या मर्यादांनुसार विकसित केलेले 10-ट्रिलियन-पॅरामीटर मॉडेल ही एक शक्तिशाली, मोठ्या प्रमाणावर देशांतर्गत सेवा देणारी प्रणाली असेल.

स्वतः प्रयोगशाळांसाठी, गणना अर्थशास्त्राबद्दल वाढत आहे. मोठी मॉडेल्स अधिक सक्षम आहेत परंतु प्रशिक्षित करणे आणि चालवणे अधिक महाग आहेत आणि उद्योग कच्चा स्केल किंवा स्मार्ट आर्किटेक्चर आणि प्रशिक्षणोत्तर पुढील विजेता ठरवेल यावर विभागलेला आहे.

मोठे चित्र

ByteDance ची योजना एक व्यापक ट्रेंड अधोरेखित करते: सर्वात मोठ्या अमेरिकन आणि चिनी सीमा मॉडेलमधील अंतर, एकेकाळी दुर्गम समजले जात होते, असे दिसते. जर मिथॉसच्या आकाराचे उद्योग अंदाज अचूक असतील तर, त्याच बॉलपार्कमधील बाइटडान्स मॉडेल त्या अंतराचे अर्थपूर्ण बंद दर्शवेल.

हे OpenAI, Anthropic आणि Google वर त्यांची आघाडी कायम ठेवण्यासाठी दबाव वाढवते. चिनी कंपन्या आता ट्रिलियन-प्लस पॅरामीटर सिस्टम आणि पाश्चात्य लॅब्सना लक्ष्य करत आहेत आणि नेहमी मोठ्या आर्किटेक्चरचा पाठपुरावा करत आहेत, पॅरामीटर रेस कमी होण्याची चिन्हे दिसत नाहीत - जरी संशोधकांनी कच्चा संख्या खरोखर किती महत्त्वाची आहे यावर चर्चा केली.

एआय रेसमध्ये पुढे रहा

फ्रंटियर-मॉडेल लँडस्केप नेहमीपेक्षा वेगाने पुढे जात आहे. नवीनतम AI घडामोडींसाठी आणि प्रत्येक प्रमुख प्रकाशनाच्या सखोल कव्हरेजसाठी आमचे मुख्यपृष्ठ बुकमार्क करा.

अधिक AI बातम्या वाचा →