मेटा ने MTIA 400 पर से पर्दा हटा दिया है, इसका पहला कस्टम एक्सेलेरेटर बड़े भाषा मॉडलों को प्रशिक्षित करने के उद्देश्य से है - एक असामान्य मोड़ के साथ। वार्षिक हॉट चिप्स सेमीकंडक्टर सम्मेलन में इस सप्ताह विस्तृत चिप, गहन शिक्षण अनुशंसाकर्ता कार्यभार भी वहन करेगी जो मेटा की संपूर्ण एआई महत्वाकांक्षा को वित्तपोषित करने वाले विज्ञापनों की सेवा करेगी।
रजिस्टर, जिसने सबसे पहले पूर्ण तकनीकी खुलासे की सूचना दी, ने डिज़ाइन को "विभाजित व्यक्तित्व" कहा: एक तरफ एक फ्रंटियर-प्रशिक्षण चिप, दूसरी तरफ एक विज्ञापन-सेवा इंजन। यह अब तक का सबसे स्पष्ट संकेत है कि मेटा अपने एआई भविष्य को अपने सिलिकॉन पर चलाने का इरादा रखता है। चिप उद्योग को आकार देने वाले नवीनतम एआई विकास पर अधिक जानकारी के लिए एआई बज़ वायर को फॉलो करें।
AI को प्रशिक्षित क्यों करें और एक ही चिप पर विज्ञापन क्यों दें?
कस्टम एआई एक्सेलेरेटर बनाने वाली अधिकांश कंपनियां अनुमान से शुरुआत करती हैं। क्लस्टर छोटे होते हैं, चिप्स सरल होते हैं, और काम अच्छी तरह से समझ में आता है। मेटा पहले एलएलएम प्रशिक्षण को लक्षित करके उस प्रवृत्ति को रोक रहा है - उद्योग में सबसे अधिक गणना-गहन कार्यभार, जिसके लिए अक्सर दसियों या सैकड़ों हजारों त्वरक की आवश्यकता होती है।
समझौता दूसरा कार्यभार है। डीएलआरएम अनुमान - गहन शिक्षण अनुशंसाकर्ता मॉडल जो यह तय करता है कि उपयोगकर्ता कौन से विज्ञापन और पोस्ट देखते हैं - मुख्य रूप से गणना-बाध्य के बजाय मेमोरी-बाउंड है, जिसका अर्थ है कि चिप की अधिकांश प्रशिक्षण मारक क्षमता विज्ञापन सेवा के दौरान निष्क्रिय रहती है। लेकिन मेटा द्वारा गणना पर अरबों डॉलर खर्च करने के साथ, एक चिप पुल डबल ड्यूटी एक व्यावहारिक बचाव है, खासकर जब दो उपयोग मामलों में से एक सीधे राजस्व उत्पन्न करता है।
एमटीआईए 400 के अंदर: 3एनएम चिपलेट्स और ब्रॉडकॉम आईपी
मेटा की हॉट चिप्स प्रस्तुति के अनुसार, जैसा कि द रजिस्टर और सर्वदहोम द्वारा विश्लेषण किया गया है:
- मल्टी-डाई आर्किटेक्चर: दो कंप्यूट डाईज, दो आई/ओ डाईज, और एक SoC डाई हैंडलिंग होस्ट कनेक्टिविटी और वर्कलोड ऑर्केस्ट्रेशन
- प्रोसेस नोड: कंप्यूट चिपलेट्स 3एनएम प्रोसेस टेक्नोलॉजी पर बनाए गए हैं, संभवतः टीएसएमसी से
- गणना: प्रति चिपलेट प्रसंस्करण तत्वों का एक 6x8 ग्रिड, 1.7 गीगाहर्ट्ज़ पर एमएक्सएफपी4 गणना के संयुक्त 12 पेटाफ्लॉप प्रदान करता है
- मेमोरी: आठ 36 जीबी एचबीएम3ई स्टैक - लगभग 9.2 टीबी/एस बैंडविड्थ के साथ कुल 288 जीबी
- इंटरकनेक्ट: आरडीएमए पर चिप-टू-चिप बैंडविड्थ का 1.2 टीबी/एस, ब्रॉडकॉम की भागीदारी को देखते हुए संभावित ईथरनेट
ब्रॉडकॉम की उंगलियों के निशान हर जगह हैं। रजिस्टर नोट करता है कि त्वरक लगभग निश्चित रूप से चिप डिजाइनर के एक्सपीयू आईपी का उपयोग करके बनाया गया था - एक व्यावहारिक विकल्प जो मेटा को त्वरक डिजाइन के गैर-ग्लैमरस हिस्सों को आउटसोर्स करते समय भेदभाव पर ध्यान केंद्रित करने देता है।
यह एनवीडिया और एएमडी के सामने कैसे खड़ा है
प्रदर्शन चित्र सूक्ष्म है. आमतौर पर प्रशिक्षण के लिए उपयोग की जाने वाली उच्च परिशुद्धता पर, MTIA 400 समान शक्ति प्राप्त करते हुए एनवीडिया के टॉप-स्पेक ब्लैकवेल एक्सेलेरेटर की तुलना में लगभग 20% तेज है। इसकी मेमोरी बैंडविड्थ एनवीडिया और एएमडी के पिछली पीढ़ी के हिस्सों से लगभग 15% बेहतर है।
लेकिन नवीनतम पीढ़ी के मुकाबले, अंतर तेजी से बढ़ गया है: MTIA 400, एनवीडिया के रुबिन और AMD के इंस्टिंक्ट MI455X की तुलना में क्रमशः 3x और 3.3x के बीच धीमा है, और यह उन नए GPU की तुलना में आधे से भी कम मेमोरी बैंडविड्थ प्रदान करता है। यही कारण है कि मेटा इस हिस्से को एक अनुमान चिप के बजाय एक प्रशिक्षण चिप के रूप में स्थापित कर रहा है - टोकन परोसने के लिए, इसके पास बहुत तेज़ विकल्प हैं।
सिस्टम स्तर पर, उद्योग मानक रैक से समानता हड़ताली है। प्रत्येक कंप्यूट ब्लेड एक PCIe स्विच, एक x86 CPU और एक स्केल-आउट NIC के साथ चार MTIA 400 त्वरक जोड़ता है। एक पूर्ण रैक में 18 कंप्यूट ब्लेड और आठ स्विच ब्लेड होते हैं - एक एकल एकीकृत डोमेन में 72 त्वरक, एक कॉन्फ़िगरेशन जो एनवीडिया के एनवीएल 72 और एएमडी के हेलिओस रैक डिजाइन को प्रतिबिंबित करता है। मेटा की स्लाइड्स क्लस्टर सीलिंग को निर्दिष्ट किए बिना "मल्टी-हज़ार एक्सेलेरेटर स्केलिंग" का वादा करती हैं।
रोडमैप: एमटीआईए 450 अगले साल
एमटीआईए 400 पंक्ति का अंत नहीं है। मेटा ने मार्च में खुलासा किया कि वह चार नई एमटीआईए पीढ़ियों में छह महीने की रिलीज ताल की योजना बना रहा है, और अगला पड़ाव एमटीआईए 450 है - एक अनुमान-अनुकूलित संस्करण जो संभवतः एचबीएम 4 को अपनाकर मेमोरी बैंडविड्थ को दोगुना करने की उम्मीद करता है। वह चिप अगले वर्ष उत्पादन के लिए निर्धारित है और एलएलएम-आधारित अनुशंसा कार्यभार चलाने के लिए उपयुक्त होनी चाहिए।
प्रगति के बावजूद, द रजिस्टर का विश्लेषण स्पष्ट है: मेटा का इन-हाउस सिलिकॉन जल्द ही एएमडी या एनवीडिया जीपीयू की जगह नहीं लेगा। मेटा सुपरइंटेलिजेंस लैब्स लगभग निश्चित रूप से अभी भी पारंपरिक जीपीयू पर फ्रंटियर मॉडल का प्रशिक्षण कर रही है, और एप्लिकेशन-विशिष्ट हार्डवेयर अच्छी तरह से समझे जाने वाले, स्थिर वर्कलोड के लिए सबसे उपयुक्त है।
यह क्यों मायने रखती है
MTIA 400 दो कारणों से मायने रखता है। सबसे पहले, यह एक हाइपरस्केलर को आसान अनुमान जीत हासिल करने के बजाय सबसे कठिन कार्यभार - सीमांत प्रशिक्षण - पर हमला करने के लिए तैयार दिखाता है। दूसरा, डिज़ाइन का विज्ञापन-सेवा पक्ष अर्थशास्त्र की याद दिलाता है: कस्टम सिलिकॉन पर पूंजीगत व्यय का प्रत्येक डॉलर इतिहास में सबसे लाभदायक विज्ञापन व्यवसाय द्वारा अंडरराइट किया गया है। यदि मेटा अपने प्रशिक्षण और अनुशंसा कार्यभार का एक अंश भी व्यापारी जीपीयू से हटा सकता है, तो इसके पैमाने पर बचत अरबों में मापी जाएगी।
स्रोत: मेटा की हॉट चिप्स 2026 प्रस्तुति, द रजिस्टर, और सर्वदहोम।
---
एआई से आगे रहेंनवीनतम एआई समाचार, विश्लेषण और सफलताएँ प्राप्त करें - सभी एक ही स्थान पर।
अधिक AI समाचार पढ़ें →