चूँकि कृत्रिम बुद्धिमत्ता सिंगल-टर्न चैटबॉट्स से लगातार चलने वाले स्वायत्त एजेंटों में स्थानांतरित हो रही है, NVIDIA इस समय को पूरा करने के लिए अपने ओपन मॉडल लाइनअप का विस्तार कर रहा है। 11 अगस्त, 2026 को, कंपनी ने नेमोट्रॉन 3.5 लाइटनिंग का अनावरण किया, एक 30-बिलियन-पैरामीटर मिश्रण-विशेषज्ञ मॉडल जिसे वह लंबे समय तक चलने वाले एजेंटिक एआई वर्कलोड के लिए अपनी कक्षा में उच्चतम दक्षता वाला मॉडल कहता है। कारी ब्रिस्की द्वारा एनवीआईडीआईए ब्लॉग पर विस्तृत रिलीज, नेमो स्विचयार्ड के साथ आती है, जो एक ओपन सोर्स रूटिंग लाइब्रेरी है जिसे प्रत्येक कार्य को स्वचालित रूप से सबसे सक्षम और लागत प्रभावी मॉडल पर निर्देशित करने के लिए डिज़ाइन किया गया है। नवीनतम [एआई उद्योग कवरेज] (https://aibuzzwire.news) के लिए, एजेंटिक एआई स्टैक आकार लेते समय अनुसरण करें।

हमेशा सक्रिय रहने वाले एजेंटों के लिए बनाया गया एक मॉडल

आधुनिक एजेंटिक सिस्टम तेजी से उसी तरह काम कर रहे हैं जिसे NVIDIA "मॉडल के सिस्टम" या मॉडल संयोजन के रूप में वर्णित करता है। नेमोट्रॉन 3 अल्ट्रा या जीपीटी-5.6 जैसे फ्रंटियर रीजनिंग मॉडल वर्कफ़्लो की योजना बना सकते हैं और व्यवस्थित कर सकते हैं, जबकि छोटे विशेष मॉडल कोड समीक्षा, टूल उपयोग, सुरक्षा चेतावनी निगरानी या बिलिंग प्रश्नों का उत्तर देने जैसे लक्षित कार्यों को संभालते हैं। नेमोट्रॉन 3.5 लाइटनिंग को उस दूसरे स्तर के उद्देश्य से बनाया गया है: उच्च-मात्रा, विशेष कार्य जो हमेशा सक्रिय रहने वाले एजेंटों को शक्ति प्रदान करते हैं।

NVIDIA के अनुसार, यह मॉडल 4 गुना तेज आउटपुट स्पीड प्रदान करता है, जिससे अपनी श्रेणी के अन्य मॉडलों की तुलना में लगभग 30% तेज एजेंटिक कार्य पूरा होता है। NVIDIA के अपने पिंचबेंच बेंचमार्क कथित तौर पर प्रदर्शित करते हैं कि नेमोट्रॉन 3.5 लाइटनिंग अपने साथियों की तुलना में कार्यों को अधिक तेजी से पूरा करते हुए सीमांत स्तर की सटीकता बनाए रखता है। मॉडल को नेमोट्रॉन गठबंधन के योगदान से विकसित किया गया था, जिसके सदस्यों ने मॉडल को आगे बढ़ाने में मदद के लिए मूल्यांकन पद्धतियां, अनुमान सॉफ्टवेयर और डेटासेट प्रदान किए थे।

क्योंकि यह खुला और अनुकूलन योग्य है, संगठन विशेष कार्यों के लिए सटीकता में सुधार करने के लिए अपने स्वयं के डोमेन डेटा, टूल और वर्कफ़्लो पर NVIDIA NeMo के साथ नेमोट्रॉन 3.5 लाइटनिंग को पोस्ट-ट्रेन कर सकते हैं। NVIDIA नेमोट्रॉन-आरएल-एजेंटिक-टर्मिनल-पिवोट भी जारी कर रहा है, जो एक एजेंटिक सुदृढीकरण सीखने वाला डेटासेट है जिसका उपयोग कोडिंग एजेंट क्षमताओं के लिए मॉडल को पोस्ट-ट्रेन करने के लिए किया जाता है।

कहीं भी दौड़ना, किनारे से बादल तक

नेमोट्रॉन 3.5 लाइटनिंग के केंद्रीय विक्रय बिंदुओं में से एक तैनाती लचीलापन है। मॉडल स्थानीय AI सिस्टम पर चल सकता है - जिसमें NVIDIA RTX PC, NVIDIA DGX स्पार्क, NVIDIA DGX स्टेशन और NVIDIA जेटसन शामिल हैं - जिससे संगठनों को मौजूदा बुनियादी ढांचे के निवेश को अधिकतम करने में मदद मिलती है। यह एंटरप्राइज़ उपयोग के मामलों के लिए एज AI डिवाइस, NVIDIA RTX PRO वर्कस्टेशन, डेटा सेंटर और क्लाउड वातावरण में भी स्केल कर सकता है। संवेदनशील डेटा को संभालने वाले संगठनों के लिए यह लचीलापन मायने रखता है जिसे परिसर में ही रहना चाहिए।

प्रत्येक नेमोट्रॉन लॉन्च की तरह, एनवीआईडीआईए का कहना है कि यह प्रशिक्षण डेटा और तकनीकों को लाइसेंसिंग परमिट के रूप में प्रकाशित करता है, जो अन्य मॉडलों की ट्रेसबिलिटी, ऑडिटिंग और प्रशिक्षण की अनुमति देता है। पारदर्शिता के प्रति यह प्रतिबद्धता एक प्रतिस्पर्धी विभेदक बन गई है क्योंकि उद्यम मालिकाना विकल्पों के मुकाबले खुले मॉडल को महत्व देते हैं जो इस बात की कम दृश्यता प्रदान करते हैं कि उनका निर्माण कैसे किया गया था।

निमो स्विचयार्ड: मॉडलों के सिस्टम के लिए स्मार्ट रूटिंग

यदि नेमोट्रॉन 3.5 लाइटनिंग वर्कहॉर्स है, तो नेमो स्विचयार्ड डिस्पैचर है। ओपन सोर्स लाइब्रेरी रूट विशिष्ट आवश्यकताओं के आधार पर, एजेंट वर्कफ़्लो के प्रत्येक चरण के लिए स्वचालित रूप से सबसे सक्षम और कुशल मॉडल का संकेत देता है। कुछ मॉडल कोडिंग के लिए बेहतर हैं, कुछ तर्क के लिए, कुछ हल्के कार्यों के लिए, और कुछ अधिक गोपनीयता और दक्षता के लिए स्थानीय रूप से चलाने के लिए अनुकूलित हैं। एकल डिफ़ॉल्ट मॉडल पर भरोसा करने का मतलब अत्यधिक खर्च करना या गुणवत्ता का त्याग करना हो सकता है; इस बीच, रूटिंग को मैन्युअल रूप से प्रबंधित करना एकीकरण कार्य बन जाता है जो तैनाती को धीमा कर सकता है।

एजेंट एप्लिकेशन डेवलपर अपनी प्राथमिकताओं, जैसे गुणवत्ता, विलंबता और लागत आवश्यकताओं से मेल खाने के लिए विभिन्न रूटिंग एल्गोरिदम के साथ राउटर को ट्यून या संशोधित कर सकते हैं। NVIDIA के आंतरिक बेंचमार्क से पता चलता है कि NeMo स्विचयार्ड कार्य पूरा करने की लागत को ओपस 4.8 के लगभग एक-तिहाई तक कम करते हुए सीमांत-स्तरीय सटीकता बनाए रखता है - बड़ी संख्या में एजेंट कार्य चलाने वाले संगठनों के लिए एक उल्लेखनीय दक्षता लाभ।

कंपनी ने भागीदार एकीकरणों की एक श्रृंखला पर प्रकाश डाला। बूमी ने 100% डोमेन-रूटिंग सटीकता की सूचना दी और 59% ट्रैफ़िक को 5x तेज़ फ़ाइन-ट्यून मॉडल पर भेजा। औपचारिक सत्यापन उपयोग के मामले में कैडेंस ने दक्षता में 9.9% सुधार किया। कॉग्निशन ने स्विचयार्ड को डेविन डेस्कटॉप में एकीकृत किया, जिससे औसत लागत में 28% की कटौती करते हुए फ्रंटियरकोड मेन पर निकट-सीमावर्ती प्रदर्शन प्राप्त हुआ। लैंगचेन ने फ्रंटियर मॉडल पर केवल 7% कॉल को रूट करके 145 मल्टी-टर्न डीप एजेंट कार्यों में 74% कम लागत की सूचना दी। लाइटएलएलएम अपनी प्रॉक्सी परत में प्लग-इन के रूप में नेमो स्विचयार्ड जोड़ रहा है, और कोंग अब कोंग एआई गेटवे के माध्यम से मूल रूप से रूटिंग प्रदान करता है। विशेष रूप से, नूस रिसर्च ने डेवलपर्स को एजेंट दक्षता के लिए आसानी से कॉन्फ़िगर किया जाने वाला रूटिंग सिस्टम देने के लिए नेमो स्विचयार्ड को हर्मीस में एकीकृत किया।

उद्योग को अपनाना और बड़ी तस्वीर

उद्योगों में एआई नेता पहले से ही अपने कार्यभार के लिए नेमोट्रॉन 3.5 लाइटनिंग को अनुकूलित कर रहे हैं। क्राउडस्ट्राइक इसे साइबर सुरक्षा में लागू कर रहा है, हार्वे इसे कानूनी सेवाओं के लिए उपयोग कर रहा है, और कोडरैबिट इसे कोड समीक्षा के लिए तैनात कर रहा है। लीला साइंसेज भौतिक और जीवन विज्ञान में एजेंटिक कार्यों के लिए तर्क क्षमताओं को बेहतर बनाने में मदद कर रही है, जबकि फास्टिनो लैब्स ने मॉडल को अनुकूलित किया और सॉफ्टवेयर विकास, वित्त और स्वास्थ्य देखभाल कार्यभार के लिए अग्रणी सटीकता की सूचना दी।

यह रिलीज़ एक व्यापक उद्योग प्रवृत्ति को रेखांकित करती है: जैसे-जैसे एजेंटिक एआई परिपक्व होता है, कोई भी एकल मॉडल स्वीकार्य लागत पर सब कुछ अच्छा नहीं कर सकता है। भविष्य समूहों का है - सीमांत योजनाकार जो विशेष श्रमिकों के बेड़े का समन्वय करते हैं - और उपकरण जो उन्हें एक साथ जोड़ते हैं। NVIDIA की शर्त यह है कि खुले मॉडल और बुद्धिमान रूटिंग उद्यमों को एक ही प्रदाता के स्टैक में खुद को लॉक किए बिना उन सिस्टमों को इकट्ठा करने देंगे।

एआई से आगे रहें

NVIDIA का नेमोट्रॉन 3.5 लाइटनिंग और नेमो स्विचयार्ड सिग्नल जहां एजेंटिक एआई जा रहा है: तेज, सस्ता, अधिक पारदर्शी और कहीं भी तैनात करने योग्य। मॉडल रिलीज़ और परिदृश्य को नया आकार देने वाले एंटरप्राइज़ टूल के साथ बने रहने के लिए, हमारी [ब्रेकिंग एआई न्यूज़] (https://aibuzzwire.news) देखें।

अधिक AI समाचार पढ़ें →