چونکہ مصنوعی ذہانت سنگل ٹرن چیٹ بوٹس سے خود مختار ایجنٹوں کی طرف منتقل ہوتی ہے جو مسلسل چلتے ہیں، NVIDIA اس لمحے کو پورا کرنے کے لیے اپنے اوپن ماڈل لائن اپ کو بڑھا رہا ہے۔ 11 اگست، 2026 کو، کمپنی نے Nemotron 3.5 Lightning کی نقاب کشائی کی، جو ماہرین کا 30 بلین پیرامیٹر مرکب ماڈل ہے جسے یہ طویل عرصے سے چلنے والے ایجنٹی AI کام کے بوجھ کے لیے اپنی کلاس میں سب سے زیادہ کارکردگی والا ماڈل کہتا ہے۔ کیری برِسکی کے NVIDIA بلاگ پر تفصیلی ریلیز NeMo Switchyard کے ساتھ آتی ہے، جو ایک اوپن سورس روٹنگ لائبریری ہے جو ہر کام کو خود بخود انتہائی قابل اور لاگت سے موثر ماڈل کی طرف ہدایت کرنے کے لیے ڈیزائن کیا گیا ہے۔ تازہ ترین AI انڈسٹری کوریج کے لیے، ایجنٹی AI اسٹیک کی شکل اختیار کرنے کے ساتھ ساتھ عمل کریں۔

ایک ماڈل جو ہمیشہ آن ایجنٹوں کے لیے بنایا گیا ہے۔

جدید ایجنٹی نظام تیزی سے اس طرح کام کرتے ہیں جسے NVIDIA "ماڈل کے نظام" یا ماڈل کے جوڑ کے طور پر بیان کرتا ہے۔ فرنٹیئر ریجننگ ماڈل جیسے کہ Nemotron 3 Ultra یا GPT-5.6 ایک ورک فلو کی منصوبہ بندی اور آرکیسٹریٹ کر سکتا ہے، جبکہ چھوٹے خصوصی ماڈلز کوڈ کا جائزہ، ٹول کا استعمال، سیکیورٹی الرٹ مانیٹرنگ، یا بلنگ کے سوالات کے جوابات جیسے ٹارگٹڈ کام ہینڈل کرتے ہیں۔ Nemotron 3.5 Lightning اس دوسرے درجے کے لیے مقصد سے تیار کی گئی ہے: اعلیٰ حجم، خصوصی کام جو ہمیشہ متحرک رہتے ہیں۔

NVIDIA کے مطابق، ماڈل 4x تیز آؤٹ پٹ سپیڈ تک فراہم کرتا ہے، جس کی وجہ سے اس کی کلاس کے دیگر ماڈلز کے مقابلے میں تقریباً 30% تیز ایجنٹی کام کی تکمیل ہوتی ہے۔ NVIDIA کے اپنے PinchBench بینچ مارکس مبینہ طور پر یہ ظاہر کرتے ہیں کہ Nemotron 3.5 Lightning فرنٹیئر لیول کی درستگی کو برقرار رکھتی ہے جبکہ کام اپنے ساتھیوں کے مقابلے میں زیادہ تیزی سے مکمل کرتی ہے۔ یہ ماڈل نیموٹرون کولیشن کے تعاون سے تیار کیا گیا تھا، جس کے اراکین نے ماڈل کو آگے بڑھانے میں مدد کے لیے تشخیصی طریقہ کار، انفرنس سافٹ ویئر، اور ڈیٹا سیٹ فراہم کیے تھے۔

چونکہ یہ کھلا اور حسب ضرورت ہے، تنظیمیں NVIDIA NeMo کے ساتھ NVIDIA NeMo کے ساتھ پوسٹ ٹریننگ کر سکتی ہیں تاکہ خصوصی کاموں کی درستگی کو بہتر بنایا جا سکے۔ NVIDIA Nemotron-RL-Agentic-Terminal-Pivot بھی جاری کر رہا ہے، ایک ایجنٹی کمک سیکھنے والا ڈیٹاسیٹ جو ماڈل کو کوڈنگ ایجنٹ کی صلاحیتوں کے لیے پوسٹ ٹریننگ کے لیے استعمال کیا جاتا ہے۔

کہیں بھی دوڑنا، کنارے سے بادل تک

Nemotron 3.5 Lightning کے مرکزی سیلنگ پوائنٹس میں سے ایک تعیناتی لچک ہے۔ یہ ماڈل مقامی AI سسٹمز پر چل سکتا ہے — بشمول NVIDIA RTX PCs، NVIDIA DGX Spark، NVIDIA DGX اسٹیشن، اور NVIDIA Jetson — تنظیموں کو موجودہ بنیادی ڈھانچے کی سرمایہ کاری کو زیادہ سے زیادہ کرنے کی اجازت دیتا ہے۔ یہ ایج AI ڈیوائسز، NVIDIA RTX PRO ورک سٹیشنز، ڈیٹا سینٹرز، اور انٹرپرائز کے استعمال کے معاملات کے لیے کلاؤڈ ماحول میں بھی پیمانے کر سکتا ہے۔ یہ لچک حساس ڈیٹا کو سنبھالنے والی تنظیموں کے لیے اہمیت رکھتی ہے جنہیں آن پریمیسس رہنا چاہیے۔

جیسا کہ ہر Nemotron لانچ کے ساتھ، NVIDIA کا کہنا ہے کہ وہ لائسنسنگ پرمٹ کے طور پر زیادہ سے زیادہ تربیتی ڈیٹا اور تکنیکوں کو شائع کرتا ہے، جو دوسرے ماڈلز کا سراغ لگانے، آڈیٹنگ اور تربیت کی اجازت دیتا ہے۔ شفافیت کے لیے یہ عزم ایک مسابقتی تفریق کار بن گیا ہے کیونکہ انٹرپرائزز کھلے ماڈلز کو ملکیتی متبادلات کے مقابلے میں وزن دیتے ہیں جو کہ ان کی تعمیر کے طریقہ کار میں کم مرئیت پیش کرتے ہیں۔

NeMo Switchyard: ماڈلز کے سسٹمز کے لیے اسمارٹ روٹنگ

اگر Nemotron 3.5 Lightning ورک ہارس ہے تو NeMo Switchyard ڈسپیچر ہے۔ اوپن سورس لائبریری روٹس مخصوص ضروریات کی بنیاد پر، ایجنٹ کے ورک فلو کے ہر قدم کے لیے خود بخود انتہائی قابل اور موثر ماڈل کی طرف اشارہ کرتا ہے۔ کچھ ماڈلز کوڈنگ کے لیے بہتر ہیں، کچھ استدلال کے لیے، کچھ ہلکے وزن کے کاموں کے لیے، اور کچھ کو زیادہ رازداری اور کارکردگی کے لیے مقامی طور پر چلانے کے لیے بہتر بنایا گیا ہے۔ ایک پہلے سے طے شدہ ماڈل پر انحصار کرنے کا مطلب زیادہ خرچ کرنا یا معیار کو قربان کرنا ہو سکتا ہے۔ دستی طور پر روٹنگ کا انتظام کرنا، اس دوران، انضمام کا کام بن جاتا ہے جو کسی تعیناتی کو سست کر سکتا ہے۔

ایجنٹ ایپلیکیشن ڈویلپرز اپنی ترجیحات، جیسے معیار، تاخیر، اور لاگت کے تقاضوں کو پورا کرنے کے لیے مختلف روٹنگ الگورتھم کے ساتھ روٹر کو ٹیون یا اس میں ترمیم کر سکتے ہیں۔ NVIDIA کے داخلی معیارات سے پتہ چلتا ہے کہ NeMo Switchyard فرنٹیئر لیول کی درستگی کو برقرار رکھتا ہے جبکہ کام کی تکمیل کی لاگت کو Opus 4.8 کا تقریباً ایک تہائی تک کم کرتا ہے — جو کہ بڑی تعداد میں ایجنٹ کے کام چلانے والی تنظیموں کے لیے ایک شاندار کارکردگی کا فائدہ ہے۔

کمپنی نے پارٹنر انضمام کے سلسلے کو اجاگر کیا۔ Boomi نے 100% ڈومین روٹنگ کی درستگی کی اطلاع دی اور 59% ٹریفک کو 5x تیز ترین فائن ٹیونڈ ماڈل پر بھیجا۔ تصدیقی استعمال کے رسمی کیس پر Cadence نے کارکردگی میں 9.9 فیصد اضافہ کیا۔ Cognition نے Switchyard کو Devin Desktop میں ضم کیا، FrontierCode Main پر قریب ترین کارکردگی کو حاصل کرتے ہوئے اوسط لاگت میں 28% کمی کی۔ LangChain نے 145 ملٹی ٹرن ڈیپ ایجنٹس کے کاموں میں صرف 7% کالز کو فرنٹیئر ماڈل پر روٹ کرکے 74% کم لاگت کی اطلاع دی۔ LiteLLM NeMo Switchyard کو اپنی پراکسی پرت میں پلگ ان کے طور پر شامل کر رہا ہے، اور Kong اب Kong AI گیٹ وے کے ذریعے مقامی طور پر روٹنگ فراہم کرتا ہے۔ خاص طور پر، Nous Research نے NeMo Switchyard کو Hermes میں ضم کر دیا تاکہ ڈیولپرز کو ایجنٹ کی کارکردگی کے لیے ترتیب دینے میں آسان روٹنگ سسٹم فراہم کیا جا سکے۔

صنعت کو اپنانا اور بڑی تصویر

تمام صنعتوں میں AI رہنما اپنے کام کے بوجھ کے لیے پہلے سے ہی Nemotron 3.5 Lightning کو حسب ضرورت بنا رہے ہیں۔ CrowdStrike اسے سائبر سیکیورٹی پر لاگو کر رہا ہے، ہاروے اسے قانونی خدمات کے لیے استعمال کر رہا ہے، اور CodeRabbit اسے کوڈ کے جائزے کے لیے تعینات کر رہا ہے۔ لیلا سائنسز تمام فزیکل اور لائف سائنسز میں ایجنٹی کاموں کے لیے استدلال کی صلاحیتوں کو بہتر بنانے میں مدد کر رہی ہے، جبکہ فاسٹینو لیبز نے ماڈل کو اپنی مرضی کے مطابق بنایا اور سافٹ ویئر ڈویلپمنٹ، فنانس، اور ہیلتھ کیئر ورک بوجھ کے لیے اہم درستگیوں کی اطلاع دی۔

ریلیز صنعت کے وسیع تر رجحان کی نشاندہی کرتی ہے: جیسا کہ ایجنٹ AI پختہ ہوتا ہے، کوئی ایک ماڈل قابل قبول قیمت پر سب کچھ ٹھیک نہیں کر سکتا۔ مستقبل جوڑوں کا ہے — سرحدی منصوبہ ساز جو خصوصی کارکنوں کے بیڑے کو مربوط کرتے ہیں — اور ٹولنگ جو انہیں آپس میں جوڑتے ہیں۔ NVIDIA کی شرط یہ ہے کہ کھلے ماڈلز اور ذہین روٹنگ انٹرپرائزز کو ان سسٹمز کو خود کو کسی ایک فراہم کنندہ کے اسٹیک میں بند کیے بغیر جمع کرنے دیں گے۔

AI سے آگے رہیں

NVIDIA کا Nemotron 3.5 Lightning اور NeMo Switchyard سگنل جہاں ایجنٹ AI آگے بڑھ رہا ہے: تیز، سستا، زیادہ شفاف، اور کہیں بھی قابل تعینات۔ ماڈل ریلیزز اور زمین کی تزئین کی نئی شکل دینے والے انٹرپرائز ٹولز کے ساتھ رہنے کے لیے، ہماری بریکنگ AI نیوز کو دیکھیں۔

مزید AI خبریں پڑھیں →