Nvidia نے اپنے Groq 3 LPX انٹرایکٹو انفرنس ایکسلریٹر کو مکمل پروڈکشن میں ڈال دیا ہے، کمپنی نے 24 اگست 2026 کو ہاٹ چپس کانفرنس کے دوران اعلان کیا۔ چپ، Nvidia کے Vera Rubin پلیٹ فارم کی توسیع ہے، مصنوعی تجزیہ بینچ مارکنگ میں ایک فعال 100,000 ٹوکن سیاق و سباق کی ونڈو کے ساتھ اوپن سورس Gemma 4 31B ماڈل چلاتے ہوئے ریکارڈ 3,400 آؤٹ پٹ ٹوکن فی سیکنڈ فراہم کرتی ہے۔ اس ماڈل کے لیے اب تک کی تیز ترین کارکردگی ریکارڈ کی گئی ہے۔

یہ لانچ Nvidia کے 20 بلین ڈالر کے انفرنس اسپیشلسٹ Groq کے حصول سے ابھی تک سب سے اہم پروڈکٹ سنگ میل کی نشاندہی کرتا ہے، یہ ایک ایسا معاہدہ ہے جس سے کمپنی اب کم تاخیر کے تخمینے کی مانگ میں اضافے کی وجہ سے فائدہ اٹھانے کے لیے آگے بڑھ رہی ہے۔ CNBC نے اطلاع دی ہے کہ Nvidia کا کہنا ہے کہ پہلے Groq ریک سال کے اختتام سے پہلے آن لائن ہوں گے۔ اس کہانی پر مزید سیاق و سباق کے لیے، ہماری جاری AI انڈسٹری کوریج دیکھیں۔

ٹوکن جنریشن کی رفتار کیوں اہمیت رکھتی ہے۔

Agentic AI سسٹمز - ایسے پروگرام جو وجہ بتاتے ہیں، ٹولز کو کال کرتے ہیں، کوڈ لکھتے اور ٹیسٹ کرتے ہیں، اور سینکڑوں یا ہزاروں انفرنس کے مراحل میں اعادہ کرتے ہیں - آؤٹ پٹ ٹوکنز کی بہت بڑی مقدار پیدا کرتے ہیں۔ جس رفتار سے وہ ٹوکن تیار کیے جاتے ہیں، جسے انٹرایکٹیویٹی یا ڈی کوڈ تھرو پٹ کہا جاتا ہے، اس بات کا تعین کرتا ہے کہ ایجنٹ اپنے کام کے ہر مرحلے کو کتنی جلدی مکمل کر سکتا ہے۔

Nvidia کا کہنا ہے کہ Groq 3 LPX ایجنٹوں کے لیے قریب ترین متبادل پلیٹ فارم کے مقابلے میں 4 گنا تیز ردعمل اور تاخیر سے متعلق حساس کام کے بوجھ فراہم کرتا ہے۔ متضاد تعیناتیوں میں، ویرا روبن NVL72 سسٹمز سیاق و سباق کے ادخال اور پری فل کمپیوٹیشن کو سنبھالتے ہیں، جبکہ Groq 3 LPX یونٹ تاخیر سے حساس ٹوکن جنریشن کے مرحلے پر کارروائی کرتے ہیں۔

Nvidia کے بانی اور CEO Jensen Huang نے اعلان میں کہا، "Inference AI کی ترقی کا انجن ہے۔" "ویرا روبن نے اس وژن کو کام کے بوجھ سے بہتر AI فیکٹری کنفیگریشنز کے ساتھ بڑھایا ہے جو ایجنٹی AI کے دور کے لیے ڈیزائن کیا گیا ہے، الٹرا فاسٹ ٹوکن جنریشن کے لیے LPX کے ساتھ پرفارمنس فرنٹیئر کو آگے بڑھاتا ہے۔"

ہارڈ ویئر کے اندر

StorageReview کے تکنیکی تجزیے کے مطابق، ہر 2U لیکوڈ کولڈ کمپیوٹ ٹرے میں سولہ Groq 3 LPUs کے ساتھ ساتھ ایک میزبان CPU، فیبرک ایکسپینشن لاجک، اور DRAM کے علاوہ بلیو فیلڈ-4 DPU یا ConnectX-9 نیٹ ورک کارڈ ہوتا ہے۔ ٹرے میں فرنٹ پینل پر 32 LPU چپ ٹو چپ آپٹیکل لنکس اور 400Gb/s ایتھرنیٹ شامل ہیں۔

ریک پیمانے پر، ایک Groq 3 LPX کی تعیناتی میں 256 LP30 ایکسلریٹر شامل ہوتے ہیں جو تیز رفتار، براہ راست چپ سے چپ انٹرکنیکٹس کے ذریعے منسلک ہوتے ہیں۔ ریک Nvidia کے وسیع تر Vera Rubin AI فیکٹری کے بنیادی ڈھانچے میں داخل ہوتے ہیں، جسے کمپنی اپنے اب تک کے سب سے وسیع پلیٹ فارم کے طور پر بیان کرتی ہے: پانچ مقاصد کے لیے تیار کردہ ریک کنفیگریشنز میں سات مجرد چپس، بشمول BlueField-4 DPUs، Vera CPU ریک، Vera BlueField-4 STXSP-Expectrumnet نیٹ ورک، اور سٹوریج۔

Nvidia نے اپنے پلیٹ فارم کی سطح کی کارکردگی کے دعووں کو بھی تازہ کیا، یہ بتاتے ہوئے کہ Vera Rubin NVL72 GB300 NVL72 کے مقابلے میں 140,000 ٹوکن ایجنٹی کوڈنگ ورک لوڈ کے مقابلے میں 30 گنا تک ٹوکن تھرو پٹ فی میگا واٹ فراہم کرتا ہے، فی صارف انٹرایکٹیویٹی کے اہداف میں اضافے کے ساتھ فائدہ بڑھتا ہے۔

نجمہ کے ساتھ ایک بینچ مارک

سرخی 3,400 ٹوکن فی سیکنڈ کا اعداد و شمار قابل توجہ انتباہ کے ساتھ آتا ہے۔ جیسا کہ StorageReview نے نشاندہی کی، Nvidia کا نتیجہ 21 اگست کو ایک پرائیویٹ پری ریلیز اینڈ پوائنٹ پر ماپا گیا، جب کہ مسابقتی نمبروں کا موازنہ لائیو سرور لیس پروڈکشن اینڈ پوائنٹس سے کیا گیا۔ عام طور پر دستیاب خدمات پر حقیقی دنیا کی کارکردگی ریکارڈ ترتیب دینے والے بینچ مارک کنفیگریشن سے مختلف ہو سکتی ہے۔

پھر بھی، آزاد بینچ مارکنگ آرگنائزیشن مصنوعی تجزیے نے اس سیاق و سباق کی لمبائی میں Gemma 4 31B کے لیے اب تک کی سب سے تیز ترین پیمائش کے طور پر نتیجہ ریکارڈ کیا، اور بنیادی دعویٰ - کہ مقصد سے بنایا گیا سلیکون ڈرامائی طور پر اندازہ کے ڈی کوڈ مرحلے کو تیز کر سکتا ہے - اس بات سے مطابقت رکھتا ہے کہ کس طرح صنعت ایجنٹی کام کے بوجھ کے لیے دوبارہ آرکیٹیکٹنگ کر رہی ہے۔

کلاؤڈ گود لینا شروع ہوتا ہے۔

Nebius، ایمسٹرڈیم میں ہیڈ کوارٹر والا AI کلاؤڈ، پہلا فراہم کنندہ ہے جس نے Groq 3 LPX کو تعینات کرنے کا عہد کیا، اسے Nebius Token Factory، اس کے پروڈکشن انفرنس پلیٹ فارم میں لانے کا منصوبہ بنایا۔

Nebius کی چیف ٹیکنالوجی آفیسر ڈینیلا شٹن نے کہا، "جنریشن تخمینہ کا وہ مرحلہ ہے جو اس بات کا تعین کرتا ہے کہ AI سسٹم اصل میں کتنا ذمہ دار ہے، اور بالکل وہی ہے جو NVIDIA Groq 3 LPX کو تیز کرنے کے لیے بنایا گیا ہے۔" "پہلے AI کلاؤڈ کے طور پر جو اسے Nebius Token Factory کے ذریعے پروڈکشن میں لا رہا ہے، ہم اس بات کو یقینی بنا رہے ہیں کہ ایجنٹ کے لوپ کا ہر قدم فوری محسوس ہو — اسی API کے ذریعے ڈویلپرز پہلے ہی استعمال کر رہے ہیں، بغیر کسی نئے اسٹیک پر منتقلی کے۔"

انفرنس فراہم کرنے والا Groq، جو اب Nvidia فیملی کا حصہ ہے، پلیٹ فارم کے ابتدائی اختیار کرنے والوں میں شامل ہونے کا ارادہ رکھتا ہے۔

بڑی تصویر

مکمل پیداوار کا اعلان اس بات کا اشارہ کرتا ہے کہ AI انفراسٹرکچر مارکیٹ نے تربیت سے لے کر اندازہ تک کتنی تیزی سے کام کیا ہے۔ چونکہ انٹرپرائزز بجٹ کو خام ماڈل پری ٹریننگ سے ریئل ٹائم استدلال اور خود مختار ایجنٹ آرکیسٹریشن کی طرف منتقل کرتے ہیں، ایک ٹوکن کی معاشیات — یہ کتنی تیزی سے پیدا کی جا سکتی ہے اور کس توانائی کی قیمت پر — مرکزی مسابقتی میدان بن گیا ہے۔

Nvidia کے لیے، Groq 3 LPX اپنی AI فیکٹری فرنچائز کے دفاع کو ایک ایسے لمحے میں بڑھاتا ہے جب کلاؤڈ فراہم کرنے والوں اور سٹارٹ اپس کی طرف سے حسب ضرورت سیلیکون ایک جیسے ایجنٹی انفرنس ورک بوجھ کا پیچھا کر رہا ہو۔ اس سال آن لائن آنے والے ریک، جیسا کہ CNBC نے اطلاع دی ہے، حصول بند ہونے کے مہینوں بعد پہلا پروڈکشن سسٹم صارفین کے ہاتھ میں ڈالے گا - سیمی کنڈکٹر انڈسٹری کے معیارات کے ذریعے ایک تیز انضمام۔

کمپنی نے نئے سسٹمز کی قیمتوں کا انکشاف نہیں کیا۔ Groq 3 LPX کو AI کلاؤڈ پارٹنرز کے ذریعے جب اور اگر دستیاب ہو تو پیش کیا جائے گا، Nebius سے توقع ہے کہ وہ اپنے موجودہ API اینڈ پوائنٹس کے ذریعے ڈویلپرز تک رسائی کی پیشکش کرے گا۔

---

AI سے آگے رہیں

تازہ ترین AI خبریں، تجزیہ اور کامیابیاں حاصل کریں — سب ایک جگہ پر۔

مزید AI خبریں پڑھیں →