Perplexity نے پورٹ ایبل کمپیوٹر لانچ کیا ہے، جو اس کے ایجنٹ "کمپیوٹر" پلیٹ فارم کا ایک ورژن ہے جو مکمل طور پر پہلے سے موجود ہارڈ ویئر صارفین پر چلتا ہے - Nvidia کے DGX Spark ڈیسک ٹاپ سپر کمپیوٹر اور RTX GPUs سے لیس لینکس مشینوں سے شروع ہوتا ہے۔ Nvidia کے ساتھ قریبی شراکت میں تیار کیا گیا اور 25 اگست 2026 کو اعلان کیا گیا، یہ AI ایجنٹ کے سنجیدہ کام کے بوجھ کو کلاؤڈ سے دور اور مقامی آلات پر منتقل کرنے کی ابھی تک کی سب سے زیادہ جارحانہ کوششوں میں سے ایک ہے۔
پچ سادہ لیکن نتیجہ خیز ہے: ماڈل، صارف کی فائلیں، اور کام خود مشین پر رہ سکتا ہے۔ مقامی طور پر مکمل ہونے والا کام کوئی بلنگ کریڈٹ استعمال نہیں کرتا، ہر کام ڈیفالٹ کے طور پر ڈیوائس پر شروع ہوتا ہے، اور سسٹم کسی بھی انفرادی قدم کو کلاؤڈ میں زیادہ طاقتور فرنٹیئر ماڈل پر بھیجنے سے پہلے اجازت طلب کرتا ہے۔ For more context on this story, see our ongoing breaking AI news.
پیر کو ایک پریس بریفنگ کے دوران انفراسٹرکچر اور انٹرپرائز کے انجینئرنگ کے پرپلیکسٹی کے نائب صدر نیٹ نے کہا، "ہم بنیادی طور پر بالکل وہی UI ایک مکمل مقامی ایپ میں لائے ہیں۔" "اس میں ایجنٹ کا مکمل استعمال اور اندازہ اور مقامی طور پر کام کرنے کے لیے درکار ہر چیز شامل ہے۔"
Nvidia کے لیے، جس نے دنیا کو ٹریلین ڈالر کے AI ڈیٹا سینٹرز پر فروخت کرنے میں پچھلے دو سال گزارے ہیں، اس اعلان میں ایک لطیف پیغام ہے: چپ میکر کا خیال ہے کہ مقامی AI نے شوق کے تجسس سے لے کر عملی ٹول تک ایک حد عبور کر لی ہے۔ "مقامی AI ایک انفلیکیشن پوائنٹ پر پہنچ گیا،" نادر نے کہا، Nvidia کے ڈویلپر ٹیکنالوجی کے ڈائریکٹر۔ "سب سے لمبے عرصے تک، یہ شوق رکھنے والے اور پرجوش تھے... ان کوانٹائزڈ ماڈلز کو چلانا انتہائی چھوٹے ہونے کے لیے۔
ایک ایپ میں ایک مکمل مقامی AI اسٹیک
پرپلیکسٹی کمپیوٹر، کلاؤڈ پروڈکٹ، ماڈلز، فائلز، ٹولز، اور ویب تک رسائی کے لیے آرکیسٹریٹس ملٹی سٹیپ نالج ورک ٹاسک — دستاویزات کے فولڈرز کا جائزہ لینا، ڈیٹا کا تجزیہ کرنا، اور رپورٹس تیار کرنا۔ پورٹ ایبل کمپیوٹر مقامی طور پر اس کی نقل تیار کرتا ہے، مقامی ماڈلز، ایجنٹ ہارنس، انفرنس انجن، ٹولز، ایپ کنیکٹرز، اور سیکیورٹی سینڈ باکس کو ایک ہی ایپلی کیشن میں بنڈل کرتا ہے۔ بنڈلنگ کے معاملات: آج کل زیادہ تر مقامی AI سٹیکس کے ساتھ، صارفین کو ان ٹکڑوں کو خود جمع کرنا ہوگا - وزن ڈاؤن لوڈ کرنا، ایک انفرنس سرور کھڑا کرنا، اور وائرنگ ٹولز کو ایک ساتھ کرنا۔
ایک پریس ڈیمو میں، سسٹم نے ایک خوردہ سرمایہ کار کا کردار ادا کیا جو 1099s کے فولڈر اور سرمایہ کاری کے دستاویزات کا جائزہ لے رہا تھا — جس قسم کا حساس مالیاتی مواد بہت سے صارفین کلاؤڈ سروس پر اپ لوڈ کرنے میں ہچکچاتے ہیں۔ DGX Spark پر GPU کے مکمل استعمال پر 27-بلین پیرامیٹر Qwen ماڈل چلاتے ہوئے، ایجنٹ نے ایسے معاملات کو جھنڈا لگایا جہاں سرمایہ کار غیر ضروری فیس ادا کر رہا تھا۔ انٹرفیس عنصر جو عام طور پر کلاؤڈ کریڈٹ کو لمبا کرتا ہے، Perplexity نے نوٹ کیا، "صرف صفر پر کھڑا ہے۔"
پروڈکٹ ہرمیٹک کے بجائے ہائبرڈ بھی ہے۔ دوسرے ڈیمو نے مقامی طور پر صارف کے فنل ڈیٹا کے CSV کا تجزیہ کیا، پھر Perplexity کے کنیکٹر ایکو سسٹم کا استعمال کرتے ہوئے مکمل تجزیے کو Slack کی طرف دھکیل دیا۔ یہ سسٹم گوگل ڈرائیو، جی میل، اور گٹ ہب سے جڑتا ہے، اور جب مقامی ماڈل اپنی حدوں کو چھوتا ہے تو فرنٹیئر کلاؤڈ ماڈل تک بڑھ سکتا ہے۔
ضروریات اور دستیابی۔
لانچ کے وقت، صارفین Qwen 3.8 27B یا PPLX 27B چلا سکتے ہیں - ایک ورژن Perplexity نے اپنے استعمال کے بعد تربیت حاصل کی ہے - Nvidia's Nemotron 3.5 Lightning کے ساتھ جلد آرہی ہے۔ سسٹم ان صارفین کے لیے جو اپنے اینڈ پوائنٹ میں پلگ لگانا چاہتے ہیں ان کے لیے ایک ایڈوانس موڈ کے ساتھ نیچے تخمینہ کی میزبانی کرنے کے لیے vLLM کا استعمال کرتا ہے۔ کم از کم 24GB VRAM کے ساتھ کوئی بھی RTX GPU، تقریباً GeForce RTX 3090 یا اس سے نیا، بار کو صاف کرتا ہے۔
پورٹ ایبل کمپیوٹر اب لینکس پر پرو، میکس، انٹرپرائز پرو، اور انٹرپرائز میکس سبسکرائبرز کے لیے ستمبر میں ونڈوز سپورٹ کے ساتھ دستیاب ہے۔
ماڈل اور ہارنس کو مشترکہ ڈیزائن کرنا
لانچ کے ساتھ ہی، Perplexity نے ایک تحقیقی مقالہ شائع کیا جس میں یہ دلیل دی گئی کہ موثر مقامی ایجنٹوں کو ماڈل اور ایجنٹ کے استعمال کی ضرورت ہوتی ہے - اشارے، ٹولز، اور آرکیسٹریشن منطق کی سہاروں کو - ایک ساتھ ڈیزائن کیا جائے۔ عام مقصد کے استعمال والے فرنٹیئر ماڈلز کو فرض کرتے ہیں جو بہت زیادہ سیاق و سباق کو جذب کر سکتے ہیں اور وسیع آلے کی سطحوں کو نیویگیٹ کر سکتے ہیں۔ چھوٹے مقامی ماڈل ان مطالبات کے تحت بکسوا. پریشانی نے پایا کہ اگرچہ Qwen 3.8 27B ایک 260,000 ٹوکن سیاق و سباق کی ونڈو کا اشتہار دیتا ہے، لیکن یہ 100,000 ٹوکنز سے آگے جدوجہد کرنا شروع کر دیتا ہے۔
کمپنی کا جواب جان بوجھ کر کم سے کم استعمال ہے: ایک مختصر سسٹم پرامپٹ، بنیادی ٹولز کا ایک چھوٹا سیٹ، اور وہ صلاحیتیں جو آن ڈیمانڈ "مہارت" کے طور پر لوڈ اور ان لوڈ ہوتی ہیں۔ اس نے Gmail اور GitHub جیسے مقبول کنیکٹرز کو ٹوکن-ہنگری MCP سرورز سے کمپیکٹ کمانڈ لائن ٹولز میں تبدیل کیا، خود تصدیقی ہکس شامل کیے، اور OS-سطح کے سینڈ باکسنگ کو ہمیشہ نافذ کیا — اگر سینڈ باکس دستیاب نہیں ہے، تو ہارنس ٹولز کو غیر محفوظ چلانے کے بجائے خود کو غیر فعال کر دیتا ہے۔
بینچ مارک کے نتائج پرپلیکسٹی رپورٹس حیران کن ہیں، حالانکہ وہ کمپنی کے اپنے جائزوں سے آتی ہیں۔ اس کے اندرونی لوکل نالج ورک بینچ پر — گہری تحقیق، مالیاتی تجزیہ، اور دستاویز کی تخلیق پر محیط 53 کام، جن کو پرپلیکسٹی اوپن سورس کرنے کا ارادہ رکھتی ہے — DGX اسپارک پر Qwen 3.8 27B چلانے والے کمپیوٹر نے 82.6% اسکور کیے، اس کے مقابلے میں اوپن سورس کے لیے 77.6% اور اس کے لیے 77.6% اسکور کے لیے Pi.0. Perplexity کے بعد کی تربیت یافتہ PPLX 27B نے اسکور کو 85.4% تک پہنچا دیا۔ BrowseComp پر، ایک ویب ریسرچ بینچ مارک، کمپیوٹر نے 66.7% درستگی بمقابلہ Pi کے لیے 50.2% اور Hermes کے لیے 43.9%، جبکہ 51% کم وال ٹائم اور Pi کے مقابلے میں %70% کم ٹوکن استعمال کیا۔
ٹوکن اکنامکس ڈرائیونگ ایجنٹس مقامی
اسٹریٹجک منطق واضح ہو جاتی ہے کہ AI کام کا بوجھ کس طرح تبدیل ہوا ہے۔ چیٹ پھٹی ہوئی تھی — ایک سوال، ایک جواب، ہو گیا۔ ایجنٹ گھنٹوں بھاگتے رہتے ہیں۔ نادر نے کہا، "ایجنٹوں کے ساتھ، آپ چاہتے ہیں کہ یہ ایجنٹ ہمیشہ جاری رہیں اگر آپ کر سکتے ہیں... جو ہم دیکھ رہے ہیں وہ ٹوکنز کے لیے ایک ناقابل تسخیر مطالبہ ہے، اور یہی وہ چیز ہے جو مقامی AI کو بہت زبردست بناتی ہے،" نادر نے کہا۔ "آپ کو ٹوکن کے ذریعے میٹر نہیں کیا گیا تھا۔ آپ ٹوکن کی ادائیگی نہیں کر رہے تھے۔"
ہائبرڈ مڈل گراؤنڈ تجارتی لحاظ سے سب سے زیادہ دلچسپ نتیجہ ہو سکتا ہے۔ ٹرمینل بنچ 2.1 پر، ایک چیلنجنگ کوڈنگ بینچ مارک، مکمل طور پر مقامی Qwen ماڈل نے بنیادی طور پر صفر کی معمولی قیمت پر 59.6% اسکور کیا۔ اسے کلاؤڈ میں ایک Claude Opus 5 "مشیر" تک بڑھنے دینے نے اسکور کو 73.0% تک بڑھا کر تخمینہ $0.415 فی ٹاسک پر کیا، جبکہ فرنٹیئر ماڈل کو چلانے نے فی ٹاسک $0.65 پر 82.4% اسکور کیا۔ ایکسیلیشن نے تقریباً دو تہائی لاگت پر فرنٹیئر پرفارمنس کے فرق کا تقریباً تین پانچواں حصہ پورا کر لیا — اور صارف فیصلہ کرتا ہے کہ تجارت کب قابل قدر ہے۔ کسی بھی مشیر کی کال سے پہلے، ہارنس باہر جانے والے سیاق و سباق پر ایک PII درجہ بندی چلاتا ہے اور صارف کو بالکل ظاہر کرتا ہے کہ ڈیوائس کو کیا چھوڑنا ہے۔ ریموٹ ماڈل صرف ٹیکسٹ گائیڈنس واپس کرتا ہے اور کبھی بھی مقامی فائلوں یا ٹولز کو نہیں چھوتا ہے۔
Nvidia نے اس بات پر بھی زور دیا کہ ہارڈ ویئر کا پیمانہ ایک ہی باکس سے آگے ہے: مشترکہ میموری پر دو DGX Sparks کو جوڑنا فرنٹیئر کلاس اوپن ماڈلز کو چلاتا ہے جیسے DeepSeek کے تازہ ترین، چار GLM 5.2 یا Nemotron Ultra چلا سکتے ہیں، اور نادر نے کہا کہ اس نے "آٹھ اسپارکس کو جڑتے ہوئے بھی دیکھا ہے۔"
لانچ ایک شراکت داری کو بڑھاتا ہے جو کہ ایک سال سے زیادہ عرصے سے تعمیر کر رہا ہے، جون 2025 میں Nvidia اور Perplexity کی جانب سے یورپی پبلشرز اور ٹیلی کام کے لیے ایک خودمختار AI تعاون کا اعلان کرنے کے بعد۔ اولاما کے DIY اسٹیک، اوپن ہارنیسز، اور خود میزبانی کا اندازہ لگانے والے ڈویلپرز کے لیے، پورٹ ایبل کمپیوٹر کا تجربہ، اور ایپ کا تجربہ ہے، جو کہ ایک مثالی تجربہ ہے۔ سینڈ باکس - وہی ہے جو آخر کار مقامی ایجنٹ AI کو مرکزی دھارے میں شامل کرتا ہے۔
---
Stay Ahead of AIGet the latest AI news, analysis, and breakthroughs — all in one place.
Read more AI news →