ایک نئی تحقیقی رپورٹ میں استدلال کیا گیا ہے کہ Perplexity کے سافٹ ویئر کی سفارشات کو بنیاد بنانے والے ذرائع پر لوگوں کے بجائے ماڈلز کے پڑھنے کے لیے بنائے گئے صفحات کا غلبہ ہے - بشمول تین سائٹس جنہوں نے مل کر 215,128 مشین سے تیار کردہ "بہترین سافٹ ویئر" صفحات شائع کیے ہیں۔ ٹریلنر ریسرچ کے ذریعہ بدھ کو شائع ہونے والی رپورٹ میں پتا چلا ہے کہ 380 سافٹ ویئر کیٹیگریز میں پرپلیکسٹی کے جوابات کے پیچھے تقریباً 60 فیصد حوالہ جات ویب کی ٹاپ 100,000 سائٹس سے باہر کے ڈومینز کی طرف اشارہ کرتے ہیں۔ یہ نتائج AI انڈسٹری کوریج میں شدت پیدا کرتے ہیں کہ کس طرح سرچ انجنز اور جوابی انجنوں کو انجینئرڈ مواد کے ذریعے خاموشی سے آگے بڑھایا جا سکتا ہے۔

مطالعہ نے کیا پیمائش کی۔

ٹریلنر نے 380 خریداروں کے ارادے والے سافٹ ویئر کیٹیگریز - "CRM سافٹ ویئر" سے "میوزیم کلیکشن مینجمنٹ سوفٹ ویئر" تک - پرپلیکسٹی کے دو ویب گراؤنڈ ماڈلز، پرپلیکسٹی/سونار اور پرپلیکسٹی/سونار پرو، جو اوپن روٹر کے ذریعے چل رہے ہیں۔ ٹیسٹ میں فی ماڈل فی زمرہ ایک پرامپٹ استعمال کیا گیا: مجموعی طور پر 760 کالز، ہر ایک پروڈکٹ کے آفیشل ہوم پیج ڈومین کے ساتھ JSON میں ٹاپ فائیو کا مطالبہ کرتا ہے۔

ہر کال نے قابل تجزیہ جواب دیا۔ اس نے 1,807 الگ مصنوعات کے نام کے 3,800 سفارشی سلاٹ تیار کیے، جن کی حمایت 2,055 الگ الگ ڈومینز میں 7,534 حوالہ جات سے کی گئی۔ اس کے بعد ٹریلنر نے دنیا کی سب سے زیادہ دیکھی جانے والی ویب سائٹس اور Wayback Machine کی Tranco فہرست کے خلاف ہر حوالہ کردہ ڈومین کو چیک کیا، اور ماڈلز کی طرف سے فراہم کردہ 1,502 وینڈر ہوم پیجز میں سے ہر ایک کو حاصل کیا۔

جہاں حوالہ جات اترتے ہیں۔

شہ سرخیوں کے نمبر سخت ہیں۔ 7,534 حوالوں میں سے، 59.8 فیصد نے ایسے ڈومینز کی طرف اشارہ کیا جو ٹرانکو ٹاپ 1 ملین کی فہرست میں #100,000 سے بھی بدتر ہیں، اور 23.4 فیصد نے ایسے ڈومینز کی طرف اشارہ کیا جو ٹاپ ملین میں بالکل نظر نہیں آتے۔ درجہ بندی والے ڈومین پر پوائنٹ کرنے والے حوالہ جات میں میڈین ٹرانکو کا درجہ 71,611 تھا۔

سب سے زیادہ حوالہ شدہ ذرائع واقف اور غیر واضح کا مرکب تھے۔ G2 نے 291 حوالہ جات کے ساتھ قیادت کی، اس کے بعد 261 کے ساتھ Reddit۔ لیکن تیسرا سب سے بڑا ذریعہ - 194 بار حوالہ دیا گیا، گارٹنر کے 158 سے آگے - گائیڈ فلو ڈاٹ کام تھا، جو کہ انٹرایکٹو پروڈکٹ ڈیمو کے لیے ایک وینڈر کا مارکیٹنگ بلاگ تھا جو کسی بھی زمرے میں مقابلہ نہیں کرتا جس کے لیے اس کا حوالہ دیا گیا تھا۔ اس کے بلاگ نے 3D رینڈرنگ سوفٹ ویئر، IVR سافٹ ویئر، RFID سافٹ ویئر اور آرکیٹیکچر پریکٹس سافٹ ویئر کے بارے میں جوابات کی بنیاد فراہم کی۔ ویکیپیڈیا کے مقابلے میں، 7,534 حوالوں میں تین بار حوالہ دیا گیا۔

نیا، غیر واضح، اور تیزی سے بڑھ رہا ہے۔

رپورٹ ایک وقتی جہت کا اضافہ کرتی ہے: غیر درجہ بند ڈومینز بھی بہت نئے ہیں۔ غیر درجہ بندی والے حوالہ کردہ ڈومینز کے لیے درمیانی پہلی Wayback مشین کیپچر 2020 تھی، 2011 کے مقابلے میں درجہ بندی والے کے لیے، اور 16.6 فیصد محفوظ شدہ غیر درجہ بند ڈومینز پہلی بار 2025 یا بعد میں ظاہر ہوئے — بمقابلہ درجہ بندی والے ڈومینز کا 1.6 فیصد۔ دوسرے لفظوں میں، Perplexity کے جوابات کی بنیادوں کا ایک معنی خیز ٹکڑا ابھی حال ہی میں موجود نہیں تھا۔

215,128 ماڈلز کے پڑھنے کے لیے بنائے گئے صفحات

رپورٹ کا سب سے حیران کن دعوی تین سائٹس سے متعلق ہے جو Trellner کا کہنا ہے کہ بظاہر عام کنٹرول میں کام کرتی ہیں۔ ان میں سے دو نے اپنے ہوم پیج کو ایچ ٹی ایم ایل ٹائٹل "حقائق اور گراؤنڈنگ پیج" دیا — گراؤنڈنگ ایک بہت ہی بازیافت کا مرحلہ ہے جو یہ ماڈل انجام دیتے ہیں — اور ایک تیسری سائٹ کے ساتھ مل کر انہوں نے 215,128 مشین سے تیار کردہ "بہترین [زمرہ]" صفحات شائع کیے ہیں۔ تینوں ڈومینز میں سے کوئی بھی دسمبر 2023 سے پہلے موجود نہیں تھا۔

ٹریلر فریمنگ کے ساتھ محتاط ہے۔ رپورٹ میں نوٹ کیا گیا ہے کہ وینڈر بلاگ کے مواد کی مارکیٹنگ کے بارے میں کچھ بھی اپنے آپ میں دھوکہ نہیں ہے - کمپنیاں ہر وقت بڑے بلاگ شائع کرتی ہیں - اور یہ کہ پیمائش اس کے بارے میں ہے کہ بازیافت پرت اس کے ساتھ کیا کرتی ہے: "ایک وینڈر کی اپنی فہرستیں ان مارکیٹوں کے بارے میں جو وہ کام نہیں کرتی ہیں وہ خریداری کی سفارشات کے لیے تیسرا سب سے بڑا ثبوت کی بنیاد بن گئی"۔

یہ AI تلاش کے لیے کیوں اہم ہے۔

یہ مطالعہ اس شفٹ کا ایک مقداری سنیپ شاٹ ہے جس کے بارے میں SEO پریکٹیشنرز انتباہ کر رہے ہیں: اصلاح تلاش کے نتائج میں درجہ بندی سے جوابی انجنوں کے ذریعے حاصل کی گئی ہے۔ ماڈلز کے لیے لکھے گئے صفحات — گھنے، فارمولک، اور مستند نظر آنے کے لیے انجنیئر — ان سفارشات کے لیے ثبوت کی بنیاد بن سکتے ہیں جن کو صارفین غیر جانبدار سمجھتے ہیں۔ HN پر رپورٹ نے سیکڑوں اپووٹ حاصل کیے، مبصرین اس بحث کے ساتھ کہ آیا یہ AI تلاش کی ناکامی کی عکاسی کرتا ہے یا صرف انٹرنیٹ اس سے مطابقت رکھتا ہے۔

اہم انتباہات

ٹریلر دائرہ کار کے بارے میں واضح ہے۔ صرف پریشانی کی پیمائش کی گئی تھی، "اور یہاں کچھ بھی کسی دوسرے انجن کے دعوے کے طور پر نہیں پڑھنا چاہئے۔" گوگل کو مکمل طور پر چھوڑ دیا گیا کیونکہ OpenRouter کے ذریعے Gemini ماڈل کو گراؤنڈ کرنا اسے OpenRouter کے اپنے ویب سرچ پلگ ان کے ذریعے روٹ کرتا ہے، جو پیمائش کو آلودہ کر دے گا۔ زمرہ جات کسی بھی نتائج کو دیکھنے سے پہلے لکھے گئے تھے اور ان پر کبھی نظر ثانی نہیں کی گئی تھی، اور مکمل ڈیٹا سیٹ — پرامپٹس، حوالہ جات اور ڈومین تلاش — رپورٹ کے ساتھ ہیں۔

وہ انتباہات دونوں طریقوں سے کاٹتے ہیں۔ وہ نتائج کو AI تلاش کے کمبلی فرد جرم سے زیادہ تنگ کرتے ہیں، لیکن وہ انہیں مسترد کرنا بھی مشکل بنا دیتے ہیں: اس کے بیان کردہ دائرہ کار میں، پیمائش سیدھی، دہرائی جا سکتی ہے، اور ہر اس شخص کے لیے غیر آرام دہ ہے جس نے زمینی جوابات کو کھلے ویب کے سب سے قابل اعتماد شیلف پر رکھا ہے۔

---

AI سے آگے رہیں

تازہ ترین AI خبریں، تجزیہ اور کامیابیاں حاصل کریں — سب ایک جگہ پر۔

مزید AI خبریں پڑھیں →