يشير تقرير بحثي جديد إلى أن المصادر التي تدعم توصيات برنامج Perplexity تهيمن عليها الصفحات المصممة لتقرأها النماذج وليس الأشخاص - بما في ذلك ثلاثة مواقع نشرت معًا 215,128 صفحة من "أفضل البرامج" التي تم إنشاؤها آليًا. وجد التقرير، الذي نشرته شركة Trellner Research يوم الأربعاء، أن ما يقرب من 60 بالمائة من الاستشهادات وراء إجابات Perplexity في 380 فئة برمجية تشير إلى نطاقات مصنفة خارج أفضل 100000 موقع على الويب. وصلت النتائج وسط [تغطية صناعة الذكاء الاصطناعي] (https://aibuzzwire.news) المكثفة حول كيفية توجيه محركات البحث ومحركات الإجابة بهدوء من خلال المحتوى الهندسي.
ما الذي قامت الدراسة بقياسه
وضع تريلنر 380 فئة برمجية مخصصة للمشتري - من "برنامج CRM" إلى "برنامج إدارة مجموعة المتاحف" - إلى اثنين من نماذج Perplexity القائمة على الويب، Perplexity/sonar وperplexity/sonar-pro، والتي تعمل من خلال OpenRouter. استخدم الاختبار مطالبة واحدة لكل فئة لكل نموذج: 760 مكالمة في المجمل، كل منها يطلب الحصول على أفضل خمسة استدعاءات في JSON مع نطاق الصفحة الرئيسية الرسمية لكل منتج.
أعادت كل مكالمة إجابة قابلة للتحليل. وقد أنتج ذلك 3,800 شريحة توصية تسمي 1,807 منتجًا متميزًا، مدعومة بـ 7,534 استشهادًا عبر 2,055 مجالًا متميزًا. قام تريلنر بعد ذلك بفحص كل نطاق تم الاستشهاد به مقابل قائمة Tranco للمواقع الإلكترونية الأكثر زيارة في العالم وWayback Machine، وجلب كل صفحة من الصفحات الرئيسية للبائعين التي قدمتها النماذج والتي يبلغ عددها 1502 صفحة.
حيث أرض الاستشهادات
الأرقام الرئيسية صارخة. من بين 7534 استشهادًا، أشار 59.8 بالمائة إلى النطاقات التي احتلت المرتبة الأسوأ من #100000 في قائمة Tranco لأفضل مليون، وأشار 23.4 بالمائة إلى النطاقات التي لا تظهر في قائمة المليون الأعلى على الإطلاق. كان متوسط ترتيب ترانكو بين الاستشهادات التي أشارت إلى المجال المُصنف هو 71,611.
وكانت المصادر الأكثر ذكرًا عبارة عن مزيج من المألوف والغامض. تصدرت G2 بـ 291 اقتباسًا، تليها Reddit بـ 261. لكن ثالث أكبر مصدر - تم الاستشهاد به 194 مرة، قبل Gartner بـ 158 مرة - كان موقع Guideflow.com، وهو موقع تسويق خاص بالموردين للعروض التوضيحية التفاعلية للمنتجات، ولا يتنافس في أي من الفئات التي تم الاستشهاد بها. قدمت مدونتها الأساس للحصول على إجابات حول برامج العرض ثلاثي الأبعاد، وبرامج IVR، وبرامج RFID وبرامج ممارسة الهندسة المعمارية على حدٍ سواء. بالمقارنة، تم الاستشهاد بـ ويكيبيديا ثلاث مرات في 7534 استشهادًا.
أحدث، غامض، وينمو بسرعة
ويضيف التقرير بعدًا زمنيًا: فالنطاقات غير المصنفة هي أيضًا أحدث كثيرًا. كان متوسط أول تسجيل لـ Wayback Machine للنطاقات المُستشهد بها غير المصنفة في عام 2020، مقابل 2011 للنطاقات المُصنفة، وظهرت 16.6 بالمائة من النطاقات غير المُصنفة المؤرشفة لأول مرة في عام 2025 أو بعد ذلك - مقابل 1.6 بالمائة من النطاقات المُصنفة. بمعنى آخر، لم تكن هناك شريحة ذات معنى من الأسباب التي أدت إلى إجابات بيربليكسيتي حتى وقت قريب جدًا.
215,128 صفحة مصممة لتقرأها العارضات
ويتعلق الادعاء الأكثر إثارة للدهشة في التقرير بثلاثة مواقع يقول تريلنر إنها تعمل تحت سيطرة مشتركة على ما يبدو. أعطى اثنان منهم صفحتهم الرئيسية عنوان HTML "صفحة الحقائق والأساس" - حيث أن التأريض هو خطوة الاسترجاع ذاتها التي تؤديها هذه النماذج - وقاموا مع موقع ثالث بنشر 215.128 صفحة "أفضل [فئة]" تم إنشاؤها آليًا. لم يكن أي من النطاقات الثلاثة موجودًا قبل ديسمبر 2023.
تريلنر حذر في التأطير. يشير التقرير إلى أنه لا يوجد شيء مخادع في تسويق محتوى مدونة البائع في حد ذاته - فالشركات تنشر مدونات كبيرة طوال الوقت - وأن القياس يدور حول ما تفعله طبقة الاسترجاع بها: "أصبحت قوائم البائع الخاصة حول الأسواق التي لا يعمل فيها ثالث أكبر قاعدة أدلة" لتوصيات الشراء.
أهمية البحث بالذكاء الاصطناعي
تعد الدراسة بمثابة لقطة كمية للتحول الذي حذر منه ممارسون تحسين محركات البحث: لقد انتقل التحسين من التصنيف في نتائج البحث إلى استرجاعه بواسطة محركات الإجابات. يمكن للصفحات المكتوبة للنماذج - الكثيفة والصيغية والمصممة لتبدو موثوقة - أن تصبح قاعدة الأدلة للتوصيات التي يتعامل معها المستهلكون على أنها محايدة. على موقع HN، اجتذب التقرير مئات الأصوات المؤيدة، حيث ناقش المعلقون ما إذا كان هذا يعكس فشل بحث الذكاء الاصطناعي أو مجرد تكيف الإنترنت معه.
##محاذير هامة
تريلنر واضح بشأن النطاق. تم قياس الحيرة فقط، "ولا ينبغي قراءة أي شيء هنا على أنه ادعاء بخصوص أي محرك آخر." لقد تم استبعاد Google تمامًا لأن تأريض نموذج Gemini عبر OpenRouter يوجهه عبر المكوّن الإضافي للبحث على الويب الخاص بـ OpenRouter، الأمر الذي من شأنه أن يلوث القياس. تمت كتابة الفئات قبل رؤية أي نتائج ولم تتم مراجعتها أبدًا، كما أن مجموعة البيانات الكاملة - المطالبات والاستشهادات وعمليات البحث عن المجال - تصاحب التقرير.
هذه التحذيرات تقطع كلا الاتجاهين. إنها تجعل النتائج أضيق من مجرد إدانة شاملة لبحث الذكاء الاصطناعي، ولكنها أيضًا تجعل من الصعب رفضها: ضمن نطاقها المعلن، يكون القياس مباشرًا وقابلًا للتكرار وغير مريح لأي شخص يفترض أن الإجابات المرتكزة على أسس موثوقة تقع على الرفوف الأكثر ثقة على الويب المفتوح.
---
ابقَ في طليعة الذكاء الاصطناعياحصل على آخر الأخبار والتحليلات والإنجازات في مجال الذكاء الاصطناعي — كل ذلك في مكان واحد.
اقرأ المزيد من أخبار الذكاء الاصطناعي →