एक नई शोध रिपोर्ट का तर्क है कि पर्प्लेक्सिटी की सॉफ़्टवेयर अनुशंसाओं को आधार बनाने वाले स्रोतों में लोगों के बजाय मॉडलों द्वारा पढ़े जाने वाले पृष्ठों का वर्चस्व है - जिसमें तीन साइटें शामिल हैं जिन्होंने एक साथ 215,128 मशीन-जनित "सर्वश्रेष्ठ सॉफ़्टवेयर" पृष्ठ प्रकाशित किए हैं। ट्रेलनर रिसर्च द्वारा बुधवार को प्रकाशित रिपोर्ट में पाया गया कि 380 सॉफ्टवेयर श्रेणियों में पर्प्लेक्सिटी के उत्तरों के पीछे लगभग 60 प्रतिशत उद्धरण वेब की शीर्ष 100,000 साइटों के बाहर रैंक किए गए डोमेन की ओर इशारा करते हैं। खोज इंजन और उत्तर इंजन को कैसे चुपचाप इंजीनियर सामग्री द्वारा संचालित किया जा सकता है, इस बारे में [एआई उद्योग कवरेज] (https://aibuzzwire.news) के गहन होने के बीच यह निष्कर्ष सामने आया है।

अध्ययन में क्या मापा गया

ट्रेलनर ने ओपनराउटर के माध्यम से चलने वाले पर्प्लेक्सिटी के दो वेब-ग्राउंडेड मॉडल, पर्प्लेक्सिटी/सोनार और पर्प्लेक्सिटी/सोनार-प्रो तक - "सीआरएम सॉफ्टवेयर" से "संग्रहालय संग्रह प्रबंधन सॉफ्टवेयर" तक - 380 खरीदार-आशय सॉफ्टवेयर श्रेणियां रखीं। परीक्षण में प्रति मॉडल प्रति श्रेणी एक प्रॉम्प्ट का उपयोग किया गया: कुल मिलाकर 760 कॉल, प्रत्येक उत्पाद के आधिकारिक होमपेज डोमेन के साथ JSON में शीर्ष पांच रैंक के लिए पूछ रहा था।

प्रत्येक कॉल ने एक विश्लेषण योग्य उत्तर दिया। इसने 1,807 विशिष्ट उत्पादों के नामकरण के लिए 3,800 अनुशंसा स्लॉट तैयार किए, जो 2,055 विशिष्ट डोमेन में 7,534 उद्धरणों द्वारा समर्थित थे। इसके बाद ट्रेलनर ने दुनिया की सबसे ज्यादा देखी जाने वाली वेबसाइटों और वेबैक मशीन की ट्रैंको सूची के खिलाफ प्रत्येक उद्धृत डोमेन की जांच की, और आपूर्ति किए गए मॉडलों के 1,502 विक्रेता होमपेजों में से प्रत्येक को प्राप्त किया।

जहां उद्धरण भूमि

शीर्षक संख्याएँ स्पष्ट हैं। 7,534 उद्धरणों में से, 59.8 प्रतिशत ने ट्रांको टॉप-1 मिलियन सूची में #100,000 से भी खराब रैंक वाले डोमेन की ओर इशारा किया, और 23.4 प्रतिशत ने उन डोमेन की ओर इशारा किया जो शीर्ष मिलियन में बिल्कुल भी दिखाई नहीं देते हैं। किसी रैंक किए गए डोमेन की ओर इशारा करने वाले उद्धरणों के बीच औसत ट्रैंको रैंक 71,611 थी।

सर्वाधिक उद्धृत स्रोत परिचित और अस्पष्ट का मिश्रण थे। G2 291 उद्धरणों के साथ सबसे आगे है, उसके बाद Reddit 261 उद्धरणों के साथ है। लेकिन तीसरा सबसे बड़ा स्रोत - गार्टनर के 158 से आगे, 194 बार उद्धृत किया गया - गाइडफ़्लो.कॉम था, जो इंटरैक्टिव उत्पाद डेमो के लिए एक विक्रेता का मार्केटिंग ब्लॉग है जो किसी भी श्रेणी में प्रतिस्पर्धा नहीं करता है जिसके लिए इसे उद्धृत किया गया था। इसके ब्लॉग ने 3डी रेंडरिंग सॉफ्टवेयर, आईवीआर सॉफ्टवेयर, आरएफआईडी सॉफ्टवेयर और आर्किटेक्चर प्रैक्टिस सॉफ्टवेयर के बारे में उत्तरों के लिए आधार प्रदान किया। तुलनात्मक रूप से, विकिपीडिया को 7,534 उद्धरणों में तीन बार उद्धृत किया गया था।

नया, अस्पष्ट और तेजी से बढ़ता हुआ

रिपोर्ट एक अस्थायी आयाम जोड़ती है: अनरैंक किए गए डोमेन भी बहुत नए हैं। बिना रैंक वाले उद्धृत डोमेन के लिए माध्य पहली वेबैक मशीन कैप्चर 2020 थी, रैंक वाले डोमेन के लिए 2011 की तुलना में, और 16.6 प्रतिशत संग्रहीत अनरैंक डोमेन पहली बार 2025 या उसके बाद दिखाई दिए - जबकि रैंक किए गए डोमेन का 1.6 प्रतिशत था। दूसरे शब्दों में, पर्प्लेक्सिटी के उत्तर किन आधारों पर मौजूद थे, इसका एक सार्थक टुकड़ा अभी हाल तक मौजूद नहीं था।

मॉडलों द्वारा पढ़ने के लिए 215,128 पेज बनाए गए

रिपोर्ट का सबसे चौंकाने वाला दावा उन तीन साइटों से संबंधित है, जिनके बारे में ट्रेलनर का कहना है कि वे स्पष्ट रूप से सामान्य नियंत्रण में काम करती हैं। उनमें से दो ने अपने होमपेज को HTML शीर्षक "तथ्य और ग्राउंडिंग पेज" दिया - ग्राउंडिंग इन मॉडलों द्वारा किया जाने वाला पुनर्प्राप्ति चरण है - और तीसरी साइट के साथ मिलकर उन्होंने 215,128 मशीन-जनरेटेड "सर्वश्रेष्ठ [श्रेणी]" पृष्ठ प्रकाशित किए हैं। तीनों डोमेन में से कोई भी दिसंबर 2023 से पहले मौजूद नहीं था।

ट्रेलनर फ़्रेमिंग को लेकर सावधान हैं। रिपोर्ट में कहा गया है कि विक्रेता ब्लॉग की सामग्री विपणन के बारे में कुछ भी अपने आप में भ्रामक नहीं है - कंपनियां हर समय बड़े ब्लॉग प्रकाशित करती हैं - और यह माप इस बारे में है कि पुनर्प्राप्ति परत इसके साथ क्या करती है: "उन बाजारों के बारे में एक विक्रेता की अपनी सूची जिसमें वह काम नहीं करता है, खरीद की सिफारिशों के लिए तीसरा सबसे बड़ा साक्ष्य आधार बन गया"।

एआई खोज के लिए यह क्यों महत्वपूर्ण है

अध्ययन उस बदलाव का एक मात्रात्मक स्नैपशॉट है जिसके बारे में एसईओ व्यवसायी चेतावनी दे रहे हैं: अनुकूलन खोज परिणामों में रैंकिंग से उत्तर इंजन द्वारा पुनर्प्राप्त होने की ओर बढ़ गया है। मॉडलों के लिए लिखे गए पृष्ठ - सघन, फार्मूलाबद्ध, और आधिकारिक दिखने के लिए इंजीनियर किए गए - उन अनुशंसाओं के लिए साक्ष्य आधार बन सकते हैं जिन्हें उपभोक्ता तटस्थ मानते हैं। एचएन पर रिपोर्ट को सैकड़ों अपवोट मिले, टिप्पणीकारों ने इस बात पर बहस की कि क्या यह एआई खोज की विफलता को दर्शाता है या बस इंटरनेट द्वारा इसे अपनाना दर्शाता है।

महत्वपूर्ण चेतावनियाँ

ट्रेलनर दायरे के बारे में स्पष्ट हैं। केवल पर्प्लेक्सिटी को मापा गया, "और यहां किसी भी चीज़ को किसी अन्य इंजन के बारे में दावे के रूप में नहीं पढ़ा जाना चाहिए।" Google को पूरी तरह से छोड़ दिया गया क्योंकि OpenRouter के माध्यम से जेमिनी मॉडल को ग्राउंड करने से यह OpenRouter के स्वयं के वेब-सर्च प्लगइन के माध्यम से रूट हो जाता है, जो माप को दूषित कर देगा। श्रेणियां किसी भी परिणाम को देखने से पहले लिखी गई थीं और उन्हें कभी संशोधित नहीं किया गया था, और पूरा डेटासेट - संकेत, उद्धरण और डोमेन लुकअप - रिपोर्ट के साथ आता है।

वे चेतावनियाँ दोनों तरह से काटती हैं। वे एआई खोज के व्यापक अभियोग की तुलना में निष्कर्षों को संकीर्ण बनाते हैं, लेकिन वे उन्हें खारिज करना भी कठिन बनाते हैं: इसके घोषित दायरे के भीतर, माप सीधा, दोहराने योग्य और किसी भी व्यक्ति के लिए असुविधाजनक है, जो मानता है कि जमीनी जवाब खुले वेब की सबसे भरोसेमंद अलमारियों पर हैं।

---

एआई से आगे रहें

नवीनतम एआई समाचार, विश्लेषण और सफलताएँ प्राप्त करें - सभी एक ही स्थान पर।

अधिक AI समाचार पढ़ें →