एका नवीन संशोधन अहवालात असा युक्तिवाद करण्यात आला आहे की पेरप्लेक्सिटीच्या सॉफ्टवेअर शिफारसींना आधार देणारे स्त्रोत लोकांऐवजी मॉडेलद्वारे वाचण्यासाठी तयार केलेल्या पृष्ठांवर वर्चस्व गाजवतात — ज्या तीन साइट्सने एकत्रितपणे 215,128 मशीन-व्युत्पन्न "सर्वोत्तम सॉफ्टवेअर" पृष्ठे प्रकाशित केली आहेत. ट्रेलनर रिसर्चने बुधवारी प्रकाशित केलेल्या अहवालात असे आढळून आले की 380 सॉफ्टवेअर श्रेणींमध्ये पेरप्लेक्सिटीच्या उत्तरांमागील सुमारे 60 टक्के उद्धरणे वेबच्या शीर्ष 100,000 साइट्सच्या बाहेर रँक केलेल्या डोमेनकडे निर्देश करतात. शोध इंजिने आणि उत्तर इंजिने इंजिनीयर केलेल्या सामग्रीद्वारे शांतपणे कशी चालविली जाऊ शकतात याचे AI इंडस्ट्री कव्हरेज तीव्र होत असताना हे निष्कर्ष आले आहेत.

अभ्यासाने काय मोजले

Trellner ने 380 खरेदीदार-उद्देश सॉफ्टवेअर श्रेणी ठेवल्या - "CRM सॉफ्टवेअर" पासून "म्युझियम कलेक्शन मॅनेजमेंट सॉफ्टवेअर" पर्यंत - Perplexity च्या वेब-ग्राउंडेड मॉडेल्सपैकी दोन, perplexity/sonar आणि perplexity/sonar-pro, OpenRouter द्वारे चालणारे. चाचणीमध्ये प्रति मॉडेल प्रति श्रेणी एक प्रॉम्प्ट वापरला गेला: एकूण 760 कॉल्स, प्रत्येक उत्पादनाच्या अधिकृत मुख्यपृष्ठ डोमेनसह JSON मध्ये शीर्ष पाच क्रमांकासाठी विचारत आहे.

प्रत्येक कॉलने विश्लेषण करण्यायोग्य उत्तर दिले. त्याने 1,807 वेगळ्या उत्पादनांची नावे देणाऱ्या 3,800 शिफारस स्लॉट तयार केले, 2,055 विभिन्न डोमेनमध्ये 7,534 उद्धरणांचा आधार घेतला. त्यानंतर Trellner ने जगातील सर्वाधिक भेट दिलेल्या वेबसाइट्स आणि Wayback Machine च्या Tranco सूचीच्या विरूद्ध प्रत्येक उद्धृत डोमेन तपासले आणि मॉडेलने पुरवलेल्या 1,502 विक्रेत्या होमपेजपैकी प्रत्येक मिळवले.

जिथे उद्धरणे जमीन

हेडलाइनचे आकडे ठळक आहेत. 7,534 उद्धरणांपैकी, 59.8 टक्क्यांनी ट्रान्को टॉप-1 दशलक्ष यादीतील #100,000 पेक्षा वाईट रँक असलेल्या डोमेनकडे निर्देश केले आणि 23.4 टक्के डोमेन्सकडे निर्देश केले जे शीर्ष दशलक्षांमध्ये अजिबात दिसत नाहीत. रँक केलेल्या डोमेनवर पॉइंट करणाऱ्या उद्धरणांमध्ये मध्यक ट्रॅन्को रँक 71,611 होता.

सर्वाधिक उद्धृत स्त्रोत हे परिचित आणि अस्पष्ट यांचे मिश्रण होते. G2 ने 291 उद्धरणांसह नेतृत्व केले, त्यानंतर Reddit 261 सह. परंतु तिसरा-सर्वात मोठा स्त्रोत - गार्टनरच्या 158 च्या पुढे, 194 वेळा उद्धृत केला - guideflow.com होता, जो विक्रेत्याचा परस्परसंवादी उत्पादन डेमोसाठीचा एक विपणन ब्लॉग होता जो कोणत्याही श्रेणींमध्ये स्पर्धा करत नाही. त्याच्या ब्लॉगने 3D रेंडरिंग सॉफ्टवेअर, IVR सॉफ्टवेअर, RFID सॉफ्टवेअर आणि आर्किटेक्चर सराव सॉफ्टवेअर बद्दलच्या उत्तरांसाठी ग्राउंडिंग पुरवले आहे. विकिपीडिया, तुलनेने, 7,534 उद्धरणांमध्ये तीन वेळा उद्धृत केले गेले.

नवीन, अस्पष्ट आणि वेगाने वाढत आहे

अहवाल एक तात्पुरती परिमाण जोडतो: रँक न केलेले डोमेन देखील बरेच नवीन आहेत. रँक न केलेल्या उद्धृत डोमेनसाठी मध्यवर्ती प्रथम वेबॅक मशीन कॅप्चर 2020 होते, 2011 च्या तुलनेत रँक केलेल्या डोमेनसाठी आणि 16.6 टक्के संग्रहित अनरँक केलेले डोमेन प्रथम 2025 मध्ये किंवा नंतर दिसले - विरुद्ध रँक केलेल्या डोमेनच्या 1.6 टक्के. दुस-या शब्दात सांगायचे तर, पेरप्लेक्सिटीच्या उत्तरांचे कारण काय याचा अर्थपूर्ण तुकडा अगदी अलीकडेपर्यंत अस्तित्वात नव्हता.

215,128 पृष्ठे मॉडेलद्वारे वाचण्यासाठी तयार केली आहेत

अहवालातील सर्वात धक्कादायक दावा तीन साइट्सशी संबंधित आहे ज्या Trellner म्हणतात की वरवर पाहता सामान्य नियंत्रणाखाली कार्य करतात. त्यापैकी दोघांनी त्यांच्या मुख्यपृष्ठाला HTML शीर्षक "तथ्ये आणि ग्राउंडिंग पृष्ठ" दिले — ग्राउंडिंग ही मॉडेल्सची पुनर्प्राप्ती चरण आहे — आणि तिसऱ्या साइटसह त्यांनी 215,128 मशीन-व्युत्पन्न "सर्वोत्तम [श्रेणी]" पृष्ठे प्रकाशित केली आहेत. डिसेंबर २०२३ पूर्वी तीनपैकी कोणतेही डोमेन अस्तित्वात नव्हते.

ट्रेलनर फ्रेमिंगसह सावध आहे. अहवालात असे नमूद केले आहे की विक्रेता ब्लॉगच्या सामग्री विपणनाबद्दल काहीही फसवे नाही — कंपन्या नेहमीच मोठे ब्लॉग प्रकाशित करतात — आणि हे मोजमाप हे पुनर्प्राप्ती स्तर त्याच्याशी काय करते याबद्दल आहे: "विक्रेत्याच्या स्वतःच्या बाजारांबद्दलची यादी ती ज्यामध्ये चालत नाही, ती खरेदी शिफारशींसाठी तिसऱ्या-सर्वात मोठा पुरावा आधार बनली आहे".

AI शोधासाठी हे महत्त्वाचे का आहे

हा अभ्यास एका शिफ्टचा एक परिमाणात्मक स्नॅपशॉट आहे ज्याबद्दल एसईओ प्रॅक्टिशनर्स चेतावणी देत आहेत: ऑप्टिमायझेशन शोध परिणामांमधील रँकिंगवरून उत्तर इंजिनद्वारे पुनर्प्राप्त केले गेले आहे. मॉडेल्ससाठी लिहिलेली पृष्ठे — दाट, सूत्रबद्ध आणि अधिकृत दिसण्यासाठी अभियांत्रिकी — ग्राहक तटस्थ मानतात अशा शिफारशींसाठी पुरावा आधार बनू शकतात. HN वर अहवालाला शेकडो अपवोट मिळाले, टिप्पणीकर्त्यांनी वादविवाद केला की हे AI शोधातील अपयश किंवा फक्त इंटरनेट त्याच्याशी जुळवून घेत आहे.

महत्वाच्या सूचना

ट्रेलनर व्याप्तीबद्दल स्पष्ट आहे. फक्त गोंधळाचे मोजमाप केले गेले, "आणि इतर कोणत्याही इंजिनबद्दल दावा म्हणून येथे काहीही वाचू नये." Google पूर्णपणे वगळले गेले कारण OpenRouter द्वारे जेमिनी मॉडेलला ग्राउंडिंग केल्याने ते OpenRouter च्या स्वतःच्या वेब-शोध प्लगइनद्वारे मार्गस्थ होते, जे मापन दूषित करेल. कोणतेही परिणाम दिसण्यापूर्वी आणि कधीही सुधारित न करण्याआधी श्रेण्या लिहिल्या गेल्या होत्या आणि संपूर्ण डेटासेट — प्रॉम्प्ट्स, उद्धरणे आणि डोमेन लुकअप — अहवालासोबत असतात.

त्या चेतावणी दोन्ही मार्ग कट. ते AI शोधाच्या ब्लँकेट आरोपापेक्षा निष्कर्ष अधिक अरुंद करतात, परंतु ते त्यांना डिसमिस करणे देखील कठिण बनवतात: त्याच्या नमूद केलेल्या व्याप्तीमध्ये, मापन सरळ, पुनरावृत्ती करता येण्याजोगे आणि ज्यांनी ग्राउंडेड उत्तरे गृहीत धरली आहेत त्यांच्यासाठी ओपन वेबच्या सर्वात विश्वासार्ह शेल्फवर राहतात.

---

एआयच्या पुढे राहा

नवीनतम AI बातम्या, विश्लेषण आणि यश मिळवा — सर्व एकाच ठिकाणी.

अधिक AI बातम्या वाचा →