एका नवीन संशोधन अहवालात असा युक्तिवाद करण्यात आला आहे की पेरप्लेक्सिटीच्या सॉफ्टवेअर शिफारसींना आधार देणारे स्त्रोत लोकांऐवजी मॉडेलद्वारे वाचण्यासाठी तयार केलेल्या पृष्ठांवर वर्चस्व गाजवतात — ज्या तीन साइट्सने एकत्रितपणे 215,128 मशीन-व्युत्पन्न "सर्वोत्तम सॉफ्टवेअर" पृष्ठे प्रकाशित केली आहेत. ट्रेलनर रिसर्चने बुधवारी प्रकाशित केलेल्या अहवालात असे आढळून आले की 380 सॉफ्टवेअर श्रेणींमध्ये पेरप्लेक्सिटीच्या उत्तरांमागील सुमारे 60 टक्के उद्धरणे वेबच्या शीर्ष 100,000 साइट्सच्या बाहेर रँक केलेल्या डोमेनकडे निर्देश करतात. शोध इंजिने आणि उत्तर इंजिने इंजिनीयर केलेल्या सामग्रीद्वारे शांतपणे कशी चालविली जाऊ शकतात याचे AI इंडस्ट्री कव्हरेज तीव्र होत असताना हे निष्कर्ष आले आहेत.
अभ्यासाने काय मोजले
Trellner ने 380 खरेदीदार-उद्देश सॉफ्टवेअर श्रेणी ठेवल्या - "CRM सॉफ्टवेअर" पासून "म्युझियम कलेक्शन मॅनेजमेंट सॉफ्टवेअर" पर्यंत - Perplexity च्या वेब-ग्राउंडेड मॉडेल्सपैकी दोन, perplexity/sonar आणि perplexity/sonar-pro, OpenRouter द्वारे चालणारे. चाचणीमध्ये प्रति मॉडेल प्रति श्रेणी एक प्रॉम्प्ट वापरला गेला: एकूण 760 कॉल्स, प्रत्येक उत्पादनाच्या अधिकृत मुख्यपृष्ठ डोमेनसह JSON मध्ये शीर्ष पाच क्रमांकासाठी विचारत आहे.
प्रत्येक कॉलने विश्लेषण करण्यायोग्य उत्तर दिले. त्याने 1,807 वेगळ्या उत्पादनांची नावे देणाऱ्या 3,800 शिफारस स्लॉट तयार केले, 2,055 विभिन्न डोमेनमध्ये 7,534 उद्धरणांचा आधार घेतला. त्यानंतर Trellner ने जगातील सर्वाधिक भेट दिलेल्या वेबसाइट्स आणि Wayback Machine च्या Tranco सूचीच्या विरूद्ध प्रत्येक उद्धृत डोमेन तपासले आणि मॉडेलने पुरवलेल्या 1,502 विक्रेत्या होमपेजपैकी प्रत्येक मिळवले.
जिथे उद्धरणे जमीन
हेडलाइनचे आकडे ठळक आहेत. 7,534 उद्धरणांपैकी, 59.8 टक्क्यांनी ट्रान्को टॉप-1 दशलक्ष यादीतील #100,000 पेक्षा वाईट रँक असलेल्या डोमेनकडे निर्देश केले आणि 23.4 टक्के डोमेन्सकडे निर्देश केले जे शीर्ष दशलक्षांमध्ये अजिबात दिसत नाहीत. रँक केलेल्या डोमेनवर पॉइंट करणाऱ्या उद्धरणांमध्ये मध्यक ट्रॅन्को रँक 71,611 होता.
सर्वाधिक उद्धृत स्त्रोत हे परिचित आणि अस्पष्ट यांचे मिश्रण होते. G2 ने 291 उद्धरणांसह नेतृत्व केले, त्यानंतर Reddit 261 सह. परंतु तिसरा-सर्वात मोठा स्त्रोत - गार्टनरच्या 158 च्या पुढे, 194 वेळा उद्धृत केला - guideflow.com होता, जो विक्रेत्याचा परस्परसंवादी उत्पादन डेमोसाठीचा एक विपणन ब्लॉग होता जो कोणत्याही श्रेणींमध्ये स्पर्धा करत नाही. त्याच्या ब्लॉगने 3D रेंडरिंग सॉफ्टवेअर, IVR सॉफ्टवेअर, RFID सॉफ्टवेअर आणि आर्किटेक्चर सराव सॉफ्टवेअर बद्दलच्या उत्तरांसाठी ग्राउंडिंग पुरवले आहे. विकिपीडिया, तुलनेने, 7,534 उद्धरणांमध्ये तीन वेळा उद्धृत केले गेले.
नवीन, अस्पष्ट आणि वेगाने वाढत आहे
अहवाल एक तात्पुरती परिमाण जोडतो: रँक न केलेले डोमेन देखील बरेच नवीन आहेत. रँक न केलेल्या उद्धृत डोमेनसाठी मध्यवर्ती प्रथम वेबॅक मशीन कॅप्चर 2020 होते, 2011 च्या तुलनेत रँक केलेल्या डोमेनसाठी आणि 16.6 टक्के संग्रहित अनरँक केलेले डोमेन प्रथम 2025 मध्ये किंवा नंतर दिसले - विरुद्ध रँक केलेल्या डोमेनच्या 1.6 टक्के. दुस-या शब्दात सांगायचे तर, पेरप्लेक्सिटीच्या उत्तरांचे कारण काय याचा अर्थपूर्ण तुकडा अगदी अलीकडेपर्यंत अस्तित्वात नव्हता.
215,128 पृष्ठे मॉडेलद्वारे वाचण्यासाठी तयार केली आहेत
अहवालातील सर्वात धक्कादायक दावा तीन साइट्सशी संबंधित आहे ज्या Trellner म्हणतात की वरवर पाहता सामान्य नियंत्रणाखाली कार्य करतात. त्यापैकी दोघांनी त्यांच्या मुख्यपृष्ठाला HTML शीर्षक "तथ्ये आणि ग्राउंडिंग पृष्ठ" दिले — ग्राउंडिंग ही मॉडेल्सची पुनर्प्राप्ती चरण आहे — आणि तिसऱ्या साइटसह त्यांनी 215,128 मशीन-व्युत्पन्न "सर्वोत्तम [श्रेणी]" पृष्ठे प्रकाशित केली आहेत. डिसेंबर २०२३ पूर्वी तीनपैकी कोणतेही डोमेन अस्तित्वात नव्हते.
ट्रेलनर फ्रेमिंगसह सावध आहे. अहवालात असे नमूद केले आहे की विक्रेता ब्लॉगच्या सामग्री विपणनाबद्दल काहीही फसवे नाही — कंपन्या नेहमीच मोठे ब्लॉग प्रकाशित करतात — आणि हे मोजमाप हे पुनर्प्राप्ती स्तर त्याच्याशी काय करते याबद्दल आहे: "विक्रेत्याच्या स्वतःच्या बाजारांबद्दलची यादी ती ज्यामध्ये चालत नाही, ती खरेदी शिफारशींसाठी तिसऱ्या-सर्वात मोठा पुरावा आधार बनली आहे".
AI शोधासाठी हे महत्त्वाचे का आहे
हा अभ्यास एका शिफ्टचा एक परिमाणात्मक स्नॅपशॉट आहे ज्याबद्दल एसईओ प्रॅक्टिशनर्स चेतावणी देत आहेत: ऑप्टिमायझेशन शोध परिणामांमधील रँकिंगवरून उत्तर इंजिनद्वारे पुनर्प्राप्त केले गेले आहे. मॉडेल्ससाठी लिहिलेली पृष्ठे — दाट, सूत्रबद्ध आणि अधिकृत दिसण्यासाठी अभियांत्रिकी — ग्राहक तटस्थ मानतात अशा शिफारशींसाठी पुरावा आधार बनू शकतात. HN वर अहवालाला शेकडो अपवोट मिळाले, टिप्पणीकर्त्यांनी वादविवाद केला की हे AI शोधातील अपयश किंवा फक्त इंटरनेट त्याच्याशी जुळवून घेत आहे.
महत्वाच्या सूचना
ट्रेलनर व्याप्तीबद्दल स्पष्ट आहे. फक्त गोंधळाचे मोजमाप केले गेले, "आणि इतर कोणत्याही इंजिनबद्दल दावा म्हणून येथे काहीही वाचू नये." Google पूर्णपणे वगळले गेले कारण OpenRouter द्वारे जेमिनी मॉडेलला ग्राउंडिंग केल्याने ते OpenRouter च्या स्वतःच्या वेब-शोध प्लगइनद्वारे मार्गस्थ होते, जे मापन दूषित करेल. कोणतेही परिणाम दिसण्यापूर्वी आणि कधीही सुधारित न करण्याआधी श्रेण्या लिहिल्या गेल्या होत्या आणि संपूर्ण डेटासेट — प्रॉम्प्ट्स, उद्धरणे आणि डोमेन लुकअप — अहवालासोबत असतात.
त्या चेतावणी दोन्ही मार्ग कट. ते AI शोधाच्या ब्लँकेट आरोपापेक्षा निष्कर्ष अधिक अरुंद करतात, परंतु ते त्यांना डिसमिस करणे देखील कठिण बनवतात: त्याच्या नमूद केलेल्या व्याप्तीमध्ये, मापन सरळ, पुनरावृत्ती करता येण्याजोगे आणि ज्यांनी ग्राउंडेड उत्तरे गृहीत धरली आहेत त्यांच्यासाठी ओपन वेबच्या सर्वात विश्वासार्ह शेल्फवर राहतात.
---
एआयच्या पुढे राहानवीनतम AI बातम्या, विश्लेषण आणि यश मिळवा — सर्व एकाच ठिकाणी.
अधिक AI बातम्या वाचा →