Μια νέα ερευνητική έκθεση υποστηρίζει ότι οι πηγές που στηρίζουν τις προτάσεις λογισμικού του Perplexity κυριαρχούνται από σελίδες που έχουν δημιουργηθεί για να διαβάζονται από μοντέλα και όχι από ανθρώπους - συμπεριλαμβανομένων τριών τοποθεσιών που δημοσίευσαν μαζί 215.128 σελίδες "καλύτερου λογισμικού" που δημιουργήθηκαν από μηχανή. Η έκθεση, που δημοσιεύθηκε την Τετάρτη από την Trellner Research, διαπίστωσε ότι σχεδόν το 60 τοις εκατό των αναφορών πίσω από τις απαντήσεις του Perplexity σε 380 κατηγορίες λογισμικού κατέδειξαν τομείς που κατατάσσονται εκτός των κορυφαίων 100.000 ιστότοπων του Ιστού. Τα ευρήματα εντοπίζονται εν μέσω της εντατικοποίησης της [κάλυψης της βιομηχανίας AI] (https://aibuzzwire.news) σχετικά με τον τρόπο με τον οποίο οι μηχανές αναζήτησης και οι μηχανές απαντήσεων μπορούν να κατευθύνονται αθόρυβα από τεχνικό περιεχόμενο.
Τι μέτρησε η Μελέτη
Η Trellner έθεσε 380 κατηγορίες λογισμικού με πρόθεση αγοραστή — από «λογισμικό CRM» έως «λογισμικό διαχείρισης συλλογής μουσείων» — σε δύο από τα μοντέλα της Perplexity που βασίζονται στον ιστό, το perplexity/sonar και το perplexity/sonar-pro, που εκτελούνται μέσω του OpenRouter. Η δοκιμή χρησιμοποίησε μία προτροπή ανά κατηγορία ανά μοντέλο: 760 κλήσεις συνολικά, καθεμία από τις οποίες ζητούσε μια πρώτη πεντάδα σε JSON με τον επίσημο τομέα αρχικής σελίδας κάθε προϊόντος.
Κάθε κλήση επέστρεφε μια αναλύσιμη απάντηση. Αυτό παρήγαγε 3.800 υποδοχές προτάσεων που ονομάζουν 1.807 διαφορετικά προϊόντα, που υποστηρίζονται από 7.534 αναφορές σε 2.055 διακριτούς τομείς. Στη συνέχεια, ο Trellner έλεγξε κάθε αναφερόμενο τομέα σε σχέση με τη λίστα Tranco με τους ιστότοπους με τις περισσότερες επισκέψεις στον κόσμο και το Wayback Machine, και πήρε καθεμία από τις 1.502 αρχικές σελίδες προμηθευτών που παρείχαν τα μοντέλα.
Where the Citations Land
Οι αριθμοί των επικεφαλίδων είναι έντονοι. Από τις 7.534 αναφορές, το 59,8 τοις εκατό αναφέρουν τομείς που κατατάσσονται χειρότερα από το #100.000 στη λίστα κορυφαίων 1 εκατομμυρίου της Tranco και το 23,4 τοις εκατό ανέφεραν τομείς που δεν εμφανίζονται καθόλου στο κορυφαίο εκατομμύριο. Η διάμεση κατάταξη Tranco μεταξύ των παραπομπών που έδειχναν σε έναν ταξινομημένο τομέα ήταν 71.611.
Οι πηγές που αναφέρθηκαν περισσότερο ήταν ένας συνδυασμός του οικείου και του σκοτεινού. Το G2 προηγήθηκε με 291 αναφορές, ακολουθούμενο από το Reddit με 261. Αλλά η τρίτη μεγαλύτερη πηγή —που αναφέρθηκε 194 φορές, μπροστά από τις 158 της Gartner— ήταν το guideflow.com, ένα ιστολόγιο μάρκετινγκ πωλητή για διαδραστικές επιδείξεις προϊόντων που δεν ανταγωνίζεται σε καμία από τις κατηγορίες για τις οποίες αναφέρθηκε. Το blog του παρείχε τη βάση για απαντήσεις σχετικά με το λογισμικό τρισδιάστατης απόδοσης, το λογισμικό IVR, το λογισμικό RFID και το λογισμικό πρακτικής αρχιτεκτονικής. Η Wikipedia, συγκριτικά, αναφέρθηκε τρεις φορές σε 7.534 αναφορές.
Πιο νεότερο, σκοτεινό και αναπτυσσόμενο γρήγορα
Η αναφορά προσθέτει μια χρονική διάσταση: οι μη ταξινομημένοι τομείς είναι επίσης πολύ νεότεροι. Η διάμεση πρώτη λήψη Wayback Machine για μη ταξινομημένους τομείς ήταν το 2020, έναντι του 2011 για τους ταξινομημένους τομείς και το 16,6 τοις εκατό των αρχειοθετημένων μη ταξινομημένων τομέων εμφανίστηκε για πρώτη φορά το 2025 ή αργότερα — έναντι 1,6 τοις εκατό των τομέων κατάταξης. Με άλλα λόγια, ένα ουσιαστικό κομμάτι του τι βασίζει τις απαντήσεις του Perplexity δεν υπήρχε μέχρι πολύ πρόσφατα.
215.128 Σελίδες που κατασκευάστηκαν για να διαβάζονται από μοντέλα
Ο πιο εντυπωσιακός ισχυρισμός της έκθεσης αφορά τρεις τοποθεσίες που η Trellner λέει ότι λειτουργούν υπό προφανώς κοινό έλεγχο. Δύο από αυτά έδωσαν στην αρχική τους σελίδα τον τίτλο HTML "Γεγονότα & Σελίδα γείωσης" - η γείωση είναι το ίδιο το βήμα ανάκτησης που εκτελούν αυτά τα μοντέλα - και μαζί με έναν τρίτο ιστότοπο έχουν δημοσιεύσει 215.128 σελίδες "καλύτερης [κατηγορίας]" που δημιουργήθηκαν από μηχανή. Κανένας από τους τρεις τομείς δεν υπήρχε πριν από τον Δεκέμβριο του 2023.
Ο Τρέλνερ είναι προσεκτικός με το καδράρισμα. Η αναφορά σημειώνει ότι τίποτα σχετικά με το μάρκετινγκ περιεχομένου του ιστολογίου πωλητή δεν είναι από μόνο του παραπλανητικό – οι εταιρείες δημοσιεύουν μεγάλα ιστολόγια συνεχώς – και ότι η μέτρηση αφορά το τι κάνει με αυτό το επίπεδο ανάκτησης: «οι κατάλογοι ενός προμηθευτή σχετικά με αγορές στις οποίες δεν δραστηριοποιείται έγιναν η τρίτη μεγαλύτερη βάση αποδεικτικών στοιχείων» για προτάσεις αγοράς.
Γιατί έχει σημασία για την αναζήτηση AI
Η μελέτη είναι ένα ποσοτικό στιγμιότυπο μιας αλλαγής για την οποία οι επαγγελματίες του SEO προειδοποιούν: η βελτιστοποίηση έχει μετακινηθεί από την κατάταξη στα αποτελέσματα αναζήτησης στην ανάκτηση από τις μηχανές απαντήσεων. Σελίδες που γράφτηκαν για μοντέλα — πυκνές, τυποποιημένες και σχεδιασμένες για να φαίνονται έγκυρες — μπορούν να γίνουν η βάση αποδεικτικών στοιχείων για συστάσεις που οι καταναλωτές αντιμετωπίζουν ως ουδέτερες. Στο HN, η έκθεση συγκέντρωσε εκατοντάδες θετικές ψήφους, με τους σχολιαστές να συζητούν εάν αυτό αντικατοπτρίζει μια αποτυχία της αναζήτησης AI ή απλώς την προσαρμογή του Διαδικτύου σε αυτήν.
Σημαντικές επιφυλάξεις
Ο Trellner είναι ξεκάθαρος σχετικά με το πεδίο εφαρμογής. Μόνο το Perplexity μετρήθηκε, «και τίποτα εδώ δεν πρέπει να διαβαστεί ως ισχυρισμός για οποιονδήποτε άλλο κινητήρα». Η Google έμεινε έξω εντελώς επειδή η γείωση ενός μοντέλου Gemini μέσω του OpenRouter το δρομολογεί μέσω της προσθήκης αναζήτησης ιστού του OpenRouter, η οποία θα μόλυνε τη μέτρηση. Οι κατηγορίες γράφτηκαν πριν εμφανιστούν οποιαδήποτε αποτελέσματα και δεν αναθεωρήθηκαν ποτέ, και το πλήρες σύνολο δεδομένων — προτροπές, παραπομπές και αναζητήσεις τομέα — συνοδεύει την αναφορά.
Αυτές οι επιφυλάξεις κόβουν και τις δύο κατευθύνσεις. Κάνουν τα ευρήματα πιο στενά από ένα γενικό κατηγορητήριο για την αναζήτηση τεχνητής νοημοσύνης, αλλά επίσης δυσκολεύουν την απόρριψή τους: εντός του προβλεπόμενου πεδίου εφαρμογής, η μέτρηση είναι απλή, επαναλαμβανόμενη και άβολη για όποιον υπέθεσε ότι οι γειωμένες απαντήσεις βρίσκονται στα πιο αξιόπιστα ράφια του ανοιχτού ιστού.
---
Μείνετε μπροστά από την τεχνητή νοημοσύνηΛάβετε τα πιο πρόσφατα νέα, αναλύσεις και ανακαλύψεις για την τεχνητή νοημοσύνη — όλα σε ένα μέρος.
Διαβάστε περισσότερα νέα AI →