Laporan penyelidikan baharu berpendapat bahawa sumber yang mendasari cadangan perisian Perplexity didominasi oleh halaman yang dibina untuk dibaca oleh model dan bukannya orang — termasuk tiga tapak yang bersama-sama menerbitkan 215,128 halaman "perisian terbaik" yang dihasilkan oleh mesin. Laporan itu, yang diterbitkan hari Rabu oleh Trellner Research, mendapati bahawa hampir 60 peratus petikan di sebalik jawapan Perplexity dalam 380 kategori perisian menunjuk kepada domain yang diletakkan di luar 100,000 tapak teratas web. Penemuan ini muncul di tengah-tengah [liputan industri AI] yang semakin intensif (https://aibuzzwire.news) tentang cara enjin carian dan enjin jawapan boleh dikendalikan secara senyap oleh kandungan yang direka bentuk.

Apa Kajian yang Diukur

Trellner meletakkan 380 kategori perisian niat pembeli — daripada "perisian CRM" kepada "perisian pengurusan koleksi muzium" — kepada dua model berasaskan web Perplexity, perplexity/sonar dan perplexity/sonar-pro, berjalan melalui OpenRouter. Ujian ini menggunakan satu gesaan bagi setiap kategori bagi setiap model: 760 panggilan kesemuanya, setiap satu meminta kedudukan lima teratas dalam JSON dengan domain halaman utama rasmi setiap produk.

Setiap panggilan membalas jawapan yang boleh dihuraikan. Itu menghasilkan 3,800 slot cadangan yang menamakan 1,807 produk berbeza, disokong oleh 7,534 petikan merentas 2,055 domain berbeza. Trellner kemudian menyemak setiap domain yang disebut dengan senarai Tranco tapak web yang paling kerap dilawati di dunia dan Mesin Wayback, dan mengambil setiap satu daripada 1,502 halaman utama vendor yang dibekalkan oleh model tersebut.

Di mana Tanah Petikan

Nombor tajuk adalah jelas. Daripada 7,534 petikan, 59.8 peratus menunjuk kepada domain yang mendapat kedudukan lebih teruk daripada #100,000 dalam senarai 1 juta teratas Tranco, dan 23.4 peratus menunjuk kepada domain yang tidak muncul dalam juta teratas sama sekali. Kedudukan median Tranco antara petikan yang menunjukkan pada domain kedudukan ialah 71,611.

Sumber yang paling banyak disebut adalah gabungan antara yang biasa dan yang tidak jelas. G2 mendahului dengan 291 petikan, diikuti oleh Reddit dengan 261. Tetapi sumber ketiga terbesar — ​​dipetik sebanyak 194 kali, mendahului Gartner 158 — ialah guideflow.com, blog pemasaran vendor untuk demo produk interaktif yang tidak bersaing dalam mana-mana kategori yang dipetik untuknya. Blognya membekalkan asas untuk jawapan tentang perisian pemaparan 3D, perisian IVR, perisian RFID dan perisian amalan seni bina. Wikipedia, sebagai perbandingan, dipetik tiga kali dalam 7,534 petikan.

Lebih Baru, Kabur dan Berkembang Pantas

Laporan itu menambah dimensi temporal: domain tidak berperingkat juga jauh lebih baharu. Pengambilan median Mesin Wayback pertama untuk domain yang disebut tidak berperingkat ialah 2020, berbanding 2011 untuk domain yang diberi kedudukan dan 16.6 peratus daripada domain tidak berperingkat yang diarkibkan mula-mula muncul pada 2025 atau lebih baru — berbanding 1.6 peratus domain kedudukan. Dalam erti kata lain, sepotong bermakna tentang alasan jawapan Perplexity tidak wujud sehingga baru-baru ini.

215,128 Halaman Dibina untuk Dibaca oleh Model

Tuntutan paling ketara dalam laporan itu melibatkan tiga tapak yang dikatakan Trellner beroperasi di bawah kawalan yang nampaknya biasa. Dua daripada mereka memberi halaman utama mereka tajuk HTML "Halaman Fakta & Asas" — asas merupakan langkah pencarian semula yang dilakukan oleh model ini — dan bersama-sama dengan tapak ketiga mereka telah menerbitkan 215,128 halaman "terbaik [kategori]" yang dijana oleh mesin. Tiada satu pun daripada tiga domain itu wujud sebelum Disember 2023.

Trellner berhati-hati dengan pembingkaian. Laporan itu menyatakan bahawa tiada apa-apa pun tentang pemasaran kandungan blog vendor yang menipu dengan sendirinya — syarikat menerbitkan blog besar sepanjang masa — dan bahawa ukurannya adalah mengenai perkara yang dilakukan oleh lapisan pengambilan semula dengannya: "senarai vendor sendiri tentang pasaran yang tidak beroperasi menjadi pangkalan bukti ketiga terbesar" untuk cadangan pembelian.

Mengapa Ia Penting untuk Carian AI

Kajian itu ialah gambaran kuantitatif peralihan yang telah diberi amaran oleh pengamal SEO tentang: pengoptimuman telah beralih daripada kedudukan dalam hasil carian kepada diperoleh semula oleh enjin jawapan. Halaman yang ditulis untuk model — padat, formulaik dan direka bentuk untuk kelihatan berwibawa — boleh menjadi asas bukti untuk pengesyoran yang pengguna anggap neutral. Pada HN, laporan itu mendapat ratusan undian positif, dengan pengulas berdebat sama ada ini mencerminkan kegagalan carian AI atau hanya Internet menyesuaikan diri dengannya.

Kaveat Penting

Trellner adalah eksplisit tentang skop. Hanya Perplexity yang diukur, "dan tiada apa pun di sini harus dibaca sebagai tuntutan tentang mana-mana enjin lain." Google ditinggalkan sepenuhnya kerana membumikan model Gemini melalui OpenRouter mengarahkannya melalui pemalam carian web OpenRouter sendiri, yang akan mencemarkan pengukuran. Kategori telah ditulis sebelum sebarang hasil dilihat dan tidak pernah disemak, dan set data penuh — gesaan, petikan dan carian domain — mengiringi laporan itu.

Kaveat tersebut memotong kedua-dua arah. Mereka membuat penemuan lebih sempit daripada dakwaan menyeluruh terhadap carian AI, tetapi mereka juga menjadikannya lebih sukar untuk ditolak: dalam skop yang dinyatakan, ukurannya adalah mudah, boleh diulang dan tidak selesa untuk sesiapa sahaja yang menganggap jawapan asas terletak pada rak web yang paling dipercayai.

---

Kekal Mendahului AI

Dapatkan berita, analisis dan penemuan terkini AI — semuanya di satu tempat.

Baca lebih banyak berita AI →