En ny forskningsrapport hävdar att källorna som grundar Perplexitys programvarurekommendationer domineras av sidor som är byggda för att läsas av modeller snarare än människor - inklusive tre sajter som tillsammans publicerade 215 128 maskingenererade "bästa mjukvarusidor". Rapporten, som publicerades på onsdagen av Trellner Research, fann att nästan 60 procent av citaten bakom Perplexitys svar i 380 programvarukategorier pekade på domäner som rankades utanför webbens 100 000 bästa webbplatser. Resultaten landar mitt i den intensifierade AI-branschens täckning av hur sökmotorer och svarsmotorer tyst kan styras av konstruerat innehåll.
Vad studien mätte
Trellner lade 380 programvarukategorier för köpare – från "CRM-mjukvara" till "mjukvara för hantering av museisamlingar" - till två av Perplexitys webbaserade modeller, förvirring/ekolod och förvirring/ekolod-pro, som körs genom OpenRouter. Testet använde en prompt per kategori per modell: 760 samtal totalt, var och en frågade efter en rankad topp fem i JSON med varje produkts officiella hemsidasdomän.
Varje samtal returnerade ett tolkbart svar. Det gav 3 800 rekommendationsplatser som namngav 1 807 distinkta produkter, uppbackade av 7 534 citeringar över 2 055 distinkta domäner. Trellner kontrollerade sedan varje citerad domän mot Tranco-listan över världens mest besökta webbplatser och Wayback Machine, och hämtade var och en av de 1 502 leverantörernas hemsidor som modellerna levererade.
Där citaten landar
Rubrikerna är skarpa. Av de 7 534 hänvisningarna pekade 59,8 procent på domäner som rankades sämre än #100 000 i Trancos topp-1-miljonlista, och 23,4 procent pekade på domäner som inte alls förekommer i toppmiljonen. Medianrankingen för Tranco bland citeringar som pekade på en rankad domän var 71 611.
De mest citerade källorna var en blandning av det välbekanta och det oklara. G2 ledde med 291 citeringar, följt av Reddit med 261. Men den tredje största källan – citerad 194 gånger, före Gartners 158 – var guideflow.com, en leverantörs marknadsföringsblogg för interaktiva produktdemonstrationer som inte konkurrerar i någon av kategorierna den citerades för. Dess blogg gav grunden för svar om både programvara för 3D-rendering, IVR-programvara, RFID-mjukvara och programvara för arkitekturövningar. Wikipedia, som jämförelse, citerades tre gånger i 7 534 citeringar.
Nyare, obskyr och växer snabbt
Rapporten lägger till en tidsmässig dimension: de orankade domänerna är också mycket nyare. Medianvärdet för första Wayback Machine-fångst för orankade citerade domäner var 2020, mot 2011 för rankade, och 16,6 procent av arkiverade orankade domäner dök upp först 2025 eller senare – jämfört med 1,6 procent av rankade domäner. Med andra ord, en meningsfull del av vad som grundar Perplexitys svar fanns inte förrän helt nyligen.
215 128 sidor byggda för att läsas av modeller
Rapportens mest slående påstående gäller tre platser som Trellner säger verkar under till synes gemensam kontroll. Två av dem gav sin hemsida HTML-titeln "Facts & Grounding Page" - jordning är själva hämtningssteget som dessa modeller utför - och tillsammans med en tredje sida har de publicerat 215 128 maskingenererade "bästa [kategori]"-sidor. Ingen av de tre domänerna fanns före december 2023.
Trellner är noga med inramningen. Rapporten konstaterar att ingenting om leverantörsbloggens innehållsmarknadsföring är vilseledande i sig – företag publicerar stora bloggar hela tiden – och att mätningen handlar om vad hämtningslagret gör med det: "en leverantörs egna listor om marknader den inte verkar på blev den tredje största evidensbasen" för köprekommendationer.
Varför det är viktigt för AI-sökning
Studien är en kvantitativ ögonblicksbild av ett skifte som SEO-utövare har varnat för: optimering har flyttats från rankning i sökresultat till att hämtas av svarsmotorer. Sidor skrivna för modeller – täta, formella och konstruerade för att se auktoritativa ut – kan bli bevisbasen för rekommendationer som konsumenter behandlar som neutrala. På HN drog rapporten hundratals uppröstningar, med kommentatorer som diskuterade om detta återspeglar ett misslyckande med AI-sökning eller helt enkelt att internet anpassat sig till det.
Viktiga varningar
Trellner är tydlig när det gäller omfattning. Endast förvirring mättes, "och ingenting här ska läsas som ett påstående om någon annan motor." Google utelämnades helt för att jordning av en Gemini-modell via OpenRouter leder den genom OpenRouters egen webbsökningsplugin, vilket skulle förorena mätningen. Kategorierna skrevs innan några resultat sågs och reviderades aldrig, och hela datamängden – uppmaningar, citat och domänsökningar – åtföljer rapporten.
Dessa varningar skär åt båda hållen. De gör fynden snävare än ett allmänt åtal mot AI-sökning, men de gör dem också svårare att avfärda: inom dess angivna räckvidd är mätningen okomplicerad, repeterbar och obekväm för alla som antar att grundade svar vilar på den öppna webbens mest pålitliga hyllor.
---
Stay ahead of AIFå de senaste AI-nyheterna, analyserna och genombrotten – allt på ett ställe.
Läs mer AI-nyheter →