Nová výzkumná zpráva tvrdí, že zdrojům, které jsou základem softwarových doporučení Perplexity, dominují stránky vytvořené tak, aby je četly spíše modelky než lidé – včetně tří webů, které dohromady zveřejnily 215 128 strojově generovaných stránek „nejlepšího softwaru“. Zpráva, kterou ve středu zveřejnil Trellner Research, zjistila, že téměř 60 procent citací za odpověďmi Perplexity v 380 kategoriích softwaru poukazovalo na domény umístěné mimo 100 000 nejlepších webů. Zjištění přistávají uprostřed intenzivnějšího pokrytí průmyslu AI toho, jak mohou být vyhledávače a odpovědní nástroje tiše řízeny umělým obsahem.
Co studie měřila
Trellner zařadil 380 kategorií softwaru se záměrem kupujícího – od „CRM softwaru“ po „software pro správu muzejních sbírek“ – až po dva modely Perplexity založené na webu, perplexity/sonar a perplexity/sonar-pro, běžící přes OpenRouter. V testu byla použita jedna výzva pro kategorii a model: celkem 760 hovorů, z nichž každý žádal o umístění pět nejlepších v JSON s oficiální doménou domovské stránky každého produktu.
Každý hovor vrátil analyzovatelnou odpověď. Výsledkem bylo 3 800 slotů doporučení pojmenujících 1 807 různých produktů, podpořených 7 534 citacemi ve 2 055 různých doménách. Trellner poté zkontroloval každou citovanou doménu se seznamem nejnavštěvovanějších světových webových stránek Tranco a Wayback Machine a načetl každou z 1 502 domovských stránek prodejců, které modely dodaly.
Kde Citations Land
Čísla titulků jsou strohá. Ze 7 534 citací 59,8 procenta poukázalo na domény, které se v žebříčku Tranco top-1 milion umístily hůře než # 100 000, a 23,4 procenta poukázalo na domény, které se v prvním milionu vůbec nevyskytují. Medián pořadí Tranco mezi citacemi, které ukazovaly na hodnocenou doménu, byl 71 611.
Nejčastěji citované zdroje byly směsí známého a neznámého. G2 vedl s 291 citacemi, následovaný Redditem s 261. Ale třetím největším zdrojem – citovaným 194krát, před Gartnerem 158 – byl guideflow.com, marketingový blog prodejce pro interaktivní ukázky produktů, který nesoutěží v žádné z kategorií, pro které byl citován. Jeho blog poskytl základy pro odpovědi týkající se softwaru pro 3D vykreslování, softwaru IVR, softwaru RFID a softwaru pro procvičování architektury. Wikipedie byla pro srovnání citována třikrát v 7 534 citacích.
Novější, nejasnější a rychle rostoucí
Přehled přidává časový rozměr: neohodnocené domény jsou také mnohem novější. Medián prvního zachycení Wayback Machine u nezařazených citovaných domén byl v roce 2020, oproti roku 2011 u hodnocených domén a 16,6 procenta archivovaných nezařazených domén se poprvé objevilo v roce 2025 nebo později – oproti 1,6 procentům hodnocených domén. Jinými slovy, smysluplný výsek toho, co je základem odpovědí Perplexity, až donedávna neexistovalo.
215 128 stránek vytvořených pro čtení modelkami
Nejvýraznější tvrzení zprávy se týká tří stránek, které podle Trellnera fungují pod zjevně společnou kontrolou. Dva z nich dali své domovské stránce název HTML „Facts & Grounding Page“ – uzemnění je samotný krok vyhledávání, který tyto modely provádějí – a spolu s třetím webem publikovali 215 128 strojově generovaných stránek „nejlepší [kategorie]“. Žádná ze tří domén neexistovala před prosincem 2023.
Trellner je s rámováním opatrný. Zpráva uvádí, že nic o marketingu obsahu blogu dodavatele není samo o sobě klamavé – společnosti neustále publikují velké blogy – a že měření je o tom, co s tím dělá vyhledávací vrstva: „vlastní seznamy prodejců o trzích, na kterých nepůsobí, se staly třetí největší základnou důkazů“ pro doporučení k nákupu.
Proč je pro vyhledávání AI tak důležité
Studie je kvantitativním snímkem posunu, na který odborníci v oblasti SEO upozorňovali: optimalizace se posunula od hodnocení ve výsledcích vyhledávání k načítání pomocí vyhledávacích strojů. Stránky napsané pro modely – husté, formulované a navržené tak, aby vypadaly autoritativní – se mohou stát důkazní základnou pro doporučení, která spotřebitelé považují za neutrální. Na HN zpráva získala stovky kladných hlasů, přičemž komentátoři debatovali o tom, zda to odráží selhání vyhledávání AI, nebo se tomu prostě přizpůsobil internet.
Důležitá upozornění
Trellner se výslovně vyjadřuje k rozsahu. Byla měřena pouze zmatenost, "a nic zde by nemělo být chápáno jako tvrzení o jakémkoli jiném motoru." Google byl zcela vynechán, protože uzemnění modelu Gemini přes OpenRouter jej vede přes vlastní webový vyhledávací plugin OpenRouter, který by kontaminoval měření. Kategorie byly napsány předtím, než byly vidět jakékoli výsledky, a nikdy nebyly revidovány, a kompletní datový soubor – výzvy, citace a vyhledávání domén – doprovází zprávu.
Tato upozornění jsou v obou směrech. Díky nim jsou zjištění užší než plošné obvinění z vyhledávání AI, ale také je obtížnější je odmítnout: v rámci stanoveného rozsahu je měření přímočaré, opakovatelné a nepohodlné pro každého, kdo předpokládal, že uzemněné odpovědi leží na nejdůvěryhodnějších policích otevřeného webu.
---
Stay Ahead of AIZískejte nejnovější zprávy, analýzy a průlomové informace o umělé inteligenci – vše na jednom místě.
Přečtěte si další zprávy o AI →