一份新的研究报告认为,Perplexity 的软件推荐的来源主要是供模型而不是人阅读的页面,其中包括三个网站,它们总共发布了 215,128 个机器生成的“最佳软件”页面。 Trellner Research 周三发布的报告发现,Perplexity 在 380 个软件类别中的答案背后的引用中有近 60% 指向排名前 100,000 个网站之外的域。这些发现正值人工智能行业报道 不断加强,关于如何通过工程内容悄悄地引导搜索引擎和答案引擎。

研究测量的内容

Trellner 将 380 个买家意向软件类别(从“CRM 软件”到“博物馆藏品管理软件”)放入 Perplexity 的两个基于网络的模型:perplexity/sonar 和 perplexity/sonar-pro,通过 OpenRouter 运行。该测试对每个模型的每个类别使用一个提示:总共 760 个调用,每个调用都要求提供每个产品的官方主页域的 JSON 排名前五名。

每个调用都会返回一个可解析的答案。这产生了 3,800 个推荐位,命名了 1,807 种不同的产品,并得到了 2,055 个不同领域的 7,534 次引用的支持。然后,Trellner 根据 Tranco 世界上访问量最大的网站列表和 Wayback Machine 检查每个引用的域,并获取模型提供的 1,502 个供应商主页中的每一个。

引文所在的地方

头条新闻的数字十分严峻。在 7,534 次引用中,59.8% 的引用指向 Tranco 前 100 万列表中排名低于 #100,000 的域名,23.4% 的引用根本没有出现在前 100 万中。确实指向已排名域名的引用中的 Tranco 排名中位数为 71,611。

被引用最多的来源既有熟悉的,也有不知名的。 G2 以 291 次引用领先,其次是 Reddit,引用次数为 261 次。但第三大来源(被引用 194 次,领先于 Gartner 的 158 次)是guideflow.com,这是一家针对交互式产品演示的供应商营销博客,但在其被引用的任何类别中均不存在竞争。它的博客为有关 3D 渲染软件、IVR 软件、RFID 软件和建筑实践软件等的答案提供了基础。相比之下,维基百科被引用了 3 次,共 7,534 次引用。

较新、默默无闻且增长迅速

该报告增加了一个时间维度:未排名的域也更新得多。未排名引用域名的首次 Wayback Machine 捕获中位数为 2020 年,排名域名为 2011 年,16.6% 的存档未排名域名首次出现于 2025 年或之后,而排名域名的这一比例为 1.6%。换句话说,困惑度答案中有意义的一部分直到最近才存在。

215,128 页供模型阅读

该报告最引人注目的说法涉及三个站点,特雷尔纳称这三个站点显然是在共同控制下运营的。其中两个将其主页命名为 HTML 标题“事实与基础页面”(基础是这些模型执行的检索步骤),并与第三个网站一起发布了 215,128 个机器生成的“最佳[类别]”页面。这三个域名在 2023 年 12 月之前都不存在。

特雷尔纳对取景很谨慎。该报告指出,供应商博客的内容营销本身并不具有欺骗性——公司一直在发布大型博客——而且衡量的是检索层对博客的作用:“供应商自己的关于其不经营的市场的列表成为购买推荐的第三大证据基础”。

为什么人工智能搜索很重要

这项研究是 SEO 从业者一直警告的转变的定量快照:优化已经从搜索结果排名转向由答案引擎检索。为模型编写的页面——密集、公式化,并且经过精心设计,看起来很权威——可以成为消费者视为中立的推荐的证据基础。在 HN 上,该报告获得了数百票赞成,评论者争论这是否反映了人工智能搜索的失败,或者仅仅是互联网在适应它。

重要警告

特雷尔纳对于范围很明确。仅测量了困惑度,“这里的任何内容都不应被解读为对任何其他引擎的声明。”谷歌完全被排除在外,因为通过 OpenRouter 接地 Gemini 模型会通过 OpenRouter 自己的网络搜索插件路由,这会污染测量结果。这些类别是在看到任何结果之前编写的,从未修改过,并且完整的数据集(提示、引文和域查找)附在报告中。

这些警告是双向的。它们使调查结果比对人工智能搜索的全面控诉更加狭隘,但也让它们更难被驳回:在其规定的范围内,测量是简单的、可重复的,并且对于那些认为有依据的答案存在于开放网络最值得信赖的货架上的人来说是不舒服的。

---

保持人工智能领先地位

获取最新的人工智能新闻、分析和突破——尽在一个地方。

阅读更多人工智能新闻 →