Một báo cáo nghiên cứu mới lập luận rằng các nguồn đưa ra đề xuất phần mềm của Perplexity chủ yếu là các trang được xây dựng để người mẫu đọc chứ không phải người đọc - bao gồm ba trang web cùng xuất bản 215.128 trang "phần mềm tốt nhất" do máy tạo ra. Báo cáo do Trellner Research công bố hôm thứ Tư cho thấy gần 60% các trích dẫn đằng sau câu trả lời của Perplexity trong 380 danh mục phần mềm đều trỏ đến các tên miền được xếp hạng bên ngoài 100.000 trang web hàng đầu trên web. Những phát hiện này được đưa ra trong bối cảnh phạm vi đưa tin của ngành AI ngày càng tăng cường về cách các công cụ tìm kiếm và công cụ trả lời có thể được điều khiển một cách lặng lẽ bởi nội dung được thiết kế sẵn.
Nghiên cứu đã đo lường điều gì
Trellner đặt 380 danh mục phần mềm dành cho người mua - từ "phần mềm CRM" đến "phần mềm quản lý bộ sưu tập bảo tàng" - cho hai mô hình dựa trên web của Perplexity, perplexity/sonar và perplexity/sonar-pro, chạy qua OpenRouter. Thử nghiệm sử dụng một lời nhắc cho mỗi danh mục trên mỗi mô hình: tổng cộng 760 lệnh gọi, mỗi lệnh yêu cầu xếp hạng 5 lệnh gọi hàng đầu trong JSON với miền trang chủ chính thức của mỗi sản phẩm.
Mỗi cuộc gọi đều trả về một câu trả lời có thể phân tích được. Điều đó tạo ra 3.800 vị trí đề xuất đặt tên cho 1.807 sản phẩm riêng biệt, được hỗ trợ bởi 7.534 trích dẫn trên 2.055 tên miền riêng biệt. Trellner sau đó đã kiểm tra mọi tên miền được trích dẫn dựa trên danh sách Tranco gồm các trang web được truy cập nhiều nhất trên thế giới và Wayback Machine, đồng thời tìm nạp từng trang trong số 1.502 trang chủ của nhà cung cấp mà các mô hình này cung cấp.
Nơi trích dẫn đất
Những con số tiêu đề rất rõ ràng. Trong số 7.534 trích dẫn, 59,8% chỉ ra các tên miền được xếp hạng kém hơn #100.000 trong danh sách 1 triệu hàng đầu của Tranco và 23,4% chỉ vào các tên miền hoàn toàn không xuất hiện trong top 1 triệu. Thứ hạng trung bình của Tranco trong số các trích dẫn trỏ đến một tên miền được xếp hạng là 71.611.
Các nguồn được trích dẫn nhiều nhất là sự kết hợp giữa những nguồn quen thuộc và ít người biết đến. G2 dẫn đầu với 291 trích dẫn, tiếp theo là Reddit với 261. Nhưng nguồn lớn thứ ba - được trích dẫn 194 lần, trước 158 của Gartner - là Guideflow.com, blog tiếp thị của một nhà cung cấp về các bản demo sản phẩm tương tác không cạnh tranh ở bất kỳ danh mục nào mà nó được trích dẫn. Blog của nó cung cấp nền tảng cho các câu trả lời về phần mềm kết xuất 3D, phần mềm IVR, phần mềm RFID và phần mềm thực hành kiến trúc. Bằng cách so sánh, Wikipedia được trích dẫn ba lần trong 7.534 trích dẫn.
Mới hơn, ít người biết đến và phát triển nhanh
Báo cáo bổ sung thêm khía cạnh thời gian: các tên miền không được xếp hạng cũng mới hơn nhiều. Lần thu thập Wayback Machine trung bình đầu tiên cho các miền được trích dẫn không được xếp hạng là vào năm 2020, so với năm 2011 đối với các miền được xếp hạng và 16,6% miền được lưu trữ không được xếp hạng xuất hiện lần đầu tiên vào năm 2025 hoặc muộn hơn — so với 1,6% của các miền được xếp hạng. Nói cách khác, một phần có ý nghĩa làm cơ sở cho câu trả lời của Perplexity không tồn tại cho đến rất gần đây.
215.128 trang được xây dựng để người mẫu đọc
Tuyên bố nổi bật nhất của báo cáo liên quan đến ba địa điểm mà Trellner cho biết dường như hoạt động dưới sự kiểm soát chung. Hai trong số họ đặt cho trang chủ của mình tiêu đề HTML là "Trang sự kiện & nền tảng" - nền tảng là bước truy xuất chính mà các mô hình này thực hiện - và cùng với trang thứ ba, họ đã xuất bản 215.128 trang "[danh mục]" tốt nhất do máy tạo ra. Không có miền nào trong ba miền tồn tại trước tháng 12 năm 2023.
Trellner cẩn thận với việc đóng khung. Báo cáo lưu ý rằng bản thân hoạt động tiếp thị nội dung của blog của nhà cung cấp không có gì là lừa đảo — các công ty luôn xuất bản các blog lớn — và phép đo là về những gì lớp truy xuất thực hiện với nó: "các bài viết của chính nhà cung cấp về các thị trường mà nó không hoạt động đã trở thành cơ sở bằng chứng lớn thứ ba" cho các khuyến nghị mua hàng.
Tại sao nó lại quan trọng đối với Tìm kiếm AI
Nghiên cứu này là một bản tóm tắt định lượng về một sự thay đổi mà những người thực hiện SEO đã cảnh báo về: tối ưu hóa đã chuyển từ xếp hạng trong kết quả tìm kiếm sang được truy xuất bởi các công cụ trả lời. Các trang được viết cho người mẫu — dày đặc, có công thức và được thiết kế để trông có thẩm quyền — có thể trở thành cơ sở bằng chứng cho những khuyến nghị mà người tiêu dùng coi là trung lập. Trên HN, báo cáo đã thu hút hàng trăm lượt tán thành, trong đó các nhà bình luận tranh luận liệu điều này phản ánh sự thất bại của tìm kiếm AI hay chỉ đơn giản là Internet đang thích ứng với nó.
Lưu ý quan trọng
Trellner rất rõ ràng về phạm vi. Chỉ có Perplexity được đo lường, "và không có gì ở đây được coi là tuyên bố về bất kỳ động cơ nào khác." Google đã bị loại hoàn toàn vì việc xây dựng mô hình Gemini thông qua OpenRouter định tuyến nó thông qua plugin tìm kiếm trên web của chính OpenRouter, điều này sẽ làm ảnh hưởng đến phép đo. Các danh mục được viết trước khi có bất kỳ kết quả nào được nhìn thấy và không bao giờ được sửa đổi, đồng thời tập dữ liệu đầy đủ — lời nhắc, trích dẫn và tra cứu tên miền — đi kèm với báo cáo.
Những cảnh báo đó cắt giảm cả hai cách. Chúng làm cho các phát hiện thu hẹp hơn so với một bản cáo trạng chung về tìm kiếm AI, nhưng chúng cũng khiến chúng khó bị bác bỏ hơn: trong phạm vi đã nêu, phép đo rất đơn giản, có thể lặp lại và không gây khó chịu cho bất kỳ ai cho rằng các câu trả lời có căn cứ nằm trên các kệ đáng tin cậy nhất của web mở.
---
Đi trước AINhận tin tức, phân tích và đột phá mới nhất về AI — tất cả ở cùng một nơi.
Đọc thêm tin tức về AI →