News Corp đã leo thang cuộc chiến pháp lý chống lại việc sử dụng trái phép hoạt động báo chí của mình bằng cách đệ đơn kiện ngược lại Brave, công cụ tìm kiếm tập trung vào quyền riêng tư, cáo buộc rằng công ty này đã loại bỏ các bài báo có bản quyền để cung cấp cho các mô hình AI mà tập đoàn truyền thông này gọi là "hành vi trộm cắp trắng trợn."

Reuters đưa tin hôm thứ Tư rằng vụ kiện ngược lại được đệ trình liên quan đến tranh chấp pháp lý đang diễn ra giữa hai công ty. News Corp cáo buộc rằng Brave đã thu thập một cách có hệ thống các bài báo từ các ấn phẩm của mình, bao gồm The Wall Street Journal, The New York Post, The Times của London và các hãng tin tức lớn khác mà không được phép hoặc bồi thường. For more context on this story, see our ongoing AI industry coverage.

Những cáo buộc chống lại Brave

Theo hồ sơ, Brave đã loại bỏ các bài báo của News Corp và cung cấp chúng cho các bên thứ ba nhằm mục đích đào tạo AI. Công ty truyền thông lập luận rằng điều này cấu thành hành vi vi phạm bản quyền trực tiếp vì nội dung đã được sao chép, lưu trữ và phân phối lại mà không có sự cho phép của chủ sở hữu quyền.

Việc News Corp sử dụng cụm từ "trộm cắp trắng trợn" nhấn mạnh mức độ nghiêm trọng của hành vi bị cáo buộc. Công ty đã tự khẳng định mình là một trong những công ty bảo vệ mạnh mẽ nhất quyền của nhà xuất bản trong kỷ nguyên AI, đồng thời đã khởi xướng các thủ tục pháp lý chống lại nhiều công ty công nghệ về việc sử dụng nội dung của nó.

Brave, được thành lập bởi người sáng tạo JavaScript Brendan Eich, tự tiếp thị mình như một giải pháp thay thế ưu tiên quyền riêng tư cho Google Tìm kiếm. Công ty vận hành một chỉ mục tìm kiếm được xây dựng bằng trình thu thập thông tin của riêng mình, vốn trước đây đã thu hút sự giám sát chặt chẽ từ các nhà xuất bản, những người cho rằng nội dung của họ đang được lập chỉ mục và sử dụng lại mà không có sự đồng ý.

Chiến trường bản quyền rộng lớn hơn

Vụ kiện ngược lại Brave là loạt đạn mới nhất trong cuộc xung đột pháp lý căng thẳng giữa các nhà xuất bản truyền thống và các công ty AI. Trong hai năm qua, nhiều tổ chức truyền thông đã đệ đơn kiện cáo buộc rằng nội dung của họ bị lấy cắp mà không được phép để đào tạo các mô hình ngôn ngữ lớn và các hệ thống AI khác.

New York Times đã kiện OpenAI và Microsoft vào cuối năm 2023, một vụ việc vẫn đang được xử lý. Hàng trăm tờ báo địa phương đã đệ đơn kiện bản quyền chung chống lại các công ty tương tự. Hiệp hội Tác giả và các tác giả riêng lẻ đã theo đuổi các hành động pháp lý riêng biệt chống lại các công ty AI về việc sử dụng sách trong dữ liệu đào tạo.

News Corp đã đi đầu trong cuộc chiến này. Công ty trước đây đã đạt được thỏa thuận cấp phép với OpenAI được cho là trị giá hàng chục triệu đô la, thể hiện chiến lược theo đuổi cả các vụ kiện tụng và thỏa thuận thương mại. Vụ kiện ngược lại của Brave gợi ý rằng News Corp hiện đang mở rộng các nỗ lực thực thi của mình ra ngoài các công ty AI lớn nhất để bao gồm các bên trung gian tạo điều kiện thuận lợi cho việc thu thập dữ liệu.

Vấn đề trung gian

Vụ kiện chống lại Brave đặt ra một câu hỏi pháp lý quan trọng mà các tòa án vẫn chưa giải quyết đầy đủ: liệu các công cụ tìm kiếm và công cụ tổng hợp dữ liệu thu thập dữ liệu trên web có thể chịu trách nhiệm pháp lý khi nội dung họ thu thập sau đó được sử dụng để đào tạo AI hay không.

Các công cụ tìm kiếm như Google từ lâu đã hoạt động theo nguyên tắc lập chỉ mục các trang web cho kết quả tìm kiếm là sử dụng hợp pháp. Tuy nhiên, bối cảnh đã thay đổi đáng kể với sự phát triển của AI sáng tạo. Khi chỉ mục của công cụ tìm kiếm được tái sử dụng để đào tạo các mô hình có thể tạo ra nội dung cạnh tranh thì việc bảo vệ việc sử dụng hợp lý sẽ trở nên kém rõ ràng hơn nhiều.

Chỉ mục tìm kiếm của Brave, được xây dựng bằng trình thu thập thông tin độc quyền của nó, chiếm một vùng màu xám trong cuộc tranh luận này. Công ty lập luận rằng hoạt động thu thập dữ liệu của họ là tiêu chuẩn cho các công cụ tìm kiếm. News Corp cho rằng việc tái sử dụng nội dung cóp nhặt để đào tạo AI vượt xa những gì cần thiết cho chức năng tìm kiếm.

Ý nghĩa đối với hệ sinh thái Web Scraping

Nếu News Corp thắng thế, vụ việc có thể có tác động sâu rộng đến hệ sinh thái quét web vốn là nền tảng của phần lớn ngành công nghiệp AI. Nhiều công ty AI dựa vào các nhà môi giới dữ liệu, chỉ mục tìm kiếm và trình thu thập dữ liệu tự động để thu thập số lượng lớn văn bản cần thiết để đào tạo mô hình của họ. Phán quyết buộc các bên trung gian này phải chịu trách nhiệm pháp lý có thể làm gián đoạn chuỗi cung ứng trong toàn ngành.

Ngược lại, phán quyết có lợi cho Brave sẽ củng cố vị thế của các công cụ tìm kiếm và công cụ tổng hợp dữ liệu, khiến nhà xuất bản khó kiểm soát cách sử dụng nội dung của họ khi nó xuất hiện trên web mở.

Các chuyên gia pháp lý lưu ý rằng kết quả có thể xoay quanh các chi tiết kỹ thuật cụ thể về cách trình thu thập dữ liệu của Brave hoạt động, dữ liệu nào được thu thập và cách cung cấp dữ liệu đó cho các nhà phát triển AI. Sự khác biệt giữa lập chỉ mục cho kết quả tìm kiếm và thu thập dữ liệu để đào tạo mô hình có thể mang tính quyết định.

Giá trị của nghề báo

Đối với News Corp và các nhà xuất bản khác, trường hợp này không chỉ liên quan đến một công cụ tìm kiếm. Công ty lập luận rằng việc khai thác báo chí không được kiểm soát sẽ đe dọa nền tảng kinh tế của các tổ chức tin tức. Nếu hệ thống AI có thể tạo ra nội dung bằng cách sử dụng tài liệu được lấy từ các hãng tin tức mà không được bồi thường, thì các nhà xuất bản sẽ mất cả độc giả lẫn doanh thu quảng cáo duy trì hoạt động của họ.

Chính quyền Trump đã gửi đi những tín hiệu lẫn lộn về vấn đề này. Trong khi một số quan chức bày tỏ sự thông cảm với những lo ngại của các nhà xuất bản, những người khác lại thúc đẩy các chính sách ưu tiên phát triển AI hơn là thực thi bản quyền. Việc giải quyết các vụ việc như News Corp kiện Brave cuối cùng có thể phụ thuộc vào cách tòa án giải thích luật bản quyền hiện hành trong bối cảnh một ngành chưa tồn tại khi các luật đó được ban hành.

Hiện tại, vụ kiện ngược lại gửi đi một thông điệp rõ ràng: News Corp dự định theo đuổi mọi con đường có sẵn để bảo vệ nội dung của mình, từ các phòng thí nghiệm AI lớn nhất đến các công cụ tìm kiếm cung cấp dữ liệu cho họ.

---

Stay Ahead of AI

Get the latest AI news, analysis, and breakthroughs — all in one place.

Read more AI news →