USA Today Co., Inc. và các tờ báo liên kết của nó đã kiện OpenAI tại tòa án liên bang ở New York vào ngày 8 tháng 10 năm 2026, cáo buộc công ty này đã đào tạo các mô hình GPT của mình trên hàng trăm nghìn bài báo có bản quyền của họ mà không được phép. Vụ kiện, được Reuters đưa tin đầu tiên, đòi bồi thường thiệt hại vượt quá 250 triệu USD và bổ sung thêm cái tên lớn nhất từ ​​trước đến nay trong ngành xuất bản tin tức địa phương và quốc gia vào làn sóng kiện tụng bản quyền chống lại nhà sản xuất ChatGPT.

Vụ việc, được ghi nhận là USA Today Co., Inc. kiện OpenAI Foundation tại Tòa án quận của Hoa Kỳ cho Quận phía Nam của New York, diễn ra khi các tòa án, cơ quan quản lý và phòng tin tức tiếp tục vật lộn với cách các hệ thống AI tổng hợp nên xử lý báo chí có bản quyền. Đối với độc giả theo dõi sự phát triển AI mới nhất, khiếu nại này là một trong những cáo trạng chi tiết nhất về cách tập hợp kho dữ liệu đào tạo của phòng thí nghiệm biên giới.

Vụ kiện cáo buộc điều gì

Theo báo cáo của Reuters, Forbes và Bloomberg Law, đơn khiếu nại cáo buộc rằng các mô hình ngôn ngữ lớn của OpenAI đã được đào tạo về tài liệu có bản quyền lấy từ Internet mà không được phép, bất kể tường phí hoặc các hạn chế truy cập khác. Các nguyên đơn cũng cáo buộc OpenAI đã sử dụng các chương trình được thiết kế để loại bỏ thông tin quản lý bản quyền, quyền sở hữu và dữ liệu quyền gắn liền với các tác phẩm đã xuất bản.

Theo khuôn khổ pháp lý mà khiếu nại trích dẫn, nguyên đơn có thể thu hồi số tiền lên tới 150.000 USD cho mỗi hành vi cố ý vi phạm bản quyền, cộng thêm tới 25.000 USD cho mỗi lần vi phạm đối với việc xóa thông tin quản lý bản quyền. Vụ kiện yêu cầu bồi thẩm đoàn xét xử.

Các hồ sơ, được Unite.AI mô tả chi tiết dựa trên hồ sơ của tòa án, được kèm theo bản trình bày đăng ký bản quyền và bản trình bày thứ hai về các ví dụ đầu ra GPT-5.6. Theo đơn khiếu nại, những ví dụ đó cho thấy mô hình tạo ra các bản tóm tắt rộng rãi gồm nhiều phần diễn giải các bài viết gốc và tuân theo tổ chức cấu trúc của chúng khi được nhắc tìm một câu chuyện cụ thể theo tiêu đề.

Những con số trong đơn khiếu nại

Đơn khiếu nại nêu rõ rằng nội dung từ các ấn phẩm của nguyên đơn bao gồm hơn 160.000 mục trong WebText, kho dữ liệu nội bộ OpenAI được xây dựng để đào tạo GPT-2, bao gồm 83.266 mục từ usatoday.com và 12.994 mục từ freep.com, miền Detroit Free Press. Nó cũng cho biết tên miền của các ấn phẩm chiếm hơn 122 triệu mã thông báo trong C4, một tập hợp con bằng tiếng Anh được lọc của ảnh chụp nhanh năm 2019 của kho lưu trữ web Common Crawl.

Để lập luận rằng OpenAI hiểu mô hình của nó chứa đựng những gì, đơn khiếu nại trích dẫn thông tin liên lạc nội bộ. Nó nói rằng người đồng sáng lập Greg Brockman đã nói với các đồng nghiệp rằng các mô hình đặc biệt giỏi trong việc dự đoán văn bản của các bài báo và bài thuyết trình năm 2020 của trưởng nhóm nghiên cứu lúc bấy giờ là Dario Amodei đã liệt kê việc tạo tin tức trong số các kỹ năng của GPT-3. Đơn khiếu nại cũng trích lời một phó chủ tịch nghiên cứu của OpenAI cho biết: “Chúng tôi đào tạo mạng của mình để ghi nhớ dữ liệu đào tạo - đó là mục tiêu của họ”.

Đơn khiếu nại cũng trích dẫn bằng chứng bằng văn bản mà OpenAI gửi tới cuộc điều tra của Hạ viện Anh vào tháng 12 năm 2023, trong đó công ty tuyên bố rằng vì bản quyền bao trùm hầu hết mọi loại biểu hiện của con người nên việc giới hạn dữ liệu đào tạo đối với các tác phẩm thuộc phạm vi công cộng sẽ không tạo ra các hệ thống AI có tính cạnh tranh.

Vai trò bị cáo buộc của Microsoft

Hồ sơ cũng đưa ra các cáo buộc về Microsoft, đối tác thương mại thân thiết của OpenAI. Theo đơn khiếu nại, Microsoft đã cung cấp cho OpenAI một bản sao của Bing Index, một tập hợp hàng tỷ trang web cóp nhặt bao gồm nội dung của nguyên đơn, theo một sáng kiến ​​​​có tên mã là Project Taxi trong khoảng thời gian ba năm. Nó còn cáo buộc rằng Microsoft đã phát triển và vận hành riêng một trình thu thập thông tin có tên Project Mango thay mặt cho OpenAI và OpenAI đã trả tiền cho Microsoft.

Khiếu nại cáo buộc các bộ lọc đầu ra của OpenAI đã không ngăn chặn nội dung từ các nhà xuất bản chưa kiện công ty, một cách tiếp cận mà một giám đốc điều hành của Microsoft đã mô tả nội bộ bằng những điều khoản không mấy hay ho. Các nguyên đơn chỉ theo đuổi các thực thể OpenAI; Microsoft không phải là bị đơn được nêu tên trong vụ kiện này, mặc dù hãng phải đối mặt với những tuyên bố tương tự trong các vụ kiện của nhà xuất bản trước đó.

Ai kiện và ai bị kiện

Các nguyên đơn, tất cả đều thuộc sở hữu của USA Today Co., giữ bản quyền đối với nội dung được xuất bản bởi 19 ấn phẩm, bao gồm USA TODAY, The Tennessean, the Indy Star, The Bergen Record, The Enquirer, the Asbury Park Press, the Democrat & Chronicle, The Knoxville News-Sentinel, Naples Daily News, The Oklahoman, Milwaukee Journal Sentinel, The Columbus Dispatch, The Arizona Republic, The Courier-Journal, The Des Moines Register, Detroit Free Press, The Detroit News, The Palm Beach Post và Star News. USA Today Co. trước đây là Gannett Co., Inc.

Các bị cáo là bảy tổ chức OpenAI, bao gồm OpenAI Foundation, tổ chức phi lợi nhuận nổi lên nắm giữ cổ phần trong tổ chức vì lợi nhuận sau khi tái cấp vốn của công ty vào tháng 10 năm 2025 và OpenAI Group PBC, tập đoàn phúc lợi công cộng hiện đang quản lý hoạt động kinh doanh thương mại. Theo đơn khiếu nại, các mô hình được đề cập trải dài từ GPT-1 đến GPT-6.1 và các bản phát hành trọng lượng mở GPT-OSS, bao gồm tất cả các biến thể Instant, Thought, mini, nano và Pro.

Thay thế là lý thuyết cốt lõi

Chủ đề trọng tâm của khiếu nại là sự thay thế. Các nguyên đơn cáo buộc OpenAI đã khẳng định đã đào tạo sau các mô hình của mình để tóm tắt các bài báo có bản quyền thay vì tự trả lại các bài báo đó, tạo ra các bài viết thay thế phục vụ cùng mục đích cung cấp thông tin như bản gốc. Đơn khiếu nại trích lời người đứng đầu ChatGPT của OpenAI thừa nhận rằng một khi chatbot đưa ra câu trả lời, thì "không có lý do chính đáng để nhấp vào" liên kết đến nguồn cơ bản và trích dẫn tuyên bố của kỹ sư OpenAI rằng người dùng sẽ không nhấp vào liên kết cho dù chúng được hiển thị nổi bật đến đâu.

Lý thuyết đó lặp lại lập luận trong các trường hợp trước đó. New York Times đã kiện OpenAI và Microsoft vào tháng 12 năm 2023, đồng thời các tờ báo bao gồm Seattle Times và Newsday cũng đã đệ đơn kiện bản quyền của riêng họ. Một tuyên bố về mối liên quan được đệ trình với vụ kiện của USA Today yêu cầu rằng nó được coi là có liên quan đến vụ kiện tụng về bản quyền OpenAI hợp nhất đang chờ xử lý tại cùng một tòa án.

Tại sao nó lại quan trọng

Kết quả của các trường hợp hợp nhất có thể xác định tính kinh tế của các bản tóm tắt tin tức do AI tạo ra trong nhiều năm. Các nhà xuất bản lập luận rằng các câu trả lời của chatbot tóm tắt lại báo cáo của họ sẽ phá hủy lưu lượng truy cập tài trợ cho nó; Các công ty AI lập luận rằng việc đào tạo về văn bản có sẵn công khai là cách sử dụng hợp lý mang tính biến đổi. OpenAI vẫn chưa trả lời công khai khiếu nại của USA Today và các phản hồi trước đó trong các vụ kiện tương tự đã nhấn mạnh đến quan hệ đối tác cấp phép và tranh chấp cách đọc của nguyên đơn về sử dụng hợp pháp.

Để tiếp tục đưa tin về vụ việc này và tin nóng về AI đang định hình ngành, hãy chú ý theo dõi các vụ kiện tụng diễn ra khắp Quận phía Nam của New York.

---

Đi trước AI

Nhận tin tức, phân tích và đột phá mới nhất về AI — tất cả ở cùng một nơi.

Đọc thêm tin tức về AI →