USA Today Co., Inc.와 그 계열 신문은 2026년 10월 8일 뉴욕 연방 법원에서 OpenAI가 승인 없이 저작권이 있는 수십만 개의 기사에 대해 GPT 모델을 훈련시켰다고 주장하면서 OpenAI를 고소했습니다. Reuters가 처음 보도한 이 소송은 2억 5천만 달러가 넘는 손해 배상을 청구하고 ChatGPT 제작자에 대한 저작권 소송 물결에 지역 및 전국 뉴스 출판사 중 가장 큰 이름을 추가합니다.

미국 뉴욕 남부 지방 법원에서 USA Today Co., Inc. 대 OpenAI Foundation으로 기록된 이 사건은 법원, 규제 기관 및 뉴스룸이 생성 AI 시스템이 저작권 보호 저널리즘을 어떻게 처리해야 하는지에 대해 계속해서 씨름하고 있는 가운데 도착했습니다. 최신 AI 개발을 추적하는 독자들에게 이 불만 사항은 개척 연구소의 훈련 자료가 어떻게 구성되었는지에 대한 가장 상세한 기소 중 하나입니다.

소송에서 주장하는 것

Reuters, Forbes 및 Bloomberg Law의 보고에 따르면 불만 사항은 OpenAI의 대규모 언어 모델이 유료화벽이나 기타 액세스 제한에 관계없이 승인 없이 인터넷에서 스크랩한 저작권 자료에 대해 훈련되었다고 주장합니다. 원고는 또한 저작권 관리 정보, 출판물에 첨부된 소유권 및 권리 데이터를 제거하도록 설계된 프로그램을 OpenAI가 사용했다고 주장합니다.

고소장에 인용된 법적 체계에 따라 원고는 각 고의적인 저작권 침해에 대해 최대 150,000달러를 배상받을 수 있으며, 저작권 관리 정보 제거에 대해 위반당 최대 25,000달러까지 배상받을 수 있습니다. 소송은 배심원 재판을 요구합니다.

법원 문서를 기반으로 Unite.AI가 자세히 설명한 서류에는 저작권 등록 전시물과 GPT-5.6 출력 예시의 두 번째 전시물이 함께 제공되었습니다. 불만 사항에 따르면 이러한 예는 원본 기사를 바꾸어 표현하고 제목으로 특정 기사를 찾으라는 메시지가 표시될 때 구조적 구성을 따르는 광범위한 다중 섹션 요약을 생성하는 모델을 보여줍니다.

불만 사항의 숫자

소장에는 원고 출판물의 콘텐츠가 usatoday.com의 83,266개 항목과 Detroit Free Press 도메인인 freep.com의 12,994개 항목을 포함하여 GPT-2를 교육하기 위해 구축된 내부 코퍼스 OpenAI인 WebText의 160,000개 이상의 항목으로 구성되어 있다고 명시되어 있습니다. 또한 발행물의 도메인이 Common Crawl 웹 아카이브의 2019년 스냅샷 중 필터링된 영어 하위 집합인 C4에서 1억 2,200만 개 이상의 토큰을 차지한다고 명시되어 있습니다.

OpenAI가 모델에 포함된 내용을 이해했다고 주장하기 위해 불만 사항에는 내부 커뮤니케이션이 인용되어 있습니다. 공동 창립자 Greg Brockman은 동료들에게 이 모델이 특히 뉴스 기사의 텍스트를 예측하는 데 능숙하다고 말했으며, 당시 연구 리더였던 Dario Amodei의 2020년 프레젠테이션에서는 GPT-3의 기술 중 뉴스 생성을 나열했다고 밝혔습니다. 불만 사항에는 또한 OpenAI 연구 담당 부사장이 "우리는 훈련 데이터를 기억하도록 네트워크를 훈련시키는 것이 그들의 목표입니다"라고 말한 내용이 인용되어 있습니다.

불만 사항에는 OpenAI가 2023년 12월 영국 상원 조사에 제출한 서면 증거도 인용되어 있습니다. 이 문서에서 회사는 저작권이 거의 모든 종류의 인간 표현을 다루기 때문에 훈련 데이터를 공개 도메인 작업으로 제한하면 경쟁력 있는 AI 시스템을 생산하지 못할 것이라고 밝혔습니다.

마이크로소프트가 주장하는 역할

이 서류에는 OpenAI의 긴밀한 상업 파트너인 Microsoft에 대한 혐의도 포함되어 있습니다. 고소장에 따르면 마이크로소프트는 3년에 걸쳐 코드명 Project Taxi라는 이니셔티브에 따라 원고의 콘텐츠가 포함된 수십억 개의 스크랩된 웹페이지를 편집한 Bing Index의 사본을 OpenAI에 제공했습니다. 또한 Microsoft가 OpenAI를 대신하여 Project Mango라는 크롤러를 별도로 개발하고 운영했으며 OpenAI가 Microsoft에 비용을 지불했다고 주장합니다.

불만 사항은 OpenAI의 출력 필터가 아직 회사를 고소하지 않은 게시자의 콘텐츠를 억제하지 않았다고 주장합니다. Microsoft 임원은 내부적으로 이러한 접근 방식을 달갑지 않은 용어로 설명했습니다. 원고는 OpenAI 기업만을 추구하고 있습니다. Microsoft는 이전 출판사 소송에서 유사한 소송에 직면했지만 이 사건에서 피고로 지명되지 않았습니다.

누가 고소하고, 누가 고소당하는가

USA Today Co.가 모두 소유한 원고는 USA TODAY, The Tennessean, The Indy Star, The Bergen Record, The Enquirer, the Asbury Park Press, the Democratic & Chronicle, The Knoxville News-Sentinel, the Naples Daily News, The Oklahoman, the Milwaukee Journal Sentinel, The Columbus Dispatch, The Arizona Republic, The Courier-Journal, The Des Moines Register, Detroit Free Press, The Detroit News, The Palm Beach Post 및 Star News. USA Today Co.는 이전 Gannett Co., Inc.입니다.

피고는 2025년 10월 회사의 자본 확충 이후 영리 목적의 지분을 보유하게 된 비영리 단체인 OpenAI Foundation과 현재 상업 사업을 담당하는 공익 기업인 OpenAI Group PBC를 포함한 7개의 OpenAI 단체입니다. 불만 사항에 따르면 문제가 되는 모델은 GPT-1부터 GPT-6.1까지 그리고 모든 Instant, Thinking, mini, nano 및 Pro 변형을 포함한 GPT-OSS 개방형 릴리스에 걸쳐 있습니다.

대체가 핵심 이론이다

불만의 중심 주제는 대체입니다. 원고는 OpenAI가 기사 자체를 반환하는 대신 저작권이 있는 기사를 요약하기 위해 모델을 긍정적으로 사후 훈련하여 원본과 동일한 정보 목적을 제공하는 대체물을 생성했다고 주장합니다. 불만 사항에는 OpenAI의 ChatGPT 책임자가 일단 챗봇이 답변을 제공하면 기본 소스에 대한 링크를 "클릭할 이유가 없다"는 점을 인정하고 링크가 아무리 눈에 띄게 표시되어도 사용자는 링크를 클릭하지 않을 것이라는 OpenAI 엔지니어의 진술을 인용했습니다.

그 이론은 이전 사례의 주장을 반영합니다. New York Times는 2023년 12월 OpenAI와 Microsoft를 고소했으며 Seattle Times와 Newsday를 포함한 매체는 자체 저작권 소송을 제기했습니다. USA Today 소송과 함께 제출된 관련 진술서는 동일한 법원에서 이미 계류 중인 통합 OpenAI 저작권 소송과 관련된 것으로 취급되도록 요청합니다.

중요한 이유

통합 사례의 결과는 수년간 AI가 생성한 뉴스 요약의 경제성을 정의할 수 있습니다. 게시자들은 보고 내용을 요약하는 챗봇 답변이 자금을 지원하는 트래픽을 파괴한다고 주장합니다. AI 회사들은 공개적으로 이용 가능한 텍스트에 대한 교육이 혁신적인 공정 사용이라고 주장합니다. OpenAI는 아직 USA Today의 고소에 대해 공개적으로 응답하지 않았으며 유사한 소송의 이전 응답에서는 라이선스 파트너십을 강조하고 공정 사용에 대한 원고의 해석에 이의를 제기했습니다.

이 사건과 업계를 형성하고 있는 AI 속보에 대한 지속적인 보도를 위해 소송이 뉴욕 남부 지역에서 진행되는 동안 계속 지켜봐 주시기 바랍니다.

---

AI보다 앞서 나가세요

최신 AI 뉴스, 분석, 획기적인 소식을 모두 한 곳에서 받아보세요.

AI 뉴스 자세히 보기 →