핵심 요약
미국 유력 일간지 USA투데이와 계열 지역 신문들이 자사 기사 수십만 건을 허락 없이 인공지능(AI) 학습에 사용했다며 오픈AI를 상대로 2억5000만달러(약 3500억원)가 넘는 손해배상 소송을 제기했다. 미국 주요 언론사들이 AI 학습에 사용된 뉴스 콘텐츠의 저작권과 이용료를 둘러싸고 오픈AI를 상대로 법적 대응을 확대하고 있다.
로이터는 10월 8일 “USA투데이와 계열 신문사들이 자사 콘텐츠를 대규모 언어모델 학습에 무단 사용했다며 뉴욕 남부연방법원에 소송(USA Today Co. v. OpenAI Foundation, No. 1:26-cv-08892)을 제기했다”고 보도했다.
원고들은 “오픈AI가 저작권자의 허락 없이 신문 기사와 기타 콘텐츠를 복제하고 챗GPT를 구동하는 AI 모델 개발에 이용했다“고 주장했다.
19개 신문 콘텐츠 문제 삼아…저작권 정보 제거도 쟁점
블룸버그로는 이날 “원고들이 USA투데이를 비롯한 19개 신문에 실린 콘텐츠의 저작권을 보유하고 있으며, 오픈AI가 이를 무단으로 수집해 AI 모델 학습에 사용했다고 주장했다”고 보도했다. 원고에는 인디애나주 지역신문 인디애나폴리스 스타, 애리조나 리퍼블릭, 디트로이트 프리프레스 등이 포함된다.
원고 측은 “오픈AI가 방대한 뉴스 콘텐츠를 복제하는 과정에서 저작권자의 허락을 받지 않았으며, 학습된 콘텐츠가 AI 이용자에게 다시 제공되면서 신문사의 사업에도 피해가 발생했다“고 주장했다.
법률 전문매체 엠엘이엑스는 “USA투데이가 오픈AI의 웹사이트 콘텐츠 수집과 AI 출력물 재구성을 문제 삼았으며, 오픈AI의 내부 커뮤니케이션 자료도 근거로 제시했다”고 전했다.
이 사건에는 직접 저작권 침해뿐 아니라 대위책임에 따른 침해와 저작권 관리정보 제거 문제도 포함된 것으로 전해졌다.
저작권 관리정보는 저작자 이름, 저작권 표시, 이용 조건 등 저작물의 권리관계를 식별하는 정보다. 미국 디지털밀레니엄저작권법 제1202조는 일정한 요건에서 이러한 정보를 고의로 제거하거나 변경하는 행위를 금지한다.
원고 측은 손해배상 외에도 오픈AI의 저작권 침해 행위를 막는 법원 명령을 요구했다. 다만 청구액은 원고가 요구한 금액으로, 법원이 인정한 손해액은 아니다.
미 법무부는 오픈AI 지지
이번 소송은 미국 언론사들이 오픈AI와 마이크로소프트를 상대로 진행 중인 저작권 분쟁과 상당 부분 쟁점을 공유한다.
뉴욕타임스는 2023년 12월 오픈AI와 마이크로소프트를 상대로 저작권 침해 소송을 제기했다. AI 모델을 개발하는 과정에서 자사 기사를 무단 복제했고, 챗봇이 기사 내용을 재현하면서 뉴스 서비스 시장에 피해를 준다는 주장이다.
2026년 9월에는 시애틀타임스와 뉴스데이도 두 회사를 상대로 소송을 제기했다. 법률정보 플랫폼 저스티아에 따르면 시애틀타임스 대 오픈AI 사건(The Seattle Times Company et al. v. OpenAI Inc. et al., No. 1:26-cv-07644)은 9월 4일 뉴욕 남부연방법원에 접수됐다.
AI 기업들은 이 같은 분쟁에서 “저작권이 있는 자료를 학습에 활용하더라도 새로운 목적과 기능을 가진 시스템으로 변환하는 행위는 공정이용에 해당할 수 있다“고 주장해 왔다.
공정이용은 미국 저작권법 제107조에 규정된 원칙이다. 저작물의 이용 목적과 성격, 원저작물의 성질, 이용된 분량과 중요성, 원저작물의 잠재적 시장에 미치는 영향 등을 고려해 저작권자의 허락 없는 이용을 허용할 수 있다.
특히 미국 법무부가 최근 오픈AI 측의 공정이용 논리를 지지하면서 소송을 둘러싼 법적 논쟁도 확대됐다.
워싱턴포스트는 9월 2일 “트럼프 행정부가 대규모 언어모델의 학습 과정에서 저작권 자료를 이용하는 행위가 공정이용으로 보호될 수 있다는 오픈AI의 주장을 지지했다”고 보도했다.
뉴스 콘텐츠의 AI 학습과 재현, 별도 침해 여부도 다툼
언론사들이 제기한 소송에서는 AI 모델을 학습시키기 위해 기사를 복제한 행위와 학습 결과물이 이용자에게 제공되는 행위가 각각 문제 되고 있다.
학습 단계에서는 저작권자의 허락 없는 복제가 공정이용에 해당하는지가 핵심이다. 출력 단계에서는 AI가 기존 기사의 보호받는 표현을 어느 정도 재현했는지, 그 결과가 원래 뉴스 콘텐츠의 시장에 어떤 영향을 미치는지가 다뤄진다.
여기에 저작권 관리정보가 제거됐는지, 제거 행위가 저작권 침해를 유도하거나 은폐할 수 있다는 점을 피고가 알고 있었는지 등 별도의 법적 요건도 검토 대상이 된다.
오픈AI는 일부 언론사들과 콘텐츠 이용계약을 체결하는 한편, 다른 언론사들과는 저작권 소송을 진행하고 있다.
Q&A
Q1. AI 학습에 신문 기사를 사용하면 모두 저작권 침해인가?
그렇지는 않다. 미국 저작권법은 공정이용을 인정한다. 다만 저작물을 이용한 목적, 복제 규모, 원저작물의 시장에 미치는 영향 등에 따라 판단이 달라질 수 있다. AI 학습에 공정이용이 적용되는 범위는 여러 소송에서 다투고 있다.
Q2. 저작권 관리정보를 제거한 행위는 왜 별도 문제가 되는가?
미국 디지털밀레니엄저작권법 제1202조는 일정한 요건에서 저작권 관리정보의 고의적인 제거·변경을 금지한다. 단순히 정보가 누락됐다는 사실만으로 위반이 성립하는 것은 아니며, 법률이 정한 인식 요건 등도 충족해야 한다.
Q3. USA투데이 소송은 뉴욕타임스 소송과 같은 사건인가?
아니다. 두 소송은 별도로 제기됐다. 다만 AI 학습에 사용된 뉴스 콘텐츠의 무단 복제, 공정이용 항변, AI 출력물의 기사 재현 등 공통 쟁점을 포함하고 있다. 각각의 사건에서 제출된 증거와 법원의 판단은 구별해야 한다.