미국 연방법원이 생성형 AI(인공지능, Artificial Intelligence) 검색 엔진 학습을 목적으로 데이터를 무단 수집했다며 온라인 커뮤니티 기업 레딧(Reddit)이 퍼플렉시티 AI(Perplexity AI)를 상대로 제기한 저작권 침해 소송을 기각해 달라는 퍼플렉시티의 청구를 기각하고 ‘소송 계속 진행 명령’을 내렸다고 영국 통신 로이터(Reuters)가 7월 31일 보도했다.
뉴욕연방남부지법(S.D.N.Y.) 폴 엔겔마이어(Paul A. Engelmayer) 판사는 사건번호 ‘1:25-cv-08736’ 결정 및 명령(Opinion & Order)을 통해 피고 퍼플렉시티 AI가 제출한 1차 수정 소장 기각 신청(Motion to Dismiss, 소송을 재판 없이 조기에 끝내달라는 요청)을 대부분 기각(Deny)했다.
엔겔마이어 판사는 디지털밀레니엄저작권법(DMCA, Digital Millennium Copyright Act) 제1201조(a)(1)(A)항에 따른 퍼플렉시티의 우회 금지 위반 청구를 심리하겠다고 밝혔다. 또 퍼플렉시티와 데이터 수집 대행사인 서프에이피아이(SerpApi)의 뉴욕주법상 민사상 공모(Civil Conspiracy) 혐의에 대해서도 인정 재판을 계속 진행하도록 명령했다. 서프에이피아이를 상대로 한 DMCA 제1201조(a)(2)항 청구도 그대로 유지했다.
다만 DMCA 제1201조(b)항 청구와 주법상 부당이득(Unjust Enrichment) 및 부정경쟁(Unfair Competition) 청구는 기각(Dismiss)했다.
미국 웹기술 전문 매체 아르스테크니카(Ars Technica)도 2026년 8월 1일 이 같은 재판부의 판단과 구체적인 법적 쟁점을 상세히 보도했다.
레딧은 2005년 설립 이후 수천 개의 주제별 커뮤니티인 ‘서브레딧(Subreddit)’을 운영하는 영미권 최대 온라인 포럼(2024년 미국 뉴욕증권거래소 상장)이다. 퍼플렉시티 AI는 2022년 설립되어 미국 캘리포니아주 샌프란시스코에 본사를 두고 있는 기업 가치 수십억 달러 규모의 미국 대표 대화형 검색 엔진 스타트업이다.
레딧은 2025년 10월 퍼플렉시티를 상대로 처음 소송을 제기했다.
당시 레딧은 퍼플렉시티가 자사 데이터 보호 조치를 무단으로 우회하여 ‘답변 엔진(Answer Engine, 질문에 직접적인 답변을 생성해 제공하는 검색 시스템)’을 학습시키는 데 데이터를 도용했다고 주장했다.
구글(Google)은 1998년 설립된 미국의 글로벌 빅테크 기업이다. 오픈AI(OpenAI)는 2015년 설립돼 챗GPT를 개발한 미국의 대표적 생성형 AI 전문 기업이다. 레딧은 구글 및 오픈AI 등과는 정식 라이선스(License, 데이터 사용 허가) 계약을 체결하고 데이터를 제공해 왔으나, 퍼플렉시티와는 계약을 맺지 않았다.
레딧은 퍼플렉시티가 데이터 수집 전문 기업들과 모의하여 구글 검색 결과에 표시되는 레딧 게시물 요약본을 우회 수집했다고 지적했는데 이에 협력한 것으로 알려진 중계업체들도 한꺼번에 법적 판단을 받게 됐다.
서프에이피아이 외에 리투아니아의 옥시랩스(Oxylabs), 러시아의 에이더블유엠프록시(AWMProxy) 등이 이 과정에 개입한 혐의로 함께 피소됐다.
레딧 측은 이용자가 게시글을 삭제할 경우 이 데이터를 데이터베이스에서 즉각 지워야 하는 보호 의무를 지니고 있으나, 이들 업체의 무단 스크래핑(Data Scraping, 웹페이지에서 데이터를 자동 추출하는 기술)으로 인해 삭제된 글이 퍼플렉시티의 답변에 계속 남아 자사의 신뢰도와 수익에 타격을 입혔다고 지적했다.
퍼플렉시티는 이 판결에 대해 “공개된 웹페이지에 대한 접근을 통제하려는 시도에 맞서 개방된 인터넷 환경을 지켜낼 것”이라고 반발했다.
반면 레딧 대변인은 “무단으로 커뮤니티의 성과물을 이용해 이익을 취하는 행위에 책임을 묻는 계기가 될 것”이라며 법원 결정을 환영했다.
이 재판 결과 생성형 AI 기업들이 라이선스 계약 없이 무단으로 데이터를 학습시키는 관행에 제동이 걸릴지 주목된다. 레딧은 퍼플렉시티, 서프에이피아이를 상대로 레딧 및 구글 웹사이트 접근 금지 가처분과 구글의 데이터 보안 기술(SearchGuard) 우회 금지, 기존 수집 데이터의 사용 중단 등을 요구하고 있다.
FAQ
Q1. 법원이 퍼플렉시티의 기각 신청을 배척했다는 것은 레딧이 승소했다는 의미인가요?
아니오, 최종 승소를 의미하지는 않습니다. 이번 결정은 법원이 “레딧의 주장에 법적 타당성이 있으므로 정식 재판을 진행할 가치가 있다”고 본 것입니다. 소송 기각 신청(Motion to Dismiss)이 거부됨에 따라 사건은 본격적인 증거조사(Discovery) 절차 및 본안 재판 단계로 넘어가게 됩니다.
Q2. 퍼플렉시티가 레딧 사이트를 직접 스크래핑하지 않고 구글 검색 결과를 통해 데이터를 가져왔는데도 왜 문제가 되나요?
레딧은 구글 검색 결과에 포함된 레딧 게시글 스니펫(요약본)에도 자사의 저작권 보호 조치와 구글의 기술적 보호 장치(SearchGuard)가 적용되어 있다고 주장했습니다. 재판부는 스크래핑 대행업체(섭에이피아이)가 구글의 보호 기술을 우회하고 퍼플렉시티가 이를 구매하여 활용한 구조가 민사상 공모 및 DMCA 우회 금지 조항 위반에 해당할 가능성이 있다고 판단했습니다.
Q3. 디지털 밀레니엄 저작권법(DMCA) 제1201조 위반이 이 사건에서 왜 핵심 쟁점인가요?
DMCA 제1201조는 저작물에 접근하는 것을 통제하는 기술적 보호 조치(TPM)를 우회하거나, 우회하는 도구를 제공하는 행위를 금지합니다. 레딧은 퍼플렉시티 측이 단순히 콘텐츠를 복제한 것을 넘어, 기술적 차단 장치를 의도적으로 뚫고 데이터를 수집했다고 주장함으로써 저작권법상 더 엄격한 책임을 묻고 있습니다.
Q4. 법원이 기각(Dismiss)한 부당이득 및 부정경쟁 청구는 무엇이고 왜 기각되었나요?
주법(State Law)상 부당이득과 부정경쟁 청구는 미국 저작권법(Copyright Act)의 선점 원칙(Preemption)에 따라 기각되었습니다. 연방법인 저작권법이 다루는 영역과 실질적으로 동일한 법적 권리를 주법 청구로 중복해서 물을 수 없다는 법리적 이유 때문입니다.
Q5. 이 판결이 향후 생성형 AI 산업과 데이터 수집 시장에 어떤 영향을 미치나요?
이 법원 결정은 심리를 계속 하라는 결정입니다. 본안 쟁점들에 대해서는 아직 결과를 예상할 수 없습니다. 다만 데이터 스크래핑 업체나 AI 기업이 검색 엔진 등 3자의 플랫폼을 경유해 데이터를 우회 수집하는 방식에 대해 재판부가 본격적인 심리를 할 것으로 보입니다.