뉴욕타임스 소송서 MS 내부 문건 공개…AI 학습 ‘노동 절도’ 평가

뉴욕타임스가 오픈AI와 마이크로소프트를 상대로 낸 저작권 소송의 법정 서류에서 AI 학습을 두고 ‘역사상 최대 노동 절도’라는 마이크로소프트 내부 평가가 공개됐다. 탐스하드웨어(Tom's Hardware)는 9월 20일 이 내용을 보도했다.

뉴욕타임스 소송서 드러난 내부 문건

뉴욕타임스는 2023년 말 오픈AI와 마이크로소프트가 자사 저작물을 허가 없이 AI 학습에 사용했다며 저작권 침해 소송을 제기했다. 소송은 약 3년이 지난 현재까지 진행 중인 것으로 전해졌으며, 뉴욕타임스 법률팀은 최근 법원에 약식판결을 요청하면서 피고 측 진술과 문건을 근거로 작성한 서면을 제출했다. 404미디어에 따르면 두 회사의 요청으로 관련 자료 상당수는 봉인되거나 일부가 삭제된 상태다.

서면에는 마이크로소프트 응용과학 부문 디렉터 브렌트 헤히트(Brent Hecht)가 2023년 1월 작성한 내부 메모가 인용됐다. 헤히트 디렉터는 수많은 사람이 대규모 언어 모델이 자신들의 작업물을 ‘빨아들이는’ 일을 전례 없는 규모의 놀라운 절도로 받아들일 것이라며 이를 ‘인류 역사상 가장 큰 노동 절도’라고 표현한 것으로 적혔다. 다른 마이크로소프트 문건에는 거의 누구도 자신이 만든 콘텐츠가 이런 방식으로 사용될 것을 의도하지 않았고, 사용 대가도 받지 못한다고 쓰였다. 회사 내부 자료는 또 코파일럿(Copilot)이 뉴욕타임스 기사로 연결되는 클릭률을 빙 검색보다 최대 93% 낮췄다고 분석했다.

헤히트는 별도 메모에서 이 현상을 ‘악순환’이라고 부르며, AI 서비스가 웹 콘텐츠 공급망을 약화하면 마이크로소프트 모델의 성능과 웹 전체가 동시에 타격을 받을 수 있다고 경고했다. 그는 최종 제품이 핵심 공급자의 경제적 기반을 위협하는 일은 매우 이례적이지만, 콘텐츠를 공급받아 작동하는 대규모 언어 모델 사업에서 바로 그런 상황이 만들어졌다고 적었다. 오픈AI의 챗GPT 책임자 닉 터리(Nick Turley)도 내부 소통에서 AI 챗봇이 출판사에 ‘존립을 위협하는 존재’라고 평가했다. 챗봇이 출판물을 대체하는 성격을 지녔고 성능이 좋아질수록 대체성이 커진다는 이유에서다.

공정 이용 항변에 미칠 영향

오픈AI 연구원은 링크를 아무리 눈에 띄게 배치해도 이용자가 클릭하지 않을 것이라고 증언한 것으로 나타났다. 또 연구원 닉 라이더(Nick Ryder)가 뉴욕타임스 유료벽을 우회하는 방법을 찾았다고 그레그 브록먼(Greg Brockman) 당시 오픈AI 사장에게 알렸고, 브록먼이 긍정적으로 반응했다는 내용도 서면에 포함됐다. 이런 자료는 AI 기업이 인터넷 자료를 학습에 활용하는 행위가 시장과 원저작자에게 미치는 영향을 인지하고 있었는지를 둘러싼 쟁점으로 이어질 수 있다.

AI 기업들은 인터넷 자료를 모델 학습에 활용하는 것이 공정 이용에 해당한다고 주장해 왔다. 공정 이용 판단에는 상업적 이용인지, 저작물의 성격은 무엇인지, 사용한 분량과 중요성이 어느 정도인지, 원저작물의 잠재 시장과 가치에 어떤 영향을 주는지 등이 고려된다. 앤트로픽(Anthropic)의 공개 저작물 활용을 공정 이용으로 본 법원 판단도 있었지만, 뉴욕타임스 서면에 담긴 이런 폭로는 두 회사 경영진이 시장 피해 가능성을 알고 있었다는 점에서 오픈AI의 공정 이용 항변을 복잡하게 만들 수 있다. 마이크로소프트 CEO 사티아 나델라(Satya Nadella)는 올해 증언에서 유료벽 뒤 콘텐츠는 학습이나 검색 보강에 쓰려는 누구나 허가를 받아야 하며, 오픈AI가 유료 콘텐츠를 학습에 사용했다는 사실을 알았다면 재학습을 요구했을 것이라고 말했다.

RELATED ARTICLES