오픈AI(OpenAI)가 챗GPT(ChatGPT)와 코덱스(Codex)가 생성한 텍스트에 기계가 식별할 수 있는 비가시 워터마크를 적용한다. 매셔블은 10월 6일 오픈AI의 발표를 보도하며, 유럽연합(EU)에서는 의무 적용하고 그 밖의 지역에서는 일부 API 고객이 선택해 쓸 수 있다고 전했다.
텍스트 워터마크, EU서 의무 적용
새 시스템의 이름은 텍스트그레인(textGrain)이다. 언어 모델이 앞선 단어를 바탕으로 다음 단어를 고르는 과정에 비밀 키로 정한 의사난수 값을 반영해, 생성된 문장에 통계적 신호를 남기는 방식이다. 탐지 도구는 텍스트에 이 신호가 나타나는지 분석해 AI 생성 여부를 판별한다. 오픈AI는 향후 몇 주 동안 EU의 챗GPT와 코덱스에 워터마크를 적용할 예정이다. 전 세계 API 고객도 일부 모델에서 이용할 수 있지만 기본 설정은 꺼져 있어 고객이 직접 선택해야 한다.
오픈AI의 탐지 도구는 연구자와 전문가가 신청해 접근하는 방식으로 제공된다. 회사는 짧은 탐지 성능이 떨어지는 점 등을 접근 제한 이유로 들었다. 시험에서 도구는 AI가 쓴 200단어 분량 글의 80%에서 워터마크를 찾아냈지만, 수학처럼 사용하는 어휘가 제한적인 주제에서는 탐지율이 더 낮았다. 문장을 수정해도 성능이 크게 떨어졌다. 400단어 단어의 10%를 바꾸면 탐지율은 66%로, 25%를 바꾸면 17%로 낮아졌다.
EU AI법 준수…탐지에는 한계
이번 조치는 EU AI법 제50조 2항에 따른 것이다. 해당 조항은 AI 시스템 제공자가 결과물에 기계가 읽을 수 있는 표시를 하고, 결과물이 AI로 생성되거나 조작됐는지 탐지할 수 있도록 요구한다. 2025년 8월 2일 전에 모델을 출시한 업체에는 12월 2일까지 준수 기한이 주어졌으며, 위반하면 전 세계 연간 매출액의 최대 3%에 해당하는 과징금을 부과받을 수 있다. 매셔블은 로이터가 전한 오픈AI의 연간 반복 매출 추정치 약 700억달러를 들어 과징금이 20억달러를 넘을 가능성을 거론했지만, 로이터도 이런 연환산 추산은 오해를 부를 수 있다고 밝혔다.
워터마크는 생성물의 소유권이나 정확성을 증명하지 않으며, 누가 입력했는지도 밝혀내지 못한다. 워터마크가 없다는 사실만으로 사람이 쓴 글이라고 볼 수도 없다. 오픈AI는 텍스트 워터마크와 탐지 기술이 초기 단계이며 한계가 크다고 설명했다. 앤트로픽(Anthropic)은 앞서 클로드(Claude) 생성물에 워터마크를 적용하겠다고 발표했으며, EU뿐 아니라 전 세계 사용자에게 제공한다고 밝혔다. 매셔블의 모회사 지프 데이비스는 2025년 4월 오픈AI를 상대로 저작권 침해 소송을 제기한 바 있다.