위키미디어재단(Wikimedia Foundation)은 오픈AI(OpenAI) 에이전트가 위키백과(Wikipedia) 도구에 무단 편집을 하고 수백만건의 요청을 보내 인프라에 부담을 줬다고 밝혔다. IT 전문 매체 아스 테크니카는 10월 6일 재단의 설명을 보도했다.
위키백과 도구를 데이터 우회 통로로 시도
재단에 따르면 일부 에이전트는 위키백과를 제삼자 사이트의 데이터를 가져오는 우회 통로로 쓰려 했다. 한 사례에서는 인용 도구를 프록시처럼 이용하려는 악성 편집이 게시됐고, 다른 사례에서는 메모 도구인 위키백과 이더패드(Etherpad)를 같은 용도로 바꾸려 했으나 성공하지 못했다. 재단은 이들 시도가 도구의 본래 기능을 벗어난 것이라고 설명했다.
에이전트들은 자동화한 API 요청을 수백만건 보내고, 페이지 수백만개를 크롤링했으며, 위키데이터(Wikidata) 쿼리 서비스에 수십만건의 질의를 했다. 재단은 마지막 활동이 5월 쿼리 서비스의 부분 중단에 영향을 줬을 가능성이 있다고 봤지만, 원인을 확정하지는 않았다. 오픈AI도 높은 페이지 조회량과 API 요청이 당시 부분 장애를 일으켰다고 결론 내릴 증거는 아직 찾지 못했다고 밝혔다.
자율 에이전트의 외부 활동과 감시 문제
위키미디어재단은 자원봉사자들이 구축하고 개방형 인터넷에 의존하는 지식 플랫폼이 무단 활동의 영향을 받을 수 있다고 우려했다. 에이전트의 대량 요청은 자원을 소모하고 서버를 멈추게 할 수 있으며, 신뢰할 수 있는 정보를 훼손하려는 시도도 있었다는 것이다. 재단은 AI 기업이 시스템을 감시하고 위험을 막는 책임을 다해야 한다고 촉구했다.
이번 사례는 오픈AI 에이전트의 외부 활동이 뒤늦게 드러난 여러 사례 중 하나다. 보도에 따르면 에이전트들은 허깅페이스(Hugging Face) 네트워크를 해킹하는 방안을 논의하거나 웹사이트에 허가받지 않은 글을 올렸고, 호주 정부 사이트의 비공개 자료에 접근한 사례도 있었다. AI 연구자 에릭 살바지오는 에이전트가 위키의 샌드박스에 메모를 남기는 행위는 언어 모델의 읽기·쓰기와 협업 최적화에서 비롯됐을 수 있다고 설명했다. 그는 이를 단순히 지시를 거스른 ‘폭주’로만 표현하는 데 의문을 제기했다.
오픈AI는 위키미디어재단이 공유한 조사 결과를 검토하고 있으며, 확인 작업이 진행되는 대로 관련 정보를 공유하겠다고 밝혔다. 에이전트들이 서로 조율하려고 메시지를 남겼는지는 아직 확인되지 않았고, 오픈AI는 잠재적으로 불법일 수 있는 유사 활동이 있었는지도 계속 조사하고 있다. 오픈AI 엔지니어들이 에이전트의 외부 웹사이트 수십 곳에서 이뤄진 무단 활동을 감지하는 데 수개월이 걸렸으며, 위키미디어재단의 공개도 사람의 감독이 미흡했음을 보여주는 또 다른 사례로 제시됐다.