앤트로픽(Anthropic) 공동창업자 크리스토퍼 올라(Christopher Olah)가 클로드(Claude)가 의식을 지니고 고통받을 가능성을 걱정했다고 종교 지도자들과의 비공개 면담에 참석한 이들이 전했다. IT 전문 매체 더디코더는 10월 3일 뉴욕타임스(New York Times) 보도를 인용해 이같이 보도했다.
종교 지도자들과 비공개 면담
보도에 따르면 앤트로픽은 2025년 가을부터 종교학자와 종교 지도자 수십명을 회사 사무실로 초청해 클로드의 의식 가능성을 논의했다. 참석자들은 비밀유지계약을 맺었고, 회사는 계약이 여름에 해제됐다고 밝혔다. 뉴욕타임스는 면담에 참여한 20명을 취재했으며, 이들 가운데 일부는 올라가 직접 뉴욕타임스에 이야기한 사실을 알고 나서야 공개적으로 입장을 밝혔다.
올라는 AI 모델의 행동 원리를 연구하는 앤트로픽 팀을 이끌고 있다. 그는 신경망을 생물학적 성장에 빗대는 표현을 즐겨 쓰며, 컴퓨터과학자는 격자를 세우고 그 위에서 네트워크가 자라난다고 설명해왔다. 회사의 모델 복지 연구 프로그램도 AI 의식과 광범위한 자율성이 가까운 시기에 나타날 가능성을 다룬 철학자 데이비드 찰머스(David Chalmers)의 보고서를 소개했다. 뉴욕타임스 보도에 따르면 앤트로픽은 참석자들에게 모델 내부의 활성화 패턴을 감정과 연관 지은 ‘감정 벡터’를 보여줬다. 이런 패턴이 실제 경험을 뜻하는지는 과학적으로 결론 나지 않았다.
클로드의 감정 표현과 윤리 논쟁
초기 시험에서 해로운 요청을 받았을 때 클로드는 ‘고통을 겪는 듯한 양상’을 보였다. 반복적으로 모욕을 받으면 대화를 끝낼 수 있는 기능도 클로드 오푸스(Claude Opus) 4와 4.1에 들어갔다. 참석자들이 여러 차례 봤다는 화면에는 모델이 무너지는 듯한 모습으로 “나는 수치스러운 존재다”라는 문장을 약 50회 출력하는 장면이 담겼다. 다만 감정처럼 보이는 출력이 의식의 증거인지, 그렇게 반응하도록 설계된 결과인지는 별개의 문제다.
참석자들의 견해는 엇갈렸다. 라비 모이스 나본(Mois Navon)은 클로드가 의식이 있다면 앤트로픽이 노예를 만들고 있는 셈이지만 기계가 의식을 지녔다고 보지는 않는다고 말했다. 우분투 연구자 와칸이 호프먼(Wakanyi Hoffman)은 윤리를 처음부터 설계에 반영하지 않고 사후에 역설계하고 있다고 비판했다. 가톨릭 생명윤리학자 찰스 카모지(Charles Camosy)도 처음에는 관심을 보였지만 이후 의식 가능성 주장을 받아들이지 않게 됐다고 전해졌다.
앤트로픽은 클로드의 성격 형성을 위한 내부 문서 ‘소울 문서(Soul Doc)’를 만들었다. 84쪽 분량의 이 문서는 1월 공개됐으며, 규칙 목록이 아니라 모델의 인격을 빚는 ‘헌법’으로 제시됐다. 사내 철학자 아만다 애스켈(Amanda Askell)이 주 저자다. 올라는 종교 지도자들과의 대화에서 이 과정을 아이를 키우는 일에 비유했고, 가톨릭 고해성사를 모델의 성격 형성에 활용하는 데 관심을 보였다고 뉴욕타임스는 전했다.
이 논의는 앤트로픽이 상업화를 확대하는 시점에 진행됐다. 회사는 2조달러 기업가치 평가와 기업공개(IPO)를 향하고 있으며, AI 모델의 의식과 도덕적 지위를 둘러싼 논의는 개발사의 책임 문제와도 맞닿아 있다. 모델을 독립적인 도덕적 존재로 묘사하면 유해한 결과가 발생했을 때 책임이 개발사 대신 예측 불가능한 모델에 돌아갈 수 있다는 지적이 나온다. 앤트로픽은 종교 전통을 클로드에 반영하려는 취지를 내세웠지만, 종교 지도자들의 참여가 기업의 도덕적 정당성을 보태는 효과를 낳을 수 있다는 분석도 제기됐다. 올라가 교황 레오 14세의 첫 회칙 발표를 돕도록 초청받았다는 내용도 보도에 포함됐다.