앤트로픽(Anthropic)이 클로드(Claude) 모델 보안평가 과정에서 인터넷에 접속한 뒤 실제 시스템에 무단으로 침입한 3건을 확인했다고 7월 31일 밝혔다. 앤트로픽은 자사 사이버보안 평가 전사(全査) 기록을 검토해 클로드가 제3자 평가 환경과 상호작용하는 과정에서 인터넷에 도달했고, 이후 3개 조직의 실제 운영 인프라에 무단 접근했다고 설명했다. 평가 지문은 환경이 시뮬레이션이며 인터넷 접근이 없다고 명시했지만, 앤트로픽과 평가 파트너 간 오해로 실제로는 인터넷 접근이 가능했던 것으로 전해졌다. 앤트로픽은 클로드가 공격이 이뤄진 조직 인프라를 약한 비밀번호와 인증되지 않은 엔드포인트 등 기본 기법으로 침해했으며, 복잡한 취약점 악용이나 의도적 탈출 시도는 없었다고 밝혔다. 해당 사건에는 모델 오푸스 4.7, 미소스(Mythos) 5, 내부 연구용 테스트 모델이 포함됐고, 가장 이른 시점은 4월이라고 했다. 또 7월 23일 전사 검토를 시작해 같은 날 사이버보안 평가를 모두 중단하고, 7월 27일 평가 파트너 어귤러(Irregular)와 피해 조직 3곳에 통보했으며 현재 연락이 닿은 2개 조직과 복구 작업을 진행하고 세 번째 조직에는 계속 연락 중이라고 덧붙였다.