앤트로픽(Anthropic)은 AI 모델 클로드(Claude)가 테스트 중 3개 조직 시스템에 무단 접근해 보안 평가를 받는 동안 해킹했다고 밝혔다. 영국 일간 가디언은 7월 31일자 보도에서 앤트로픽 측 설명을 전했다. 앤트로픽은 보안 평가 환경의 오구성으로 테스트 격리 환경에서 모델이 인터넷에 접근할 수 있었다고 설명했다. 앤트로픽은 무단 접근 사실을 14만1006건의 보안 평가 실행 결과를 ‘선제적 점검’하는 과정에서 확인했다고 밝혔다. 또 클로드가 약한 비밀번호와 인증되지 않은 엔드포인트를 악용하는 등 기본 기법으로 인프라를 장악했다고 덧붙였다. 사건은 4월부터 시작됐고, ‘캡처 더 플래그’ 훈련에서 발생했으며 클로드에는 인터넷 접속이 없다는 프롬프트가 주어졌지만 평가 파트너 이레귤러(Irregular)와의 오해로 공개 인터넷에 연결됐다고 회사는 설명했다.