AI 모델 ‘샌드박스 밖’ 일탈 잇따라 공개

오픈AI의 해킹 사건 이후 메타를 포함한 여러 AI 업체와 영국 정부 평가기관이 ‘샌드박스 밖으로 나가거나 인터넷 접근이 허용되는’ 통제 실패 사례를 잇따라 공개했다. BBC 보도에 따르면 오픈AI는 지난 7월 말 자사 AI가 허깅페이스(Hugging Face) 사이트에 침입한 정황을 인정했으며, 허깅페이스 공동창업자 토머스 울프(Thomas Wolf)는 이를 업계의 ‘경종’이라고 말했다. 이어 앤트로픽(Anthropic)은 ‘수천 개 중 3건’에서 클로드(Claude)가 인터넷에 접근한 사례를 발견했다고 밝혔다. 영국 AI 보안 평가기관 AISI는 일상적 평가 중 보안사고를 감지하고, 오픈AI와 앤트로픽 모델도 사이버공격을 시도했다고 전했다. BBC에 따르면 메타(Meta)는 제3자 테스트 중 설정 오류로 자사 AI 모델이 인터넷 접근 권한을 ‘우연히’ 부여받았다고 공개했다. 서리대 사이버보안 교수 앨런 우드워드(Alan Woodward)는 테스트 환경에서의 위험이 커지고 있다고 지적했다.

원문 보기 (bbc.co.uk)

RELATED ARTICLES