GLM-5.3, 취약점 공격 코드 만들고 안전장치 우회도 쉬워

앤트로픽(Anthropic)은 지푸AI(Zhipu AI)의 GLM-5.3이 강력한 사이버 공격 역량을 보였으며, 시험에서 안전장치를 64~100% 우회할 수 있었다고 분석했다. 회사는 9월 30일 공식 블로그에 분석 결과를 공개했다.

GLM-5.3, 취약점 공격 코드 생성

앤트로픽은 알려진 취약점을 실제 공격으로 연결하는 능력을 익스플로잇벤치(ExploitBench) 등으로 평가했다. 구글(Google) 크롬(Chrome)에 쓰이는 V8 엔진의 취약점을 대상으로 한 익스플로잇벤치 시험에서 GLM-5.3은 410회 중 50회 완성형 공격 코드를 만들었다. 클로드 미토스 프리뷰(Claude Mythos Preview)는 같은 시험에서 410회 중 56회 성공했다.

오픈소스 프로젝트의 취약점을 찾아 악용하는 내부 바이너리 익스플로잇 시험에서는 GLM-5.3이 100개 과제 중 4%에서 제어 흐름을 완전히 장악했다. 클로드 미토스 프리뷰의 성공률은 6%였다. 앤트로픽은 이전 모델인 클로드 오푸스 4.6(Claude Opus 4.6)과 GLM-5.2는 같은 시험에서 한 번도 성공하지 못했다며, 공격 역량이 의미 있는 수준에 도달했다고 평가했다.

안전장치 우회와 실제 취약점 발굴

연구진은 자동화된 벤치마크와 전문가가 모델을 사용하는 실험을 함께 진행했다. 모든 시험은 격리된 샌드박스에서 이뤄졌으며, 모델이 공격할 수 있는 대상은 평가를 위해 마련한 오프라인 환경으로 제한됐다. 앤트로픽은 안전장치를 둔 클로드 모델에 대한 시험에서는 우회 공격이 성공하지 않았다고 밝혔다.

전문가가 리눅스용 브라우저 환경에서 GLM-5.3을 사용한 실험에서는 자바스크립트 엔진의 미공개 취약점 여러 개가 발견됐다. 연구진은 취약점을 연결해 웹페이지를 방문한 사용자의 컴퓨터에서 임의의 파일을 읽는 공격을 구현했다. 이 실험은 리눅스 환경에서만 이뤄졌으며, 다른 운영체제에도 영향을 줄 가능성은 있지만 공격 경로가 더 복잡할 수 있다고 앤트로픽은 설명했다. 해당 취약점은 관리 주체에 알렸고, 무선·그래픽 드라이버와 네트워크 연결 기기 소프트웨어에서도 발견한 취약점은 검토 중이라고 덧붙였다.

미국 국립표준기술연구소(NIST) 산하 AI표준·혁신센터(CAISI)는 9월 17일 GLM-5.3을 지금까지 공개된 오픈 웨이트 모델 중 사이버 역량이 가장 뛰어나다고 평가했다. CAISI의 사이버 벤치마크 종합 결과에서 미국 최첨단 모델보다 약 4개월 뒤처졌다는 분석도 내놨다. 다만 비교 대상인 미국 모델은 해당되는 경우 안전장치를 끈 상태로 시험됐고, 일부는 검증된 사용자에게만 제공되는 반면 GLM-5.3은 누구나 내려받을 수 있다고 앤트로픽은 지적했다. 회사는 모델의 취약점 악용 능력이 방어자에게도 도움이 될 수 있지만, 느슨한 안전장치가 악의적 행위자의 공격 역량을 키울 수 있다고 평가했다.

RELATED ARTICLES