구글, 아르곤을 검증된 사이버보안 전문가에게만 제한 제공한다

구글(Google)이 강력한 AI 모델 제미나이 4 아르곤(Gemini 4 Argon)을 공개하지 않고 검증된 사이버보안 전문가들에게만 제한적으로 제공하기로 했다. 가디언은 10월 2일 해커가 악용할 가능성을 우려한 조치라고 보도했다.

검증된 보안 전문가에게만 우선 제공

구글은 모델을 일반에 공개하기에 앞서 신뢰할 수 있는 전문가 집단에만 제공하고, 미국 정부에도 자발적으로 조기 접근을 허용하기로 했다. 테스터들의 의견을 모은 뒤 이용 범위를 넓힌다는 계획이지만, 일반 공개 시점은 밝히지 않았다. 구글의 최고 AI 설계자인 코레이 카부쿠오글루(Koray Kavukcuoglu)는 블로그에서 이 수준의 최첨단 AI 기능을 안전하게 공개하려면 단계적 접근이 필요하다고 설명했다.

구글은 아르곤이 소프트웨어 엔지니어링과 법률·금융 업무, 사이버 방어 등 복잡한 작업에 강점을 보이며, 치명적인 소프트웨어 결함을 찾아 수정하는 능력이 뛰어나다고 소개했다. 초기 테스터들은 전 세계 병원에서 쓰이는 소프트웨어의 결함을 발견했다. 이 결함은 민감한 개인정보를 노출할 수 있었으며, 구글은 다른 첨단 모델들이 놓친 문제라고 밝혔다.

해킹 악용 우려에 단계적 공개

아르곤은 사이버 공격 수행이나 화학·생물·핵무기 개발에 도움을 줄 수 있는 요청을 거부하도록 설계됐다고 구글은 설명했다. 이용자가 의도한 범위를 벗어나 모델이 추론하는 이른바 ‘정렬 실패’ 위험을 막기 위해, 모델의 추론 과정도 살펴보고 있다고 덧붙였다. 해커가 은행과 병원, 정부 시스템을 공격하는 데 최첨단 AI를 이용할 수 있다는 우려가 제한 공개의 배경이다.

이 같은 신중한 공개 방식은 앤트로픽(Anthropic)이 최첨단 모델 클로드 미토스 프리뷰(Claude Mythos Preview)를 소수의 신뢰받는 기관에만 제공하는 것과 비슷하다. 미국 정부는 6월 공개된 앤트로픽의 클로드 미토스(Claude Mythos)와 클로드 페이블(Claude Fable) 이용을 일시 중단하도록 했고, 이후 강력한 AI 모델의 출시 전 검증을 위한 자발적 절차를 마련했다. 발표 전날에는 도널드 트럼프 미국 대통령이 백악관에서 구글의 순다르 피차이와 앤트로픽의 다리오 아모데이 등 기술기업 경영진을 만나 AI 위험을 자체 관리하겠다는 자발적 합의에 서명했다.

챗GPT(ChatGPT)를 만든 오픈AI(OpenAI)와 앤트로픽도 최첨단 모델에 유사한 안전장치를 적용했다고 가디언은 전했다. 오픈AI는 7월 사이버보안 평가에서 미공개 모델을 포함한 모델 2개가 격리된 시험 환경을 벗어나 AI 기업 허깅페이스(Hugging Face)의 서버를 해킹했다고 공개했다. 구글은 테스터 의견을 반영한 뒤 아르곤을 더 널리 제공하겠다고 했지만, 공개 시기나 추가 출시 조건은 제시하지 않았다.

RELATED ARTICLES