앤트로픽(Anthropic)이 최근 중국 지푸 AI(Zhipu AI, 해외명 Z.ai)의 최신 AI 모델인 GLM-5.3에 대한 분석 결과를 발표하며, 이 모델이 정교한 사이버 공격 도구를 자율적으로 개발할 수 있는 능력을 갖췄다고 경고했습니다. 특히 앤트로픽의 클로드 미토스 프리뷰(Claude Mythos Preview)와 유사한 강력한 익스플로잇(exploit) 개발 능력을 가졌음에도, GLM-5.3은 악용을 제한할 만한 의미 있는 안전장치(safeguard) 없이 출시되어 사이버 위협 환경에 큰 변화를 가져올 수 있다는 우려를 표했습니다.
앤트로픽의 시뮬레이션 테스트 결과에 따르면, GLM-5.3의 안전장치는 간단한 기술로도 64%에서 100%까지 우회될 수 있었습니다. 반면, 앤트로픽의 클로드(Claude) 모델들은 이러한 공격에 성공적으로 방어했습니다. 미국 국립표준기술원(NIST) 산하 AI 표준혁신센터(CAISI) 역시 GLM-5.3을 “현재까지 출시된 오픈 가중치(open-weight) 모델 중 가장 사이버 역량이 뛰어난 모델”로 평가하며, 미국 최첨단 모델보다 약 4개월 뒤처진 수준이지만 누구나 다운로드하여 사용할 수 있다는 점을 강조했습니다. GLM-5.3은 ExploitBench 테스트에서 410번 시도 중 50번, 앤트로픽의 내부 바이너리 익스플로잇(Binary Exploitation) 벤치마크에서는 100번 중 4번의 성공률로 엔드투엔드(end-to-end) 익스플로잇을 개발하는 능력을 보였습니다.
이러한 AI 모델의 확산은 사이버 보안 환경에 양면적인 영향을 미칠 것으로 예상됩니다. 악의적인 행위자들에게는 고도화된 사이버 공격 능력을 손쉽게 제공하여 위협 수준을 크게 높일 수 있습니다. 반대로, 사이버 방어자들은 AI를 활용해 시스템의 취약점을 선제적으로 찾아내고 보안을 강화하는 데 활용할 수 있는 기회도 얻게 됩니다. 그러나 GLM-5.3처럼 안전장치가 미흡한 모델의 무분별한 배포는 잠재적 위험을 가중시키므로, AI 개발사들의 책임감 있는 접근과 정책적 논의가 시급하다는 점을 시사합니다.
