최근 앤트로픽(Anthropic)의 보고서에 따르면, 중국 지푸 AI(Zhipu AI)가 개발한 오픈소스 대규모 언어모델(LLM)인 GLM-5.3이 놀라운 사이버 익스플로잇(exploit) 개발 능력을 보여주었습니다. 이 모델은 누구나 내려받아 사용할 수 있음에도 불구하고, 앤트로픽의 최첨단 모델인 클로드 미토스 프리뷰(Claude Mythos Preview)와 거의 동등한 수준으로 취약점을 찾아내고 실제 작동하는 공격 코드를 생성할 수 있는 것으로 평가되었습니다.
앤트로픽의 평가 결과에 따르면, GLM-5.3은 구글 크롬(Chrome) V8 엔진의 알려진 취약점을 악용하는 벤치마크에서 410회 시도 중 50회 성공하여, 클로드 미토스 프리뷰의 56회 성공과 근접한 성능을 보였습니다. 특히 전문가 연계 실험에서는 인기 웹 브라우저의 미공개 자바스크립트(JavaScript) 엔진 취약점을 발견하고 연결하여 사용자가 웹페이지 방문 시 임의 파일을 읽을 수 있는 공격을 구현했습니다. 심지어 더 작은 모델인 GLM-5.3-플래시(Flash)는 사람의 개입 20분과 모델 작업 8시간, 약 20.40달러의 API 비용만으로 ARM64 대상의 안정적인 공격 체인을 만들고 포인터 인증(PAC) 보호를 우회하는 데 성공했습니다.
이러한 결과는 누구나 접근 가능한 오픈소스 LLM이 사이버 공격과 방어 모두에 엄청난 영향을 미칠 수 있음을 시사합니다. 공격자들은 저렴한 비용과 적은 노력으로 고도화된 공격 도구를 개발할 수 있게 되어 사이버 위협의 문턱이 낮아질 수 있습니다. 앤트로픽은 이러한 모델의 확산에 대응하여 방어자들이 고성능 모델에 더 쉽게 접근할 수 있도록 하고, 정부가 독립적인 AI 안전성 평가를 시행하여 잠재적 위험에 선제적으로 대응해야 한다고 강조하고 있습니다. 이는 AI 기술 발전이 가져올 양면성을 명확히 보여주며, 기술 개발과 함께 윤리적, 사회적 책임에 대한 논의가 더욱 중요해지고 있음을 의미합니다.