앤트로픽(Anthropic)의 최신 AI 모델인 클로드 미토스 프리뷰(Claude Mythos Preview)가 암호화 알고리즘 자체의 수학적 약점을 발견하는 데 성공했습니다. 이는 기존에 AI가 소프트웨어 구현 오류를 찾아내던 수준을 넘어, 암호화 시스템의 근본적인 설계 결함을 식별할 수 있음을 보여주는 중요한 진전입니다. 이번 연구 결과는 아직 실제 시스템에 영향을 미치지는 않지만, 강력한 AI 모델이 미래 암호학 연구와 보안 환경에 미칠 잠재력을 시사합니다.
클로드는 두 가지 주요 성과를 달성했습니다. 첫째, 양자 컴퓨터 시대에 대비해 미국 국립표준기술연구소(NIST)가 검토 중인 디지털 서명 방식인 HAWK에 대한 기존 공격 방식을 크게 개선했습니다. 2년간 전문가 검토를 거친 HAWK의 키 강도를 사실상 절반으로 줄이는 공격법을 단 60시간 만에 찾아냈습니다. 둘째, 가장 널리 사용되는 대칭 암호인 AES의 약화된 버전에 대한 새로운 공격 방식을 발견하여 기존 공격 속도를 200~800배 향상시켰습니다. 이 연구는 대부분 자율적으로 진행되었으며, HAWK 공격 개발에는 한 명의 연구원이 클로드와 협력했고, AES 공격은 클로드가 완전히 자율적으로 발견했습니다. 각 연구에는 약 10만 달러의 API 비용이 소요되었습니다.
이러한 발견은 AI가 암호학 연구의 판도를 바꿀 수 있음을 보여줍니다. AI는 인간 연구자가 놓칠 수 있는 복잡한 패턴과 취약점을 대규모 데이터에서 빠르게 식별할 수 있어, 새로운 암호화 알고리즘을 설계하고 기존 알고리즘의 견고성을 테스트하는 데 필수적인 도구가 될 것입니다. 앤트로픽은 이러한 연구를 촉진하기 위해 ETH 취리히 등 학계와 협력하여 LLM의 암호 분석 능력을 평가하는 벤치마크인 크립토애널리시스벤치(CryptanalysisBench)를 구축했습니다. 이번 연구 결과는 책임 있는 공개 절차를 거쳐 HAWK 개발자 및 NIST에 사전 공유되었으며, 이는 새로운 기술 발전이 가져올 잠재적 위험에 대한 선제적 대응의 중요성을 강조합니다.