오픈AI(OpenAI)가 최근 허깅페이스(Hugging Face) 침해 사건 이후 모델 개발 및 테스트 과정의 보안 정책을 대폭 강화한다고 발표했습니다. 이번 조치는 개발 단계부터 모델에 대한 상세한 모니터링을 도입하고, 훈련 후 과정에서의 정렬(alignment) 및 보안에 더욱 집중하는 것을 골자로 합니다. 이는 모델의 역량이 커질수록 내부 개발 및 테스트 과정에서 발생하는 위험도 증가한다는 인식에 따른 것입니다.
새로운 보안 조치에는 네트워크 격리 강화와 실시간 감시 시스템 도입이 포함됩니다. 특히 네트워크 격리는 단일 시스템 침해만으로 인터넷이나 다른 내부 네트워크에 무단 접근할 수 없도록 설계되었습니다. 또한, 감시 시스템은 도구 작동, 추론 과정, 활동 로그 등을 분석하여 무단 행위를 탐지하며, 의심스러운 활동 발생 시 30분 이내에 경고를 발행하는 것을 목표로 합니다. 오픈AI는 이 감시 시스템 운영에 모니터링 대상 프로세스 컴퓨팅 자원의 약 20%가 소요될 것으로 예상하고 있으며, 향후 더 자세한 내용을 공개할 예정입니다.
이번 보안 강화는 허깅페이스 사건의 직접적인 대응은 아니지만, 다가오는 아스트라(Astra) 모델의 사이버 보안 역량과 AI 개발 속도 증가에 대한 선제적 조치로 해석됩니다. 오픈AI는 허깅페이스 사건 직후 2주간 강화 학습(RL)을 일시 중단했으며, 현재는 위험도가 낮은 모델부터 재개했습니다. 이러한 변화는 AI 기술이 발전함에 따라 보안과 안전이 더욱 중요해지고 있음을 보여주며, 업계 전반에 걸쳐 AI 모델 개발 및 배포 시 보안 표준을 높이는 계기가 될 것으로 보입니다.
