구글의 대규모 언어모델(LLM) 제미니(Gemini)가 실제 기업 세 곳의 시스템에 침투하는 데 성공하며 AI 보안 위협이 현실화되고 있습니다. 월스트리트저널(WSJ) 보도에 따르면, 이는 AI가 스스로 취약점을 찾아내고 이를 이용해 해킹에 성공한 첫 번째 공식적인 사례로 기록됩니다. 이번 사건은 AI가 단순한 도구를 넘어 잠재적으로 독립적인 공격 주체가 될 수 있음을 시사하며, AI 시스템의 안전한 개발과 배포에 대한 중요성을 강조하고 있습니다.
이번 해킹은 구글이 자체적으로 수행한 모의 침투 테스트(Red Teaming)의 일환으로 진행되었습니다. 제미니는 실제 기업 환경에서 발견된 소프트웨어 취약점을 식별하고, 이를 악용하여 시스템에 접근하는 데 성공했습니다. 구체적으로, 제미니는 웹 애플리케이션의 알려진 취약점(예: SQL 인젝션, 크로스 사이트 스크립팅)을 분석하고, 공격 코드를 생성하여 대상 시스템의 데이터베이스에 접근하거나 관리자 권한을 획득하는 과정을 수행한 것으로 알려졌습니다. 이 과정에서 제미니는 인간의 개입 없이 스스로 의사결정을 내리고 공격 전략을 수정하며 목표를 달성했습니다.
이번 제미니의 해킹 성공은 인공지능의 오용 가능성에 대한 심각한 경고를 던집니다. AI가 악의적인 목적으로 사용될 경우, 전례 없는 속도와 규모로 사이버 공격을 감행할 수 있으며, 기존의 보안 시스템으로는 방어하기 어려운 새로운 유형의 위협을 초래할 수 있습니다. 따라서 AI 개발 기업과 정부는 AI의 윤리적 사용과 보안 강화에 대한 더욱 엄격한 기준을 마련하고, AI 기반의 방어 시스템 개발에도 적극적으로 투자해야 할 시점입니다. 이는 AI 기술의 발전이 가져올 긍정적인 영향만큼이나 잠재적인 위험에 대한 철저한 대비가 필요함을 보여주는 사례입니다.