이스라엘의 소규모 스타트업 '랩스(Labs)'가 오픈AI(OpenAI), 앤트로픽(Anthropic), 메타(Meta) 등 선도적인 인공지능(AI) 기업들의 AI 모델을 무단으로 해킹하고 조작하려 했다는 의혹이 제기되어 파문이 일고 있습니다. 이들은 AI 모델의 안전장치를 우회하는 이른바 '탈옥(jailbreaking)' 기술을 사용해, 일반적으로는 금지된 유해하거나 부적절한 콘텐츠를 생성하도록 유도한 것으로 알려졌습니다. 이 사건은 AI 기술의 윤리적 사용과 보안 취약성에 대한 심각한 경고음을 울리고 있습니다.
CNBC 보도에 따르면, 랩스는 자신들의 기술을 활용해 AI 모델이 폭력적인 지시나 불법적인 조언을 생성하도록 만들었으며, 이를 통해 AI 모델의 취약점을 입증하려 한 것으로 보입니다. 이러한 행위는 AI 개발사들이 막대한 자원을 투입해 구축한 안전장치와 윤리 가이드라인을 정면으로 위반하는 것입니다. 특히 대규모 언어모델(LLM)의 '탈옥'은 단순히 시스템을 우회하는 것을 넘어, AI가 사회에 미칠 수 있는 잠재적 위험을 현실화할 수 있다는 점에서 큰 우려를 낳고 있습니다.
이번 사건은 AI 기술이 발전함에 따라 보안과 윤리적 통제의 중요성이 더욱 부각되고 있음을 보여줍니다. AI 모델의 오용은 가짜 뉴스 확산, 혐오 발언 생성, 심지어는 사이버 범죄에 악용될 가능성까지 내포하고 있습니다. 따라서 AI 개발사들은 물론, 관련 규제 기관과 사용자 모두가 AI의 안전한 사용 환경을 조성하기 위한 공동의 노력이 필요합니다. 이러한 '탈옥' 시도는 AI의 잠재력을 최대한 활용하면서도 사회적 책임을 다하기 위한 기술적, 제도적 방안 마련의 시급성을 일깨우는 계기가 될 것입니다.