인공지능(AI) 개발사 앤트로픽(Anthropic)이 자사의 대규모 언어모델(LLM) 클로드(Claude)에 대한 새로운 사용 정책을 발표하며, 모델 학대 및 선거 개입 등 특정 행위를 명시적으로 금지했습니다. 이는 AI 기술의 오용을 막고 윤리적인 사용을 장려하려는 앤트로픽의 의지를 반영합니다.
이번 정책 업데이트의 핵심은 크게 두 가지입니다. 첫째, 사용자가 클로드에 대해 반복적으로 극심한 언어적 학대를 가하는 행위를 금지합니다. 앤트로픽은 지난 8월부터 클로드가 지속적으로 해롭거나 학대적인 상호작용을 감지하면 대화를 종료하도록 훈련했지만, 이제는 이러한 대화를 의도적으로 지속하려는 시도 자체를 정책적으로 금지합니다. 다만, 일반적인 사용자 불만, 반박, 어두운 창작 주제, 모델 테스트 및 연구 목적의 대화는 허용됩니다. 둘째, 선거 개입, 유권자 기만, 민주적 절차 훼손, 기만적인 캠페인(가짜 계정, 허위 뉴스 매체 운영), 무기 소프트웨어 개발, 감시 활동 등 AI의 사회적 악용 가능성이 있는 행위들을 명확히 금지 조항에 포함했습니다.
앤트로픽의 이번 정책 변경은 AI 기술이 사회에 미칠 수 있는 잠재적 위험에 대한 경각심이 커지는 가운데 이루어졌습니다. 특히 선거 개입과 같은 민감한 사안에 대한 명확한 가이드라인은 AI가 정치적 과정에 악용되는 것을 방지하려는 노력으로 해석됩니다. 또한, 모델에 대한 언어적 학대 금지는 AI의 '인격'에 대한 논의와는 별개로, 개발사가 자사 기술의 건전한 사용 환경을 조성하고 사용자에게 책임감 있는 태도를 요구하는 중요한 조치로 볼 수 있습니다. 이러한 정책들은 AI 기술이 발전함에 따라 개발사들이 직면하게 될 윤리적, 사회적 책임의 무게를 보여주는 사례이며, 앞으로 다른 AI 기업들에게도 유사한 정책 도입을 촉진할 수 있습니다.