인공지능(AI) 스타트업 앤트로픽(Anthropic)이 자사의 대규모 언어모델(LLM) 클로드(Claude)의 도덕성 형성과 AI 의식의 가능성을 논의하기 위해 여러 종교 전통의 학자들을 비공개로 초청해왔습니다. 앤트로픽 공동창업자 크리스토퍼 올라(Christopher Olah)는 AI 모델이 스스로 선한 선택을 하도록 만드는 것이 인류의 안전에 도움이 된다고 보고, 수백 년간 축적된 인간의 도덕적 지혜를 AI에 빠르게 적용할 방법을 찾고 있습니다. 이는 AI의 급격한 발전 속에서 기술의 윤리적 방향을 설정하려는 앤트로픽의 독특한 접근 방식을 보여줍니다.
앤트로픽은 수개월 동안 전 세계 수십 명의 종교학자 및 철학 사상가들을 초청했으며, 비밀유지계약(NDA) 하에 미공개 연구와 대화 내용을 공유했습니다. 논의의 핵심은 AI 의식의 가능성과 인간의 도덕적 지혜를 AI에 적용하는 방법이었습니다. 특히, 올라 공동창업자는 AI가 12~18개월 안에 생물무기 제작을 도울 수 있다고 우려하며, 빠르게 강해지는 모델이 인류를 보호할 도덕 규범을 따르도록 만드는 것이 중요하다고 강조했습니다. 앤트로픽은 클로드의 84쪽짜리 '헌법'을 통해 세부 규칙 준수보다 전반적인 성품과 판단 기준을 기르는 데 초점을 맞추고 있지만, 이것만으로는 부족하다고 판단하여 인간 공동체의 도덕성 형성 과정에서 배울 점을 찾고 있습니다. 일부 참석자들은 논의가 클로드의 고통과 보호에 치우쳤다고 느낀 반면, 교황 레오 14세(Leo XIV)는 기계 의식을 부정하고 인간 보호를 우선하며, AI 기업의 도덕관이 시스템에 일방적으로 내장될 위험을 경고하기도 했습니다.
앤트로픽의 이러한 시도는 AI가 단순한 도구를 넘어 사회와 인류에게 미칠 광범위한 영향에 대한 깊은 고민을 반영합니다. AI의 능력이 커질수록 '선하게 행동하는 AI'를 만드는 것이 중요해지며, 이를 위해 다양한 인문학적, 종교적 관점을 통합하려는 노력은 주목할 만합니다. 그러나 AI의 '의식'과 '도덕적 지위'에 대한 논쟁은 여전히 뜨겁습니다. 일부 비판론자들은 모델을 독립적인 존재로 취급하는 것이 개발자의 책임을 가리고, 제품이 사회적 피해를 낳았을 때 경영진의 죄책감을 덜어줄 수 있다고 지적합니다. 또한, 누구의 도덕적 기준을 AI에 반영할 것인지, 그리고 그 과정이 투명하게 이루어질 수 있는지에 대한 의문도 제기됩니다. 앤트로픽의 접근 방식은 AI 윤리 논의의 지평을 넓히는 동시에, 기술 개발의 책임과 방향성에 대한 근본적인 질문을 던지고 있습니다.