인공지능(AI) 스타트업 앤트로픽(Anthropic)이 자사의 대규모 언어모델(LLM) 기반 챗봇 클로드(Claude)가 생성한 텍스트에 '보이지 않는 워터마크' 기술을 도입합니다. 이는 AI가 만든 콘텐츠를 식별할 수 있도록 하는 새로운 접근 방식으로, AI 생성물의 투명성을 높이고 오정보(misinformation) 확산을 막기 위한 노력의 일환입니다. 사용자는 이 워터마크를 통해 클로드의 결과물임을 확인할 수 있게 됩니다.
이 워터마크는 텍스트 자체에 미묘한 통계적 패턴을 심어 넣는 방식으로 작동합니다. 즉, 사람이 읽기에는 일반 텍스트와 전혀 차이가 없지만, 특정 분석 도구를 사용하면 AI가 생성한 것임을 판별할 수 있습니다. 앤트로픽은 이 기술이 AI 콘텐츠의 출처를 명확히 하여, 특히 뉴스나 중요한 정보 영역에서 AI가 생성한 내용이 마치 사람의 글인 것처럼 오인되는 것을 방지하는 데 중점을 둡니다. 이는 AI 기술의 발전과 함께 사회적 책임감을 강조하는 움직임으로 해석됩니다.
앤트로픽의 이번 워터마크 도입은 AI 콘텐츠의 신뢰성 문제를 해결하려는 업계 전반의 노력과 궤를 같이 합니다. AI가 생성한 가짜 뉴스나 허위 정보가 사회에 미칠 수 있는 부정적인 영향을 줄이고, AI 기술이 더욱 책임감 있게 활용될 수 있는 기반을 마련하는 중요한 단계입니다. 궁극적으로는 AI 콘텐츠에 대한 대중의 신뢰를 구축하고, AI와 인간이 상호작용하는 방식에 있어 투명성을 강화하는 데 기여할 것으로 보입니다.