법률 정보 기업 톰슨 로이터가 법률 AI 스타트업 로스 인텔리전스를 상대로 제기한 저작권 침해 소송에서 미국 제2순회 항소법원이 로스의 공정 사용(fair use) 주장을 기각했습니다. 이 판결은 생성형 인공지능(Generative AI) 모델 학습에 사용되는 데이터의 저작권 문제에 대한 중요한 법적 기준을 제시하며, AI 업계 전반에 큰 영향을 미칠 것으로 예상됩니다.
이번 소송에서 톰슨 로이터는 로스가 자사의 법률 데이터베이스인 웨스트로(Westlaw)의 콘텐츠를 무단으로 복제하여 AI 모델을 훈련하고, 이를 통해 경쟁 서비스를 개발했다고 주장했습니다. 로스 인텔리전스는 자신들의 행위가 저작권법상 공정 사용에 해당한다고 항변했으나, 항소법원은 이를 받아들이지 않았습니다. 법원은 로스가 톰슨 로이터의 콘텐츠를 변형적으로 사용(transformative use)했다고 보기 어렵고, 상업적 목적의 복제가 원저작물의 시장 가치에 부정적인 영향을 미칠 수 있다고 판단했습니다. 특히, 로스가 웨스트로의 콘텐츠를 단순히 복제하여 자신들의 AI 모델을 훈련하고, 그 결과물을 통해 웨스트로와 직접 경쟁하는 서비스를 제공하려 했다는 점이 주요 쟁점이었습니다.
이번 판결은 AI 개발사들이 모델 학습에 사용하는 데이터의 출처와 사용 방식에 대해 더욱 엄격한 주의를 기울여야 함을 의미합니다. 단순히 데이터를 수집하여 AI를 훈련하는 것이 공정 사용으로 인정받기 어렵다는 선례를 남긴 만큼, 향후 AI 학습 데이터 라이선싱 및 저작권 침해 소송이 증가할 가능성이 있습니다. 이는 AI 기술 발전의 중요한 동력인 데이터 접근성에 제약을 가할 수 있으며, AI 기업들은 합법적인 데이터 확보 전략을 수립하는 데 더 많은 자원과 노력을 투자해야 할 것입니다.