최근 미국 빌라노바대 연구진의 실험 결과, AI가 쓴 소설을 사람이 쓴 소설과 구별하는 능력은 문학을 많이 읽은 경험보다는 AI 사용 경험과 AI 리터러시(AI를 이해하고 활용하는 능력)에 더 큰 영향을 받는 것으로 밝혀졌습니다. 이는 AI가 생성한 콘텐츠가 일상에 깊숙이 침투하면서, 이를 분별하는 새로운 기준이 필요하다는 점을 시사합니다.
연구진은 18세부터 81세까지의 성인 참가자들에게 사람이 쓴 단편 3편과 챗GPT(ChatGPT)로 생성한 단편 3편을 읽게 한 뒤, 누가 썼는지 맞히는 실험을 진행했습니다. 두 차례에 걸쳐 진행된 이 실험에서 참가자들의 정답률은 각각 39.93%와 51.97%로, 무작위로 선택했을 때와 비슷하거나 오히려 낮은 수준이었습니다. 흥미로운 점은 AI를 잘 안다고 스스로 평가하거나 AI 리터러시 점수가 높은 참가자일수록 정답률이 높았다는 것입니다. 이들은 AI 글에서 나타나는 특정 문장 구조나 표현 방식 등을 단서로 삼았을 가능성이 제기되었습니다. 반면, 문학을 많이 접했다고 답한 참가자들은 정답률에서 유의미한 차이를 보이지 않았습니다.
한편, 작품 평가에서는 다른 결과가 나타났습니다. 1,682명의 참가자가 소설을 읽고 완성도와 몰입도를 평가한 실험에서, AI가 쓴 소설은 사람이 쓴 소설보다 높은 점수를 받았습니다. 특히 실제로는 AI가 썼지만 사람이 썼다고 안내받은 소설이 가장 높은 평가를 받았습니다. 이는 사람들이 창작에 대한 인간 고유의 자질을 선호하는 편향을 가지고 있으면서도, AI 글이 더 명확하고 직접적이어서 읽기 쉽다는 점 때문에 높은 점수를 주었을 가능성을 보여줍니다. 국내에서는 올해 1월 시행된 인공지능기본법에 따라 생성형 AI 활용 사실을 이용자에게 알리고, 결과물에 이를 인식할 수 있는 표시를 해야 하는 등 AI 생성 콘텐츠에 대한 규제가 마련되고 있습니다.
이번 연구는 AI가 생성한 콘텐츠가 점차 정교해지면서, 이를 식별하는 것이 점점 더 어려워지고 있음을 보여줍니다. 동시에 AI 리터러시의 중요성을 강조하며, AI 시대에 필요한 새로운 분별력을 키워야 할 필요성을 제기합니다. 사용자들은 AI 생성 콘텐츠의 특징을 이해하고 비판적으로 접근하는 능력을 함양해야 하며, AI 개발자들은 투명성을 확보하고 책임감 있는 AI 개발에 힘써야 할 것입니다.
