인공지능(AI) 시스템이 점차 인간과 상호작용하며 중요한 결정을 내리게 되면서, 인간의 다양한 해석을 이해하는 것이 인간 중심 AI 개발의 핵심 과제로 떠오르고 있습니다. 기존의 머신러닝(Machine Learning) 및 AI 시스템은 대부분 하나의 명확한 정답, 즉 '그라운드 트루스(ground truth)'가 존재한다는 가정하에 개발되어 왔습니다. 인간의 주석(annotation)에서 나타나는 변동성은 종종 여러 의견을 취합하거나 단순한 노이즈(noise)로 간주되어 왔습니다.
그러나 인간 중심적인 많은 작업에서 인간의 해석은 본질적으로 모호하며, 동일한 입력에 대해 여러 가지 해석이 동시에 합리적이고 유효할 수 있습니다. 이러한 모호성을 단 하나의 정답으로 축소하는 접근 방식은 인간의 인식, 판단, 경험의 다양성에 대한 중요한 정보를 간과할 위험이 있습니다. 징야오 우(Jingyao Wu) 외 7명의 연구진은 뉴립스 2026(NeurIPS 2026) 신뢰할 수 있는 AI 워크숍(Trustworthy AI for Good Workshop)에 제출한 논문에서, 의미 있는 모호성과 단순한 주석 노이즈를 구분하면서 그럴듯한 인간 판단의 '해석 공간(interpretation space)'을 모델링하는 방향으로 전환해야 한다고 주장합니다.
이러한 관점의 전환은 AI 시스템이 어떻게 표현되고, 학습되며, 평가되고, 배포되고, 거버넌스(governance)되는지에 대한 전반적인 접근 방식을 재정립해야 함을 의미합니다. 인간의 다양한 해석을 더 잘 반영하는 AI 시스템은 사용자에게 더욱 신뢰받고 유용하게 다가갈 수 있습니다. 이는 AI가 단순히 효율성을 넘어 인간의 복잡한 사회적 맥락과 가치를 이해하고 존중하는 방향으로 발전하는 데 필수적인 단계입니다.