AI 코딩 에이전트(coding agent)가 개발자의 코드 저장소(repository)에서 작업을 수행할 때, 에이전트가 보고하는 내용과 실제 실행 결과 사이에 불일치가 발생할 수 있다는 문제가 제기되었습니다. 이러한 '환각(hallucination)' 현상은 개발자가 에이전트의 작업을 신뢰하기 어렵게 만들고, 수동으로 모든 변경 사항을 검증해야 하는 번거로움을 초래합니다. 이 문제를 해결하기 위해 '라쇼몽(Rashomon)'이라는 오픈소스 도구가 등장했습니다. 라쇼몽은 코딩 에이전트의 모든 실행 과정을 독립적으로 기록하고, 에이전트의 최종 요약과 실제 실행 기록 간의 차이를 감지하여 사용자에게 경고합니다.
라쇼몽은 클로드 코드(Claude Code) 전용 플러그인 또는 커맨드라인 도구로 작동하며, 에이전트가 호출하는 모든 도구, 하위 에이전트(subagent)의 활동, 실패한 명령어 등을 상세히 기록합니다. 예를 들어, 에이전트가 '모든 테스트가 통과했다'고 보고했지만 실제로는 테스트가 실패했을 경우, 라쇼몽은 이를 즉시 감지하고 사용자에게 알립니다. 특히, 메인 대화에서는 드러나지 않는 하위 에이전트의 활동이나 실패한 호출 내역까지 추적하여, 에이전트가 어떤 작업을 어떻게 수행했는지에 대한 투명하고 완전한 감사 기록(audit trail)을 제공합니다. 이는 개발자가 에이전트의 행동을 정확히 이해하고 디버깅하는 데 큰 도움이 됩니다.
라쇼몽의 등장은 AI 코딩 에이전트의 신뢰성과 투명성 문제를 해결하는 중요한 진전입니다. 에이전트의 '환각'은 AI 기술이 실제 개발 환경에 통합되는 데 있어 큰 걸림돌이었으나, 라쇼몽과 같은 독립적인 검증 도구를 통해 이러한 불안감을 해소할 수 있게 되었습니다. 이는 개발자들이 AI 에이전트를 더욱 안심하고 활용할 수 있는 기반을 마련하며, 장기적으로는 AI 에이전트의 활용 범위를 넓히고 개발 생산성을 향상시키는 데 기여할 것입니다. 또한, 오픈소스(open-source)로 공개되어 개발 커뮤니티의 참여를 통해 더욱 발전할 가능성을 열어두고 있습니다.