AI(인공지능) 시대에 접어들면서 소프트웨어 개발 팀의 코드 리뷰 방식이 근본적인 도전에 직면했습니다. 동료들이 AI를 적극 활용해 코드를 생성하면서, 개발자들이 검토해야 할 PR(Pull Request)의 평균 변경분(diff)이 약 6,000줄에 달할 정도로 폭증한 것입니다. 이처럼 방대한 양의 코드를 효과적으로 검토하기 어려워지자, 개발자들은 AI 리뷰 도구의 장황한 설명과 이해하기 어려운 피드백에 대한 불만을 토로하며 새로운 해결책을 찾고 있습니다.
이러한 대규모 PR 문제에 대응하기 위해 개발 커뮤니티에서는 몇 가지 조직적, 개인적 전략이 논의되고 있습니다. 가장 핵심적인 제안은 PR 크기를 사람이 검토할 수 있는 수준으로 제한하고, 작성자가 변경의 의도를 명확히 설명하는 책임을 강화해야 한다는 것입니다. 예를 들어, 한 팀은 코드 이동 같은 예외를 제외하고 PR 변경분을 400줄 이하로 제한하며, AI가 작성한 코드에도 사람이 작성한 코드와 동일한 리뷰 기준을 적용하고 있습니다. 또한, PR에는 '왜 필요한지', '무엇을 바꿨는지', '다른 대안은 없었는지' 등 변경에 대한 작성자의 명확한 설명이 포함되어야 하며, AI가 생성한 분석을 첨부하더라도 작성자 본인이 직접 정리한 의도와 판단 근거가 선행되어야 한다고 강조됩니다.
AI는 코드 분할이나 충돌 해결을 돕고, 사전 리뷰를 통해 기본적인 오류를 걸러내는 등 리뷰 준비 단계에서 유용하게 활용될 수 있습니다. 하지만 AI 리뷰가 사소한 취향을 지적하거나 이전 요구사항을 뒤집는 등 반복될수록 비효율적일 수 있다는 지적도 나옵니다. 결국 '병합할 만큼 충분히 좋은 코드인지'를 판단하는 최종 기준은 사람이 세워야 하며, AI의 모든 지적을 그대로 작성자에게 전달하기보다는 실제 문제인지, 수정할 가치가 있는지 리뷰어가 선별하는 안목이 필요합니다.
이러한 변화는 단순히 도구를 추가하는 것을 넘어, 팀과 관리자가 코드 리뷰의 목적과 기준에 대해 합의하는 것이 중요함을 시사합니다. 관리자가 리뷰에 무엇을 기대하고, 리뷰어에게 어떤 책임과 거절 권한을 부여하는지에 대한 명확한 합의가 없다면, 한쪽은 검토가 부실하다고 느끼고 다른 쪽은 리뷰가 진행을 방해한다고 느끼는 갈등이 발생할 수 있습니다. 궁극적으로는 사람이 모든 코드를 이해하는 방식과 AI 에이전트가 코드를 작성하고 사람은 관리자 역할을 하는 방식 중 팀이 어떤 개발 문화를 지향할지 명확히 정해야 할 시점입니다.