앤스로픽(Anthropic)의 AI 코딩 에이전트 클로드 코드(Claude Code)에 혁신적인 '인턴 리뷰(Interns Review)' 플러그인이 추가되었습니다. 이 플러그인은 AI 에이전트가 코드 설계나 버그 수정 제안을 내놓으면, 1~3명의 독립적인 AI 리뷰어(일명 '인턴')가 이를 비판적으로 검토하고, 최종적으로 리드 에이전트가 이들의 피드백을 바탕으로 최적의 솔루션을 도출하는 방식입니다. 이는 AI 코딩의 고질적인 문제였던 '자기 확신'과 '동일한 관점'의 한계를 극복하려는 시도로 평가됩니다.
기존 AI 코딩 에이전트는 자신의 아이디어를 스스로 검토하는 방식이어서, 동일한 모델과 맥락, 그리고 맹점을 가지고 있어 효과적인 검토가 어려웠습니다. 하지만 '인턴 리뷰' 플러그인은 이러한 방식에 변화를 줍니다. 리드 에이전트가 문제, 오류, 제약 조건, 제안된 솔루션 등을 담은 '컨텍스트 파일(Context File)'을 작성하면, 1~3명의 독립적인 '합의 리뷰어(consensus-reviewer)' 서브 에이전트가 이 파일만을 보고 병렬적으로 검토합니다. 각 리뷰어는 정확성, 엣지 케이스, 단순성 등 서로 다른 관점에서 비판적인 피드백을 제공하며, 리드 에이전트는 이 '인턴'들의 제안을 코드와 대조하여 검증하고, 불필요하거나 잘못된 피드백은 걸러내어 최종 솔루션에 반영합니다. 이 과정에서 어떤 피드백이 수용되고 거부되었는지에 대한 '영수증(receipt)'도 생성되어 투명성을 높입니다.
이러한 다중 에이전트 기반의 비판적 검토 시스템은 AI가 생성하는 코드의 품질과 신뢰성을 크게 향상시킬 잠재력을 가지고 있습니다. 특히, 복잡한 아키텍처 설계, 데이터 모델 변경, 보안 관련 코드 등 중요도가 높은 작업에는 최대 3명의 리뷰어가 투입되어 더욱 면밀한 검토가 이루어집니다. 이는 단순히 AI가 코드를 생성하는 것을 넘어, 인간 개발팀의 코드 리뷰 프로세스를 모방하여 AI 스스로 오류를 줄이고 견고한 결과물을 만들어내는 방향으로 진화하고 있음을 보여줍니다. 개발자들은 AI의 제안을 더욱 신뢰할 수 있게 되고, 중요한 의사결정 과정에서 발생할 수 있는 잠재적 위험을 최소화하는 데 도움을 받을 수 있을 것입니다.