하나의 HTML 파일만으로 앤스로픽(Anthropic)의 클로드 코드(Claude Code)나 오픈AI(OpenAI)의 코덱스(Codex)와 같은 대규모 언어모델(LLM) 기반의 코딩 에이전트 함대(fleet)를 손쉽게 생성하는 도구가 등장했습니다. '플릿 제너레이터(fleet-generator)'라는 이름의 이 도구는 별도의 설치나 빌드 과정 없이 웹 브라우저에서 HTML 파일을 열어 몇 가지 질문에 답하는 것만으로, 복잡한 다중 에이전트 시스템을 즉시 구축할 수 있게 해줍니다. 생성된 결과물은 에이전트 정의, 스킬, 훅(hook), 설정 등을 포함하는 압축 파일 형태로 제공되어 개발 환경에 바로 적용 가능합니다.
이 시스템의 핵심은 단일 에이전트가 모든 작업을 처리하는 대신, 오케스트레이터(orchestrator), 워커(worker), 리뷰어(reviewer)의 세 가지 역할로 작업을 분할한다는 점입니다. 오케스트레이터는 전체 작업을 분해하고 각 워커에게 할당하며, 워커는 할당된 단위 작업을 구현하고, 리뷰어는 오케스트레이터의 결과물을 검토합니다. 이러한 역할 분담은 단순히 조직적인 효율성을 넘어, 실제 운영 비용 절감과 코드 품질 향상으로 이어집니다. 개발자에 따르면, 작업 분담을 통해 서브 에이전트(sub-agent)에서 토큰 사용량의 약 64%를 처리하여, 단일 에이전트가 모든 코드를 직접 작성하는 방식보다 비용을 3~4배 절감하는 효과를 가져왔습니다. 또한, 각 역할에 최적화된 모델 티어(model tier)를 할당하여 비용 효율성을 더욱 높일 수 있습니다.
이러한 다중 에이전트 접근 방식은 AI 기반 코드 생성 및 개발 프로세스의 패러다임을 바꿀 잠재력을 가지고 있습니다. 단일 LLM의 한계인 긴 컨텍스트 유지 비용과 비효율적인 자원 활용 문제를 해결하며, 병렬 처리와 독립적인 검토 과정을 통해 더 저렴하고 고품질의 코드를 생산할 수 있게 합니다. 이는 특히 스타트업이나 소규모 팀에서 AI 코딩 도구를 활용할 때 비용 효율성과 생산성을 극대화할 수 있는 중요한 기회를 제공하며, AI 에이전트 설계 및 운영에 대한 새로운 표준을 제시할 수 있습니다.