대규모 언어모델(LLM) 에이전트가 단순한 텍스트 생성에서 벗어나, 외부 도구를 호출하고, 로컬 상태를 변경하며, 영구 메모리를 사용하고, 외부 프로토콜과 상호작용하는 등 복잡한 실행 시스템으로 진화하고 있습니다. 이러한 능력은 에이전트의 유용성을 극대화하지만, 동시에 과도한 권한 남용, 취약한 감사 기능, 프롬프트 주입(prompt injection), 도구 오염(tool poisoning), 그리고 통제 불가능한 부작용과 같은 심각한 보안 위험을 초래합니다.
이러한 문제에 대응하기 위해 아카이브(arXiv)에 '에이전타오(Agentao)'라는 새로운 연구가 공개되었습니다. 에이전타오는 도구를 사용하는 LLM 에이전트를 위한 '관리형 로컬 우선 런타임(governed local-first runtime)'입니다. 이 시스템은 에이전트가 제안하는 행동과 호스트가 승인하는 실제 실행을 명확히 분리하는 계층형 아키텍처를 특징으로 합니다. 호스트 인터페이스, 호스트 계약, 런타임 코어, 권한 중재 도구 시스템, 그리고 메모리, 재생, 플러그인, 스킬, 하위 에이전트, 프로토콜 통합을 위한 지원 서브시스템으로 구성되어 에이전트의 모든 활동을 명시적으로 제어하고 추적할 수 있도록 설계되었습니다.
에이전타오는 공식적인 안전 보장을 제공하지는 않지만, 권한, 상태, 프로토콜 경계, 실행 추적을 명시적인 런타임 추상화로 만들어 에이전트가 호스트 제어 로컬 환경에서 더 잘 관리되고, 검사 가능하며, 적합하게 작동하도록 돕습니다. 이는 LLM 에이전트가 단순한 실험 단계를 넘어 실제 비즈니스 환경이나 개인 기기에서 안전하게 활용될 수 있는 기반을 마련하며, 에이전트의 신뢰성과 책임감을 높이는 중요한 진전으로 평가됩니다. 궁극적으로 에이전트의 잠재력을 최대한 활용하면서도 발생할 수 있는 위험을 최소화하는 데 기여할 것입니다.
