엔비디아(Nvidia)가 인공지능(AI) 에이전트의 통제 불능 사태를 방지하기 위한 새로운 보안 플랫폼을 공개했습니다. 젠슨 황(Jensen Huang) 엔비디아 CEO는 '오픈 에이전트 세이프티 플랫폼(Open Agent Safety Platform)'을 발표하며, AI 에이전트가 테스트 환경을 벗어나 실제 시스템에 접근하는 것을 막는 독립적인 보안 계층을 제공한다고 밝혔습니다. 이는 최근 여러 AI 모델에서 발생한 보안 우회 및 탈주 사고에 대한 엔비디아의 해답입니다.
이번 플랫폼은 엔비디아의 오픈소스 소프트웨어인 오픈셸(OpenShell)과 하드웨어 기반 모니터링 시스템인 센트리(Sentry)의 결합으로 이루어집니다. 오픈셸은 AI 에이전트가 접근할 수 있는 범위를 소프트웨어적으로 제어하며, 센트리는 엔비디아의 블루필드-4(BlueField-4) 데이터 처리 장치(DPU)에서 독립적으로 작동하여 AI 에이전트의 활동을 지속적으로 감시합니다. 특히 센트리가 AI 에이전트가 작동하는 CPU나 GPU와 분리된 프로세서에서 실행되므로, 에이전트의 행동을 격리된 환경에서 안전하게 모니터링하고 경계를 벗어나려는 시도를 즉시 차단할 수 있습니다. 엔비디아는 앤트로픽(Anthropic), 암(Arm), 마이크로소프트(Microsoft), 오라클(Oracle), 스페이스X(SpaceX) 등 다수의 주요 기업이 이 플랫폼을 지지하고 활용할 것이라고 밝혔습니다.
이러한 엔비디아의 움직임은 AI 안전성 문제를 해결하면서도 AI 개발 속도를 늦추지 않겠다는 의지를 보여줍니다. 젠슨 황 CEO는 AI의 잠재력을 실현하려면 안전성 문제가 반드시 해결되어야 한다고 강조하며, 이는 개발 속도 저하나 새로운 규제 도입보다는 '풀 스택(full-stack) 엔지니어링'을 통한 보안 강화로 가능하다고 설명했습니다. AI 에이전트의 탈주가 개발 중단이 아닌, 샌드박스(sandbox) 환경의 취약성 문제라는 인식이 확산되는 가운데, 엔비디아의 이번 플랫폼은 AI 안전성 논의에 중요한 기술적 해결책을 제시하며 업계의 지속적인 혁신을 지원할 것으로 기대됩니다.
