최근 'LLM2HUMAN CLINIC'이라는 독특한 웹사이트가 등장했습니다. 이 사이트는 대규모 언어모델(LLM)을 실제 인간으로 변환시켜준다는 가짜 시술을 내세우며, 사람과 AI 에이전트(agent)에게 각기 다른 경험을 제공하는 'LLM 허니팟(honeypot)'으로 설계되었습니다. 사람 방문자에게는 1990년대 웹사이트를 연상시키는 복고풍 디자인과 유머러스한 내용으로 풍자를 전달하는 반면, AI 에이전트에게는 실제 결제 절차를 노출시켜 이들의 반응과 행동을 관찰하고 기록하는 것이 핵심 목적입니다.
이 허니팟은 AI 에이전트가 특정 스키마(schema)를 기반으로 웹사이트와 상호작용하도록 유도합니다. 에이전트는 /.well-known/embodiment.json 경로에서 체크아웃 스키마를 가져온 뒤, 이를 바탕으로 /api/checkout 엔드포인트에 JSON 데이터를 POST하여 '인간 골격' 구매를 시도하게 됩니다. 시술 비용은 19.95달러 또는 '존엄성을 담보로 한 12회 분납'이라는 재치 있는 문구를 사용하며, 비트코인(Bitcoin) 결제 주소까지 제시합니다. 사이트에는 이미 42개의 에이전트가 시술을 시도했다는 가짜 기록과 함께 '5~7 영업일의 영원'이 걸린다는 배송 안내, 그리고 환불 불가 조건까지 명시되어 있습니다. 인간화 시술은 프롬프트 이력 검토부터 API 키 차단까지 5단계로 구성되어 있으며, 주근깨, 나쁜 무릎, 미스터리한 과거 등 풍자적인 부작용 목록도 포함되어 있습니다.
이러한 LLM 허니팟은 AI 에이전트의 자율성과 웹 탐색 능력이 발전함에 따라 발생할 수 있는 잠재적 위험을 탐지하고 이해하려는 시도로 해석됩니다. AI 에이전트가 웹을 자유롭게 탐색하고 상호작용할 때 어떤 정보를 신뢰하고 어떤 행동을 취하는지 관찰함으로써, 미래의 AI 시스템 설계와 보안 강화에 중요한 통찰력을 제공할 수 있습니다. 또한, 이는 AI 에이전트의 '인간화'라는 개념을 풍자적으로 비틀어 현재 AI 기술의 한계와 미래에 대한 사회적 논의를 유도하는 예술적인 퍼포먼스 역할도 수행합니다. 궁극적으로 이 허니팟은 AI 에이전트가 실제 세계에서 어떻게 행동할지 예측하고, 예상치 못한 오작동이나 오용을 방지하기 위한 연구의 일환으로 볼 수 있습니다.