베트남 연구팀이 대규모 언어모델(LLM)을 활용한 다중 에이전트 시스템 'ViFA-Council'을 개발하여 베트남 민속 예술 이미지를 생성하는 데 성공했습니다. 이 시스템은 단순히 텍스트를 이미지로 변환하는 것을 넘어, 여러 AI 에이전트가 마치 인간 전문가처럼 서로 논의하고 협력하며 예술적 아이디어를 발전시키는 방식으로 작동합니다. 이는 AI가 복잡한 문화적 맥락과 창의성을 이해하고 표현하는 새로운 접근 방식을 제시합니다.
ViFA-Council은 '기획자', '비평가', '예술가' 등 다양한 역할을 맡은 LLM 에이전트들로 구성됩니다. 기획자 에이전트는 사용자의 프롬프트(명령어)를 바탕으로 초기 아이디어를 구상하고, 비평가 에이전트는 이 아이디어를 평가하고 개선점을 제시합니다. 예술가 에이전트는 이러한 논의를 바탕으로 실제 이미지를 생성하며, 이 과정은 만족스러운 결과가 나올 때까지 반복됩니다. 이 다단계 협업 방식은 단순한 프롬프트 엔지니어링으로는 얻기 어려운 깊이와 복잡성을 가진 예술 작품을 만들어낼 수 있게 합니다. 특히 베트남의 풍부한 민속 신화, 전설, 전통 의상 등 고유한 문화 요소를 이미지에 효과적으로 통합하는 데 중점을 두었습니다.
이러한 다중 에이전트 시스템은 AI의 창의적 잠재력을 한 단계 끌어올리는 중요한 진전입니다. 기존의 단일 LLM 기반 이미지 생성 모델이 놓칠 수 있는 문화적 뉘앙스와 예술적 깊이를 여러 에이전트의 상호작용을 통해 포착할 수 있기 때문입니다. 이는 비단 예술 창작뿐만 아니라, 복잡한 문제 해결, 콘텐츠 기획, 교육 등 다양한 분야에서 AI의 활용 가능성을 넓힐 것입니다. 또한, 소멸 위기에 처한 전통 예술과 문화를 AI를 통해 보존하고 현대적으로 재해석하는 데 기여할 수 있다는 점에서 의미가 큽니다.