중국 AI 스타트업 미니맥스(MiniMax)가 텍스트, 이미지, 오디오 등 다양한 입력을 통합하여 2K 해상도의 비디오를 생성하는 멀티모달 AI 모델 '미니맥스 H3'를 출시했습니다. 이 모델은 특히 모션 디자인과 브랜딩 분야에서 상업용 콘텐츠 제작을 혁신할 잠재력을 가지고 있으며, 정확한 텍스트 렌더링과 시각적 패키징, 복잡한 지시 이행 능력을 강점으로 내세웁니다.
2022년 초 설립된 미니맥스는 인공 일반 지능(AGI) 달성을 목표로 다양한 멀티모달 파운데이션 모델(foundation models)을 개발해왔습니다. 미니맥스 H3는 이러한 노력의 일환으로, 텍스트, 오디오, 이미지, 비디오, 음악 등 여러 양식을 이해하고 생성하며 통합할 수 있는 능력을 갖추고 있습니다. 특히 2K 해상도의 비디오를 원본 스테레오 사운드와 함께 생성할 수 있어, 기존 영상 생성 AI 모델 대비 높은 품질과 활용성을 제공합니다.
미니맥스 H3의 출시는 AI 기반 영상 제작 시장에 중요한 이정표가 될 것으로 보입니다. 텍스트 프롬프트만으로도 고품질의 상업용 영상을 만들 수 있게 됨으로써, 마케터, 디자이너, 소규모 비즈니스 등 다양한 주체들이 훨씬 적은 비용과 시간으로 전문적인 수준의 영상 콘텐츠를 제작할 수 있게 될 것입니다. 이는 콘텐츠 제작의 진입 장벽을 낮추고, 개인 창작자와 기업 모두에게 새로운 비즈니스 기회를 제공할 잠정력을 가지고 있습니다.
