구글이 영상 제작 시장을 겨냥한 강력한 생성형 영상 모델 '제미니 옴니 1.1 플래시(Gemini Omni 1.1 Flash)'를 제미니 API(Gemini API)를 통해 선보였습니다. 이 모델은 기존 생성형 영상 도구의 한계를 뛰어넘어, 장면 연장, 키프레임 전환, 참조 영상 활용, 그리고 최대 4K 해상도 출력을 지원하며 영상 제작의 정교한 제어와 효율성을 크게 높였습니다.
제미니 옴니 1.1 플래시는 최대 10초의 이전 문맥을 분석하여 영상을 10초 단위로 최대 40초까지 자연스럽게 연장할 수 있습니다. 이는 기존 모델이 마지막 1초만 참조하던 한계를 개선한 것입니다. 또한, 시작 및 종료 프레임을 지정해 복잡한 카메라 이동이나 반복 영상을 만들 수 있으며, 최대 3초의 참조 영상을 활용하여 시각적 문맥과 캐릭터 일관성을 유지하는 기능도 추가되었습니다. 특히, 360p 초안은 기존 720p보다 최대 60% 빠르고 비용은 3분의 1 수준으로 프로토타이핑에 용이하며, 최종 결과물은 1080p 또는 4K로 업스케일(upscale)할 수 있습니다. 어도비 파이어플라이(Adobe Firefly), 피그마 위브(Figma Weave), GMI 클라우드(GMI Cloud), 런웨이(Runway) 등 주요 플랫폼들이 이미 이 모델을 실제 제작 환경에 적용하고 있습니다.
이번 출시는 생성형 인공지능(AI)이 영상 제작 산업에 미치는 영향을 더욱 가속화할 것으로 보입니다. 개발자들은 제미니 API를 통해 이 강력한 기능을 자신들의 애플리케이션에 통합하여, 영상 워크플로우를 혁신하고 창작 도구의 가능성을 확장할 수 있습니다. 특히, 빠른 초안 생성과 고해상도 최종 출력의 조합은 콘텐츠 제작 비용과 시간을 획기적으로 줄여줄 수 있어, 소규모 스튜디오나 개인 크리에이터에게도 큰 기회가 될 수 있습니다. 구글은 유튜브(YouTube)라는 거대한 영상 플랫폼을 보유하고 있어, 이러한 생성형 영상 기술이 광고 및 콘텐츠 제작 시장에 미칠 파급력은 상당할 것으로 예상됩니다.