AI 음악 생성 분야의 선두 주자인 스타트업 수노(Suno)가 사용자의 음성(spoken word)에 맞춰 자동으로 배경 음악을 만들어주는 혁신적인 도구를 공개했습니다. 이 기술은 사용자가 말하는 내용의 감정, 속도, 스타일 등을 분석하여 가장 적합한 분위기와 장르의 음악을 즉석에서 생성해내는 것이 특징입니다. 기존의 텍스트 기반 음악 생성에서 한 단계 더 나아가, 음성 콘텐츠 제작자들이 겪는 배경 음악 선정 및 제작의 어려움을 크게 해소할 것으로 기대됩니다.
수노의 새로운 도구는 단순히 음성을 음악으로 변환하는 것을 넘어, 입력된 음성의 뉘앙스를 파악하여 다채로운 악기 구성과 멜로디를 자동으로 조합합니다. 예를 들어, 차분한 목소리로 이야기를 하면 잔잔한 피아노 선율이, 역동적인 어조로 스포츠 중계를 하면 비트감 있는 전자음악이 생성되는 식입니다. 이러한 기능은 팟캐스트, 오디오북, 유튜브 영상, 프레젠테이션 등 다양한 형태의 음성 기반 콘텐츠에 전문적인 수준의 배경 음악을 손쉽게 추가할 수 있게 하여, 콘텐츠의 몰입도와 완성도를 크게 높일 수 있습니다.
이번 수노의 발표는 AI 음악 기술이 단순한 실험 단계를 넘어 실제 콘텐츠 제작 시장에서 강력한 도구로 자리매김할 수 있음을 보여줍니다. 특히, 음악 저작권 문제나 고품질 음악 제작 비용에 대한 부담을 느끼던 개인 크리에이터나 소규모 스튜디오에게는 매우 매력적인 대안이 될 것입니다. AI가 생성한 음악은 저작권 분쟁에서 상대적으로 자유롭고, 전문 작곡가나 스튜디오에 의뢰하는 것보다 훨씬 저렴한 비용으로 원하는 분위기의 음악을 얻을 수 있기 때문입니다. 이는 콘텐츠 제작의 민주화를 가속화하고, 창작자들이 오직 콘텐츠의 본질에만 집중할 수 있는 환경을 조성하는 데 기여할 것으로 보입니다.