yozm.tech
피드로 돌아가기
The VergeHOTAI 재작성

AI 음악 생성기 수노, 이제 음성까지 만든다

AI 음악 생성으로 잘 알려진 수노(Suno)가 스크립트나 프롬프트 기반의 음성 생성 기능을 새롭게 출시했습니다. 이 '스피치(Speech)' 기능은 음성과 배경 음악을 동시에 생성할 수 있어, 시 낭송이나 드라마틱한 내레이션 등 다양한 활용 가능성을 제시합니다. 현재 웹과 모바일 플랫폼에서 공개 베타로 제공되며, 수노는 이를 통해 플랫폼의 다각화를 꾀하고 있습니다.

5시간 전·2026.10.02·읽기 2분·Jess Weatherbed

AI 음악 생성 서비스로 유명한 수노(Suno)가 이제 음성 생성 기능까지 선보이며 서비스 영역을 확장합니다. 새로 출시된 '스피치(Speech)' 기능은 사용자가 입력한 스크립트나 프롬프트 설명을 바탕으로 음성을 만들어주며, 동시에 배경 음악까지 함께 생성할 수 있는 것이 특징입니다. 이는 수노가 단순한 음악 생성기를 넘어 다양한 형태의 인간 표현을 지원하려는 비전을 보여주는 행보입니다.

수노의 스피치 기능은 현재 웹과 모바일 플랫폼에서 공개 베타로 제공됩니다. 사용자는 '생성(Create)' 탭에서 스피치 옵션을 선택할 수 있으며, 간단한 설명을 통해 원하는 음성을 만드는 '심플(Simple)' 모드와 직접 스크립트를 입력하는 '고급(Advanced)' 모드를 제공합니다. 고급 설정에서는 AI 음성의 성별, 말하기 스타일, 그리고 각 음성 생성의 다양성까지 조절할 수 있습니다. 최대 8분 길이의 음성 생성이 가능하며, 배경 음악은 선택 사항으로 필요에 따라 끌 수 있습니다. 수노는 이 기능이 아직 완벽하지 않지만, 사용자 피드백을 통해 지속적으로 개선해 나갈 것이라고 밝혔습니다.

음성 생성 기술 자체는 딥마인드(DeepMind), 어도비(Adobe), 일레븐랩스(ElevenLabs) 등 여러 기업에서 이미 제공하고 있습니다. 하지만 수노는 AI 음악과 음성을 하나의 응집력 있는 트랙으로 동시에 생성한다는 점에서 차별점을 가집니다. 이는 시 낭송에 잔잔한 배경 음악을 더하거나, 연설에 에너지를 불어넣는 등 특정 사용 사례에서 시너지를 낼 수 있습니다. 수노는 이번 스피치 기능 출시를 통해 플랫폼 다각화를 꾀하며, 저작권 소송 등으로 인한 기존 AI 음악 사업의 리스크를 분산하려는 전략으로도 해석될 수 있습니다. 사용자들은 이 새로운 기능을 통해 더욱 풍부하고 몰입감 있는 오디오 콘텐츠를 손쉽게 제작할 수 있을 것으로 기대됩니다.

1인 창업자를 위한 기회 분석
AI 분석 · 참고용이며 검증이 필요합니다
3/10
약한 신호
왜 3점인가

기존 시장에 강력한 경쟁자들이 많고, 수노의 핵심 차별점이 모든 사용자에게 큰 가치를 제공하지 않을 수 있습니다. 1인 창업자가 직접 AI 모델을 개발하기는 어렵습니다.

문제 / 미충족 수요

AI 음성 생성 시장은 이미 경쟁이 치열하며, 수노의 차별점인 '음악과의 결합'이 모든 사용 사례에 필수적인 것은 아닙니다.

한국 시장
국내 있음한국어 음성 생성 서비스는 이미 다수 존재하며, AI 음악 생성 서비스도 점차 늘어나는 추세입니다. 수노와 같은 통합형 서비스는 아직 드뭅니다.
수익 모델

B2C/B2B 구독 모델, API 종량제 · 돈 내는 주체: 콘텐츠 크리에이터 (유튜버, 팟캐스터, 오디오북 제작자), 소규모 미디어 회사, 마케터

1인 실현 가능성
2/5

AI 음성/음악 생성 자체는 대규모 모델 학습이 필요해 1인 창업이 어렵지만, 기존 API를 활용한 특정 니치 시장의 서비스 개발은 가능합니다.

진입 지점 (Wedge)

특정 분야(예: 오디오 드라마, 명상 콘텐츠)에 특화된 AI 음성+음악 생성 템플릿 및 편집 도구 제공

이번 주 첫 실험

타겟 고객(예: 오디오 드라마 작가)을 대상으로 AI 음성+음악 결합 콘텐츠 제작의 니즈와 페인포인트를 인터뷰하고, 수노와 같은 도구로 프로토타입을 만들어 보여주기

Original source
이 글은 The Verge의 기사를 yozm.tech가 한국어로 재작성한 버전입니다.
원문 보기