yozm.tech
피드로 돌아가기
TechCrunchHOTAI 재작성

AI 음성 모델 스타트업 피쉬 오디오, 5,200만 달러 투자 유치

AI 음성 모델 스타트업 피쉬 오디오(Fish Audio)가 시드 라운드에서 5,200만 달러(약 700억 원)를 유치했습니다. 이 회사는 출시 1년 만에 800만 명 이상의 사용자를 확보하고 연간 반복 매출(ARR) 2,100만 달러를 달성하며 빠르게 성장 중입니다. 크리에이터와 기업을 위한 고품질의 표현력 풍부한 AI 음성 모델을 제공하며, 특히 동의 없는 음성 사용 문제 해결을 위한 자동화된 시스템을 구축했습니다.

3시간 전·2026.07.28·읽기 2·Ivan Mehta

AI 음성 모델 스타트업 피쉬 오디오(Fish Audio)가 시드 라운드에서 5,200만 달러(약 700억 원)의 대규모 투자를 유치하며 업계의 주목을 받고 있습니다. 이 회사는 출시 1년 만에 800만 명 이상의 사용자를 끌어모으고 연간 반복 매출(ARR) 2,100만 달러를 기록하는 등 폭발적인 성장세를 보이고 있습니다. 이번 투자는 코어라인 벤처스(Coreline Ventures)와 캐피탈 투데이(Capital Today)가 주도했으며, 359 캐피탈(359 Capital) 등 다수의 투자사가 참여했습니다.

피쉬 오디오는 엔비디아(NVIDIA) 출신 연구원 시지아 랴오(Shijia Liao)가 시장에 만연한 비표현적인 합성 음성에 불만을 느껴 단일 GPU로 음성 생성 모델을 훈련하며 시작되었습니다. 이 프로젝트는 오픈소스 '피쉬 스피치(Fish Speech)'로 깃허브(GitHub)에서 31,000개 이상의 스타를 받으며 인디 개발자, 비디오 게임 디자이너, 크리에이터들 사이에서 큰 인기를 얻었습니다. 현재 피쉬 오디오는 4개의 음성 생성 모델과 1개의 음성-텍스트(speech-to-text) 모델을 포함해 총 5개의 모델을 출시했으며, 최신 S2.1 Pro 모델은 유료 API를 통해서만 제공됩니다. 헤이젠(HeyGen), 사나스(Sanas)와 같은 기업들도 피쉬 오디오의 API와 플랫폼을 활용하고 있습니다.

피쉬 오디오는 15,000개 이상의 자연어 제어 기능을 통해 크리에이티브 산업부터 고객 지원 자동화까지 다양한 기업의 요구를 충족시키고 있습니다. 특히, 사용자들이 자신의 음성을 모델 훈련에 제공하고 보상을 받는 커뮤니티 기반의 접근 방식을 사용하는데, 이 과정에서 발생했던 동의 없는 음성 사용 논란에 대해 3분 이내에 음성을 삭제할 수 있는 자동화된 DMCA 테이크다운(takedown) 프로세스를 도입하여 신뢰 회복에 힘쓰고 있습니다. 투자사 코어라인 벤처스의 오스케 혼다(Osuke Honda) 파트너는 크리에이터의 신뢰가 플랫폼 성공의 핵심임을 강조하며, 투명한 동의, 저작권 확인, 수익 공유 모델의 필요성을 언급했습니다.

피쉬 오디오의 이번 대규모 자금 조달은 급성장하는 AI 음성 시장에서 경쟁력을 강화하고 기술 혁신을 가속화하는 중요한 발판이 될 것입니다. 이들은 올해 안에 오디오 이해(audio understanding) 모델과 음성-음성(speech-to-speech) 모델 출시를 계획하고 있습니다. 엘레븐랩스(ElevenLabs), 웰세이드(WellSaid) 등 경쟁이 치열한 시장에서 피쉬 오디오는 개발자를 위한 세밀한 제어 기능과 비용 효율적인 모델 훈련을 통해 차별화를 꾀하며, 인공 음성과 인간 음성 간의 격차를 줄이는 데 기여할 것으로 기대됩니다.

1인 창업자를 위한 기회 분석
AI 분석 · 참고용이며 검증이 필요합니다
4/10
보통
4점인가

AI 음성 시장의 성장성은 높지만, 기술적 진입 장벽과 저작권 문제 해결의 복잡성으로 1인 창업자가 단독으로 큰 기회를 잡기는 어렵습니다.

문제 / 미충족 수요

AI 음성 모델 시장은 빠르게 성장하고 있지만, 고품질의 표현력 풍부한 음성 생성과 함께 음성 저작권 및 동의 문제가 중요한 해결 과제로 남아 있습니다.

한국 시장
국내 있음한국에도 AI 음성 합성 기술을 제공하는 기업들이 있으나, 고품질의 표현력과 저작권 관리 솔루션을 통합한 서비스는 아직 초기 단계입니다.
수익 모델

B2B SaaS 구독, API 종량제 · 돈 내는 주체: 콘텐츠 크리에이터, 게임 개발사, 기업(고객 지원, 마케팅 부서), 오디오북 제작사

1인 실현 가능성
2/5

고품질 AI 음성 모델 개발은 상당한 데이터와 컴퓨팅 자원이 필요하며, 저작권 관리 시스템 구축 또한 법률적 지식과 기술적 구현이 요구되어 1인 창업자가 단독으로 진입하기는 어렵습니다.

진입 지점 (Wedge)

특정 산업(예: 교육, 오디오북)에 특화된 고품질 AI 음성 모델과 저작권 관리 솔루션을 결합한 서비스

이번 주 첫 실험

타겟 산업의 잠재 고객 10명을 대상으로 현재 AI 음성 사용의 불편함과 저작권 관련 우려 사항에 대한 심층 인터뷰를 진행하여 니즈를 파악한다.

Original source
이 글은 TechCrunch의 기사를 yozm.tech가 한국어로 재작성한 버전입니다.
원문 보기