[Techmeme 요약] AI 음성 모델 스타트업 Fish Audio, 5천만 달러 투자 유치하며 성장 가속화
0
설명
AI 음성 모델 개발 스타트업 Fish Audio가 2026년 7월 28일, Coreline Ventures와 Capital Today가 주도한 5천만 달러 규모의 시드(seed) 투자를 유치했습니다.
이 자금은 크리에이터와 기업을 위한 더욱 발전된 AI 음성 모델 개발에 사용될 예정입니다.
Fish Audio는 현재 연간 반복 매출(ARR) 2,100만 달러를 기록하며 빠르게 성장하고 있습니다.
### 배경 설명
인공지능(AI) 기술이 발전하면서, 사람의 목소리를 모방하거나 새로운 목소리를 생성하는 AI 음성 모델의 중요성이 커지고 있습니다. 이러한 기술은 콘텐츠 제작, 고객 지원 자동화, 게임 캐릭터 더빙 등 다양한 분야에서 활용됩니다.
Fish Audio는 이러한 시장의 요구에 맞춰, 15,000개 이상의 자연어 제어 기능을 갖춘 AI 음성 모델 라이브러리를 구축하고 있습니다. 특히, 크리에이터에게는 더욱 풍부하고 감정적인 표현이 가능한 음성을, 기업에게는 고객 응대 및 판매 업무 자동화를 위한 제어 가능한 음성을 제공하는 것을 목표로 합니다.
이 회사는 2025년 출시 이후 800만 명 이상의 사용자를 확보했으며, 오픈소스 버전과 유료 호스팅 버전을 모두 제공하고 있습니다. 이번 투자 유치는 Fish Audio가 기술 개발을 가속화하고 더 많은 기업 고객을 확보하는 데 중요한 발판이 될 것으로 보입니다.
### Fish Audio의 성장 동력: 오픈소스와 유료 서비스의 조화
Fish Audio는 전 NVIDIA 연구원이었던 Shijia Liao가 비표현적인 합성 음성에 대한 불만으로 시작한 프로젝트에서 출발했습니다. 그의 오픈소스 음성 생성 모델인 'Fish Speech'는 GitHub에서 31,000개 이상의 별(star)을 받으며 인디 개발자, 게임 디자이너, 크리에이터들 사이에서 큰 인기를 얻었습니다. 지난 1년간 네 개의 음성 생성 모델과 하나의 음성-텍스트 변환(Speech-to-Text) 모델을 출시했으며, 이 중 세 개의 음성 생성 모델은 오픈소스로 제공됩니다. 최신 모델인 S2.1 Pro는 유료 API를 통해서만 접근 가능합니다. 크리에이터와 팀을 위한 월간 유료 플랜은 일정 시간의 음성 생성 시간을 제공하며, 음성 복제 기능도 포함합니다. 또한, HeyGen, Sanas, Plaud와 같은 기업들이 이미 사용 중인 엔터프라이즈 버전의 API와 플랫폼도 제공합니다.
### 커뮤니티 기반 모델의 도전과 해결 노력
Fish Audio는 사용자의 목소리를 직접 받아 모델 학습에 활용하고, 사용될 경우 보상하는 커뮤니티 기반 모델을 운영해왔습니다. 하지만 최근 몇 달간 일부 크리에이터들은 자신의 목소리가 동의 없이 Fish Audio에 업로드되었다고 주장하며 논란이 일었습니다. 초기에는 디지털 밀레니엄 저작권법(DMCA)에 따른 콘텐츠 삭제 절차가 있었으나, 시간이 오래 걸린다는 지적이 있었습니다. Fish Audio의 CEO인 Rissa Cao는 이러한 문제를 해결하기 위해 삭제 절차를 자동화했다고 밝혔습니다. 이제 사용자는 짧은 음성 샘플이나 계약서를 제출하면 3분 이내에 자신의 목소리가 플랫폼에서 삭제되도록 할 수 있습니다. Coreline Ventures의 파트너인 Oskue Honda는 커뮤니티 중심 모델이 성공하려면 투명성과 신뢰가 필수적이며, 향후에는 음성 소유권 인증, 명확한 라이선스 조건, 쉬운 신고 및 삭제 절차, 그리고 궁극적으로는 음성 사용에 따른 수익 공유 모델이 필요하다고 강조했습니다.
### 미래 기술 개발 및 시장 경쟁
Fish Audio는 이번 투자 유치를 통해 오디오 이해 모델과 음성-음성 변환(Speech-to-Speech) 모델 개발에 박차를 가할 계획입니다. 현재 AI 음성 생성 시장은 ElevenLabs, WellSaid, Cartesia 등 다수의 경쟁사들이 존재하며 치열한 경쟁이 벌어지고 있습니다. 359 Capital의 파트너인 Rico Mallozzi는 Fish Audio가 개발자 친화적인 세밀한 제어 기능과 비용 효율적인 모델 학습을 통해 경쟁 우위를 확보할 수 있을 것으로 전망했습니다. 그는 Fish Audio가 보유한 기술력으로 인해 대규모 AI 연구소들과의 격차를 빠르게 좁히고 있으며, 인공적인 목소리와 사람 목소리 간의 경계를 허무는 데 기여하고 있다고 평가했습니다.
### 가치와 인사이트
Fish Audio의 5천만 달러 시드 투자 유치는 AI 음성 기술 시장의 성장 잠재력과 함께, 크리에이터와의 신뢰 구축 및 투명한 운영이 얼마나 중요한지를 보여줍니다. 오픈소스와 유료 서비스의 결합, 그리고 커뮤니티 참여를 통한 기술 발전은 앞으로도 AI 분야에서 중요한 성공 요인이 될 것입니다. 또한, 음성 데이터의 소유권 및 활용에 대한 윤리적, 법적 논의가 더욱 활발해질 것으로 예상됩니다.
### 향후 전망
이번 투자는 Fish Audio가 더욱 정교하고 다양한 AI 음성 모델을 개발하는 데 기여할 것입니다. 향후에는 게임, 영화, 오디오북 제작 등 엔터테인먼트 산업뿐만 아니라, 개인화된 교육 콘텐츠, 접근성 향상을 위한 보조 기술 등 더욱 폭넓은 분야에서 Fish Audio의 기술이 활용될 가능성이 높습니다. 또한, 음성 데이터의 윤리적 사용과 저작권 보호에 대한 사회적 요구가 커짐에 따라, Fish Audio는 이러한 문제를 해결하기 위한 기술적, 정책적 노력을 지속해야 할 것입니다. 이는 AI 음성 기술의 건전한 발전과 함께 새로운 비즈니스 기회를 창출할 것입니다.
📝 원문 및 참고
- Source: Techmeme
- Techmeme 리버: [techmeme.com](https://www.techmeme.com/260728/p22#a260728p22)
- 원문 기사: [링크 열기](https://techcrunch.com/2026/07/28/fish-audio-raises-50m-seed-to-build-ai-voice-models-for-creators-and-enterprises/)
---
출처: Techmeme ([Original Article](https://techcrunch.com/2026/07/28/fish-audio-raises-50m-seed-to-build-ai-voice-models-for-creators-and-enterprises/))
신고 · 불법·유해·아동 안전(CSAE) 관련 콘텐츠
댓글 0
아직 댓글이 없습니다. 첫 댓글을 남겨 보세요.