Fish Audio raises $52M seed to build AI voice models for creators and enterprises

Fish Audio raises $52M seed to build AI voice models for creators and enterprises

전 Nvidia 연구원이 창업한 Fish Audio가 시드 라운드에서 5,200만 달러를 조달해 크리에이터와 기업 대상 AI 음성 모델 개발을 본격 확대합니다.

캘리포니아주 팔로알토 소재 인공지능 음성 모델 스타트업 피시 오디오가 시드 라운드에서 총 오천이백만 달러의 투자를 유치했습니다. 코어라인 벤처스와 캐피털 투데이가 공동 리드를 맡았으며, 다수의 투자사가 이번 라운드에 참여했어요. 회사는 전직 엔비디아 연구원 출신인 샤오지아 리아오가 창업했으며, 서비스 출시 이후 빠르게 성장해 현재 팔백만 명 이상의 사용자와 연간 반복 매출 이천백만 달러를 달성했습니다. 플랫폼은 만오천 개 이상의 자연어 제어 옵션을 갖춘 음성 생성 라이브러리를 제공하며, 지난 한 해 동안 음성 생성 모델 네 종과 음성-텍스트 변환 모델 한 종 등 총 다섯 가지 모델을 출시했어요. 이 중 세 개 모델은 오픈소스로 공개되어 깃허브에서 삼만 천 개 이상의 스타를 기록하고 있으며, 최신 모델은 유료 방식의 인터페이스로만 제공됩니다.

피시 오디오는 크리에이터와 기업 시장을 동시에 공략하는 이중 전략을 취하고 있어요. 크리에이터는 월 정기 구독 플랜을 통해 음성 생성 시간과 보이스 클로닝 기능을 이용할 수 있고, 기업 고객들은 인공지능 아바타, 게임 캐릭터 음성, 음성 에이전트 구현에 이 기술을 적극 활용하고 있습니다. 한편, 창작자들의 동의 없이 목소리가 무단으로 업로드됐다는 논란이 있었는데, 피시 오디오는 신청 후 삼 분 이내 음성 삭제가 가능한 자동화 시스템을 구축해 대응했어요. 최고경영자 리사 카오는 이번 투자를 통해 더욱 고도화된 모델 개발과 늘어나는 기업 수요에 적극 대응할 수 있게 됐다고 밝혔습니다. 올해 안에 오디오 이해 모델을, 향후에는 음성 간 직접 변환이 가능한 음성 대 음성 변환 모델도 출시할 계획이에요. 인공지능 음성 합성 시장의 경쟁이 갈수록 치열해지는 가운데, 피시 오디오가 오픈소스 생태계와 기업 고객 기반을 무기로 차별화된 입지를 구축할 수 있을지 주목됩니다.

원문: TechCrunch