Fish Audio完成52亿美元种子轮融资 推动AI语音模型商业落地

融资概览
2026年7月28日,位于硅谷的AI语音公司Fish Audio宣布完成5.2亿美元种子轮融资。领投方为Coreline Ventures,随后Capital Today、359 Capital、Parable、Play Time、Alphalist Partners、Bayhouse Ventures、Carya Venture Partners以及HF0等多家机构跟投。
产品与技术
- 公司自去年启动以来,已开源三款语音生成模型,累计拥有**15,000+**自然语言控制指令,支持情感、语速、音色等细致调节。
- 最新的S2.1 Pro模型仅通过付费API提供,主打低延迟与高保真度,适配企业级语音克隆与实时对话场景。
- 计划在今年推出音频理解模型以及**语音到语音(Speech‑to‑Speech)**模型,进一步拓展从生成到理解的闭环能力。
“社区驱动的模型只有在创作者信任平台时才能持久,”Fish Audio联合创始人兼CEO Rissa Cao 说。
市场与竞争格局
截至目前,Fish Audio的开源或托管版已吸引800万用户,年经常性收入(ARR)突破2100万美元。主要客户包括AI头像平台HeyGen、语音代理公司LiveKit以及游戏工作室等。
同领域竞争者包括ElevenLabs、WellSaid、Cartesia、Speechify、Async(前Podcastle)和Krisp等。
合规与声音所有权
此前平台因部分创作者声称未经同意上传其声音而受到争议。Fish Audio已在系统中嵌入自动化DMCA下架流程,用户只需提交简短音频或授权合同,即可在3分钟内完成删除。
“透明的授权与收益分配是社区模型的核心,”Coreline Ventures合伙人 Osuke Honda 评价道。
前景展望
Cao 表示,种子轮资金将用于加速模型研发、提升云端推理算力以及完善企业级API安全体系。随着生成式语音在AI avatar、客服、游戏配音等场景的渗透,Fish Audio计划通过更细粒度的控制和更低的成本,争夺创作者与企业的预算份额。
行业观点
359 Capital合伙人 Rico Mallozzi 认为,细致的控制指令和成本效益是Fish Audio相较于大型AI实验室的最大竞争优势,若能持续保持模型质量,将在竞争激烈的语音AI赛道中脱颖而出。