时间:2026年7月28日
地点:美国加州帕洛阿尔托
人物:Hanabi AI Inc.(Fish Audio)创始人Shijia Liao、CEO Rissa Cao,以及Coreline Ventures、Capital Today
事件详情:TechCrunch 7月28日报道,AI语音初创公司Fish Audio完成5200万美元种子轮融资,由Coreline Ventures和Capital Today领投,多家机构跟投。公司目前拥有超过800万开源及托管模型用户,年经常性收入达到2100万美元,并提供超过1.5万条自然语言控制能力。Fish Audio表示,融资将用于扩展面向创作者和企业的语音模型、音频理解及语音转语音产品。
背景:Fish Audio源于前英伟达研究员Shijia Liao发起的开源Fish Speech项目,GitHub仓库已获3.1万颗星。公司过去一年推出四款语音生成模型和一款语音转文本模型,部分模型开源。其S2系统采用双自回归架构和强化学习对齐,支持多说话人、多轮生成,以及通过自然语言标签细粒度控制语气、情绪和韵律。
影响:
– 5200万美元种子资金将加速AI语音从内容创作向客服、销售和语音智能体等企业场景扩张
– 超800万用户和2100万美元ARR显示开源模型可以转化为托管服务与API收入
– 自然语言控制、声音克隆和低延迟流式生成,将继续成为AI语音平台竞争的核心能力
– 声音样本收集、授权和非自愿克隆治理,仍是产品规模化必须面对的合规问题
总结:Fish Audio此次融资并不只是语音模型公司的资本加码,也反映出AI交互正在从文字界面向更自然的声音界面延伸。其开源社区带来的用户基础、细粒度情感控制和企业API商业化形成了较完整的产品闭环。下一阶段,Fish Audio能否在音频理解、语音转语音和声音授权治理之间取得平衡,将决定其能否在ElevenLabs、Cartesia等竞争者密集的市场中继续扩大优势。
参考来源:
– https://techcrunch.com/2026/07/28/fish-audio-raises-50m-seed-to-build-ai-voice-models-for-creators-and-enterprises/
– https://fish.audio/
– https://fish.audio/blog/fish-audio-open-sources-s2/
– https://github.com/fishaudio/fish-speech
– https://arxiv.org/abs/2603.08823
– https://sj.cfi.cn/newspage.aspx?id=20260728002439&client=phone
– https://hub.baai.ac.cn/view/52764