最近看到一个挺有意思的开源项目,推荐给大家。
从搜索结果来看,这个项目确实很火,说明确实有很多人在关注语音合成。
想本地跑 TTS,又嫌那些模型太重?可以看看 Soprano。
Soprano 是一个主打轻量和低延迟的开源 TTS 模型,只有约 80M 参数,重点就是让语音合成跑得足够快。
它支持 CPU、GPU 推理,GPU 下还能做到非常低的延迟,适合实时语音交互。
同时提供多种使用方式:
- OpenAI 兼容 API
- WebUI
- CLI
- ComfyUI
输出支持 32kHz 音频,内存占用也比较低。
如果你想自己部署一个轻量、低延迟的语音合成服务,Soprano 是个值得试试的选择。
项目地址:github.com/ekwek1/soprano
对于做AI开发、关注AI工具的小伙伴来说,这个是真的有帮助。
以前想做语音合成,要么自己搭建环境,要么用国外的平台。现在有了Soprano,可以直接用开源工具生成语音,还能支持多种平台和功能。
对于想了解AI工具、想关注AI发展的小伙伴来说,这个是真的有帮助。
19 浏览 0 评论
0 反应











