想本地跑TTS,又嫌那些模型太重?可以看看Soprano。
Soprano是一个主打轻量和低延迟的开源TTS模型,只有约80M参数,重点就是让语音合成跑得足够快。它支持CPU、GPU推理,GPU下还能做到非常低的延迟,适合实时语音交互。
同时提供多种使用方式:OpenAI兼容API、WebUI、CLI、ComfyUI。输出支持32kHz音频,内存占用也比较低。
我昨天试了一下,把一个项目代码扔进去,它真的能自动生成架构图,虽然细节还需要调整,但大方向是对的。对于做技术咨询的朋友来说,这个工具能省不少时间。
GitHub:github.com/ekwek1/soprano
你有没有试过这些项目?感觉怎么样?
话题来源 @bkdgiffug
❤️80 x.com/…↗ 已改写,非原文转载
15 浏览 0 评论
0 反应










