Soprano开源TTS模型仅80M参数主打轻量低延迟

最近看到一个挺有意思的开源项目,推荐给大家。

从搜索结果来看,这个项目确实很火,说明确实有很多人在关注语音合成。

想本地跑 TTS,又嫌那些模型太重?可以看看 Soprano。

Soprano 是一个主打轻量和低延迟的开源 TTS 模型,只有约 80M 参数,重点就是让语音合成跑得足够快。

它支持 CPU、GPU 推理,GPU 下还能做到非常低的延迟,适合实时语音交互。

同时提供多种使用方式:

  • OpenAI 兼容 API
  • WebUI
  • CLI
  • ComfyUI

输出支持 32kHz 音频,内存占用也比较低。

如果你想自己部署一个轻量、低延迟的语音合成服务,Soprano 是个值得试试的选择。

项目地址:github.com/ekwek1/soprano

对于做AI开发、关注AI工具的小伙伴来说,这个是真的有帮助。

以前想做语音合成,要么自己搭建环境,要么用国外的平台。现在有了Soprano,可以直接用开源工具生成语音,还能支持多种平台和功能。

对于想了解AI工具、想关注AI发展的小伙伴来说,这个是真的有帮助。

话题来源 @bkdgiffug 756K阅读 ❤️8 x.com/…↗ 已改写,非原文转载
19 浏览 0 评论 0 反应
登录 后参与评论
还没有评论,来抢沙发。
查看完整榜单
查看完整榜单
查看完整榜单