一个叫OmniVoice的开源项目火了,GitHub星标快1万了。这个项目能用600多种语言完全复刻你的声音,而且是零样本语音合成,不需要大量训练数据。
核心功能挺实用的:用音频样本就能克隆声音,还能调整年龄、音高、方言、气音这些参数。实时生成速度快40倍,做多语言内容和视频配音的人应该会很感兴趣。
我试了一下,效果确实不错。比如你录一段中文音频,它能直接生成英文、日文、韩文等600多种语言的版本,而且保留了原声的音色特点。对于做跨国内容创作的团队来说,这能省下大量配音成本。
项目地址:github.com/k2-fsa/OmniVoi…
Python写的,安装和使用都比较简单。如果你在做多语言内容,或者需要批量生成语音,可以试试这个。
话题来源 @xiaoying_eth
48.3K阅读 ❤️968 x.com/…↗ 已改写,非原文转载
23 浏览 0 评论
0 反应










