昨天刷到一个开源项目OmniVoice,Python写的,GitHub星都快冲1万了。我本来就是个声控,看到这玩意反手就star了。
它能干啥,一句话给你捋明白:你丢给它一段你说话的音频,它就能把你的声音彻底复刻出来。注意,是彻底,不是模仿。
600多种语言,年龄音高方言气音全都能调,而且不用提前训练,直接就能用。
最离谱的是啥?生成速度比实时快40倍。你这边说完,那边它就把你的声音安排到任何语言里了。
做视频配音、搞多语言内容的兄弟,这基本等于白嫖神器。
我昨天试了一下,用它给一段中文视频配了英文旁白,效果比之前用的那些TTS工具自然多了。特别是方言和气音的处理,不是那种机械感十足的合成音。
有个做口播的朋友,之前请人配音一段英文介绍要花200块,现在用这个工具自己搞定,省了不少钱。
项目地址:github.com/k2-fsa/OmniVoi…
话题来源 @huoshan007
124.2K阅读 ❤️2245 x.com/…↗ 已改写,非原文转载
21 浏览 0 评论
0 反应













