昨天刷到一个开源项目OmniVoice,Python写的,GitHub星都快冲1万了。我本来就是个声控,看到这玩意儿反手就star了。
它能干啥,我一句话给你捋明白:你丢给它一段你说话的音频,它就能把你的声音彻底复刻出来。注意,是彻底,不是模仿。
600多种语言,年龄音高方言气音全都能调,而且不用提前训练,直接就能用。
最离谱的是啥?生成速度比实时快40倍。你这边说完,那边它就把你的声音安排到任何语言里了。
做视频配音、搞多语言内容的兄弟,这基本等于白嫖神器。
我昨天用它试了一下,把一段中文语音转成英文,声音居然还是我自己的。以前用其他工具做多语言配音,要么声音不像,要么得花好几天训练模型。这个直接就能用,省了不少事。
有个做口播的朋友跟我说,他现在用这个工具做多语言版本的视频,以前得找好几个配音员,现在一个人就搞定了。
项目地址:github.com/k2-fsa/OmniVoi…
话题来源 @huoshan007
128.4K阅读 ❤️2348 x.com/…↗ 已改写,非原文转载
20 浏览 0 评论
0 反应
















