OmniVoice:开源语音克隆神器,声音轻松实现“一键复制”

最近挖到一个挺有意思的开源项目叫 OmniVoice,一个用 Python 开发的语音生成(克隆)项目。

简单来说,它可以根据一段参考音频,学习说话人的声音特征,然后生成用这个声音说出来的新内容。

最让我觉得有意思的是,它不只是简单模仿音色,还可以对年龄、音高、方言、气息等声音特征进行调整,而且支持多语言生成,不需要针对每个人单独进行长时间训练,拿到参考音频就可以直接尝试。

另外,我发现它的生成速度也很快,项目介绍中给出的速度可以达到实时速度的数十倍级别。也就是说,一段音频处理完成后,可以比较快速地生成对应的语音。

对于经常做视频、配音或者多语言内容的人来说,这类工具还是挺方便的。比如你录一段自己的声音,然后让 AI 用类似的声音去生成其他语言的内容,就不用每种语言都重新找人配音了。

我大慨使用了体验一下,感觉 OmniVoice 更像是一个可以自己部署、自己折腾的开源语音实验平台,如果你的项目中需要用到 AI 语音、声音克隆或者多语言配音,个人认为非常值得研究一下。

项目是开源的,感兴趣可以直接去 GitHub 看看: