#2 · 主分类: 语音合成与识别

Real-Time-Voice-Cloning

deep-learning python pytorch tensorflow tts voice-cloning

在5秒内克隆声音,实时生成任意语音

项目最后更新:03/09/26

GitHub Stars

60.1K

Forks数量

9.4K

贡献者数量

20

许可证

Other

收录理由

这是语音克隆领域被研究得最广泛的开源实现之一,核心基于SV2TTS框架。它只需几秒参考音频就能提取说话人特征,再用该特征驱动文本转语音合成器与实时声码器生成语音。项目自带图形界面工具箱,可录制样本并输入文字,立即听到克隆后的声音,也提供命令行方式便于脚本化使用。作者坦诚代码库已随时间老化,商业服务如今能提供更清晰的音质,因此该项目更适合作为参考实现,帮助理解说话人验证与多说话人合成如何衔接,而非直接用于生产环境的TTS引擎。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目