#2 · 主分类: 语音合成与识别
Real-Time-Voice-Cloning
deep-learning
python
pytorch
tensorflow
tts
voice-cloning
在5秒内克隆声音,实时生成任意语音
项目最后更新:03/09/26
GitHub Stars
60.1K
Forks数量
9.4K
贡献者数量
20
许可证
Other
收录理由
这是语音克隆领域被研究得最广泛的开源实现之一,核心基于SV2TTS框架。它只需几秒参考音频就能提取说话人特征,再用该特征驱动文本转语音合成器与实时声码器生成语音。项目自带图形界面工具箱,可录制样本并输入文字,立即听到克隆后的声音,也提供命令行方式便于脚本化使用。作者坦诚代码库已随时间老化,商业服务如今能提供更清晰的音质,因此该项目更适合作为参考实现,帮助理解说话人验证与多说话人合成如何衔接,而非直接用于生产环境的TTS引擎。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。