#58 · 主分类: 语音合成与识别
TTS
:robot: :speech_balloon: 深度学习用于文本转语音 (讨论论坛: https://discourse.mozilla.org/c/tts)
项目最后更新:11/09/23
GitHub Stars
10.2K
Forks数量
1.3K
贡献者数量
56
许可证
MPL-2.0
收录理由
想在自有硬件上跑神经语音合成,这个 PyTorch 项目把通常要自己拼装的部件都打包好了:文本转频谱模型(如 Tacotron 2 和 Glow-TTS)、说话人编码器,以及 MelGAN、WaveGrad 这类声码器。预训练模型覆盖 20 多种语言,装完就能很快出语音;数据集分析工具和灵活的加载器也让重训变得实际——当自带音色不适用时,可以用自己的录音来训练。它还能做多说话人训练、多 GPU 跑,并导出到 TensorFlow/TFLite 用于端侧推理,对要发布语音助手或无障碍功能的团队挺重要。如果你在评估神经 TTS、想找个代码库做实验,这个值得认真考虑。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。