#5 · 主分类: 语音合成与识别
TTS
deep-learning
glow-tts
hifigan
melgan
multi-speaker-tts
python
pytorch
speaker-encoder
speaker-encodings
speech
speech-synthesis
tacotron
text-to-speech
tts
tts-model
vocoder
voice-cloning
voice-conversion
voice-synthesis
🐸💬 - 用于文本转语音的深度学习工具包,在研究和生产中久经考验。
项目最后更新:08/16/24
GitHub Stars
46.0K
Forks数量
6.1K
贡献者数量
166
许可证
MPL-2.0
收录理由
如果你需要语音合成,又不想从零拼装各种模型组件,Coqui TTS 是一个很顺手的起点。它把 Tacotron、Glow-TTS 这些经典模型,和 XTTS、Bark 这类新模型都收在同一个代码库里,你可以按自己的场景挑合适的方案,省去自己接线调试的功夫。这套代码既能跑快速推理脚本,也能起服务,还能拿自己的声音数据微调预训练模型,研究或落地都够用。预训练声音覆盖超过一千种语言,XTTS 的流式输出延迟低于 200 毫秒,很多实际部署都能直接满足。如果团队既要声音克隆,又需要在一个持续维护的项目里完成模型训练,用它就能省下把多个库拼在一起的工作量。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。