#133 · 主分类: 语音合成与识别
hifi-gan
deep-learning
gan
hifi-gan
pytorch
speech-synthesis
text-to-speech
tts
vocoder
HiFi-GAN:用于高效高保真语音合成的生成对抗网络
项目最后更新:07/27/24
GitHub Stars
2.4K
Forks数量
557
贡献者数量
2
许可证
MIT
收录理由
做语音合成的人都知道,把梅尔频谱转成最终音频是绕不开的一步。HiFi-GAN 用生成对抗网络来完成这件事,生成的语音听感自然,速度也比早先的自回归声码器快不少。仓库里直接给了预训练模型,下载就能跑,不用自己从头训练。它还提供了一个轻量版,在 CPU 上也能较快出结果,适合很多实际场景。如果你想在采购商业声码器之前先试试开源方案,这个项目值得花时间验证一下。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。