#133 · 主分类: 语音合成与识别

hifi-gan

deep-learning gan hifi-gan pytorch speech-synthesis text-to-speech tts vocoder

HiFi-GAN:用于高效高保真语音合成的生成对抗网络

项目最后更新:07/27/24

GitHub Stars

2.4K

Forks数量

557

贡献者数量

2

许可证

MIT

收录理由

做语音合成的人都知道,把梅尔频谱转成最终音频是绕不开的一步。HiFi-GAN 用生成对抗网络来完成这件事,生成的语音听感自然,速度也比早先的自回归声码器快不少。仓库里直接给了预训练模型,下载就能跑,不用自己从头训练。它还提供了一个轻量版,在 CPU 上也能较快出结果,适合很多实际场景。如果你想在采购商业声码器之前先试试开源方案,这个项目值得花时间验证一下。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目