#263 · 主分类: AI工具目录与精选清单

awesome-speech-recognition-speech-synthesis-papers

acoustic-model attention-mechanism automatic-speech-recognition cnn diffusion-models dnn language-model neural-network papers recognition-synthesis rnn roadmap seq2seq singing-voice-synthesis speaker-verification speech-recognition speech-synthesis timit-dataset tts voice-conversion

自动语音识别(ASR)、说话人验证、语音合成、文本转语音(TTS)、语言建模、歌声合成(SVS)、声音转换(VC)

项目最后更新:10/19/23

GitHub Stars

3.1K

Forks数量

514

贡献者数量

12

许可证

MIT

收录理由

这份论文索引把语音与音频领域的重要研究工作串成了一条清晰的脉络,从早期隐马尔可夫模型和有限状态转换器的经典方法,一路延伸到如今基于注意力机制的序列到序列模型以及扩散模型。对刚接触语音技术的人来说,它不像零散的论文列表那样让人摸不着头脑,而是能帮你理解现代语音识别和语音合成系统是怎么一步步演变过来的。做项目调研时,它更像一张阅读地图:论文按任务类型分好,识别、验证、合成、声音转换、语言建模、音乐建模各归其位,每篇都直接附上PDF链接,省去在arXiv和会议论文库里翻找的功夫。当然,它本质上是文献目录,不是可运行的代码,所以更适合当作学习伴侣和文献综述的起点,而不是直接拿来部署的工具。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目