#558 · 主分类: 教育与研究

dla

deep-learning keyword-spotting signal-processing speaker-verification speech-recognition tts voice-conversion

音频处理的深度学习

项目最后更新:12/15/25

GitHub Stars

762

Forks数量

123

贡献者数量

14

许可证

MIT

收录理由

这是一套完整的高校课程仓库,面向音频深度学习的系统教学,由高等经济学院计算机系开设并每年更新。内容按周推进,从数字信号处理基础讲起,逐步覆盖自动语音识别、源分离、音视频联合学习以及语音合成等方向,每阶段都配有讲义、研讨班笔记和作业。对于从事语音与音频机器学习的研究者和工程师来说,仓库里提供了现成的PyTorch训练流程、实验追踪配置,以及CTC、RNN-T、波束搜索、Demucs和ConvTasNet等模型的实际代码。由于课程每年重开,材料会跟随技术发展持续修订,既适合自学,也可以作为搭建团队内部培训课程的蓝本。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目