#36 · 主分类: 语音合成与识别

wav2letter

cpp deep-learning end-to-end speech-recognition wav2letter

Facebook AI Research 的自动语音识别工具包

项目最后更新:08/28/26

GitHub Stars

6.4K

Forks数量

988

贡献者数量

52

许可证

Other

收录理由

wav2letter 是 Facebook AI Research 开发的自动语音识别工具包,专注于训练和运行从原始音频直接到文本的端到端模型。这个仓库收录了与已发表论文配套的可复现实验配置,涵盖流式卷积网络、免词典解码和半监督自训练等方向,还提供了预训练模型供直接使用。需要留意的是,项目的后续开发已迁移至 Flashlight 项目,因此当前仓库更适合作为验证成熟方案与复现结果的参考,而非继续扩展的代码基础。对于希望复现公开语音识别成果、或者想了解一套生产级端到端系统如何搭建的研究者和工程师来说,这份参考价值恰恰是最关键的。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目