#36 · 主分类: 语音合成与识别
wav2letter
cpp
deep-learning
end-to-end
speech-recognition
wav2letter
Facebook AI Research 的自动语音识别工具包
项目最后更新:08/28/26
GitHub Stars
6.4K
Forks数量
988
贡献者数量
52
许可证
Other
收录理由
wav2letter 是 Facebook AI Research 开发的自动语音识别工具包,专注于训练和运行从原始音频直接到文本的端到端模型。这个仓库收录了与已发表论文配套的可复现实验配置,涵盖流式卷积网络、免词典解码和半监督自训练等方向,还提供了预训练模型供直接使用。需要留意的是,项目的后续开发已迁移至 Flashlight 项目,因此当前仓库更适合作为验证成熟方案与复现结果的参考,而非继续扩展的代码基础。对于希望复现公开语音识别成果、或者想了解一套生产级端到端系统如何搭建的研究者和工程师来说,这份参考价值恰恰是最关键的。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。