#41 · 主分类: 语音合成与识别

wenet

asr automatic-speech-recognition conformer e2e-models production-ready pytorch speech-recognition transformer whisper

生产优先且生产就绪的端到端语音识别工具包

项目最后更新:06/15/26

GitHub Stars

5.2K

Forks数量

1.2K

贡献者数量

158

许可证

Apache-2.0

收录理由

WeNet 的设计初衷是让语音识别真正经得起生产环境的考验,而不只是停留在演示阶段。它用 PyTorch 训练 Conformer 和 Transformer 模型,训练好的管线可以直接推到预编译的运行时里,部署在 Linux 服务器、Android、iOS、树莓派甚至 NPU 上。针对中文语音,它自带了 Paraformer、Wenetspeech 等预训练权重,英文则通过 Whisper 后端在同一个接口下完成。pip 包装好了命令行和 Python API,想先拿一段音频试试效果,完全不需要碰复杂的训练环境。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目