#41 · 主分类: 语音合成与识别
wenet
asr
automatic-speech-recognition
conformer
e2e-models
production-ready
pytorch
speech-recognition
transformer
whisper
生产优先且生产就绪的端到端语音识别工具包
项目最后更新:06/15/26
GitHub Stars
5.2K
Forks数量
1.2K
贡献者数量
158
许可证
Apache-2.0
收录理由
WeNet 的设计初衷是让语音识别真正经得起生产环境的考验,而不只是停留在演示阶段。它用 PyTorch 训练 Conformer 和 Transformer 模型,训练好的管线可以直接推到预编译的运行时里,部署在 Linux 服务器、Android、iOS、树莓派甚至 NPU 上。针对中文语音,它自带了 Paraformer、Wenetspeech 等预训练权重,英文则通过 Whisper 后端在同一个接口下完成。pip 包装好了命令行和 Python API,想先拿一段音频试试效果,完全不需要碰复杂的训练环境。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。