#152 · 主分类: 语音合成与识别

PaddlePaddle-DeepSpeech

asr chinese deep-learning deepspeech deepspeech2 docker nvidia-docker paddlepaddle speech-recognition speech-to-text

基于PaddlePaddle实现的语音识别,中文语音识别。项目完善,识别效果好。支持Windows,Linux下训练和预测,支持Nvidia Jetson开发板预测。

项目最后更新:12/17/25

GitHub Stars

762

Forks数量

146

贡献者数量

2

许可证

Apache-2.0

收录理由

这个项目把DeepSpeech2架构在PaddlePaddle上落地,专门面向中文普通话识别,同时也兼顾英文。它把从数据准备、数据增强,到训练、集束搜索解码、模型导出的完整流程都串了起来,小团队拿到手就能从原始音频跑出可用的识别结果,不用自己东拼西凑脚本。作者还公开了在AIShell、LibriSpeech、WenetSpeech上训练好的预训练模型,中文和英文都有,想快速验证效果或者做二次开发,直接拿这些模型起步会省不少事。部署方面也考虑得比较周全,支持基于VAD的长语音切分、Web推理服务、图形界面,还能在Nvidia Jetson这类边缘设备上跑。如果后续想尝试更新的模型结构,作者维护的PPASR动态图版本还加入了Conformer和Squeezeformer。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目