#152 · 主分类: 语音合成与识别
PaddlePaddle-DeepSpeech
基于PaddlePaddle实现的语音识别,中文语音识别。项目完善,识别效果好。支持Windows,Linux下训练和预测,支持Nvidia Jetson开发板预测。
项目最后更新:12/17/25
GitHub Stars
762
Forks数量
146
贡献者数量
2
许可证
Apache-2.0
收录理由
这个项目把DeepSpeech2架构在PaddlePaddle上落地,专门面向中文普通话识别,同时也兼顾英文。它把从数据准备、数据增强,到训练、集束搜索解码、模型导出的完整流程都串了起来,小团队拿到手就能从原始音频跑出可用的识别结果,不用自己东拼西凑脚本。作者还公开了在AIShell、LibriSpeech、WenetSpeech上训练好的预训练模型,中文和英文都有,想快速验证效果或者做二次开发,直接拿这些模型起步会省不少事。部署方面也考虑得比较周全,支持基于VAD的长语音切分、Web推理服务、图形界面,还能在Nvidia Jetson这类边缘设备上跑。如果后续想尝试更新的模型结构,作者维护的PPASR动态图版本还加入了Conformer和Squeezeformer。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。