#115 · 主分类: 语音合成与识别
sherpa-ncnn
使用下一代Kaldi和ncnn进行实时语音识别和语音活动检测(VAD),无需互联网连接。支持iOS、Android、Linux、macOS、Windows、Raspberry Pi、VisionFive2、LicheePi4A等。
项目最后更新:10/20/25
GitHub Stars
1.8K
Forks数量
218
贡献者数量
21
许可证
Apache-2.0
收录理由
sherpa-ncnn 把流式语音识别、文本转语音和语音活动检测都放在设备端本地运行,语音助手或转写工具因此可以在完全离线的情况下工作。它基于腾讯的轻量级 ncnn 推理引擎,不依赖 PyTorch 等重型框架,编译一次就能跑在 iOS、Android、Windows、macOS、Linux、WebAssembly 上,也支持 ARM 和 RISC-V 开发板,比如树莓派和 VisionFive2。项目提供了 C++、Python、Go、C#、Kotlin、JavaScript、Swift 等多种语言的绑定,多数团队可以直接接入自己熟悉的编程环境。在资源受限或对隐私敏感的场景里,如果语音功能必须稳定可靠地工作,这个库是一条很实际的路径。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。