#17 · 主分类: 语音合成与识别
vosk-api
适用于Android、iOS、Raspberry Pi和服务器的离线语音识别API,支持Python、Java、C#和Node
项目最后更新:08/09/26
GitHub Stars
15.1K
Forks数量
1.8K
贡献者数量
51
许可证
Apache-2.0
收录理由
如果你需要一套完全在设备本地运行的语音识别方案,Vosk 是个很实在的选择,整个过程不依赖云端往返。它的模型体积不大,大约 50 MB,却支持 20 多种语言,并且能通过流式接口实现连续大词汇量转写,响应几乎没有延迟。这意味着它很适合做语音助手、智能家居设备,或者给直播、讲座实时生成字幕。工具包为 Python、Java、Node.js、C#、C++、Rust、Go 等多种语言提供了绑定,同一套引擎可以跑在移动端、嵌入式设备和服务端代码里。从树莓派或安卓手机到更大的服务器集群,它都能灵活伸缩;由于所有处理都在本地完成,对于音频数据不能离开设备的隐私敏感场景尤其合适。此外,说话人识别和可重新配置的词汇表,让你在搭建定制化转写流程时拥有更多控制力。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。