#17 · 主分类: 语音合成与识别

vosk-api

android asr deep-learning deep-neural-networks deepspeech google-speech-to-text ios kaldi offline privacy python raspberry-pi speaker-identification speaker-verification speech-recognition speech-to-text speech-to-text-android stt voice-recognition vosk

适用于Android、iOS、Raspberry Pi和服务器的离线语音识别API,支持Python、Java、C#和Node

项目最后更新:08/09/26

GitHub Stars

15.1K

Forks数量

1.8K

贡献者数量

51

许可证

Apache-2.0

收录理由

如果你需要一套完全在设备本地运行的语音识别方案,Vosk 是个很实在的选择,整个过程不依赖云端往返。它的模型体积不大,大约 50 MB,却支持 20 多种语言,并且能通过流式接口实现连续大词汇量转写,响应几乎没有延迟。这意味着它很适合做语音助手、智能家居设备,或者给直播、讲座实时生成字幕。工具包为 Python、Java、Node.js、C#、C++、Rust、Go 等多种语言提供了绑定,同一套引擎可以跑在移动端、嵌入式设备和服务端代码里。从树莓派或安卓手机到更大的服务器集群,它都能灵活伸缩;由于所有处理都在本地完成,对于音频数据不能离开设备的隐私敏感场景尤其合适。此外,说话人识别和可重新配置的词汇表,让你在搭建定制化转写流程时拥有更多控制力。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目