#124 · 主分类: 语音合成与识别
vosk-server
基于Vosk和Kaldi库的WebSocket、gRPC和WebRTC语音识别服务器
项目最后更新:07/25/25
GitHub Stars
1.3K
Forks数量
318
贡献者数量
17
许可证
Apache-2.0
收录理由
这个项目把Vosk的离线语音识别引擎包装成网络服务,让你不必把它嵌进单个应用,而是可以独立部署、按需调用。它自带WebSocket、gRPC、MQTT和WebRTC四种现成的服务器实现,你可以根据实际场景选择通信方式,在低延迟下传输音频流,同时识别过程完全在自己的硬件上完成。无论是智能家居的语音控制,还是FreeSWITCH、Asterisk这类PBX系统的集成,又或是聊天机器人、浏览器端的应用,都能找到对应的接入方式。项目还提供了Docker镜像和多种语言的客户端绑定,部署和开发都挺方便。由于它底层用的还是Vosk-API,和你熟悉的模型、识别效果完全一致,从原型验证迁移到正式服务时,几乎不用重新适配,能省下不少功夫。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。