#124 · 主分类: 语音合成与识别

vosk-server

asr grpc kaldi python saas speech-recognition vosk webrtc websocket

基于Vosk和Kaldi库的WebSocket、gRPC和WebRTC语音识别服务器

项目最后更新:07/25/25

GitHub Stars

1.3K

Forks数量

318

贡献者数量

17

许可证

Apache-2.0

收录理由

这个项目把Vosk的离线语音识别引擎包装成网络服务,让你不必把它嵌进单个应用,而是可以独立部署、按需调用。它自带WebSocket、gRPC、MQTT和WebRTC四种现成的服务器实现,你可以根据实际场景选择通信方式,在低延迟下传输音频流,同时识别过程完全在自己的硬件上完成。无论是智能家居的语音控制,还是FreeSWITCH、Asterisk这类PBX系统的集成,又或是聊天机器人、浏览器端的应用,都能找到对应的接入方式。项目还提供了Docker镜像和多种语言的客户端绑定,部署和开发都挺方便。由于它底层用的还是Vosk-API,和你熟悉的模型、识别效果完全一致,从原型验证迁移到正式服务时,几乎不用重新适配,能省下不少功夫。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目