#174 · 主分类: 语音合成与识别
vosk-browser
一个语音识别库,得益于Vosk的WebAssembly构建,可在浏览器中运行。
项目最后更新:12/07/25
GitHub Stars
528
Forks数量
91
贡献者数量
7
许可证
Apache-2.0
收录理由
vosk-browser 把基于 Kaldi 的 Vosk 语音识别引擎编译成 WebAssembly 模块,像普通 TypeScript 包一样加载到浏览器里。所有识别都在用户设备本地完成,麦克风采集的音频不会上传到任何云端接口,对隐私敏感的场景格外有用。使用时只需指定模型文件、捕获麦克风输入,程序便会持续返回部分结果和最终转写文本。识别任务默认放在 Web Worker 中执行,页面主线程不会被计算阻塞,操作起来依然流畅。官方提供的在线演示支持 13 种语言,既可以直接用麦克风说话,也可以上传音频文件来测试,动手验证识别效果非常方便。模型文件需要你自己准备,这库负责把加载、识别、事件回调这些细节都打理好。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。