#127 · 主分类: 语音合成与识别

whisper-web

javascript transformers whisper

ML驱动的语音识别,直接在浏览器中运行

项目最后更新:10/01/24

GitHub Stars

3.3K

Forks数量

426

贡献者数量

3

许可证

MIT

收录理由

对于想在浏览器里直接完成语音转文字、又不想自己搭后端或按分钟付费调用API的Web开发者来说,这个仓库提供了一个可以立刻上手的参考实现。它借助Transformers.js让OpenAI的Whisper模型完全在浏览器端运行,音频数据从头到尾不离开用户设备,对涉及隐私的转录场景是个实在的加分项。与其说它是一个开箱即用的库,不如说它更像一个能跑通的示范项目:克隆下来、启动开发服务器,就能看到多语言转录和可选的时间戳功能。另外,仓库里还有一个实验分支,把计算量大的部分交给WebGPU做加速,并且提供了在线演示页面,方便你在决定采用之前先实际感受一下效果。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目