#57 · 主分类: 语音合成与识别

stt

speech speech-recognition speech-to-text stt

语音识别转文字工具 / 一个离线运行的本地音视频转字幕工具,输出json、srt字幕、纯文字格式

项目最后更新:01/22/26

GitHub Stars

4.8K

Forks数量

499

贡献者数量

11

许可证

GPL-3.0

收录理由

这个工具把语音识别流程完整地跑在本地,基于 faster-whisper 模型,音视频文件无需上传到第三方服务就能转成文字。对于在意数据隐私、或者想省去按分钟计费的 API 开销的团队来说,它在自有硬件上就能达到与 OpenAI 转录接口相近的实用准确率。自带的浏览器界面支持拖拽上传,可以手动指定源语言,模型从 tiny 到 large-v3 都能选,结果可输出为纯文本、JSON 或带时间戳的 SRT 字幕。同一套引擎也通过 HTTP 接口暴露出来,现有代码想替换外部语音识别服务时,直接对接即可。无论是批量给视频内容生成字幕,还是想长期削减转录账单,它都提供了很实在的替代方案。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目