#57 · 主分类: 语音合成与识别
stt
语音识别转文字工具 / 一个离线运行的本地音视频转字幕工具,输出json、srt字幕、纯文字格式
项目最后更新:01/22/26
GitHub Stars
4.8K
Forks数量
499
贡献者数量
11
许可证
GPL-3.0
收录理由
这个工具把语音识别流程完整地跑在本地,基于 faster-whisper 模型,音视频文件无需上传到第三方服务就能转成文字。对于在意数据隐私、或者想省去按分钟计费的 API 开销的团队来说,它在自有硬件上就能达到与 OpenAI 转录接口相近的实用准确率。自带的浏览器界面支持拖拽上传,可以手动指定源语言,模型从 tiny 到 large-v3 都能选,结果可输出为纯文本、JSON 或带时间戳的 SRT 字幕。同一套引擎也通过 HTTP 接口暴露出来,现有代码想替换外部语音识别服务时,直接对接即可。无论是批量给视频内容生成字幕,还是想长期削减转录账单,它都提供了很实在的替代方案。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。