#66 · 主分类: 语音合成与识别
whishper
将任何音频转录为文本,翻译和编辑字幕,100%本地化,带Web界面。由whisper模型驱动!
项目最后更新:07/31/26
GitHub Stars
3.1K
Forks数量
179
贡献者数量
7
许可证
AGPL-3.0
收录理由
Whishper把Whisper从命令行里解放出来,让人能直接上手用。你可以上传音频或视频文件,也可以粘贴一个yt-dlp能抓取的网址,它就能生成转录文本,并导出为TXT、VTT、SRT或JSON。内置的字幕编辑器支持拆分和插入片段,当每秒字符数过高时会给出警告,还能借助LibreTranslate在浏览器里直接翻译字幕。整套流程都在本地完成,基于FasterWhisper后端,离线也能跑,CPU上表现流畅,需要提速时也能调用NVIDIA GPU。对于要转写访谈、播客、讲座或给视频配字幕的团队来说,如果不想把音频交给第三方服务,这是个相当稳妥的选择。需要留意的是,作者正在重写v4版本,当前分支已经不再发布新版本。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。