#93 · 主分类: 语音合成与识别
Whisper-WebUI
一个用于轻松使用whisper模型生成字幕的Web界面。
项目最后更新:12/29/25
GitHub Stars
2.9K
Forks数量
434
贡献者数量
25
许可证
Apache-2.0
收录理由
做字幕通常要在转写工具、字幕编辑器和一堆命令行参数之间来回切换。Whisper-WebUI 把这件事收进了一个浏览器界面里:你可以按需选择不同的 Whisper 实现,在速度与精度之间取舍,然后从本地上传文件、YouTube 链接或麦克风实时录音开始转写。结果可以导出为 SRT、WebVTT 或纯文本。更有意思的是转写前后的处理流程:可选 Silero VAD 自动剪掉静音段,UVR 能分离背景音乐,pyannote 声纹分割则能标出每句话是谁说的,对访谈和播客类内容特别实用。翻译功能也内置其中,既支持把其他语言语音直接转成英文,也支持用 NLLB 或 DeepL API 对整个字幕文件做文本翻译。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。