#24 · 主分类: 视频与动画

pyvideotrans

speech-to-text text-to-speech video-transition

将视频从一种语言翻译成另一种语言,并嵌入配音和字幕。

项目最后更新:08/26/26

GitHub Stars

18.8K

Forks数量

2.3K

贡献者数量

36

许可证

GPL-3.0

收录理由

做视频国际化本地化的团队,常常卡在语音识别、字幕翻译、配音合成这几步来回倒腾文件。pyVideoTrans 把整条链路串成了一个可暂停的工作流:从原始视频出发,先转写出语音,再翻译字幕,接着生成配音,最后合成目标语言的新视频。每一步之间都能停下来人工校对,确认识别、翻译和配音没问题了再继续渲染,省去了在多个工具之间手动搬运中间文件的麻烦。它既可以用 Faster-Whisper、Ollama 这类本地模型完全离线跑,也能接主流的云端 API;操作上提供了图形界面、适合批量任务的无头命令行,以及方便部署到服务器的浏览器 WebUI。多角色配音和声音克隆能让不同说话人在配音版本里保持各自的音色,采访、课程、纪录片这类场景尤其受用。对于经常需要产出多语言视频的团队,这个工具把原本分散的 ASR、翻译和 TTS 环节整合在一起,大幅减少了手工拼接的琐碎工作。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目