#127 · 主分类: 语音合成与识别
Pandrator
本地优先的工具,用于从PDF、EPUB和视频创建有声书、字幕和配音视频,支持语音克隆和翻译。
项目最后更新:08/30/26
GitHub Stars
616
Forks数量
47
贡献者数量
3
许可证
MIT
收录理由
如果你想把PDF、EPUB或字幕文件变成有声书、配音视频或旁白,又不想把内容交给云端服务,Pandrator是个很顺手的工具。它把文本清理、断句、语音生成和导出整合成一条流水线,全部在本地电脑上完成。浏览器界面背后接入了Kokoro、XTTS v2、Chatterbox、Silero等多种语音引擎,支持对允许的模型做声音克隆,包括RVC后处理和XTTS微调。配音流程里还内置了WhisperX转写和可选的翻译功能,做视频本地化时很实用。一键安装包和图形界面让不熟悉脚本的人也能直接上手,逐句重新生成和基于LLM的文本预处理则让旁白听起来更干净。对于想自己掌控媒体处理流程的团队或爱好者,这套自包含的方案省去了不少折腾。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。