#63 · 主分类: 语音合成与识别
TTS-WebUI
一个集成了 Gradio 和 React 的 WebUI,支持 ACE-Step、OmniVoice、Kimi Audio、Piper TTS、GPT-SoVITS、CosyVoice、XTTSv2、DIA、Kokoro、OpenVoice、ParlerTTS、Stable Audio、MMS、StyleTTS2、MAGNet、AudioGen、MusicGen、Tortoise、RVC、Vocos、Demucs、SeamlessM4T 和 Bark 等扩展!
项目最后更新:07/27/26
GitHub Stars
3.2K
Forks数量
329
贡献者数量
15
许可证
MIT
收录理由
TTS-WebUI 把二十多种语音合成模型统一收进同一个 Gradio 与 React 界面里,装一个应用就能用上 Bark、GPT-SoVITS、CosyVoice、StyleTTS2、Piper、Kokoro、XTTSv2 这些原本需要分别配置的工具。同一套窗口还顺带覆盖了声音克隆与转换(RVC)、音乐和音频生成(MusicGen、MAGNeT、Stable Audio),以及 Demucs 这类后期清理功能。覆盖面这么广,做配音、角色语音、旁白,或者游戏和聊天机器人的音频处理,拿它当底座都挺顺手。模型扩展都是按需开启的,新装时体积很小,要用哪个再加载哪个,内存和安装负担都控制得住。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。