#63 · 主分类: 语音合成与识别

TTS-WebUI

ace-step ai audio-generation cosyvoice generative-ai generator gradio music musicgen openai-api openvoice rvc styletts2 text-to-speech tortoise-tts tts vocos

一个集成了 Gradio 和 React 的 WebUI,支持 ACE-Step、OmniVoice、Kimi Audio、Piper TTS、GPT-SoVITS、CosyVoice、XTTSv2、DIA、Kokoro、OpenVoice、ParlerTTS、Stable Audio、MMS、StyleTTS2、MAGNet、AudioGen、MusicGen、Tortoise、RVC、Vocos、Demucs、SeamlessM4T 和 Bark 等扩展!

项目最后更新:07/27/26

GitHub Stars

3.2K

Forks数量

329

贡献者数量

15

许可证

MIT

收录理由

TTS-WebUI 把二十多种语音合成模型统一收进同一个 Gradio 与 React 界面里,装一个应用就能用上 Bark、GPT-SoVITS、CosyVoice、StyleTTS2、Piper、Kokoro、XTTSv2 这些原本需要分别配置的工具。同一套窗口还顺带覆盖了声音克隆与转换(RVC)、音乐和音频生成(MusicGen、MAGNeT、Stable Audio),以及 Demucs 这类后期清理功能。覆盖面这么广,做配音、角色语音、旁白,或者游戏和聊天机器人的音频处理,拿它当底座都挺顺手。模型扩展都是按需开启的,新装时体积很小,要用哪个再加载哪个,内存和安装负担都控制得住。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目