#94 · 主分类: 语音合成与识别

TTS-Audio-Suite

ai-audio audio audio-editing audio-generation audio-processing chatterbox comfyui cozy-voice-3 echo-tts f5 f5-tts higgs-audio indextts-2 qwen3-tts rvc text-to-speech tts vibevoice voice-cloning voice-conversion

一个ComfyUI自定义节点套件,支持多引擎、多语言文本转语音和语音转换,并附带SRT时间轴和音频工具。

项目最后更新:08/28/26

GitHub Stars

1.2K

Forks数量

140

贡献者数量

13

许可证

Other

收录理由

做 ComfyUI 音频工作流的人常常要为每个模型单独装一套节点,TTS-Audio-Suite 把十九种左右的引擎收进同一组节点里,RVC、Chatterbox、F5-TTS、Higgs Audio 2/3、IndexTTS-2、CosyVoice3、Qwen3-TTS、VibeVoice 都在其中,界面统一,团队要跑多语言或不同合成风格时不用维护多套集成。它的字幕流程尤其实用:能转录音频为 SRT、从纯文本估算时间轴、编辑后重建字幕,还能把工程控制标签直接送进 TTS 节点,做配音和长篇旁白省事很多。声音克隆和 RVC 训练也内置了,你可以先捏一个专属音色,再在同一个工具里用它生成。所有处理都在本地完成,音频和模型权重不出机器。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目