#144 · 主分类: 语音合成与识别

ComfyUI-OmniVoice-TTS

comfyui custom-nodes text-to-speech tts voice-clone voice-cloning

ComfyUI 的 OmniVoice TTS 节点 - 支持零样本多语言文本转语音,具备声音克隆、声音设计和多说话人对话功能。

项目最后更新:06/11/26

GitHub Stars

539

Forks数量

69

贡献者数量

1

许可证

Apache-2.0

收录理由

在ComfyUI的节点图里直接做语音生成,这个插件带来的是覆盖600多种语言的零样本TTS引擎。拿几秒参考音频就能克隆某个人的声音,或者用文字描述性别、年龄、音高、口音来凭空设计一个合成音色。多说话人对话靠简单的行内标签就能实现,笑声、叹气这类非语言表达也能直接写进文本里。节点还处理了不少实际麻烦:模型首次使用自动下载,CPU卸载机制让显存占用保持低位,Whisper会缓存起来,重复运行不用反复拉取。这样一来,无论是做配音工作还是随便试试多语言TTS的点子,把语音生成塞进ComfyUI工作流都变得相当顺手。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目