#139 · 主分类: 语音合成与识别

ComfyUI-VoxCPM

ai-voice audio comfyui-node t2s text-to-speech tts voice-cloning voice-generation

ComfyUI节点,用于高度表现力的语音和逼真的零样本声音克隆

项目最后更新:08/06/26

GitHub Stars

509

Forks数量

49

贡献者数量

1

许可证

Apache-2.0

收录理由

对于已经熟练使用ComfyUI的创作者来说,这个自定义节点直接带来一套完整的文生语音与声音克隆工作流,可以无缝接入现有的节点连线中。它集成了VoxCPM——一种在连续空间而非离散词元上建模语音的TTS系统,这正是其语音表达富有感染力、零样本克隆效果逼真的根源。节点本身还包办了模型下载、显存管理和音频输出,首次运行就能直接生成30多种语言、48kHz的声音,只需接上几个节点即可。新版模型更进一步,允许你用自然语言描述来凭空设计声音,或者将参考说话人的音色与单独的韵律音频结合,实现更精细的控制。无论是做旁白、有声书还是游戏对白,都可以即时试听不同声音效果,无需为每个新音色单独训练模型,在快速验证配音方案时尤其高效。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目