#139 · 主分类: 语音合成与识别
ComfyUI-VoxCPM
ComfyUI节点,用于高度表现力的语音和逼真的零样本声音克隆
项目最后更新:08/06/26
GitHub Stars
509
Forks数量
49
贡献者数量
1
许可证
Apache-2.0
收录理由
对于已经熟练使用ComfyUI的创作者来说,这个自定义节点直接带来一套完整的文生语音与声音克隆工作流,可以无缝接入现有的节点连线中。它集成了VoxCPM——一种在连续空间而非离散词元上建模语音的TTS系统,这正是其语音表达富有感染力、零样本克隆效果逼真的根源。节点本身还包办了模型下载、显存管理和音频输出,首次运行就能直接生成30多种语言、48kHz的声音,只需接上几个节点即可。新版模型更进一步,允许你用自然语言描述来凭空设计声音,或者将参考说话人的音色与单独的韵律音频结合,实现更精细的控制。无论是做旁白、有声书还是游戏对白,都可以即时试听不同声音效果,无需为每个新音色单独训练模型,在快速验证配音方案时尤其高效。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。