#121 · 主分类: 语音合成与识别
ComfyUI-Index-TTS
使用IndexTTS模型在ComfyUI中实现高质量文本到语音转换的自定义节点。支持中文和英文文本,可以基于参考音频复刻声音特征。
项目最后更新:08/15/26
GitHub Stars
747
Forks数量
67
贡献者数量
9
许可证
Other
收录理由
在ComfyUI里做语音合成的用户,现在可以把这套节点直接拖进工作流,用一小段参考音频就能复刻音色,实现IndexTTS的语音克隆。2.5版本新增了中、英、日、西、阿五种语言,还支持跨语种克隆——拿中文参考音频就能让模型说英文或日文。节点拆成了几个独立模块:基础合成、情感参考音频、8维情感向量、文本情感描述,按需自由组合。发音控制可以直接写在文本里,对中文多音字和英文CMU音素都很有用。内容创作者和视频制作者如果不想离开ComfyUI,又想自己部署、可控性强的TTS,这套方案值得一试。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。