#92 · 主分类: 语音合成与识别

ComfyUI-Qwen-TTS

Qwen3-TTS的ComfyUI简单实现

项目最后更新:06/03/26

GitHub Stars

1.9K

Forks数量

204

贡献者数量

10

许可证

Other

收录理由

对于已经在节点画布上搭好图像和视频生成流程的 ComfyUI 用户,这个插件能把阿里开源的 Qwen3-TTS 模型直接变成可拖拽的节点,用来做文字转语音、用一小段参考音频实现零样本音色克隆,还能用自然语言描述来设计新的声音。保存的说话人提示词可以跨会话复用,对话节点支持多角色脚本化旁白,不用手动去拼流程。它同时支持 12Hz 和 25Hz 两种语音分词器架构,输出覆盖多种语言,能自然地嵌进你现有的生成管线里。需要留意的是,这只是给已装好的 ComfyUI 用的插件,不是独立程序,而且目前必须把 transformers 固定在 5.0 以下的版本才能正常运行。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目