GitHub Stars
1.9K
Forks数量
204
贡献者数量
10
许可证
Other
收录理由
对于已经在节点画布上搭好图像和视频生成流程的 ComfyUI 用户,这个插件能把阿里开源的 Qwen3-TTS 模型直接变成可拖拽的节点,用来做文字转语音、用一小段参考音频实现零样本音色克隆,还能用自然语言描述来设计新的声音。保存的说话人提示词可以跨会话复用,对话节点支持多角色脚本化旁白,不用手动去拼流程。它同时支持 12Hz 和 25Hz 两种语音分词器架构,输出覆盖多种语言,能自然地嵌进你现有的生成管线里。需要留意的是,这只是给已装好的 ComfyUI 用的插件,不是独立程序,而且目前必须把 transformers 固定在 5.0 以下的版本才能正常运行。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。