#205 · 主分类: 视频与动画
ComfyUI-LatentSyncWrapper
该节点使用字节跳动的LatentSync模型在ComfyUI中提供唇形同步功能,允许您将视频中的嘴唇与音频输入同步。
项目最后更新:09/04/25
GitHub Stars
958
Forks数量
91
贡献者数量
5
许可证
Other
收录理由
嘴型同步通常需要跳出 ComfyUI 另跑一套流程,而这个封装节点把 LatentSync 直接塞进工作流里,算是最省事的路子。它基于字节跳动的 LatentSync:扔进一段说话人视频,配上音频,节点就会重绘嘴部来匹配语音,还提供唇动强度和去噪步数等调节项。1.6 版模型用 512×512 分辨率训练,解决了早期版本牙齿和嘴唇细节糊成一片的毛病;实现上优化了显存占用,20GB 的显卡也能跑得动。不过有两点得提前心里有数:一是 LatentSync 1.6 的权重放在 HuggingFace 的受限仓库里,得手动去取;二是这个插件要求彻底删除旧版再重装,不支持原地升级,否则会出冲突。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。