#176 · 主分类: 视频与动画

ComfyUI_Sonic

Sonic是一种关于'在肖像动画中将焦点转向全局音频感知'的方法,你可以在ComfyUI中使用它。

项目最后更新:05/04/26

GitHub Stars

1.1K

Forks数量

109

贡献者数量

4

许可证

MIT

收录理由

做口播头像动画的创作者,不必再依赖独立脚本,Sonic 以 ComfyUI 自定义节点的形式融入现有工作流,和旁边的图像、视频节点串在一起使用。它根据全局音频线索驱动人像的嘴唇、头部姿态和表情,让声音和画面自然同步。安装方式遵循常见的自定义节点流程:克隆到 ComfyUI/custom_node,安装依赖,再把 Sonic 权重、Whisper-tiny 模型和 SVD 检查点放到指定目录。维护者修复了非 25 帧率下批量不匹配的问题,用秒数代替帧数来控制输出音频长度,还降低了 12GB 显存显卡首次运行时的内存压力,并加入了对 Mac MPS 的支持,相比上游研究代码,对中端硬件更友好。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目