GitHub Stars
1.1K
Forks数量
109
贡献者数量
4
许可证
MIT
收录理由
做口播头像动画的创作者,不必再依赖独立脚本,Sonic 以 ComfyUI 自定义节点的形式融入现有工作流,和旁边的图像、视频节点串在一起使用。它根据全局音频线索驱动人像的嘴唇、头部姿态和表情,让声音和画面自然同步。安装方式遵循常见的自定义节点流程:克隆到 ComfyUI/custom_node,安装依赖,再把 Sonic 权重、Whisper-tiny 模型和 SVD 检查点放到指定目录。维护者修复了非 25 帧率下批量不匹配的问题,用秒数代替帧数来控制输出音频长度,还降低了 12GB 显存显卡首次运行时的内存压力,并加入了对 Mac MPS 的支持,相比上游研究代码,对中端硬件更友好。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。