#196 · 主分类: 视频与动画
hallo
face-animation
image-animation
video-animation
Hallo:用于肖像图像动画的分层音频驱动视觉合成
项目最后更新:09/14/24
GitHub Stars
8.7K
Forks数量
1.1K
贡献者数量
15
许可证
MIT
收录理由
这张图片配上语音就能生成一段口型同步、头部自然运动的短片,在数字人、配音和虚拟主播这类场景里非常实用。项目把说话人视频生成这种通常要依赖商业API的能力做成了可跑通的开源实现,输入一张人像照片和一段音频即可出片。方法上采用扩散模型架构,通过分层音频条件控制来保持面部身份稳定,同时让嘴型和头部动作贴合语音内容。代码库对训练和推理流程都有清晰呈现,适合作为二次开发的参考。项目提供了预训练权重、在线Demo和论文,动手前可以先看效果再决定是否深入集成。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。