#196 · 主分类: 视频与动画

hallo

face-animation image-animation video-animation

Hallo:用于肖像图像动画的分层音频驱动视觉合成

项目最后更新:09/14/24

GitHub Stars

8.7K

Forks数量

1.1K

贡献者数量

15

许可证

MIT

收录理由

这张图片配上语音就能生成一段口型同步、头部自然运动的短片,在数字人、配音和虚拟主播这类场景里非常实用。项目把说话人视频生成这种通常要依赖商业API的能力做成了可跑通的开源实现,输入一张人像照片和一段音频即可出片。方法上采用扩散模型架构,通过分层音频条件控制来保持面部身份稳定,同时让嘴型和头部动作贴合语音内容。代码库对训练和推理流程都有清晰呈现,适合作为二次开发的参考。项目提供了预训练权重、在线Demo和论文,动手前可以先看效果再决定是否深入集成。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目