#128 · 主分类: 视频与动画

echomimic

aaai2025 audio-driven-portrait-animations audio-driven-talking-face human-animation talking-face-generation talking-head

[AAAI 2025] EchoMimic:通过可编辑地标条件实现逼真的音频驱动肖像动画

项目最后更新:04/07/26

GitHub Stars

4.3K

Forks数量

467

贡献者数量

6

许可证

Apache-2.0

收录理由

EchoMimic能把一张静态人像照片和一段音频合成为人物开口说话、头部自然摆动的视频。与常见的纯唇形同步工具不同,它多了一个可编辑的“地标条件”环节:在匹配语音的同时,还能手动控制表情、姿势乃至具体的面部动作。这种设计让同一套代码既能处理简单的音频驱动说话头,也能应付生产中更棘手的音频加地标混合需求。仓库里备有推理脚本、加速模型、中英文预训练权重,以及Gradio和ComfyUI界面,小团队拿到手就能跑起来,不用只停留在阅读层面。对正在做虚拟主播、数字人播报或配音相关项目的开发者来说,这份参考非常实在。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目