#128 · 主分类: 视频与动画
echomimic
aaai2025
audio-driven-portrait-animations
audio-driven-talking-face
human-animation
talking-face-generation
talking-head
[AAAI 2025] EchoMimic:通过可编辑地标条件实现逼真的音频驱动肖像动画
项目最后更新:04/07/26
GitHub Stars
4.3K
Forks数量
467
贡献者数量
6
许可证
Apache-2.0
收录理由
EchoMimic能把一张静态人像照片和一段音频合成为人物开口说话、头部自然摆动的视频。与常见的纯唇形同步工具不同,它多了一个可编辑的“地标条件”环节:在匹配语音的同时,还能手动控制表情、姿势乃至具体的面部动作。这种设计让同一套代码既能处理简单的音频驱动说话头,也能应付生产中更棘手的音频加地标混合需求。仓库里备有推理脚本、加速模型、中英文预训练权重,以及Gradio和ComfyUI界面,小团队拿到手就能跑起来,不用只停留在阅读层面。对正在做虚拟主播、数字人播报或配音相关项目的开发者来说,这份参考非常实在。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。