#139 · 主分类: 视频与动画

echomimic_v2

audio-driven-body-animation audio-driven-portrait-animations audio-driven-talking-face cvpr2025 human-animation talking-face-generation talking-head video-generation

[CVPR 2025] EchoMimicV2:迈向引人注目、简化且半身的人体动画

项目最后更新:02/23/26

GitHub Stars

4.7K

Forks数量

551

贡献者数量

6

许可证

Apache-2.0

收录理由

把一张静态照片和一段音频丢进去,EchoMimicV2 就能让画面里的人开口说话、做出手势。它做的是半身动画,嘴唇、表情、头部转动和上半身动作都会跟着音频走,不只是脸在动。代码来自蚂蚁集团的研究团队,论文被 CVPR 2025 接收,附带英文和中文的预训练权重,还提供了加速的单 GPU 推理路径。想上手试试的话,有 Gradio 和 ComfyUI 界面,不用自己搭流程;不过毕竟属于研究性质的软件,装依赖、下模型、调配置这些步骤躲不掉。花点时间折腾下来,对正在做口播视频原型或虚拟形象演示的团队来说挺值。项目里还带 EMTD 数据集处理脚本,给做音频驱动动画研究的人打了个不错的地基。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目