#139 · 主分类: 视频与动画
echomimic_v2
[CVPR 2025] EchoMimicV2:迈向引人注目、简化且半身的人体动画
项目最后更新:02/23/26
GitHub Stars
4.7K
Forks数量
551
贡献者数量
6
许可证
Apache-2.0
收录理由
把一张静态照片和一段音频丢进去,EchoMimicV2 就能让画面里的人开口说话、做出手势。它做的是半身动画,嘴唇、表情、头部转动和上半身动作都会跟着音频走,不只是脸在动。代码来自蚂蚁集团的研究团队,论文被 CVPR 2025 接收,附带英文和中文的预训练权重,还提供了加速的单 GPU 推理路径。想上手试试的话,有 Gradio 和 ComfyUI 界面,不用自己搭流程;不过毕竟属于研究性质的软件,装依赖、下模型、调配置这些步骤躲不掉。花点时间折腾下来,对正在做口播视频原型或虚拟形象演示的团队来说挺值。项目里还带 EMTD 数据集处理脚本,给做音频驱动动画研究的人打了个不错的地基。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。