#163 · 主分类: 视频与动画

SadTalker

audio-driven-talking-face cvpr2023 deep-fake deep-fakes image-animation talking-face talking-face-generation talking-head talking-heads

[CVPR 2023] SadTalker:学习逼真的3D运动系数,用于风格化音频驱动的单图像说话人脸动画

项目最后更新:06/26/24

GitHub Stars

14.0K

Forks数量

2.7K

贡献者数量

18

许可证

Other

收录理由

SadTalker 只需一张正面人像照片和一段音频,就能生成说话头部视频,唇形与头部动作会跟随语音节奏,还提供了若干风格化选项,让输出不至于千篇一律。对动画师、内容创作者,以及正在搭建虚拟形象或虚拟主持人流程的工程师来说,它提供了一种从现有图片和配音快速生成素材的途径。项目既支持命令行和 Python 脚本调用,也有 Gradio 与 Colab 演示,能直接嵌入自动化视频处理流程,无需在界面里逐项点击。随附的 CVPR 2023 论文和模型权重均有文档说明,需要理解方法局限或做二次适配时会省去不少功夫。不过要留意,逼真的合成说话头会带来深伪与伦理风险,正式投入生产前务必规划好负责任的使用方式。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目