#163 · 主分类: 视频与动画
SadTalker
[CVPR 2023] SadTalker:学习逼真的3D运动系数,用于风格化音频驱动的单图像说话人脸动画
项目最后更新:06/26/24
GitHub Stars
14.0K
Forks数量
2.7K
贡献者数量
18
许可证
Other
收录理由
SadTalker 只需一张正面人像照片和一段音频,就能生成说话头部视频,唇形与头部动作会跟随语音节奏,还提供了若干风格化选项,让输出不至于千篇一律。对动画师、内容创作者,以及正在搭建虚拟形象或虚拟主持人流程的工程师来说,它提供了一种从现有图片和配音快速生成素材的途径。项目既支持命令行和 Python 脚本调用,也有 Gradio 与 Colab 演示,能直接嵌入自动化视频处理流程,无需在界面里逐项点击。随附的 CVPR 2023 论文和模型权重均有文档说明,需要理解方法局限或做二次适配时会省去不少功夫。不过要留意,逼真的合成说话头会带来深伪与伦理风险,正式投入生产前务必规划好负责任的使用方式。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。