#241 · 主分类: 视频与动画

Rerender_A_Video

controlnet diffusion video-processing

[SIGGRAPH Asia 2023] Rerender A Video: 零样本文本引导的视频到视频转换

项目最后更新:03/09/24

GitHub Stars

3.0K

Forks数量

196

贡献者数量

6

许可证

Other

收录理由

如果你已经在使用图像扩散模型,并想把能力延伸到视频领域,这个项目是一个很合适的起点。它直接拿现成的文生图模型,改造成视频到视频的转换工具,无需重新训练,也不用针对每个视频单独调参。你可以用它给素材换风格、改内容,同时保证帧与帧之间在时间上保持一致。具体做法是先通过带有层级跨帧约束的扩散模型生成关键帧,确保形状、纹理和色彩连贯,再用基于时间感知的补块匹配和帧混合技术,把关键帧传播到整段视频的其他帧上,从而避免单独处理每一帧时常见的闪烁问题。这个框架与现有的图像扩散生态兼容,你还可以接入ControlNet来增加空间引导,或者用LoRA来保持特定主体的外观稳定。作为视频风格化原型开发的参考实现,它的思路很清晰,不过要直接用到自己的流程里,大概率还是需要你根据实际情况调整代码。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目