#154 · 主分类: 视频与动画

Causal-Forcing

auto-regressive-diffusion-model autoregressive-models consistency-models diffusion diffusion-models distillation few-step-generation generative-ai text-to-video text-to-video-generation video-diffusion-model video-generation wan-video wan2 wan21 world-model world-models

[ICML 2026] 官方代码库,包含论文“因果强制:自回归扩散蒸馏的正确做法,用于高质量实时交互视频生成”及 Causal Forcing++。

项目最后更新:08/28/26

GitHub Stars

938

Forks数量

53

贡献者数量

3

许可证

Apache-2.0

收录理由

团队若想将扩散视频生成做到交互式或流式延迟,这个代码库比论文本身更值得作为起点,因为代码可以直接运行。它把自回归扩散视频模型蒸馏到一两步采样,使得文生视频和图生视频片段能快到实时可用,同样的机制还能扩展到分钟级长序列。该代码库基于Wan2.1提供分块和逐帧两种检查点,带有命令行推理命令、分阶段训练流程以及托管在Hugging Face上的预训练权重,复现或调整效果时不用从零实现。逐帧模型将文生视频和图生视频统一到一套设置中,其中的一致性蒸馏变体和之前自回归施加方案有本质区别。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目