#152 · 主分类: 视频与动画

Stable-Video-Infinity

audio-driven-talking-face dance-generation end-to-end-filming long-video-generation video-diffusion-transformers

[ICLR 26 口头报告] Stable Video Infinity:通过错误回收实现无限长度视频生成

项目最后更新:06/03/26

GitHub Stars

2.6K

Forks数量

227

贡献者数量

4

许可证

MIT

收录理由

长视频生成一直面临一个难题:生成的内容一旦超过几秒,前后就容易脱节,画面逐渐失真。Stable Video Infinity 正是针对这个痛点设计的。它的核心思路不是把每一段视频都当作全新任务来生成,而是在生成过程中不断回收并修正自己的输出,让整个长场景保持连贯,而不是慢慢漂移出各种伪影。这个项目来自 EPFL 的 VITA 实验室,被 ICLR 26 接收为口头报告。实际使用时,你可以把多个文本提示串联成一个完整叙事,每一段画面单独控制,同一个模型家族还能处理说话人脸和舞蹈生成。无论是做研究的团队,还是想靠提示词直接产出长镜头素材、又不想手动拼接独立片段的创作者,都能从这里找到顺手的工具。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目