#213 · 主分类: 视频与动画

VGen

diffusion-models video-synthesis

VGen官方仓库:基于扩散模型的全面视频生成生态系统

项目最后更新:01/10/25

GitHub Stars

3.2K

Forks数量

274

贡献者数量

14

许可证

Other

收录理由

如果你打算自己搭建或微调基于扩散模型的视频生成器,而不是只调用现成API,VGen是一个相当实用的起点。这个仓库由阿里通义实验室维护,把几项已发表的方法集中在一起:I2VGen-XL能把静态图片变成高分辨率视频片段,VideoComposer允许你控制运动与构图,InstructVideo则支持用人类反馈来引导生成过程。这些方法放在同一处,方便你对比不同的条件控制策略,挑出适合自己场景的那一个,省去同时维护多套代码的麻烦。仓库里包含了训练和推理代码,以及采样、可视化、加速等工具,团队可以从已发布的检查点出发,逐步训练出自己的微调模型。如果你关注文生视频、图生视频或可控合成,并且希望拿到带公开权重的参考实现,这个代码库值得深入看看。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目