#244 · 主分类: 视频与动画

video-diffusion-pytorch

artificial-intelligence ddpm deep-learning text-to-video video-generation

视频扩散模型的实现,Jonathan Ho 的新论文将 DDPM 扩展到视频生成——基于 Pytorch

项目最后更新:05/03/24

GitHub Stars

1.4K

Forks数量

140

贡献者数量

3

许可证

MIT

收录理由

这个项目把Jonathan Ho提出的视频扩散模型论文用PyTorch实现了一遍,是早期把去噪扩散从静态图像延伸到短视频的工作之一。代码把空间-时间分解的U-Net和高斯扩散训练器封装成简洁的类,用几行代码就能训练一个小型视频模型,省去自己从头搭建架构的功夫。作者在合成任务(如移动MNIST)上验证了收敛性,同时也明确表示,追求真实文本生成视频效果的话,应该去看更活跃的imagen-pytorch仓库。因此,它更适合当作理解视频扩散管线的学习样本和起步脚手架,想完整读一遍可运行代码的人,从这里入手会很顺手。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目