#244 · 主分类: 视频与动画
video-diffusion-pytorch
artificial-intelligence
ddpm
deep-learning
text-to-video
video-generation
视频扩散模型的实现,Jonathan Ho 的新论文将 DDPM 扩展到视频生成——基于 Pytorch
项目最后更新:05/03/24
GitHub Stars
1.4K
Forks数量
140
贡献者数量
3
许可证
MIT
收录理由
这个项目把Jonathan Ho提出的视频扩散模型论文用PyTorch实现了一遍,是早期把去噪扩散从静态图像延伸到短视频的工作之一。代码把空间-时间分解的U-Net和高斯扩散训练器封装成简洁的类,用几行代码就能训练一个小型视频模型,省去自己从头搭建架构的功夫。作者在合成任务(如移动MNIST)上验证了收敛性,同时也明确表示,追求真实文本生成视频效果的话,应该去看更活跃的imagen-pytorch仓库。因此,它更适合当作理解视频扩散管线的学习样本和起步脚手架,想完整读一遍可运行代码的人,从这里入手会很顺手。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。