#233 · 主分类: 计算机视觉

diffusion-e2e-ft

diffusion in-the-wild monocular-depth-estimation monocular-normals-estimation single-step zero-shot

[WACV'25口头报告] 微调图像条件扩散模型比你想象的更容易

项目最后更新:07/09/26

GitHub Stars

521

Forks数量

22

贡献者数量

2

许可证

Other

收录理由

这个仓库提供了WACV 2025论文对应的训练与推理代码,论文主题是对图像条件扩散模型做端到端微调。发布的模型能从单张图像直接估计单目深度和表面法线,推理时只需一次确定性的前向传播,而且走的是标准diffusers管道,几行Python代码就能调用,不必自己搭整个模型栈。对做几何视觉的团队来说,实际价值在于:端到端微调把原本需要多步采样的扩散过程压缩成单步,深度和法线的推理成本明显降低、速度更快。仓库还附带了预训练权重和在线演示,想评估方案时可以先拿这些现成的基线跑一跑,再决定要不要上更重的流程。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目