#233 · 主分类: 计算机视觉
diffusion-e2e-ft
diffusion
in-the-wild
monocular-depth-estimation
monocular-normals-estimation
single-step
zero-shot
[WACV'25口头报告] 微调图像条件扩散模型比你想象的更容易
项目最后更新:07/09/26
GitHub Stars
521
Forks数量
22
贡献者数量
2
许可证
Other
收录理由
这个仓库提供了WACV 2025论文对应的训练与推理代码,论文主题是对图像条件扩散模型做端到端微调。发布的模型能从单张图像直接估计单目深度和表面法线,推理时只需一次确定性的前向传播,而且走的是标准diffusers管道,几行Python代码就能调用,不必自己搭整个模型栈。对做几何视觉的团队来说,实际价值在于:端到端微调把原本需要多步采样的扩散过程压缩成单步,深度和法线的推理成本明显降低、速度更快。仓库还附带了预训练权重和在线演示,想评估方案时可以先拿这些现成的基线跑一跑,再决定要不要上更重的流程。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。