#196 · 主分类: 计算机视觉

Video-Depth-Anything

depth-estimation monocular-depth-estimation transformer video-depth

[CVPR 2025 Highlight] Video Depth Anything:面向超长视频的一致性深度估计

项目最后更新:10/07/25

GitHub Stars

2.1K

Forks数量

194

贡献者数量

11

许可证

Apache-2.0

收录理由

单目深度模型逐帧处理视频时,深度估计常常在帧间抖动,严重影响三维重建或影视特效等下游任务的稳定性。Video Depth Anything 在帧间传递时序信息,让任意长度的视频都能保持深度一致性,还提供了实验性的流式模式,可应对连续输入。项目公开了小、中、大三档预训练权重以及度量深度版本,一条脚本就能导出灰度图、NPZ 或 EXR 文件。相比扩散类视频深度方法,它更轻量、推理更快,单张 GPU 也能跑长视频。仓库同时集成了推理、评估和训练损失代码,适合团队快速搭建场景理解工具。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目