#213 · 主分类: 计算机视觉

MonoScene

2d-to-3d computer-vision cvpr2022 cvpr22 deep-learning kitti-360 mayavi monocular nyu-depth-v2 occupancy-prediction pytorch semantic-kitti semantic-scene-completion semantic-scene-understanding single-image-reconstruction

[CVPR 2022] MonoScene:单目3D语义场景补全:从单张图像进行3D语义占用预测

项目最后更新:03/25/26

GitHub Stars

819

Forks数量

78

贡献者数量

1

许可证

Apache-2.0

收录理由

如果你在做自动驾驶或机器人相关的三维感知,MonoScene 是一个绕不开的参考实现。它只靠一张单目 RGB 图像,就能重建出稠密的三维语义占用网格,同时预测场景中每个体素的几何结构和语义类别。这个仓库随 Inria 团队发表在 CVPR 2022 的论文一起开源,包含了 SemanticKITTI 和 NYUv2 上的训练与评估流程、预训练权重,以及一个可以直接体验的 Hugging Face 在线演示,方便你复现论文结果,或者拿它当自己占用预测工作的基线。README 里还整理了其他纯视觉三维占用预测项目,顺着这些链接能很快摸到这条研究线的脉络,对新手和老手都挺实用。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目