#213 · 主分类: 计算机视觉
MonoScene
[CVPR 2022] MonoScene:单目3D语义场景补全:从单张图像进行3D语义占用预测
项目最后更新:03/25/26
GitHub Stars
819
Forks数量
78
贡献者数量
1
许可证
Apache-2.0
收录理由
如果你在做自动驾驶或机器人相关的三维感知,MonoScene 是一个绕不开的参考实现。它只靠一张单目 RGB 图像,就能重建出稠密的三维语义占用网格,同时预测场景中每个体素的几何结构和语义类别。这个仓库随 Inria 团队发表在 CVPR 2022 的论文一起开源,包含了 SemanticKITTI 和 NYUv2 上的训练与评估流程、预训练权重,以及一个可以直接体验的 Hugging Face 在线演示,方便你复现论文结果,或者拿它当自己占用预测工作的基线。README 里还整理了其他纯视觉三维占用预测项目,顺着这些链接能很快摸到这条研究线的脉络,对新手和老手都挺实用。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。