#391 · 主分类: 计算机视觉
Mask3D
Mask3D 预测准确的3D语义实例,在ScanNet、ScanNet200、S3DIS和STPLS3D上达到最先进水平。
项目最后更新:10/29/23
GitHub Stars
745
Forks数量
129
贡献者数量
3
许可证
MIT
收录理由
Mask3D 是一套面向三维语义实例分割的掩码 Transformer 研究实现,目标是从点云中逐物体地识别并标注每个独立实例,而非仅对整片场景做分类。项目基于 PyTorch、Lightning 与 Hydra 构建,在 ScanNet、ScanNet200、S3DIS 和 STPLS3D 四个公开基准上均取得了领先的结果,仓库内附带了各数据集的预处理脚本与训练好的权重,复现论文中的指标并不需要太多额外工作。代码整体偏向科研用途,若想接入实际业务,需要针对自有数据和硬件做适配。对于从事室内场景理解、机器人感知或城市点云分析的团队来说,这套实现提供了清晰的实例分离思路,模块化设计也便于在此基础上继续扩展。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。