#180 · 主分类: 计算机视觉

VGGT-SLAM

computer-vision slam vggt vggt-slam

VGGT-SLAM:在SL(4)流形上优化的稠密RGB SLAM

项目最后更新:06/29/26

GitHub Stars

1.1K

Forks数量

119

贡献者数量

3

许可证

BSD-2-Clause

收录理由

VGGT-SLAM 将前馈式的 VGGT 场景重建模型改造成一条完整的稠密 SLAM 流水线,只需普通单目视频即可工作,无需相机标定。它把长序列切分成子地图,并在 SL(4) 流形上对齐,以此处理单纯相似变换无法覆盖的射影模糊问题。因此,即便单个 VGGT 推理因显存限制无法处理成百上千帧的 RGB 输入,这套方法也能重建大尺度的室内场景,而且不需要额外训练,也不需要已知内参。仓库自带脚本能生成增量式地图可视化,同时通过 SAM 3 和 Perception Encoder 提供可选的开集三维物体检测,方便视觉研究者或机器人工程师在做稠密建图原型时直接使用。安装脚本会自动下载第三方模型权重,只要 GPU 显存足够,很快就能跑通一次重建。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目