#113 · 主分类: 计算机视觉

Segment-and-Track-Anything

interactive-segmentation segment-anything segment-anything-model video-object-segmentation visual-object-tracking

使用SAM和AOT对视频中的任意对象进行分割与跟踪,支持自动和交互模式。

项目最后更新:07/03/26

GitHub Stars

3.1K

Forks数量

356

贡献者数量

15

许可证

AGPL-3.0

收录理由

这个项目将Segment Anything Model与基于Transformer的DeAOT跟踪器相结合,先在视频的某一帧中完成物体分割,随后将掩膜持续传递到后续帧,实现对任意目标的跟踪。用户可以通过点击、涂抹或输入文字提示来指定要分割的物体,也可以让系统自动检测,因此适用于视频编辑中的抠像、数据标注以及监控摄像头画面的目标跟踪等实际场景。项目提供了WebUI和Colab笔记本,方便用户快速在自己的视频上测试效果,Python API则适合批量处理任务。它还支持音频定位模式,能够跟随音轨中发出声音的对象。这套方案在学术和工业界也有实际应用,MIT CSAIL和哈佛SEAS发表的无人机开放词汇跟踪研究便以它为底层基础设施。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目