#251 · 主分类: 计算机视觉

XMem

computer-vision deep-learning eccv-2022 eccv2022 pytorch segmentation video-object-segmentation video-segmentation

[ECCV 2022] XMem:基于Atkinson-Shiffrin记忆模型的长期视频对象分割

项目最后更新:11/15/24

GitHub Stars

2.0K

Forks数量

212

贡献者数量

5

许可证

MIT

收录理由

XMem把视频目标分割当作一个记忆问题来处理,将特征存储拆成短期工作记忆和基于Atkinson-Shiffrin理论的长期记忆两部分。这种结构让模型在超长视频中持续追踪目标,而不会像那些把所有信息都堆在单一记忆库的方法那样,导致显存占用失控。作者在长视频上测得的处理速度大约为每秒20帧,仓库里还带了一个图形界面,你只需在首帧点一下目标,模型就会自动把掩膜往后传播。对需要处理数千帧的后期制作来说,比如遮罩图层插入或动态遮罩绘制,这个工具很实用。此外,XMem也是Cutie和DEVA等后续工作的基础,所以读懂这套代码,有助于理解现代视频分割的发展脉络。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目