#172 · 主分类: 计算机视觉

MambaVision

deep-learning foundation-models huggingface-transformers hybrid-models image-classification instance-segmentation mamba object-detection self-attention semantic-segmentation transformers vision-transformer visual-recognition

[CVPR 2025] 官方PyTorch实现:MambaVision:混合Mamba-Transformer视觉骨干网络

项目最后更新:03/11/26

GitHub Stars

2.2K

Forks数量

150

贡献者数量

2

许可证

Other

收录理由

这是CVPR 2025论文《MambaVision》的官方PyTorch实现,提出了一种将状态空间模型(Mamba)与自注意力机制相结合的分层视觉骨干网络。这种设计让它在ImageNet上取得高准确率的同时保持较快的推理速度,在精度与吞吐量之间达到了新的平衡。仓库不仅涵盖图像分类,还提供了语义分割和目标检测的完整代码,预训练权重可借助Hugging Face的transformers库几行代码加载。模型输出多尺度特征,便于直接接入现有的检测或分割框架;同时附带了pip安装包和Colab示例,上手非常方便。需要注意的是,该项目采用NVIDIA的非商业许可协议,更适合用于学术研究或技术验证,不建议直接部署到生产环境。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目