#216 · 主分类: 计算机视觉

count-anything

computer-vision count-anything object-counting object-detection open-vocabulary vision-foundation-model vision-language-model

论文《✨Counting Anything》的代码和实现指南。项目页面:https://mengqi-lei.github.io/count-anything-projectpage/

项目最后更新:08/12/26

GitHub Stars

536

Forks数量

46

贡献者数量

3

许可证

Apache-2.0

收录理由

Count Anything 回答了一个看似简单的问题:给定一张图片和一句自然语言描述,比如“这里有多少个细胞”,它会输出一组标记点,每个点对应一个实例,点的数量就是计数结果。由于输出是落在具体位置上的点,而不是一个孤零零的数字,你可以直观地看到模型认为每个目标在哪里,从而判断结果是否可信。一个模型就能覆盖六个视觉领域,从普通场景、遥感影像到组织病理、细胞显微、农业和微生物图像,省去了为每个领域单独训练计数器的麻烦。仓库里提供了 Hugging Face 在线演示、可直接下载的模型权重和安装指南,还附带了 CLOC 基准及其 v1.1 注释修订版,方便复现论文中的评估。对于质检、生物医学图像分析和农业监测这类既看重计数准确率又需要结果可解释的场景,这套方案很实用。

相关文章

暂无针对该项目的文章。

如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。

同类热门项目