计算机视觉
检测、分割、OCR 与视觉流水线,面向生产的开源计算机视觉方案。
共 384 个项目
排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。
| 排名 | 项目 | Stars | Forks | 更新 | 许可证 |
|---|---|---|---|---|---|
| 101 |
LightGlue
LightGlue:光速局部特征匹配(ICCV 2023) |
4.7K | 560 | 02/18/26 | Apache-2.0 |
| 102 |
deepdoctection
一个用于文档人工智能的仓库 |
3.2K | 196 | 08/16/26 | Apache-2.0 |
| 103 |
CompreFace
领先的免费开源人脸识别系统 |
8.3K | 1.2K | 10/05/24 | Apache-2.0 |
| 104 |
deep-person-reid
Torchreid:基于PyTorch的深度学习行人重识别。 |
4.9K | 1.2K | 01/09/26 | MIT |
| 105 |
QualityScaler
QualityScaler - 图像/视频 AI 超分辨率应用 |
3.1K | 253 | 08/27/26 | MIT |
| 106 |
Ask-Anything
[CVPR2024 Highlight][VideoChatGPT] 具有视频理解能力的ChatGPT!并且支持更多语言模型,如miniGPT4、StableLM和MOSS。 |
3.3K | 268 | 07/17/26 | MIT |
| 107 |
WebPlotDigitizer
计算机视觉辅助工具,用于从图表图像中提取数值数据。 |
3.1K | 436 | 07/27/26 | AGPL-3.0 |
| 108 |
pytorchvideo
用于视频理解研究的深度学习库。 |
3.6K | 425 | 05/05/26 | Apache-2.0 |
| 109 |
ImageAI
一个Python库,旨在赋能开发者构建具有自包含计算机视觉能力的应用和系统。 |
8.9K | 2.2K | 08/03/24 | MIT |
| 110 |
paperless-gpt
使用LLM和LLM视觉(OCR)处理paperless-ngx——由AI驱动的文档数字化 |
2.7K | 204 | 08/28/26 | MIT |
| 111 |
llm_aided_ocr
使用LLM(本地或API)增强Tesseract OCR输出,用于错误纠正、智能分块和扫描PDF的Markdown格式化。 |
3.0K | 214 | 08/03/26 | Other |
| 112 |
voxelmorph
用于图像配准的无监督学习 |
2.7K | 640 | 08/17/26 | Apache-2.0 |
| 113 |
Segment-and-Track-Anything
使用SAM和AOT对视频中的任意对象进行分割与跟踪,支持自动和交互模式。 |
3.1K | 356 | 07/03/26 | AGPL-3.0 |
| 114 |
imagededup
😎 轻松查找重复图片! |
5.7K | 477 | 08/15/25 | Apache-2.0 |
| 115 |
stitching
用于快速且稳健的图像拼接的Python包 |
2.6K | 217 | 08/26/26 | Apache-2.0 |
| 116 |
computervision-recipes
计算机视觉的最佳实践、代码示例和文档。 |
9.9K | 1.2K | 02/16/24 | MIT |
| 117 |
CV-CUDA
CV-CUDA™ 是一个开源的、GPU 加速的库,用于云规模的图像处理和计算机视觉。 |
2.7K | 262 | 08/11/26 | Other |
| 118 |
DeepCamera
开源AI摄像头技能平台,支持本地VLM分析和智能安全代理,通过消息应用实现家庭监控。 |
3.0K | 477 | 06/18/26 | MIT |
| 119 |
torchio
面向AI应用的医学影像处理。 |
2.4K | 275 | 08/01/26 | Apache-2.0 |
| 120 |
Simd
使用SIMD的C++图像处理和机器学习库:支持x86/x64的SSE、AVX、AVX-512、AMX,ARM的NEON、SVE,Hexagon的HVX |
2.3K | 453 | 08/27/26 | MIT |