计算机视觉
检测、分割、OCR 与视觉流水线,面向生产的开源计算机视觉方案。
共 384 个项目
排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。
| 排名 | 项目 | Stars | Forks | 更新 | 许可证 |
|---|---|---|---|---|---|
| 41 |
pytorch-grad-cam
面向计算机视觉的高级AI可解释性。支持CNN、视觉Transformer、分类、目标检测、分割、图像相似度等。 |
13.0K | 1.7K | 08/13/26 | MIT |
| 42 |
openFrameworks
openFrameworks是一个社区开发的跨平台工具包,用于C++创意编程。 |
10.4K | 2.6K | 08/27/26 | Other |
| 43 |
fiftyone
优化高质量数据集和视觉AI模型 |
11.0K | 819 | 08/29/26 | Apache-2.0 |
| 44 |
LaTeX-OCR
pix2tex: 使用ViT将方程图像转换为LaTeX代码。 |
16.5K | 1.3K | 01/18/25 | MIT |
| 45 |
chandra
处理复杂表格、表单、手写内容及完整布局的OCR模型。 |
12.2K | 1.2K | 06/26/26 | Apache-2.0 |
| 46 |
sam3
该仓库提供了使用Meta Segment Anything Model 3 (SAM 3)进行推理和微调的代码、下载训练好的模型检查点的链接,以及展示如何使用模型的示例笔记本。 |
11.5K | 1.7K | 08/26/26 | Other |
| 47 |
librealsense
RealSense SDK |
9.0K | 5.0K | 08/27/26 | Apache-2.0 |
| 48 |
yolov3
YOLOv3、YOLOv3-SPP和YOLOv3-tiny的PyTorch实现,用于实时目标检测,包括训练、验证、推理和多格式导出。 |
10.6K | 3.4K | 08/28/26 | AGPL-3.0 |
| 49 |
nerfstudio
一个便于协作的NeRF工作室 |
11.9K | 1.7K | 07/29/25 | Apache-2.0 |
| 50 |
motioneyeos
用于单板计算机的视频监控操作系统 |
8.2K | 915 | 02/14/25 | Other |
| 51 |
scikit-image
Python图像处理 |
6.6K | 2.4K | 08/26/26 | Other |
| 52 |
rf-detr
RF-DETR 是由 Roboflow 开发的实时目标检测与分割模型架构,在 COCO 上达到 SOTA,专为微调设计。[ICLR 2026] |
9.1K | 1.1K | 08/25/26 | Apache-2.0 |
| 53 |
librephotos
一个自托管的开源照片管理服务。 |
8.1K | 386 | 08/28/26 | MIT |
| 54 |
nsfwjs
使用TensorFlow.js在客户端进行NSFW检测 |
9.0K | 600 | 08/04/26 | MIT |
| 55 |
imgaug
用于机器学习实验的图像增强。 |
14.7K | 2.5K | 07/30/24 | MIT |
| 56 |
javacv
OpenCV、FFmpeg 等的 Java 接口 |
8.3K | 1.6K | 08/12/26 | Other |
| 57 |
boxmot
BoxMOT:可插拔的 Python 和 C++ 最新多目标跟踪模块,支持轴对齐和旋转边界框。 |
8.3K | 1.9K | 08/27/26 | AGPL-3.0 |
| 58 |
video-subtitle-extractor
视频硬字幕提取,生成srt文件。无需申请第三方API,本地实现文本识别。基于深度学习的视频字幕提取框架,包含字幕区域检测、字幕内容提取。 |
9.4K | 948 | 04/09/26 | Apache-2.0 |
| 59 |
backgroundremover
Background Remover 使用AI从图像和视频中移除背景,提供简单的命令行界面,免费且开源。 |
8.0K | 651 | 07/10/26 | MIT |
| 60 |
gocv
使用OpenCV 4及更高版本的计算机视觉Go包。支持DNN、CUDA、OpenCV Contrib和OpenVINO。 |
7.5K | 901 | 05/28/26 | Other |