计算机视觉

检测、分割、OCR 与视觉流水线,面向生产的开源计算机视觉方案。

共 384 个项目

排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。

第 41–60 项,共 384 个

排名 项目 Stars Forks
41 pytorch-grad-cam

面向计算机视觉的高级AI可解释性。支持CNN、视觉Transformer、分类、目标检测、分割、图像相似度等。

13.0K 1.7K
42 openFrameworks

openFrameworks是一个社区开发的跨平台工具包,用于C++创意编程。

10.4K 2.6K
43 fiftyone

优化高质量数据集和视觉AI模型

11.0K 819
44 LaTeX-OCR

pix2tex: 使用ViT将方程图像转换为LaTeX代码。

16.5K 1.3K
45 chandra

处理复杂表格、表单、手写内容及完整布局的OCR模型。

12.2K 1.2K
46 sam3

该仓库提供了使用Meta Segment Anything Model 3 (SAM 3)进行推理和微调的代码、下载训练好的模型检查点的链接,以及展示如何使用模型的示例笔记本。

11.5K 1.7K
47 librealsense

RealSense SDK

9.0K 5.0K
48 yolov3

YOLOv3、YOLOv3-SPP和YOLOv3-tiny的PyTorch实现,用于实时目标检测,包括训练、验证、推理和多格式导出。

10.6K 3.4K
49 nerfstudio

一个便于协作的NeRF工作室

11.9K 1.7K
50 motioneyeos

用于单板计算机的视频监控操作系统

8.2K 915
51 scikit-image

Python图像处理

6.6K 2.4K
52 rf-detr

RF-DETR 是由 Roboflow 开发的实时目标检测与分割模型架构,在 COCO 上达到 SOTA,专为微调设计。[ICLR 2026]

9.1K 1.1K
53 librephotos

一个自托管的开源照片管理服务。

8.1K 386
54 nsfwjs

使用TensorFlow.js在客户端进行NSFW检测

9.0K 600
55 imgaug

用于机器学习实验的图像增强。

14.7K 2.5K
56 javacv

OpenCV、FFmpeg 等的 Java 接口

8.3K 1.6K
57 boxmot

BoxMOT:可插拔的 Python 和 C++ 最新多目标跟踪模块,支持轴对齐和旋转边界框。

8.3K 1.9K
58 video-subtitle-extractor

视频硬字幕提取,生成srt文件。无需申请第三方API,本地实现文本识别。基于深度学习的视频字幕提取框架,包含字幕区域检测、字幕内容提取。

9.4K 948
59 backgroundremover

Background Remover 使用AI从图像和视频中移除背景,提供简单的命令行界面,免费且开源。

8.0K 651
60 gocv

使用OpenCV 4及更高版本的计算机视觉Go包。支持DNN、CUDA、OpenCV Contrib和OpenVINO。

7.5K 901
< 上一页
/ 20
下一页 >