计算机视觉

检测、分割、OCR 与视觉流水线,面向生产的开源计算机视觉方案。

共 384 个项目

排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。

第 141–160 项,共 384 个

排名 项目 Stars Forks
141 smolvlm-realtime-webcam

使用 SmolVLM 和 llama.cpp 服务器的实时网络摄像头演示

5.6K 894
142 raster-vision

开源库和框架,用于卫星与航空影像的深度学习。

2.2K 397
143 lightly-train

视觉模型的一体化训练(YOLO、ViTs、RT-DETR、DINOv3):预训练、微调、蒸馏。

1.7K 112
144 streamlit-webrtc

在Streamlit上进行实时视频和音频处理

1.7K 219
145 SimpleHTR

使用TensorFlow实现的手写文本识别(HTR)系统。

2.2K 916
146 robosat

对航空和卫星影像进行语义分割。提取特征如:建筑物、停车场、道路、水体、云层。

2.1K 385
147 bgslibrary

一个C++背景减除库,提供Python、MATLAB、Java封装及基于QT的GUI

2.3K 736
148 ha-llmvision

家居视觉智能。

1.4K 141
149 geti

本地构建、训练、优化和运行计算机视觉模型,从原始图像到实时推理。开源,支持CPU、Intel XPU和NVIDIA CUDA。

1.3K 477
150 uniface

UniFace:面向Python的统一人脸分析库 | 检测、对齐、关键点、人脸网格、识别、解析、注视、属性与防伪于同一API。

1.6K 215
151 Sa2VA

Pixel-LLM 代码库官方仓库:Sa2VA (T-PAMI-26)、SAMTok (CVPR-26)、VRT (Arxiv-25)、SaSaSa2VA(LSVOS 第一名解决方案)

1.7K 131
152 VideoPipe

基于CV模型与mLLM的跨平台视频结构化(视频分析)框架。

2.9K 463
153 Grounded-SAM-2

Grounded SAM 2:使用Grounding DINO、Florence-2和SAM 2在视频中定位和跟踪任意目标

3.7K 430
154 Biodiversity

微软AI for Good实验室——生物多样性研究中心,提供开源AI模型、边缘设备及监测保护工具,涵盖MegaDetector、SPARROW、PytorchWildlife、Bioacoustics等。

1.1K 296
155 MulimgViewer

MulimgViewer 是一个多图像查看器,可在同一界面中打开多个图像,便于图像比较和图像拼接。

1.4K 121
156 imagej2

开源的科学N维图像处理 :microscope: :sparkler:

1.4K 350
157 gluon-cv

Gluon CV 工具包

5.9K 1.2K
158 BoofCV

用于SFM、标定、基准标记、跟踪、图像处理等的快速计算机视觉库。

1.2K 269
159 PhotonCamera

使用增强图像处理的Android相机

1.1K 108
160 Chinese_license_plate_detection_recognition

yolov5 车牌检测 车牌识别 中文车牌识别 检测 支持12种中文车牌 支持双层车牌

1.9K 298
< 上一页
/ 20
下一页 >