计算机视觉
检测、分割、OCR 与视觉流水线,面向生产的开源计算机视觉方案。
共 384 个项目
排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。
| 排名 | 项目 | Stars | Forks | 更新 | 许可证 |
|---|---|---|---|---|---|
| 1 |
opencv
开源计算机视觉库 |
90.6K | 57.0K | 08/29/26 | Apache-2.0 |
| 2 |
RuView
π RuView 将普通 WiFi 信号转化为实时空间智能、生命体征监测和存在检测——全程无需任何视频像素。 |
92.0K | 12.2K | 08/29/26 | MIT |
| 3 |
PaddleOCR
将任何PDF或图像文档转化为适用于AI的结构化数据。一个强大且轻量级的OCR工具包,弥合图像/PDF与LLM之间的差距。支持100多种语言。 |
88.5K | 11.3K | 07/22/26 | Apache-2.0 |
| 4 |
MinerU
将 PDF 和 Office 文档等复杂文档转换为 LLM 可用的 markdown/JSON,以支持您的智能体工作流。 |
78.7K | 6.6K | 08/28/26 | Other |
| 5 |
tesseract
Tesseract开源OCR引擎(主仓库) |
76.2K | 10.8K | 08/25/26 | Apache-2.0 |
| 6 |
ultralytics
Ultralytics YOLO26、YOLO11、YOLOv8——目标检测、实例分割、语义分割、图像分类、姿态估计、目标跟踪 |
61.1K | 11.7K | 08/29/26 | AGPL-3.0 |
| 7 |
yolov5
基于PyTorch的Ultralytics YOLOv5,用于目标检测、实例分割、分类、训练和导出。 |
57.9K | 17.5K | 08/28/26 | AGPL-3.0 |
| 8 |
faceswap
面向所有人的Deepfakes软件 |
57.5K | 13.5K | 08/05/26 | GPL-3.0 |
| 9 |
face_recognition
世界上最简单的面部识别API,适用于Python和命令行 |
56.7K | 13.7K | 06/25/26 | MIT |
| 10 |
supervision
我们编写您可复用的计算机视觉工具。💜 |
49.8K | 4.7K | 08/25/26 | MIT |
| 11 |
photoprism
AI驱动的照片应用 🌈💎✨ |
40.1K | 2.3K | 08/29/26 | Other |
| 12 |
tesseract.js
纯JavaScript OCR,支持100多种语言 📖🎉🖥 |
38.7K | 2.4K | 05/17/26 | Apache-2.0 |
| 13 |
frigate
用于IP摄像头的实时本地物体检测NVR |
35.5K | 3.5K | 08/29/26 | MIT |
| 14 |
mediapipe
跨平台、可定制的机器学习解决方案,用于实时和流媒体。 |
36.8K | 6.1K | 08/29/26 | Apache-2.0 |
| 15 |
GFPGAN
GFPGAN旨在开发用于真实世界人脸恢复的实用算法。 |
37.7K | 6.3K | 07/26/24 | Other |
| 16 |
Real-ESRGAN
Real-ESRGAN 旨在开发用于通用图像/视频恢复的实用算法。 |
36.6K | 4.5K | 08/06/24 | BSD-3-Clause |
| 17 |
facefusion
行业领先的人脸处理平台 |
29.7K | 4.8K | 08/29/26 | Other |
| 18 |
openpose
OpenPose:用于身体、面部、手部和脚部估计的实时多人关键点检测库 |
34.4K | 8.0K | 08/03/24 | Other |
| 19 |
EasyOCR
即用型OCR,支持80多种语言和所有流行的书写系统,包括拉丁文、中文、阿拉伯文、天城文、西里尔文等。 |
30.0K | 3.6K | 12/05/25 | Apache-2.0 |
| 20 |
vit-pytorch
Vision Transformer的实现,一种仅使用单个transformer编码器即可在视觉分类中达到SOTA的简单方法,基于Pytorch。 |
25.5K | 3.5K | 08/27/26 | MIT |