计算机视觉

检测、分割、OCR 与视觉流水线,面向生产的开源计算机视觉方案。

共 384 个项目

排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。

第 1–20 项,共 384 个

排名 项目 Stars Forks
1 opencv

开源计算机视觉库

90.6K 57.0K
2 RuView

π RuView 将普通 WiFi 信号转化为实时空间智能、生命体征监测和存在检测——全程无需任何视频像素。

92.0K 12.2K
3 PaddleOCR

将任何PDF或图像文档转化为适用于AI的结构化数据。一个强大且轻量级的OCR工具包,弥合图像/PDF与LLM之间的差距。支持100多种语言。

88.5K 11.3K
4 MinerU

将 PDF 和 Office 文档等复杂文档转换为 LLM 可用的 markdown/JSON,以支持您的智能体工作流。

78.7K 6.6K
5 tesseract

Tesseract开源OCR引擎(主仓库)

76.2K 10.8K
6 ultralytics

Ultralytics YOLO26、YOLO11、YOLOv8——目标检测、实例分割、语义分割、图像分类、姿态估计、目标跟踪

61.1K 11.7K
7 yolov5

基于PyTorch的Ultralytics YOLOv5,用于目标检测、实例分割、分类、训练和导出。

57.9K 17.5K
8 faceswap

面向所有人的Deepfakes软件

57.5K 13.5K
9 face_recognition

世界上最简单的面部识别API,适用于Python和命令行

56.7K 13.7K
10 supervision

我们编写您可复用的计算机视觉工具。💜

49.8K 4.7K
11 photoprism

AI驱动的照片应用 🌈💎✨

40.1K 2.3K
12 tesseract.js

纯JavaScript OCR,支持100多种语言 📖🎉🖥

38.7K 2.4K
13 frigate

用于IP摄像头的实时本地物体检测NVR

35.5K 3.5K
14 mediapipe

跨平台、可定制的机器学习解决方案,用于实时和流媒体。

36.8K 6.1K
15 GFPGAN

GFPGAN旨在开发用于真实世界人脸恢复的实用算法。

37.7K 6.3K
16 Real-ESRGAN

Real-ESRGAN 旨在开发用于通用图像/视频恢复的实用算法。

36.6K 4.5K
17 facefusion

行业领先的人脸处理平台

29.7K 4.8K
18 openpose

OpenPose:用于身体、面部、手部和脚部估计的实时多人关键点检测库

34.4K 8.0K
19 EasyOCR

即用型OCR,支持80多种语言和所有流行的书写系统,包括拉丁文、中文、阿拉伯文、天城文、西里尔文等。

30.0K 3.6K
20 vit-pytorch

Vision Transformer的实现,一种仅使用单个transformer编码器即可在视觉分类中达到SOTA的简单方法,基于Pytorch。

25.5K 3.5K
< 上一页
/ 20
下一页 >