计算机视觉
检测、分割、OCR 与视觉流水线,面向生产的开源计算机视觉方案。
共 384 个项目
排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。
| 排名 | 项目 | Stars | Forks | 更新 | 许可证 |
|---|---|---|---|---|---|
| 61 |
YOLOX
YOLOX 是一个高性能的无锚框 YOLO,在 MegEngine、ONNX、TensorRT、ncnn 和 OpenVINO 支持下超越 yolov3~v5。文档:https://yolox.readthedocs.io/ |
10.6K | 2.5K | 06/08/25 | Apache-2.0 |
| 62 |
Final2x
跨平台图像超分辨率工具 |
7.3K | 525 | 08/20/26 | BSD-3-Clause |
| 63 |
doctr
docTR(文档文本识别)- 一个无缝、高性能且易于访问的库,用于基于深度学习的OCR相关任务。由t2k持续开发和维护。 |
6.3K | 673 | 08/28/26 | Apache-2.0 |
| 64 |
caire
内容感知图像缩放库 |
10.5K | 387 | 05/02/25 | MIT |
| 65 |
opencvsharp
OpenCV的.NET封装 |
6.1K | 1.2K | 08/24/26 | Apache-2.0 |
| 66 |
jetson-inference
Hello AI World 指南,介绍如何使用 TensorRT 和 NVIDIA Jetson 部署深度学习推理网络和深度视觉原语。 |
9.0K | 3.1K | 10/16/25 | MIT |
| 67 |
face-alignment
:fire: 基于pytorch构建的2D和3D人脸对齐库 |
7.5K | 1.4K | 04/06/26 | BSD-3-Clause |
| 68 |
DeepLabCut
DeepLabCut的官方实现:利用深度学习对所有动物(包括人类)的用户定义特征进行无标记姿态估计。 |
5.7K | 1.8K | 08/28/26 | LGPL-3.0 |
| 69 |
scrypted
Scrypted 是一个高性能的视频集成和自动化平台 |
5.9K | 391 | 08/29/26 | Other |
| 70 |
PaddleX
基于PaddlePaddle的一体化开发工具 |
6.3K | 1.2K | 06/25/26 | Apache-2.0 |
| 71 |
SlowFast
PySlowFast:来自FAIR的视频理解代码库,用于复现最先进的视频模型。 |
7.4K | 1.3K | 03/16/26 | Apache-2.0 |
| 72 |
sahi
框架无关的切片/分块推理 + 交互式UI + 错误分析图 |
5.5K | 781 | 08/22/26 | MIT |
| 73 |
Pytorch-UNet
PyTorch实现的U-Net,用于图像语义分割,支持高质量图像。 |
11.6K | 2.8K | 08/11/24 | GPL-3.0 |
| 74 |
clip-as-service
🏄 基于CLIP的可扩展图像和句子嵌入、推理与排序 |
12.8K | 2.1K | 01/23/24 | Other |
| 75 |
Edit-Banana
Edit Banana:一个将统计格式转换为可编辑格式的框架。 |
5.5K | 358 | 08/25/26 | AGPL-3.0 |
| 76 |
facenet
使用TensorFlow进行人脸识别 |
14.3K | 4.8K | 07/24/23 | MIT |
| 77 |
remove-ai-watermarks
移除图像和视频中可见及不可见的AI水印和来源元数据。提供Python库和CLI,支持SynthID、C2PA、EXIF、IPTC、XMP及常见生成式AI标记。 |
5.3K | 499 | 08/30/26 | Apache-2.0 |
| 78 |
gemini-watermark-remover
高性能、100% 客户端工具,用于去除 Gemini AI 图像和视频水印。使用纯 JavaScript 构建,采用数学精确的反向 Alpha 混合算法。 |
5.4K | 861 | 08/15/26 | MIT |
| 79 |
sports
计算机视觉和运动 |
5.3K | 656 | 08/28/26 | MIT |
| 80 |
MaaFramework
基于图像识别的自动化黑盒测试框架 |
4.7K | 543 | 08/28/26 | LGPL-3.0 |