计算机视觉

检测、分割、OCR 与视觉流水线,面向生产的开源计算机视觉方案。

共 384 个项目

排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。

第 61–80 项,共 384 个

排名 项目 Stars Forks
61 YOLOX

YOLOX 是一个高性能的无锚框 YOLO,在 MegEngine、ONNX、TensorRT、ncnn 和 OpenVINO 支持下超越 yolov3~v5。文档:https://yolox.readthedocs.io/

10.6K 2.5K
62 Final2x

跨平台图像超分辨率工具

7.3K 525
63 doctr

docTR(文档文本识别)- 一个无缝、高性能且易于访问的库,用于基于深度学习的OCR相关任务。由t2k持续开发和维护。

6.3K 673
64 caire

内容感知图像缩放库

10.5K 387
65 opencvsharp

OpenCV的.NET封装

6.1K 1.2K
66 jetson-inference

Hello AI World 指南,介绍如何使用 TensorRT 和 NVIDIA Jetson 部署深度学习推理网络和深度视觉原语。

9.0K 3.1K
67 face-alignment

:fire: 基于pytorch构建的2D和3D人脸对齐库

7.5K 1.4K
68 DeepLabCut

DeepLabCut的官方实现:利用深度学习对所有动物(包括人类)的用户定义特征进行无标记姿态估计。

5.7K 1.8K
69 scrypted

Scrypted 是一个高性能的视频集成和自动化平台

5.9K 391
70 PaddleX

基于PaddlePaddle的一体化开发工具

6.3K 1.2K
71 SlowFast

PySlowFast:来自FAIR的视频理解代码库,用于复现最先进的视频模型。

7.4K 1.3K
72 sahi

框架无关的切片/分块推理 + 交互式UI + 错误分析图

5.5K 781
73 Pytorch-UNet

PyTorch实现的U-Net,用于图像语义分割,支持高质量图像。

11.6K 2.8K
74 clip-as-service

🏄 基于CLIP的可扩展图像和句子嵌入、推理与排序

12.8K 2.1K
75 Edit-Banana

Edit Banana:一个将统计格式转换为可编辑格式的框架。

5.5K 358
76 facenet

使用TensorFlow进行人脸识别

14.3K 4.8K
77 remove-ai-watermarks

移除图像和视频中可见及不可见的AI水印和来源元数据。提供Python库和CLI,支持SynthID、C2PA、EXIF、IPTC、XMP及常见生成式AI标记。

5.3K 499
78 gemini-watermark-remover

高性能、100% 客户端工具,用于去除 Gemini AI 图像和视频水印。使用纯 JavaScript 构建,采用数学精确的反向 Alpha 混合算法。

5.4K 861
79 sports

计算机视觉和运动

5.3K 656
80 MaaFramework

基于图像识别的自动化黑盒测试框架

4.7K 543
< 上一页
/ 20
下一页 >