计算机视觉

检测、分割、OCR 与视觉流水线,面向生产的开源计算机视觉方案。

共 384 个项目

排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。

第 121–140 项,共 384 个

排名 项目 Stars Forks
121 DeepDanbooru

基于AI的多标签少女图像分类系统,使用TensorFlow实现。

2.9K 266
122 gpupixel

基于GPU的实时图像滤镜引擎

2.4K 342
123 manga-ocr

用于日语文本的光学字符识别,主要关注日本漫画。

2.8K 140
124 3dgrut

高斯粒子的光线追踪和混合光栅化

2.4K 279
125 RobustVideoMatting

在PyTorch、TensorFlow、TensorFlow.js、ONNX、CoreML中的稳健视频抠像!

9.5K 1.2K
126 emgucv

Emgu CV 是 OpenCV 图像处理库的跨平台 .Net 包装器。

2.3K 583
127 torch-cam

为您的PyTorch模型生成类激活图(CAM、Grad-CAM、Grad-CAM++、Smooth Grad-CAM++、Score-CAM、SS-CAM、IS-CAM、XGrad-CAM、Layer-CAM、Finer-CAM、LeGrad、RefineCAM)

2.3K 227
128 datasets

🎁 7,400,000+ Unsplash 图片,供研究和机器学习使用。

2.8K 142
129 BasicSR

开源图像和视频修复工具箱,用于超分辨率、去噪、去模糊等。目前包括EDSR、RCAN、SRResNet、SRGAN、ESRGAN、EDVR、BasicVSR、SwinIR、ECBSR等。也支持StyleGAN2、DFDNet。

8.4K 1.4K
130 Hierarchical-Localization

使用hloc轻松实现视觉定位

4.2K 770
131 video-search-and-summarization

GPU加速的参考架构,用于构建视频AI代理,具有实时验证的警报、视觉问答和自动摘要功能。

1.8K 381
132 claude-real-video

让Claude(或任何LLM)真正观看视频——从URL或本地文件获取场景感知、去重的帧+转录。本地运行,MIT许可。

2.1K 184
133 vipe

ViPE:视频姿态引擎,用于几何3D感知

2.1K 172
134 InternVideo

[ECCV2024] 视频基础模型与多模态理解数据

2.4K 159
135 ComfyUI-RMBG

一个ComfyUI自定义节点,用于高级图像背景移除以及物体、人脸、衣物和时尚分割,利用多个模型,包括RMBG-2.0、INSPYRENET、BEN、BEN2、BiRefNet、SDMatte、SAM、SAM2、SAM3和GroundingDINO。

2.1K 133
136 HyperLPR

高性能中文车牌识别框架。

6.3K 2.1K
137 ocrs

Rust库和命令行工具,用于OCR(从图像中提取文本)

1.9K 90
138 JoyAI-VL-Interaction

JoyAI-VL-Interaction:一个开源的实时视频-语言交互系统

1.8K 181
139 tapnet

跟踪任意点 (TAP)

2.0K 187
140 Open-Source-Face-Recognition-SDK

全球首个面向Windows和Linux的开源人脸识别SDK(人脸检测、人脸关键点提取、人脸特征提取、人脸模板匹配)

1.9K 350
< 上一页
/ 20
下一页 >