计算机视觉

检测、分割、OCR 与视觉流水线,面向生产的开源计算机视觉方案。

共 384 个项目

排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。

第 201–220 项,共 384 个

排名 项目 Stars Forks
201 SiamMask

[CVPR19/TPAMI23] SiamMask:用于快速在线目标跟踪与分割的框架

3.5K 804
202 UForm

袖珍型多模态AI,用于跨多语言文本、图像和🔜视频的内容理解与生成,速度比OpenAI CLIP和LLaVA快多达5倍 🖼️ & 🖋️

1.2K 78
203 DPED

用于使用深度卷积网络自动增强照片质量的软件和预训练模型

1.7K 366
204 HYPIR

HYPIR的官方实现:利用扩散生成的分数先验进行图像恢复(SIGGRAPH 2025)

1.2K 102
205 deep-high-resolution-net.pytorch

The project is an official implementation of our CVPR2019 paper "Deep High-Resolution Representation Learning for Human Pose Estimation"

4.5K 922
206 BEVFormer

[ECCV 2022] 这是BEVFormer的官方实现,一个仅使用摄像头的自动驾驶感知框架,例如3D物体检测和语义地图分割。

4.6K 748
207 MedSegDiff

使用扩散模型从医学图像中分割/重建器官 [AAAI最具影响力论文]

1.4K 201
208 pytorch-cifar100

cifar100练习(ResNet、DenseNet、VGG、GoogleNet、InceptionV3、InceptionV4、Inception-ResNetv2、Xception、Resnet In Resnet、ResNext、ShuffleNet、ShuffleNetv2、MobileNet、MobileNetv2、SqueezeNet、NasNet、Residual Attention Network、SENet、WideResNet)

4.8K 1.2K
209 ComfyUI-segment-anything-2

ComfyUI节点,用于使用segment-anything-2

1.2K 87
210 Ollama-OCR

使用Ollama视觉语言模型从图像和PDF中提取文本的OCR包,支持多种模型、输出格式和批量处理。

2.8K 323
211 4DGaussians

[CVPR 2024] 4D高斯溅射用于实时动态场景渲染

3.9K 385
212 rPPG-Toolbox

rPPG-Toolbox:深度远程PPG工具箱(NeurIPS 2023)

1.2K 304
213 monodepth2

[ICCV 2019] 基于单张图像的单目深度估计

4.5K 987
214 Video-LLaVA

【EMNLP 2024🔥】Video-LLaVA:通过投影前对齐学习统一视觉表示

3.5K 255
215 MAX-Image-Resolution-Enhancer

将图像放大4倍,同时生成照片级真实细节。

1.0K 161
216 SimpleCV

开源机器视觉框架

2.7K 787
217 SuperGluePretrainedNetwork

SuperGlue: 使用图神经网络学习特征匹配 (CVPR 2020, Oral)

4.1K 758
218 EasyCV

一体化计算机视觉工具包

2.0K 227
219 LISA

LISA: 基于大语言模型的推理分割项目页面

2.7K 206
220 SimpleCVReproduction

简单计算机视觉项目的复现,包括注意力、分类、检测、关键点检测等。

1.3K 318
< 上一页
/ 20
下一页 >