计算机视觉

检测、分割、OCR 与视觉流水线,面向生产的开源计算机视觉方案。

共 390 个项目

排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。

第 241–260 项,共 390 个

排名 项目 Stars Forks
241 GPUImage2

GPUImage 2 是一个采用BSD许可证的Swift框架,用于GPU加速的视频和图像处理。

4.9K 618
242 mmyolo

OpenMMLab YOLO系列工具箱和基准。实现了RTMDet、RTMDet-Rotated、YOLOv5、YOLOv6、YOLOv7、YOLOv8、YOLOX、PPYOLOE等。

3.5K 631
243 pytracking

基于PyTorch的视觉跟踪库。

3.5K 614
244 UniDepth

通用单目度量深度估计

1.2K 118
245 pytorch-segmentation

:art: 基于PyTorch实现的语义分割模型、数据集和损失函数。

1.8K 389
246 tensorflow-yolov3

🔥 TensorFlow 代码,对应技术报告:《YOLOv3: An Incremental Improvement》

3.6K 1.3K
247 SegmentAnythingin3D

使用NeRFs在3D中进行任意分割(NeurIPS 2023 & IJCV 2025)

1.0K 64
248 ghost

一种用于图像和视频领域的全新一次性换脸方法。

1.6K 308
249 DenseNet

密集连接卷积网络,CVPR 2017(最佳论文奖)

4.9K 1.1K
250 PyTorch-Encoding

用于我的论文的CV工具包

2.0K 448
251 mAP

平均精度均值 - 此代码评估你的神经网络用于目标识别的性能。

3.0K 918
252 DIS

本仓库为我们的新项目高精度二分图像分割(Highly Accurate Dichotomous Image Segmentation)的代码库

2.6K 289
253 DeepMosaics

自动移除图像和视频中的马赛克,或为它们添加马赛克。

2.6K 486
254 DINO

[ICLR 2023] 论文《DINO: DETR with Improved DeNoising Anchor Boxes for End-to-End Object Detection》的官方实现

2.8K 309
255 XMem

[ECCV 2022] XMem:基于Atkinson-Shiffrin记忆模型的长期视频对象分割

2.0K 212
256 yolov3-tf2

基于Tensorflow 2.0实现的YoloV3

2.5K 888
257 deep-text-recognition-benchmark

使用深度学习方法的文本识别(光学字符识别),ICCV 2019

3.9K 1.1K
258 hagrid

手势识别图像数据集

1.1K 149
259 ScaledYOLOv4

Scaled-YOLOv4:缩放跨阶段部分网络

2.0K 563
260 Video-LLaMA

[EMNLP 2023 演示] Video-LLaMA:面向视频理解的指令调优音视频语言模型

3.1K 287
< 上一页
/ 20
下一页 >