计算机视觉

检测、分割、OCR 与视觉流水线,面向生产的开源计算机视觉方案。

共 484 个项目

排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。

第 401–420 项,共 484 个

排名 项目 Stars Forks
401 CRNN_Chinese_Characters_Rec

(CRNN) 中文字符识别。

1.9K 533
402 interactive-deep-colorization

深度学习软件,用于黑白图像着色,只需几次点击。

2.7K 446
403 lip-reading-deeplearning

:unlock: 唇语识别 - 使用3D架构的跨音视频识别

1.9K 331
404 STEGO

通过蒸馏特征对应关系的无监督语义分割

791 157
405 image-to-latex

将LaTex数学公式的图片转换为LaTex代码。

2.2K 311
406 aster

识别自然图像中的裁剪文本。

743 196
407 pytorch-center-loss

Pytorch实现Center Loss

993 216
408 Medical-Transformer

官方Pytorch代码,用于“医学Transformer:门控轴向注意力用于医学图像分割”(MICCAI 2021)

861 175
409 flame-fitting

FLAME 3D头部模型的示例代码。该代码演示了如何从模型中采样3D头部,将模型拟合到3D关键点和3D扫描。

820 120
410 QuickDraw

Quickdraw 的实现 - 一款由 Google 开发的在线游戏

1.1K 195
411 tencent-ml-images

最大的多标签图像数据库;ResNet-101模型;在ImageNet上top-1准确率80.73%

3.1K 503
412 grad-cam

[ICCV 2017] 用于 Grad-CAM 的 Torch 代码

1.7K 237
413 PWC-Net

PWC-Net: 基于金字塔、扭曲和代价体积的光流CNN,CVPR 2018(口头)

1.7K 365
414 flamingo-pytorch

在Pytorch中实现🦩 Flamingo,Deepmind的最先进的小样本视觉问答注意力网络。

1.3K 66
415 PreciseRoIPooling

Precise RoI Pooling,支持坐标梯度,出自论文《Acquisition of Localization Confidence for Accurate Object Detection》(https://arxiv.org/abs/1807.11590)。

781 151
416 redner

可微渲染,无近似。

1.4K 145
417 Yolov5-Deepsort

最新版本yolov5+deepsort目标检测和追踪,能够显示目标类别,支持5.0版本可训练自己数据集

1.2K 171
418 PaddleViT

:robot: PaddleViT:面向PaddlePaddle 2.0+的最先进的视觉Transformer和MLP模型

1.2K 328
419 natural-language-image-search

使用自然语言在Unsplash上搜索照片

1.0K 103
420 keras-vis

用于keras的神经网络可视化工具包

3.0K 635
< 上一页
/ 25
下一页 >