计算机视觉
检测、分割、OCR 与视觉流水线,面向生产的开源计算机视觉方案。
共 468 个项目
排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。
| 排名 | 项目 | Stars | Forks | 更新 | 许可证 |
|---|---|---|---|---|---|
| 381 |
HyperPose
快速灵活的人体姿态估计库 |
1.3K | 271 | 03/25/23 | Other |
| 382 |
covid-chestxray-dataset
我们正在构建一个包含胸部X光或CT图像的COVID-19病例开放数据库。 |
3.1K | 1.3K | 08/18/22 | Other |
| 383 |
FLAME_PyTorch
这是PyTorch中3D FLAME模型的实现。 |
810 | 102 | 05/23/23 | MIT |
| 384 |
MUNIT
多模态无监督图像到图像翻译 |
2.7K | 487 | 09/20/22 | Other |
| 385 |
TheiaSfM
一个用于多视图几何和运动恢复结构的开源库 |
945 | 278 | 04/03/23 | BSD-3-Clause |
| 386 |
3DDFA
TPAMI 2017论文的PyTorch改进版:全姿态人脸对齐的3D整体解决方案。 |
3.7K | 642 | 05/14/22 | MIT |
| 387 |
tsdf-fusion-python
将多个RGB-D图像融合为TSDF体素体积的Python代码。 |
1.4K | 236 | 02/18/23 | BSD-2-Clause |
| 388 |
a-PyTorch-Tutorial-to-Image-Captioning
展示、关注和讲述 | 一个用于图像描述的PyTorch教程 |
2.9K | 727 | 07/28/22 | MIT |
| 389 |
handtrack.js
一个用于在浏览器中直接进行实时手部检测(边界框)原型设计的库。 |
2.9K | 258 | 07/20/22 | MIT |
| 390 |
RingNet
从图像中回归3D人脸形状和表情,无需3D监督 |
884 | 172 | 03/24/23 | MIT |
| 391 |
CRNN_Chinese_Characters_Rec
(CRNN) 中文字符识别。 |
1.9K | 533 | 11/13/22 | Other |
| 392 |
interactive-deep-colorization
深度学习软件,用于黑白图像着色,只需几次点击。 |
2.7K | 446 | 07/29/22 | MIT |
| 393 |
lip-reading-deeplearning
:unlock: 唇语识别 - 使用3D架构的跨音视频识别 |
1.9K | 331 | 11/07/22 | Apache-2.0 |
| 394 |
STEGO
通过蒸馏特征对应关系的无监督语义分割 |
791 | 157 | 03/24/23 | MIT |
| 395 |
image-to-latex
将LaTex数学公式的图片转换为LaTex代码。 |
2.2K | 311 | 10/04/22 | MIT |
| 396 |
pytorch-center-loss
Pytorch实现Center Loss |
993 | 216 | 02/19/23 | MIT |
| 397 |
Medical-Transformer
官方Pytorch代码,用于“医学Transformer:门控轴向注意力用于医学图像分割”(MICCAI 2021) |
861 | 175 | 02/23/23 | MIT |
| 398 |
flame-fitting
FLAME 3D头部模型的示例代码。该代码演示了如何从模型中采样3D头部,将模型拟合到3D关键点和3D扫描。 |
820 | 120 | 02/16/23 | Other |
| 399 |
QuickDraw
Quickdraw 的实现 - 一款由 Google 开发的在线游戏 |
1.1K | 195 | 01/11/23 | MIT |
| 400 |
tencent-ml-images
最大的多标签图像数据库;ResNet-101模型;在ImageNet上top-1准确率80.73% |
3.1K | 503 | 04/20/22 | Other |