计算机视觉
检测、分割、OCR 与视觉流水线,面向生产的开源计算机视觉方案。
共 395 个项目
排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。
| 排名 | 项目 | Stars | Forks | 更新 | 许可证 |
|---|---|---|---|---|---|
| 261 |
ScaledYOLOv4
Scaled-YOLOv4:缩放跨阶段部分网络 |
2.0K | 563 | 11/03/24 | GPL-3.0 |
| 262 |
Video-LLaMA
[EMNLP 2023 演示] Video-LLaMA:面向视频理解的指令调优音视频语言模型 |
3.1K | 287 | 06/04/24 | BSD-3-Clause |
| 263 |
DAMO-YOLO
DAMO-YOLO:一种快速准确的物体检测方法,采用了一些新技术,包括NAS骨干网络、高效的RepGFPN、ZeroHead、AlignedOTA和蒸馏增强。 |
3.2K | 407 | 05/25/24 | Apache-2.0 |
| 264 |
Sophus
使用Eigen的Lie群的C++实现。 |
2.4K | 671 | 07/06/24 | Other |
| 265 |
decord
高效深度学习视频加载器,具备智能洗牌功能,超级容易上手。 |
2.5K | 233 | 07/17/24 | Apache-2.0 |
| 266 |
darknet_ros
YOLO ROS:用于ROS的实时物体检测 |
2.4K | 1.2K | 07/19/24 | BSD-3-Clause |
| 267 |
sort
简单、在线、实时的视频序列中多目标跟踪。 |
4.4K | 1.1K | 11/28/23 | GPL-3.0 |
| 268 |
MonoGS
CVPR'24 Highlight和最佳演示奖 Gaussian Splatting SLAM |
2.1K | 232 | 08/07/24 | Other |
| 269 |
BlenderNeRF
在Blender中轻松创建NeRF合成数据集 |
1.0K | 77 | 12/16/24 | MIT |
| 270 |
temporal-shift-module
[ICCV 2019] TSM:用于高效视频理解的时间移位模块 |
2.2K | 421 | 07/11/24 | MIT |
| 271 |
Cutie
[CVPR 2024 Highlight] 将对象重新放回视频对象分割中 |
1.1K | 114 | 11/08/24 | MIT |
| 272 |
Low-Cost-Mocap
用于房间级追踪的低成本动作捕捉系统 |
2.4K | 408 | 05/25/24 | MIT |
| 273 |
MedicalZooPytorch
基于PyTorch的深度学习框架,用于多模态2D/3D医学图像分割 |
1.9K | 305 | 07/25/24 | MIT |
| 274 |
SplaTAM
SplaTAM:用于稠密RGB-D SLAM的3D高斯溅射、跟踪与建图(CVPR 2024) |
2.2K | 253 | 06/19/24 | BSD-3-Clause |
| 275 |
FCOS
FCOS:全卷积单阶段目标检测 (ICCV'19) |
3.3K | 621 | 12/09/23 | Other |
| 276 |
magic-copy
Magic Copy 是一款 Chrome 扩展程序,利用 Meta 的 Segment Anything Model 从图像中提取前景对象并复制到剪贴板。 |
2.5K | 155 | 05/06/24 | MIT |
| 277 |
AI-basketball-analysis
:basketball::robot::basketball: 分析篮球投篮和投篮姿势的AI Web应用和API |
1.3K | 235 | 09/26/24 | Other |
| 278 |
3DDFA_V2
Towards Fast, Accurate and Stable 3D Dense Face Alignment 的官方 PyTorch 实现,ECCV 2020。 |
3.1K | 555 | 02/02/24 | MIT |
| 279 |
ECON
[CVPR'23, Highlight] ECON:通过法线积分优化的显式穿衣人体 |
1.2K | 116 | 09/17/24 | Other |
| 280 |
Emotion-detection
使用深度学习进行实时面部情绪检测 |
1.4K | 552 | 08/30/24 | MIT |