计算机视觉

检测、分割、OCR 与视觉流水线,面向生产的开源计算机视觉方案。

共 413 个项目

排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。

第 301–320 项,共 413 个

排名 项目 Stars Forks
301 comfyui_segment_anything

基于GroundingDino和SAM,使用语义字符串分割图像中的任意元素。这是sd-webui-segment-anything的comfyui版本。

1.1K 110
302 tennis_analysis

分析视频中的网球运动员,使用YOLO检测和基于CNN的球场关键点提取来测量运动员速度、球速和击球次数。

884 269
303 Gaussian-SLAM

Gaussian-SLAM:基于高斯泼溅的照片级逼真密集SLAM

1.2K 88
304 Efficient-Segmentation-Networks

用于实时语义分割的轻量级模型,基于PyTorch(包括SQNet、LinkNet、SegNet、UNet、ENet、ERFNet、EDANet、ESPNet、ESPNetv2、LEDNet、ESNet、FSSNet、CGNet、DABNet、Fast-SCNN、ContextNet、FPENet等)。

1.0K 167
305 pydensecrf

Philipp Krähenbühl 的密集(全连接)CRF(含高斯边缘势能)的 Python 封装。

2.0K 428
306 AB3DMOT

(IROS 2020,ECCVW 2020)官方Python实现,用于“3D多目标跟踪:基线与新评估指标”

1.8K 415
307 nsfw_model

NSFW检测器的Keras模型

2.1K 302
308 antialiased-cnns

pip install antialiased-cnns 以提高稳定性和准确性

1.7K 202
309 DSINE

[CVPR 2024 Oral] 重新思考表面法线估计的归纳偏置

924 43
310 lanenet-lane-detection

lanenet模型的非官方实现,用于实时车道线检测

2.6K 896
311 efficientnet

EfficientNet模型的实现。Keras和TensorFlow Keras。

2.1K 457
312 MPRNet

[CVPR 2021] 多阶段渐进式图像恢复。在图像去模糊、去雨和去噪方面达到SOTA结果。

1.4K 207
313 Transformer-Explainability

[CVPR 2021] 官方PyTorch实现,用于超越注意力可视化的Transformer可解释性,一种通过基于Transformer的网络可视化分类的新方法。

2.0K 261
314 SSD

高质量、快速、模块化的PyTorch SSD参考实现

1.6K 384
315 VisDrone-Dataset

基于无人机的检测与跟踪数据集已发布,包含图像/视频和标注。

2.5K 242
316 VideoMAE

[NeurIPS 2022 Spotlight] VideoMAE:用于自监督视频预训练的数据高效掩码自编码器

1.8K 171
317 NeuralRecon

代码对应论文“NeuralRecon:基于单目视频的实时连贯三维重建”,CVPR 2021口头报告

2.3K 311
318 ml-cvnets

CVNets:用于训练计算机视觉网络的库

2.0K 258
319 jeelizWeboji

实时WebGL和JavaScript库,用于浏览器中的人脸跟踪、表情检测和动画表情,包含SVG和Three.js演示 😄

1.1K 151
320 DECA

DECA:精细表情捕捉与动画(SIGGRAPH 2021)

2.5K 497
< 上一页
/ 21
下一页 >