计算机视觉

检测、分割、OCR 与视觉流水线,面向生产的开源计算机视觉方案。

共 384 个项目

排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。

第 101–120 项,共 384 个

排名 项目 Stars Forks
101 LightGlue

LightGlue:光速局部特征匹配(ICCV 2023)

4.7K 560
102 deepdoctection

一个用于文档人工智能的仓库

3.2K 196
103 CompreFace

领先的免费开源人脸识别系统

8.3K 1.2K
104 deep-person-reid

Torchreid:基于PyTorch的深度学习行人重识别。

4.9K 1.2K
105 QualityScaler

QualityScaler - 图像/视频 AI 超分辨率应用

3.1K 253
106 Ask-Anything

[CVPR2024 Highlight][VideoChatGPT] 具有视频理解能力的ChatGPT!并且支持更多语言模型,如miniGPT4、StableLM和MOSS。

3.3K 268
107 WebPlotDigitizer

计算机视觉辅助工具,用于从图表图像中提取数值数据。

3.1K 436
108 pytorchvideo

用于视频理解研究的深度学习库。

3.6K 425
109 ImageAI

一个Python库,旨在赋能开发者构建具有自包含计算机视觉能力的应用和系统。

8.9K 2.2K
110 paperless-gpt

使用LLM和LLM视觉(OCR)处理paperless-ngx——由AI驱动的文档数字化

2.7K 204
111 llm_aided_ocr

使用LLM(本地或API)增强Tesseract OCR输出,用于错误纠正、智能分块和扫描PDF的Markdown格式化。

3.0K 214
112 voxelmorph

用于图像配准的无监督学习

2.7K 640
113 Segment-and-Track-Anything

使用SAM和AOT对视频中的任意对象进行分割与跟踪,支持自动和交互模式。

3.1K 356
114 imagededup

😎 轻松查找重复图片!

5.7K 477
115 stitching

用于快速且稳健的图像拼接的Python包

2.6K 217
116 computervision-recipes

计算机视觉的最佳实践、代码示例和文档。

9.9K 1.2K
117 CV-CUDA

CV-CUDA™ 是一个开源的、GPU 加速的库,用于云规模的图像处理和计算机视觉。

2.7K 262
118 DeepCamera

开源AI摄像头技能平台,支持本地VLM分析和智能安全代理,通过消息应用实现家庭监控。

3.0K 477
119 torchio

面向AI应用的医学影像处理。

2.4K 275
120 Simd

使用SIMD的C++图像处理和机器学习库:支持x86/x64的SSE、AVX、AVX-512、AMX,ARM的NEON、SVE,Hexagon的HVX

2.3K 453
< 上一页
/ 20
下一页 >