计算机视觉

检测、分割、OCR 与视觉流水线,面向生产的开源计算机视觉方案。

共 384 个项目

排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。

第 81–100 项,共 384 个

排名 项目 Stars Forks
81 sparrow

使用机器学习、大语言模型和视觉大语言模型进行结构化数据提取、指令调用和智能体工作流。

5.2K 519
82 openMVG

开放多视图几何库。3D计算机视觉和运动恢复结构的基础。

6.5K 1.7K
83 watermark-removal

一个机器学习图像修复任务,能自然地从图像中移除水印,且与原始图像难以区分。

5.1K 599
84 trace.moe

动漫片段时间戳检索,适用于任何地方

5.0K 263
85 nsfw_data_scraper

用于聚合图像数据以训练NSFW图像分类器的脚本集合

12.6K 2.8K
86 torchgeo

TorchGeo:用于地理空间数据的数据集、采样器、变换和预训练模型

4.2K 581
87 Chinese-CLIP

中文版CLIP,实现中文跨模态检索和表征生成。

6.0K 552
88 AliceVision

3D计算机视觉框架

3.5K 878
89 obs-backgroundremoval

一个OBS插件,用于去除人像(视频)中的背景,方便在录制或直播时更换背景。

4.5K 288
90 scenic

Scenic:一个用于计算机视觉研究及其他领域的Jax库

3.8K 479
91 lightly

一个用于图像自监督学习的Python库。

3.8K 356
92 segment-geospatial

使用Segment Anything Model (SAM)分割地理空间数据的Python包。

4.1K 440
93 super-gradients

轻松地使用一个开源训练库训练或微调SOTA计算机视觉模型。Yolo-NAS的所在地。

5.1K 592
94 modlens

全网最强 DeepSeek Harness 外挂视觉插件,为 DeepSeek、GLM 等纯文本模型外挂视觉能力,粘贴图片即得结构化 JSON 证据(OCR、版面、语义)。

3.8K 110
95 vision-agent

此工具已弃用,请改用 Agentic Document Extraction。

5.3K 601
96 co-tracker

CoTracker 是一个用于跟踪视频上任意点(像素)的模型。

5.1K 386
97 U-2-Net

我们新被Pattern Recognition 2020接收的论文的代码:"U^2-Net: Going Deeper with Nested U-Structure for Salient Object Detection"。

9.9K 1.6K
98 nunif

杂项;waifu2x最新版本;2D视频转立体3D视频

3.4K 282
99 geoai

GeoAI:面向地理空间数据的人工智能

3.3K 472
100 vjepa2

用于视频的VJEPA2自监督学习的PyTorch代码和模型。

4.5K 559
< 上一页
/ 20
下一页 >