计算机视觉
检测、分割、OCR 与视觉流水线,面向生产的开源计算机视觉方案。
共 384 个项目
排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。
| 排名 | 项目 | Stars | Forks | 更新 | 许可证 |
|---|---|---|---|---|---|
| 81 |
sparrow
使用机器学习、大语言模型和视觉大语言模型进行结构化数据提取、指令调用和智能体工作流。 |
5.2K | 519 | 08/26/26 | GPL-3.0 |
| 82 |
openMVG
开放多视图几何库。3D计算机视觉和运动恢复结构的基础。 |
6.5K | 1.7K | 12/17/25 | MPL-2.0 |
| 83 |
watermark-removal
一个机器学习图像修复任务,能自然地从图像中移除水印,且与原始图像难以区分。 |
5.1K | 599 | 08/14/26 | Other |
| 84 |
trace.moe
动漫片段时间戳检索,适用于任何地方 |
5.0K | 263 | 08/21/26 | MIT |
| 85 |
nsfw_data_scraper
用于聚合图像数据以训练NSFW图像分类器的脚本集合 |
12.6K | 2.8K | 01/21/24 | MIT |
| 86 |
torchgeo
TorchGeo:用于地理空间数据的数据集、采样器、变换和预训练模型 |
4.2K | 581 | 08/29/26 | MIT |
| 87 |
Chinese-CLIP
中文版CLIP,实现中文跨模态检索和表征生成。 |
6.0K | 552 | 03/31/26 | MIT |
| 88 |
AliceVision
3D计算机视觉框架 |
3.5K | 878 | 08/28/26 | Other |
| 89 |
obs-backgroundremoval
一个OBS插件,用于去除人像(视频)中的背景,方便在录制或直播时更换背景。 |
4.5K | 288 | 08/29/26 | GPL-3.0 |
| 90 |
scenic
Scenic:一个用于计算机视觉研究及其他领域的Jax库 |
3.8K | 479 | 08/28/26 | Apache-2.0 |
| 91 |
lightly
一个用于图像自监督学习的Python库。 |
3.8K | 356 | 08/28/26 | MIT |
| 92 |
segment-geospatial
使用Segment Anything Model (SAM)分割地理空间数据的Python包。 |
4.1K | 440 | 08/24/26 | MIT |
| 93 |
super-gradients
轻松地使用一个开源训练库训练或微调SOTA计算机视觉模型。Yolo-NAS的所在地。 |
5.1K | 592 | 02/24/26 | Apache-2.0 |
| 94 |
modlens
全网最强 DeepSeek Harness 外挂视觉插件,为 DeepSeek、GLM 等纯文本模型外挂视觉能力,粘贴图片即得结构化 JSON 证据(OCR、版面、语义)。 |
3.8K | 110 | 08/27/26 | MIT |
| 95 |
vision-agent
此工具已弃用,请改用 Agentic Document Extraction。 |
5.3K | 601 | 01/29/26 | Apache-2.0 |
| 96 |
co-tracker
CoTracker 是一个用于跟踪视频上任意点(像素)的模型。 |
5.1K | 386 | 03/03/26 | Other |
| 97 |
U-2-Net
我们新被Pattern Recognition 2020接收的论文的代码:"U^2-Net: Going Deeper with Nested U-Structure for Salient Object Detection"。 |
9.9K | 1.6K | 06/26/24 | Apache-2.0 |
| 98 |
nunif
杂项;waifu2x最新版本;2D视频转立体3D视频 |
3.4K | 282 | 08/22/26 | MIT |
| 99 |
geoai
GeoAI:面向地理空间数据的人工智能 |
3.3K | 472 | 08/24/26 | MIT |
| 100 |
vjepa2
用于视频的VJEPA2自监督学习的PyTorch代码和模型。 |
4.5K | 559 | 03/23/26 | MIT |