MLOps与评测

实验跟踪、部署、监控与模型评测等 MLOps 工具。

共 187 个项目

排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。

第 61–80 项,共 187 个

排名 项目 Stars Forks
61 pipelines

用于Kubeflow的机器学习流水线

4.2K 2.1K
62 harbor

用于评估和改进智能体的框架

4.8K 1.7K
63 AugLy

一个用于音频、图像、文本和视频的数据增强库。

5.1K 311
64 Kiln

构建、评估和优化AI系统。包括评估、RAG、代理、微调、合成数据生成、数据集管理、MCP等。

5.0K 375
65 VLMEvalKit

开源的多模态大模型评估工具包,支持220+个多模态大模型,80+个基准测试

4.4K 756
66 tpot

一个使用遗传编程优化机器学习流程的Python自动化机器学习工具。

10.1K 1.6K
67 transformerlab-app

面向AI研究人员的开源研究环境,可无缝地从本地硬件到GPU集群训练、评估和扩展模型。

5.2K 547
68 lmms-eval

全能多模态评估工具包,覆盖文本、图像、视频和音频任务

4.4K 647
69 MedicalGPT

训练医疗大模型,实现了包括增量预训练(PT)、有监督微调(SFT)、RLHF、DPO、ORPO、GRPO。

5.8K 790
70 onnxsim

简化你的onnx模型

4.4K 432
71 cube-studio

开源的云原生AI平台,用于端到端MLOps,涵盖深度学习和大模型训练、推理、流水线编排以及资源管理。

5.1K 881
72 alignment-handbook

稳健的指南,用于使语言模型与人类和AI偏好对齐。

5.7K 491
73 SwanLab

⚡️SwanLab - 开源、现代设计的AI训练跟踪与可视化工具。支持云端/自托管使用。集成PyTorch / Transformers / verl / LLaMA Factory / ms-swift / Ultralytics / MMEngine / Keras等。

4.2K 217
74 lightning-hydra-template

PyTorch Lightning + Hydra。一个非常用户友好的机器学习实验模板。⚡🔥⚡

5.3K 754
75 mteb

MTEB:跨语言和模态的嵌入最先进评估

3.4K 681
76 autotrain-advanced

🤗 AutoTrain 高级

4.6K 627
77 deepo

在几秒内设置和定制深度学习环境。

6.3K 736
78 polyaxon

AI基础设施 / AI编排 / AI控制平面

3.7K 331
79 maestro

Maestro:Netflix 的工作流编排器

3.8K 311
80 trulens

面向LLM实验和AI智能体的评估与追踪

3.5K 334
< 上一页
/ 10
下一页 >