MLOps与评测
实验跟踪、部署、监控与模型评测等 MLOps 工具。
共 187 个项目
排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。
| 排名 | 项目 | Stars | Forks | 更新 | 许可证 |
|---|---|---|---|---|---|
| 21 |
dvc
🦉 数据版本控制与机器学习实验 |
15.8K | 1.3K | 08/24/26 | Apache-2.0 |
| 22 |
kubeflow
用于Kubernetes的机器学习工具包 |
15.8K | 2.7K | 08/21/26 | Apache-2.0 |
| 23 |
optuna
超参数优化框架 |
14.7K | 1.4K | 08/27/26 | MIT |
| 24 |
scalene
Scalene:一个高性能、高精度的 Python CPU、GPU 和内存分析器,带有 AI 驱动的优化建议。 |
13.5K | 436 | 08/27/26 | Apache-2.0 |
| 25 |
ragas
增强您的LLM应用评估 🚀 |
15.5K | 1.7K | 02/24/26 | Apache-2.0 |
| 26 |
RagaAI-Catalyst
用于Agent AI可观测性、监控和评估框架的Python SDK。包括智能体、LLM和工具追踪,调试多智能体系统,自托管仪表板以及带有时间线和执行图视图的高级分析。 |
16.2K | 3.6K | 02/11/26 | Apache-2.0 |
| 27 |
easy-dataset
一个用于创建LLM微调、RAG和评估数据集的强大工具。 |
14.9K | 1.5K | 05/01/26 | Other |
| 28 |
great_expectations
始终了解你的数据预期。 |
11.7K | 1.8K | 08/28/26 | Apache-2.0 |
| 29 |
bisheng
用于企业AI应用的开源LLM DevOps平台,具备GenAI工作流、RAG、智能体、模型管理、评估和可观测性。 |
11.9K | 2.0K | 08/28/26 | Apache-2.0 |
| 30 |
pest
面向PHP开发者和AI代理的优雅测试框架。 |
11.7K | 529 | 08/26/26 | MIT |
| 31 |
ai-toolkit
微调扩散模型的终极训练工具包 |
11.8K | 1.5K | 08/29/26 | MIT |
| 32 |
wandb
AI开发者平台。使用Weights & Biases训练和微调模型,并管理从实验到生产的模型。 |
11.2K | 891 | 08/29/26 | MIT |
| 33 |
phoenix
AI 可观测性与评估 |
11.2K | 1.1K | 08/29/26 | Other |
| 34 |
kedro
Kedro 是一个用于生产级数据科学的工具箱。它利用软件工程最佳实践,帮助您创建可重现、可维护且模块化的数据工程和数据科学流水线。 |
11.0K | 1.1K | 08/28/26 | Other |
| 35 |
iFixAi
独立审计AI代理。由人类或代理本身运行,回答AI代理经济中最关键的问题:代理是否在按预期行事?使用iFixAi,你可以在120秒内获得答案。 |
11.4K | 1.2K | 08/28/26 | Apache-2.0 |
| 36 |
inspector
MCP服务器的可视化测试工具 |
10.8K | 1.5K | 08/29/26 | Other |
| 37 |
autogluon
快速准确的机器学习,仅需3行代码 |
10.6K | 1.2K | 08/28/26 | Apache-2.0 |
| 38 |
visdom
用于AI/ML实验和实时数据的实时可视化、监控和协作分析工具。支持Python、PyTorch/Torch、NumPy、TensorFlow/Keras https://visdom.dev |
10.3K | 1.2K | 08/29/26 | Apache-2.0 |
| 39 |
metaflow
构建、管理和部署 AI/ML 系统 |
10.3K | 1.3K | 08/27/26 | Apache-2.0 |
| 40 |
oha
Ohayou(おはよう),HTTP负载生成器,灵感来自rakyll/hey,带TUI动画。 |
10.5K | 296 | 08/23/26 | MIT |