MLOps与评测

实验跟踪、部署、监控与模型评测等 MLOps 工具。

共 187 个项目

排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。

第 141–160 项,共 187 个

排名 项目 Stars Forks
141 beir

一个异构信息检索基准。易于使用,在15+个多样化的IR数据集上评估你的模型。

2.3K 251
142 cml

♾️ CML - 持续机器学习 | 机器学习的CI/CD

4.2K 344
143 optimate

一组用于优化AI模型性能的库

8.3K 616
144 xai

XAI - 机器学习可解释性工具箱

1.3K 187
145 langtrace

Langtrace 🔍 是一个基于开放遥测的开源端到端可观测性工具,用于LLM应用,为流行的LLM、LLM框架、向量数据库等提供实时追踪、评估和指标。支持使用TypeScript、Python集成。🚀💻📊

1.2K 127
146 Firefly

Firefly: 大模型训练工具,支持训练Qwen2.5、Qwen2、Yi1.5、Phi-3、Llama3、Gemma、MiniCPM、Yi、Deepseek、Orion、Xverse、Mixtral-8x7B、Zephyr、Mistral、Baichuan2、Llma2、Llama、Qwen、Baichuan、ChatGLM2、InternLM、Ziya2、Vicuna、Bloom等大模型

6.7K 583
147 alpaca_eval

自动评估指令跟随语言模型的工具。经过人工验证,高质量,低成本,快速。

2.0K 315
148 yellowbrick

视觉分析与诊断工具,助力机器学习模型选择。

4.4K 569
149 VisualDL

深度学习可视化工具(『飞桨』深度学习可视化工具)

4.9K 631
150 nannyml

nannyml:Python中的部署后数据科学

2.2K 192
151 featureform

虚拟特征存储。将您现有的数据基础设施转变为特征存储。

2.0K 107
152 DB-GPT-Hub

一个包含用于DB-GPT的模型、数据集和微调技术的仓库,旨在提升Text-to-SQL中的模型性能。

2.0K 250
153 determined

Determined 是一个开源机器学习平台,简化分布式训练、超参数调优、实验跟踪和资源管理。支持 PyTorch 和 TensorFlow。

3.2K 373
154 clean-fid

PyTorch - 使用正确的图像缩放和量化步骤进行FID计算 [CVPR 2022]

1.2K 81
155 labml

🔎 从手机监控深度学习模型训练和硬件使用情况 📱

2.3K 152
156 Deep-Learning-in-Production

分享关于在生产环境中部署深度学习模型的有用笔记和参考资料。

4.4K 685
157 RLHF-Reward-Modeling

训练RLHF奖励模型的配方。

1.5K 110
158 whylogs

一个用于机器学习模型和数据管道的开源数据日志库。📚 提供对数据质量和模型性能随时间变化的可见性。🛡️ 支持保护隐私的数据收集,确保安全与稳健性。📈

2.8K 144
159 llm-colosseum

通过在《街头霸王3》中对战来评测LLM!评估LLM质量的新方法

1.5K 182
160 hopsworks

Hopsworks - 数据密集型AI平台,具有特征存储

1.3K 160
< 上一页
/ 10
下一页 >