#94 · 主分类: MLOps与评测
inspector
用于聊天、检查和调试MCP服务器、MCP应用及ChatGPT应用的测试与评估平台。
项目最后更新:08/29/26
GitHub Stars
2.2K
Forks数量
271
贡献者数量
154
许可证
Other
收录理由
调试MCP服务器往往要盯着JSON-RPC报文看,而这款工具把这件事变成了有条理的工作流。你可以直接打开托管网页版,或在本地运行,一边与接入你服务器的LLM对话,一边查看工具调用和智能体每一步的完整链路,还能集中浏览暴露出来的工具、资源和提示词,并在引导式检查中走完OAuth授权流程。它还提供了命令行工具和SDK,方便你在自己的测试里探测服务器、运行诊断检查,并对工具与资源的形状做断言,进而把这些检查接入CI,在每次拉取请求时跑端到端测试和协议符合性验证。评测功能不止于调试:你可以定义带预期工具调用的用例,跨多个模型运行,并持续追踪准确率变化,及早发现回归。这种将可见性、程序化测试与回归追踪结合的方式,让它成为MCP基础设施团队日常工作中顺手又实用的帮手。
相关文章
暂无针对该项目的文章。
如需补充新闻资讯、使用教程、应用测评等内容,欢迎 联系我们推荐选题或投稿。
同类热门项目
unsloth
本地UI,用于运行和训练LLM及扩散模型。支持GGUF、MLX、Qwen3.8、Kimi K3、MiniMax-H3、Gemma 4、FLUX等。
LlamaFactory
统一高效微调100+大语言模型与视觉语言模型(ACL 2024)
airflow
Apache Airflow - 一个以编程方式编写、调度和监控工作流的平台
langfuse
🪢 开源AI工程平台:LLM评估、可观测性、指标、提示管理、游乐场、数据集。与OpenTelemetry、LangChain、OpenAI SDK、LiteLLM等集成。🍊YC W23
netron
神经网络、深度学习和机器学习模型的可视化工具