AI运维与SRE工具

面向基础设施运维与SRE场景,提供将原始系统状态转化为自然语言解释和修复建议的独立AI辅助工具。

共 61 个项目

排名逻辑见 方法论 ;同类排名基于 GitHub 公开指标。

第 21–40 项,共 61 个

排名 项目 Stars Forks
21 st2

面向DevOps和SRE的开源事件驱动自动化平台,具备规则引擎、工作流、6000+操作以及用于自动修复和事件响应的ChatOps。

6.5K 787
22 kubectl-ai

AI驱动的Kubernetes助手

7.6K 717
23 Pulse

为Proxmox、Docker、Kubernetes、TrueNAS和vSphere提供监控,为您守护基础设施:智能警报、AI巡逻捕获静默故障,以及验证修复。

6.6K 264
24 pixie

即时Kubernetes原生应用可观测性

6.5K 499
25 aws-lambda-power-tuning

AWS Lambda Power Tuning 是一个开源工具,可帮助您可视化和微调 Lambda 函数的内存/功率配置。它在您自己的 AWS 账户中运行,由 AWS Step Functions 提供支持,并支持三种优化策略:成本、速度和平衡。

6.1K 417
26 mirrord

在任何机器或AI代理环境中运行任何进程,如同在Kubernetes集群中的Pod一样:真实的env vars、DNS、网络和流量。

5.3K 210
27 mockserver-monorepo

MockServer 是一个多协议 HTTP(S) 模拟服务器和代理,用于测试,可模拟 API、检查实时流量、注入故障,并支持 AI/LLM API。

5.0K 1.1K
28 logfire

AI 可观测性平台,用于生产 LLM 和智能体系统。

4.4K 281
29 deepflow

eBPF可观测性 - 分布式追踪与性能剖析

4.2K 483
30 vibetunnel

将任何浏览器变成你的终端,随时随地指挥你的智能体。

4.6K 332
31 varlock

AI安全的.env文件:为代理提供模式,为人类提供机密。

4.2K 114
32 conftest

使用 Open Policy Agent Rego 查询语言对结构化配置数据编写测试

3.3K 357
33 swarmpit

轻量级、对AI友好的Docker Swarm管理

3.5K 315
34 holmesgpt

SRE智能体 - CNCF沙盒项目

3.2K 457
35 radar

缺失的开源 Kubernetes UI,内置用于 AI 代理的 MCP 服务器。查看哪里出了问题、原因以及变化。问题、拓扑、事件时间线、Helm、GitOps、实时服务流量和集群审计——全部包含在一个 Go 二进制文件中。

3.2K 188
36 kite

🪁 一个轻量级、现代的 Kubernetes 仪表板,将多集群和资源管理、企业级用户治理(OAuth、RBAC 和审计日志)以及 AI 代理统一在一个工作区中。不仅仅是一个工具,更像一个平台。

3.1K 304
37 Chaterm

开源AI终端,用于云端和基础设施管理,支持使用自然语言和智能代理进行服务部署、故障排除和自动化。

3.0K 293
38 claude-tap

在本地跟踪查看器中拦截并检查来自Claude Code、Codex CLI、Gemini CLI、Cursor CLI、OpenCode、Kimi/Kimi Code、Pi和Hermes的Coding Agent API流量。

3.1K 272
39 testsprite-cli

官方 TestSprite CLI — 从终端进行 AI 驱动的自动化测试

3.0K 153
40 claude-devtools

Claude Code 缺失的开发者工具 — 在可视化界面中检查会话日志、工具调用、token 使用、子代理和上下文窗口。免费开源。

3.9K 297