在 Manus 中运行任何 Skill
一键导入
一键导入
一键在 Manus 中运行任何 Skill
开始使用alert-root-cause
星标118
分支42
更新时间2026年7月2日 15:14
对活跃告警进行根因分析,关联指标和巡检记录。
安装
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
SKILL.md
readonly菜单
对活跃告警进行根因分析,关联指标和巡检记录。
用 Codex 或 Claude 帮你安装 复制这段 Prompt,粘贴到 Codex、Claude 或其他助手里,让它检查 Skill 页面并帮你完成安装。
基于 SOC 职业分类
curl 测试目标l链接返回内容
检查 Prometheus 数据源的连通性、数据延迟和指标采集健康度。
检查磁盘使用率并给出处理建议 — 综合 metrics 查询和 exec 脚本两种方式。
镜像下载工具
对现有数据源进行测试,验证数据源是否可用,是否在线
ProomAI服务健康检测
| name | alert-root-cause |
| description | 对活跃告警进行根因分析,关联指标和巡检记录。 |
| user-invocable | true |
| x-enabled | true |
| metadata | {} |
当用户询问告警原因、触发根因、或要求分析某个告警时,使用此工作流。
用户通常会说 "分析一下这个告警" 或 "为什么 CPU 告警了"。先使用已知的 metric_name 或从上下文推断。
这是分析告警的核心工具。直接传入指标名称:
analyze_alert(metric_name="node_cpu_seconds_total")
如果用户提到了具体实例,带上 instance:
analyze_alert(metric_name="node_memory_MemAvailable_bytes", instance="192.168.1.100:9100")
analyze_alert 返回后,根据结果补充查询关联指标:
如果是 CPU 告警,检查负载:
node_load1
如果是内存告警,检查 OOM:
(node_memory_Active_bytes / node_memory_MemTotal_bytes) * 100
如果是磁盘告警,检查 inode:
(node_filesystem_files_free{fstype!=""} / node_filesystem_files{fstype!=""}) * 100
使用 list_reports 获取近期巡检报告:
list_reports(status="problem", page_size=5)
如果找到相关报告,用 get_report_detail 查看详情:
get_report_detail(report_id=123)
push_report 通知值班人员analyze_alert(metric_name="node_cpu_seconds_total")query_metrics(promql="topk(5, sum by (process) (rate(node_procs_running{}[5m])))")exec 确认是否有异常进程