ワンクリックで
prometheus
Prometheus 指标查询与分析。当目标环境配置了 prom_url 时启用。用于执行 PromQL 查询、搜索指标、获取标签维度、异常检测与相关性分析。
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
メニュー
Prometheus 指标查询与分析。当目标环境配置了 prom_url 时启用。用于执行 PromQL 查询、搜索指标、获取标签维度、异常检测与相关性分析。
Codex または Claude でインストール この Prompt をコピーして Codex、Claude、または他のアシスタントに貼り付けると、Skill ページを確認してインストールできます。
SOC 職業分類に基づく
Grafana 仪表盘查询。当目标环境配置了 graf_url 时启用。用于列出仪表盘、获取仪表盘中的 PromQL 查询,便于复用已有面板的查询逻辑。
K8s 集群安装指导。通过对话询问用户安装方式、节点信息,分步骤输出命令,每步等待用户确认。不嵌入安装包,优先使用阿里云镜像下载,国内网络更稳定。
Kubernetes 集群巡检。当目标环境关联了 k8s_cluster_id 时启用。用于获取集群摘要、节点、命名空间、Pod、工作负载及事件,支持故障排查与资源分析。
| name | prometheus |
| description | Prometheus 指标查询与分析。当目标环境配置了 prom_url 时启用。用于执行 PromQL 查询、搜索指标、获取标签维度、异常检测与相关性分析。 |
| allowed-tools | find_metrics_by_keyword get_metric_dimension execute_promql_query detect_anomaly check_correlation |
当用户任务涉及指标查询、PromQL 分析、异常检测、根因定位时,使用本技能。
在 Prometheus 中搜索包含关键字的指标名,用于发现可用指标。
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
| keyword | string | 是 | 搜索关键字,如 "cpu"、"http_requests" |
示例:{"keyword": "http_requests"}
获取指定指标名的标签维度,用于下钻分析。
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
| metric_name | string | 是 | 指标名 |
示例:{"metric_name": "http_requests_total"}
执行 PromQL 范围查询,返回时序数据。
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
| query | string | 是 | PromQL 表达式 |
| duration | string | 否 | 时间范围,默认 "1h" |
| step | string | 否 | 步长,默认 "1m" |
| start_time | string | 否 | 开始时间 |
| end_time | string | 否 | 结束时间 |
示例:{"query": "rate(http_requests_total[5m])", "duration": "1h"}
对 Prometheus 查询结果做 3-sigma 异常检测。
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
| result_list | array | 是 | execute_promql_query 返回的时序数据 |
计算两个指标序列的相关系数,用于因果分析。
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
| result_a | array | 是 | 第一个指标序列 |
| result_b | array | 是 | 第二个指标序列 |
find_metrics_by_keyword 搜索execute_promql_query → detect_anomaly → 结合维度下钻check_correlation 验证关联execute_promql_query 未提供时间参数时,默认:duration="1h"、step="1m"start_time/end_time 时,不再补 duration,按显式时间窗口执行find_metrics_by_keyword,不要盲猜不存在的指标get_metric_dimension 再下钻up 仅用于可用性基线检查:同一轮巡检中,query="up" 建议最多 1-2 次(当前快照 + 一个关键时间窗)up(如 duration=1h 与等价 start_time/end_time 重复)up 已确认可用,应切换到更有诊断价值的指标(错误率、延迟、CPU/内存)继续分析每次分析尽量按以下结构输出,避免只给原始结果:
目标环境已配置 prom_url(从「监控告警 → 数据源」选择 Prometheus/VictoriaMetrics/Thanos)。
inspector、sreinspector:走极速评审(2-3 分钟)sre:在极速评审基础上,额外检查“证据链完整”sre 额外必查: