بنقرة واحدة
prometheus
Prometheus 指标查询与分析。当目标环境配置了 prom_url 时启用。用于执行 PromQL 查询、搜索指标、获取标签维度、异常检测与相关性分析。
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
القائمة
Prometheus 指标查询与分析。当目标环境配置了 prom_url 时启用。用于执行 PromQL 查询、搜索指标、获取标签维度、异常检测与相关性分析。
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
استنادا إلى تصنيف SOC المهني
Grafana 仪表盘查询。当目标环境配置了 graf_url 时启用。用于列出仪表盘、获取仪表盘中的 PromQL 查询,便于复用已有面板的查询逻辑。
K8s 集群安装指导。通过对话询问用户安装方式、节点信息,分步骤输出命令,每步等待用户确认。不嵌入安装包,优先使用阿里云镜像下载,国内网络更稳定。
Kubernetes 集群巡检。当目标环境关联了 k8s_cluster_id 时启用。用于获取集群摘要、节点、命名空间、Pod、工作负载及事件,支持故障排查与资源分析。
| name | prometheus |
| description | Prometheus 指标查询与分析。当目标环境配置了 prom_url 时启用。用于执行 PromQL 查询、搜索指标、获取标签维度、异常检测与相关性分析。 |
| allowed-tools | find_metrics_by_keyword get_metric_dimension execute_promql_query detect_anomaly check_correlation |
当用户任务涉及指标查询、PromQL 分析、异常检测、根因定位时,使用本技能。
在 Prometheus 中搜索包含关键字的指标名,用于发现可用指标。
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
| keyword | string | 是 | 搜索关键字,如 "cpu"、"http_requests" |
示例:{"keyword": "http_requests"}
获取指定指标名的标签维度,用于下钻分析。
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
| metric_name | string | 是 | 指标名 |
示例:{"metric_name": "http_requests_total"}
执行 PromQL 范围查询,返回时序数据。
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
| query | string | 是 | PromQL 表达式 |
| duration | string | 否 | 时间范围,默认 "1h" |
| step | string | 否 | 步长,默认 "1m" |
| start_time | string | 否 | 开始时间 |
| end_time | string | 否 | 结束时间 |
示例:{"query": "rate(http_requests_total[5m])", "duration": "1h"}
对 Prometheus 查询结果做 3-sigma 异常检测。
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
| result_list | array | 是 | execute_promql_query 返回的时序数据 |
计算两个指标序列的相关系数,用于因果分析。
| 参数 | 类型 | 必填 | 说明 |
|---|---|---|---|
| result_a | array | 是 | 第一个指标序列 |
| result_b | array | 是 | 第二个指标序列 |
find_metrics_by_keyword 搜索execute_promql_query → detect_anomaly → 结合维度下钻check_correlation 验证关联execute_promql_query 未提供时间参数时,默认:duration="1h"、step="1m"start_time/end_time 时,不再补 duration,按显式时间窗口执行find_metrics_by_keyword,不要盲猜不存在的指标get_metric_dimension 再下钻up 仅用于可用性基线检查:同一轮巡检中,query="up" 建议最多 1-2 次(当前快照 + 一个关键时间窗)up(如 duration=1h 与等价 start_time/end_time 重复)up 已确认可用,应切换到更有诊断价值的指标(错误率、延迟、CPU/内存)继续分析每次分析尽量按以下结构输出,避免只给原始结果:
目标环境已配置 prom_url(从「监控告警 → 数据源」选择 Prometheus/VictoriaMetrics/Thanos)。
inspector、sreinspector:走极速评审(2-3 分钟)sre:在极速评审基础上,额外检查“证据链完整”sre 额外必查: