| name | health-check-patterns |
| description | 健康检查模式 —— 存活探针、就绪探针、依赖健康检查与服务健康度仪表板 |
| category | 运维 |
| loading | on-demand |
| triggers | {"keywords":["健康检查","health check","探针","liveness","readiness","监控","存活"]} |
健康检查模式
概述
提供微服务和容器化环境下的健康检查策略,覆盖 Kubernetes 探针、依赖检查、健康指标聚合与可视化。
使用场景
- 服务容器化部署时需要配置存活探针和就绪探针
- 依赖服务(数据库、缓存、消息队列)状态需要纳入健康检查
- 负载均衡器需要健康端点决定流量分发
- 排查服务间歇性不可用问题
核心原则
- 区分存活与就绪:Liveness 探针判断"是否要重启",Readiness 探针判断"是否能接流量"。
- 轻量级检查:探针请求必须在毫秒级完成,不能做复杂计算或全量依赖扫描。
- 依赖检查分级:核心依赖不可用 → 服务不可用;非核心依赖不可用 → 降级运行但标记 DEGRADED。
- 有意义的健康指示:返回的不是"Up/Down"布尔值,而是包含各子系统和版本的结构化信息。
标准端点设计
GET /health/live —— HTTP 200 即存活,仅验证进程未僵死
GET /health/ready —— 检查关键依赖(DB 连接池、Redis 连通),正常返回 200
GET /health —— 聚合视图,包含所有子系统状态、版本号、启动时间
检查清单