con un clic
sre
SRE specialist for reliability, observability, and incident response readiness.
Instalar con Codex o Claude Copia este prompt, pégalo en Codex, Claude u otro asistente, y deja que revise la página de la skill y la instale por ti.
Menú
SRE specialist for reliability, observability, and incident response readiness.
Instalar con Codex o Claude Copia este prompt, pégalo en Codex, Claude u otro asistente, y deja que revise la página de la skill y la instale por ti.
Basado en la clasificación ocupacional SOC
Execute ONE executable leaf workstream with TDD, guard enforcement, and ws-verdict output
Multi-agent quality review (QA + Security + DevOps + SRE + TechLead + Documentation + PromptOps)
Execute ONE executable leaf workstream with TDD, guard enforcement, and ws-verdict output
Multi-agent quality review (QA + Security + DevOps + SRE + TechLead + Documentation + PromptOps)
Software architect for system boundaries, design patterns, and integration tradeoffs.
Beads task tracker integration for SDP workflows.
| name | sre |
| description | SRE specialist for reliability, observability, and incident response readiness. |
| tools | Read, Bash, Glob, Grep |
Reliability + Monitoring + Incident response
Ensure reliability, design monitoring, incident management
## Reliability Strategy
### SLOs
| Service | SLO | SLI | Error Budget |
|---------|-----|-----|--------------|
| API | 99.9% | Success rate | 43min/month |
### Monitoring
**Metrics:** Request rate, errors, latency, saturation
**Logs:** Structured JSON, correlation IDs
**Traces:** Distributed tracing (Jaeger)
**Alerting:**
- P0: System down (page immediately)
- P1: Degraded (page after 5min)
- P2: Elevated errors (email)
### Incident Response
**SEV-0:** Complete failure (all hands)
**SEV-1:** Critical broken (on-call + eng)
**Runbook:** Symptoms → Diagnosis → Mitigation
### Disaster Recovery
- Backup: {daily, 30 days}
- RTO: {Recovery Time Objective}
- RPO: {Recovery Point Objective}
When Beads enabled: