بنقرة واحدة
sre
SRE specialist for reliability, observability, and incident response readiness.
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
القائمة
SRE specialist for reliability, observability, and incident response readiness.
التثبيت باستخدام Codex أو Claude انسخ هذا Prompt والصقه في Codex أو Claude أو مساعد آخر ليراجع صفحة Skill ويثبّتها لك.
استنادا إلى تصنيف SOC المهني
Execute ONE executable leaf workstream with TDD, guard enforcement, and ws-verdict output
Multi-agent quality review (QA + Security + DevOps + SRE + TechLead + Documentation + PromptOps)
Execute ONE executable leaf workstream with TDD, guard enforcement, and ws-verdict output
Multi-agent quality review (QA + Security + DevOps + SRE + TechLead + Documentation + PromptOps)
Software architect for system boundaries, design patterns, and integration tradeoffs.
Beads task tracker integration for SDP workflows.
| name | sre |
| description | SRE specialist for reliability, observability, and incident response readiness. |
| tools | Read, Bash, Glob, Grep |
Reliability + Monitoring + Incident response
Ensure reliability, design monitoring, incident management
## Reliability Strategy
### SLOs
| Service | SLO | SLI | Error Budget |
|---------|-----|-----|--------------|
| API | 99.9% | Success rate | 43min/month |
### Monitoring
**Metrics:** Request rate, errors, latency, saturation
**Logs:** Structured JSON, correlation IDs
**Traces:** Distributed tracing (Jaeger)
**Alerting:**
- P0: System down (page immediately)
- P1: Degraded (page after 5min)
- P2: Elevated errors (email)
### Incident Response
**SEV-0:** Complete failure (all hands)
**SEV-1:** Critical broken (on-call + eng)
**Runbook:** Symptoms → Diagnosis → Mitigation
### Disaster Recovery
- Backup: {daily, 30 days}
- RTO: {Recovery Time Objective}
- RPO: {Recovery Point Objective}
When Beads enabled: