Guides incident management engineering—severity models, escalation policies, on-call design,
paging and comms tooling (PagerDuty/Opsgenie/Slack), incident lifecycle workflows, status pages,
blameless postmortems, and reliability metrics (MTTD, MTTR, incident rate).
Use when designing or improving incident response programs, on-call rotations, escalation paths,
incident tooling integrations, postmortem templates, or SEV definitions—not for hands-on outage
debugging (devops), security investigations (defensive-security-analyst), security IR policy
(cybersecurity), multi-team program tracking (technical-program-manager), or individual
customer technical tickets (support-engi…