DevOps 事件响应体系:On-Call 轮值、MTTR 优化与事后复盘
构建完整的 DevOps 事件响应体系,涵盖 On-Call 轮值设计、告警分级策略、Runbook 自动化、MTTR 度量优化与无责事后复盘文化,附有 PagerDuty / Prometheus 配置示例。
tag
构建完整的 DevOps 事件响应体系,涵盖 On-Call 轮值设计、告警分级策略、Runbook 自动化、MTTR 度量优化与无责事后复盘文化,附有 PagerDuty / Prometheus 配置示例。
系统性告警与事件响应实战指南:告警设计的黄金法则(可行动性/关联上下文/优先级/渐进式)、Four Golden Signals 与 USE/RED 方法论、告警分级(P0/P1/P2/P3)与升级策略、告警疲劳根因分析与降噪手段(抑制/聚合/去重/依赖静默)、值班轮换(on-call)制度、事件响应 SOP(检测/评估/缓解/复盘)、ChatOps / Runbook 自动化、事后复盘模板(Postmortem)与无责文化、MTTR/MTBF/MTTF 指标定义与追踪、PagerDuty/Opsgenie 集成实践。
从 Web 应用安全(XSS/CSRF/SQL 注入)到云原生安全架构,涵盖 DevSecOps、零信任网络、AI/LLM 安全、密码学、渗透测试、隐私计算、供应链安全、事件响应等企业级安全防护体系。
安全事件应急响应全流程:准备、检测、分析、遏制、根除、恢复、复盘,以及数字取证技术和事件响应计划(IRP)建设。
SIEM 选型与架构、日志采集与分析、Sigma 规则、威胁狩猎、SOC 分层运营、SOAR 自动化编排与事件响应流程。