学习路径 05 · 课程: 8 · 90 分钟
运行与改进
学习维护、可观测性、事件管理、SOC 和 SIRT。通过有边界的自愈和已验证改进完成反馈闭环。
- 01
部署后继续对服务负责
已完成定义有效服务信号、事件决策、恢复和维护。代码生成结束后,仍要明确运维责任。
- 02
在软件的整个使用期内持续维护
已完成为漏洞、升级、配置漂移和退役安排优先级。追踪维护发现,直到生产修复得到验证。
- 03
持续发现并修复漏洞
已完成建立从漏洞发现到经验证生产修复的持续流程。理解成功原型可能掩盖的维护缺口。
- 04
观察服务及其用户体验
已完成将指标、日志和链路追踪与服务目标关联起来。设计告警、数据边界,以及发现遥测缺失的检查。
- 05
管理从发现到恢复的事件全过程
已完成协调响应人员、遏制影响、说明不确定性并验证恢复。将事件转化为有负责人承担的改进。
- 06
将软件交付与 SOC、SIRT 衔接
已完成明确安全监控、事件交接、证据保全和恢复职责。让安全响应贯穿软件生命周期。
- 07
为自愈设置安全边界
已完成在明确权限、验证和停止条件下,自动执行已知恢复操作。区分运行时恢复与软件修改。
- 08
通过验证改进闭合反馈循环
已完成将生产证据转化为要求、测试、受控修改和实测结果。明确负责任的软件自我改进意味着什么。