เส้นทาง 05 · บทเรียน: 8 · 90 min
ดำเนินงานและปรับปรุง
การบำรุงรักษา observability การจัดการ incident, SOC และ SIRT เชื่อมผลกลับสู่การพัฒนาด้วย self-healing ที่มีขอบเขตและการปรับปรุงที่ตรวจสอบแล้ว
- 01
รับผิดชอบบริการหลัง deployment
เรียนจบแล้วกำหนดสัญญาณบริการที่มีประโยชน์ การตัดสินใจระหว่าง incident การกู้คืน และการบำรุงรักษา แสดงความรับผิดชอบด้านการดำเนินงานให้ชัดเจนหลังการสร้างโค้ดสิ้นสุด
- 02
บำรุงรักษาซอฟต์แวร์ตลอดอายุการใช้งาน
เรียนจบแล้วจัดลำดับช่องโหว่ การอัปเกรด configuration drift และการเลิกใช้งาน ติดตามข้อค้นพบด้านการบำรุงรักษาจนถึงการแก้ใน production ที่ตรวจสอบแล้ว
- 03
ค้นหาและแก้ช่องโหว่อย่างต่อเนื่อง
เรียนจบแล้วสร้างกระบวนการต่อเนื่องตั้งแต่ตรวจพบช่องโหว่จนถึงการแก้ใน production ที่ตรวจสอบแล้ว เข้าใจช่องว่างด้านการบำรุงรักษาที่ต้นแบบซึ่งทำงานสำเร็จอาจซ่อนไว้
- 04
สังเกตบริการและผู้ใช้
เรียนจบแล้วเชื่อม metrics, logs และ traces กับเป้าหมายบริการ ออกแบบ alert ขอบเขตข้อมูล และการตรวจหา telemetry ที่ขาด
- 05
จัดการ incident ตั้งแต่ตรวจพบจนกู้คืน
เรียนจบแล้วประสานผู้ตอบสนอง จำกัดผลกระทบ สื่อสารสิ่งที่ยังไม่แน่ชัด และตรวจสอบการกู้คืน เปลี่ยน incident เป็นงานปรับปรุงที่มีผู้รับผิดชอบ
- 06
เชื่อมการส่งมอบกับ SOC และ SIRT
เรียนจบแล้วกำหนด security monitoring การส่งต่อ incident การเก็บรักษาหลักฐาน และหน้าที่กู้คืน เชื่อมการตอบสนองด้านความปลอดภัยกับ lifecycle ของซอฟต์แวร์
- 07
กำหนดขอบเขตที่ปลอดภัยสำหรับ self-healing
เรียนจบแล้วทำการกู้คืนที่รู้วิธีแล้วให้เป็นอัตโนมัติ พร้อมอำนาจที่ชัดเจน การตรวจสอบ และเงื่อนไขหยุด แยกการกู้คืน runtime ออกจากการเปลี่ยนซอฟต์แวร์
- 08
ทำให้วงจรครบด้วยการปรับปรุงที่ตรวจสอบแล้ว
เรียนจบแล้วเปลี่ยนหลักฐานจาก production เป็นข้อกำหนด test การเปลี่ยนแปลงที่ควบคุมได้ และผลที่วัด กำหนดความหมายของซอฟต์แวร์ที่ปรับปรุงตัวเองอย่างมีความรับผิดชอบ