# 자동 복구의 안전한 경계 설정하기

Taiga Learning · 워크시트
https://taiga.training/ko/lessons/self-healing/

가상 정보나 승인된 정보를 사용하세요. 이 워크시트에 비밀 정보를 넣지 마세요.

## 학습 목표
- 자동 복구와 영구적인 소프트웨어 수정을 구분합니다.
- 범위가 제한된 복구 정책과 독립적인 성공 검사를 정합니다.
- 자동화를 멈추고 상위 대응 단계로 넘겨야 할 때를 알아봅니다.

## 실습
이 강의의 가상 내보내기 워커를 위한 복구 정책을 설계하세요. 실행 계기, 제외 조건, 허용 조치, 재시도 한도, 대기 시간, 성공 검사, 상위 대응 담당자를 명시하세요. 데이터베이스 장애와 원인을 모르는 데이터 무결성 실패에 대해 테스트하세요.

## 작성할 답
- 시나리오와 범위:
- 가정과 미해결 질문:
- 제안하는 답이나 결정과 그 이유:

## 답 검증하기
| 주장 또는 기준 | 증거 또는 테스트 | 결과 또는 공백 | 담당자 |
| --- | --- | --- | --- |
| | | | |
| | | | |
| | | | |

## 다음 조치
- 조치, 담당자, 날짜:
- 이 답을 언제 다시 검토하나요?

## 기억할 원칙
자동 복구에는 정의된 실패, 허가된 조치, 측정 가능한 결과, 중지 조건이 필요합니다. 복구 없이 조치만 반복하는 것도 실패입니다.

## 출처
- [Kubernetes: Self-Healing](https://kubernetes.io/docs/concepts/architecture/self-healing/)
- [AWS Builders’ Library: Timeouts, retries, and backoff with jitter](https://aws.amazon.com/builders-library/timeouts-retries-and-backoff-with-jitter/)
- [Google SRE: Automation at Google](https://sre.google/sre-book/automation-at-google/)

이 워크시트는 학습을 돕습니다. 작성 완료만으로 프로덕션 변경이 허가되지는 않습니다.
