# Задайте безопасные границы самовосстановления

Taiga Learning · Рабочий лист
https://taiga.training/ru/lessons/self-healing/

Используйте вымышленную или разрешённую информацию. Не записывайте секреты в этот рабочий лист.

## Цели обучения
- Отличать самовосстановление от постоянного исправления ПО.
- Определять ограниченную политику восстановления и независимые проверки успеха.
- Распознавать, когда автоматизация должна остановиться и передать вопрос на эскалацию.

## Упражнение
Разработайте политику восстановления для вымышленного export worker из урока. Укажите триггер, исключения, разрешённое действие, предел повторов, паузу между попытками, проверку успеха и ответственного за эскалацию. Проверьте её при недоступности базы данных и неизвестном нарушении целостности данных.

## Ваш ответ
- Сценарий и объём:
- Предположения и открытые вопросы:
- Предлагаемый ответ или решение с обоснованием:

## Проверьте свой ответ
| Утверждение или критерий | Подтверждение или тест | Результат или пробел | Ответственный |
| --- | --- | --- | --- |
| | | | |
| | | | |
| | | | |

## Следующее действие
- Действие, ответственный и дата:
- Когда вы пересмотрите этот ответ?

## Принцип, который нужно сохранить
Для самовосстановления нужны определённый сбой, разрешённое действие, измеримый результат и условие остановки. Повторение действия без восстановления — ещё один сбой.

## Источники
- [Kubernetes: Self-Healing](https://kubernetes.io/docs/concepts/architecture/self-healing/)
- [AWS Builders’ Library: Timeouts, retries, and backoff with jitter](https://aws.amazon.com/builders-library/timeouts-retries-and-backoff-with-jitter/)
- [Google SRE: Automation at Google](https://sre.google/sre-book/automation-at-google/)

Этот рабочий лист помогает обучению. Его заполнение само по себе не разрешает изменение production.
