# Отвечайте за сервис после deployment

Taiga Learning · Рабочий лист
https://taiga.training/ru/lessons/operations/

Используйте вымышленную или разрешённую информацию. Не записывайте секреты в этот рабочий лист.

## Цели обучения
- Определить сигнал о работе сервиса с точки зрения пользователя.
- Разделить координацию инцидента и техническое расследование.
- Запланировать обслуживание и восстановление как постоянные обязанности.

## Упражнение
Составьте одностраничную инструкцию по эксплуатации вымышленного экспорта клиентов. Укажите один показатель работы сервиса с точки зрения пользователя, его целевое значение, получателя оповещения, безопасное первое действие, ограничение восстановления и ответственного за обслуживание. Укажите, чего мониторинг не обнаруживает.

## Ваш ответ
- Сценарий и объём:
- Предположения и открытые вопросы:
- Предлагаемый ответ или решение с обоснованием:

## Проверьте свой ответ
| Утверждение или критерий | Подтверждение или тест | Результат или пробел | Ответственный |
| --- | --- | --- | --- |
| | | | |
| | | | |
| | | | |

## Следующее действие
- Действие, ответственный и дата:
- Когда вы пересмотрите этот ответ?

## Принцип, который нужно сохранить
Использование в production создаёт постоянную работу. До того как пользователи станут зависеть от сервиса, определите ответственного, порядок реагирования, способ восстановления и ресурсы для обслуживания.

## Источники
- [Google SRE: Implementing SLOs](https://sre.google/workbook/implementing-slos/)
- [Google SRE: Incident Response](https://sre.google/workbook/incident-response/)
- [Google SRE: Example Error Budget Policy](https://sre.google/workbook/error-budget-policy/)

Этот рабочий лист помогает обучению. Его заполнение само по себе не разрешает изменение production.
