# Self-healing की सुरक्षित सीमाएँ तय करें

Taiga Learning · Worksheet अभ्यास पत्र
https://taiga.training/hi/lessons/self-healing/

काल्पनिक या स्वीकृत जानकारी इस्तेमाल करें। इस worksheet में secrets न डालें।

## सीखने के उद्देश्य
- Self-healing और स्थायी software correction का अंतर समझें।
- सीमित recovery policy और स्वतंत्र success checks तय करें।
- पहचानें कि automation कब रुककर escalate करे।

## अभ्यास
इस पाठ के काल्पनिक export worker के लिए recovery policy बनाएँ। Trigger, exclusions, स्वीकार्य कार्रवाई, retry limit, cooldown, success check और escalation owner तय करें। Database outage और अज्ञात data-integrity failure पर इसे जाँचें।

## आपका उत्तर
- परिदृश्य और दायरा:
- धारणाएँ और खुले सवाल:
- प्रस्तावित उत्तर या निर्णय, कारणों सहित:

## अपना उत्तर सत्यापित करें
| दावा या मानदंड | प्रमाण या test | परिणाम या कमी | जिम्मेदार व्यक्ति |
| --- | --- | --- | --- |
| | | | |
| | | | |
| | | | |

## अगली कार्रवाई
- कार्रवाई, जिम्मेदार व्यक्ति और तारीख:
- आप इस उत्तर की समीक्षा कब करेंगे?

## याद रखने वाला सिद्धांत
Self-healing को तय failure, अधिकृत कार्रवाई, मापा जा सकने वाला परिणाम और stop condition चाहिए। Recovery के बिना कार्रवाई दोहराना दूसरी विफलता है।

## स्रोत
- [Kubernetes: Self-Healing](https://kubernetes.io/docs/concepts/architecture/self-healing/)
- [AWS Builders’ Library: Timeouts, retries, and backoff with jitter](https://aws.amazon.com/builders-library/timeouts-retries-and-backoff-with-jitter/)
- [Google SRE: Automation at Google](https://sre.google/sre-book/automation-at-google/)

यह worksheet सीखने में मदद करती है। इसे पूरा करने से अपने-आप production में बदलाव की अनुमति नहीं मिलती।
