Përcaktoni dhe testoni RTO dhe RPO
PërfunduarPërcaktoni ndërprerjen dhe humbjen e pranueshme të të dhënave. Krahasoni strategjitë e rikuperimit dhe matni një ushtrim të plotë rikuperimi kundrejt kërkesave të biznesit.
Publikuar nga TaigaSi shkruajmë
Kontrolloni çfarë keni kuptuarNjë ushtrim rikuperimi rikthen shërbimin e dobishëm në 55 minuta. Ai rikuperon të dhëna nga 20 minuta para ndërprerjes. Objektivat janë RTO 60 minuta dhe RPO 15 minuta. Cili është rezultati?Bëni ushtrimin
Çfarë do të mësoni
- Dalloni RTO nga RPO dhe disponueshmëria.
- Llogaritni kohën e kaluar të rikuperimit dhe intervalin e humbjes së të dhënave.
- Specifikoni një ushtrim rikuperimi me evidencë dhe person përgjegjës për shërbimin.
Përcaktoni dy objektiva të veçantë
Recovery Time Objective (RTO), objektivi i kohës së rikuperimit, përcakton ndërprerjen maksimale të pranueshme para se të rikthehet shërbimi i dobishëm. Recovery Point Objective (RPO), objektivi i pikës së rikuperimit, përcakton humbjen maksimale të pranueshme të të dhënave, të matur në kohë. Dakordoni këta objektiva me personin përgjegjës të biznesit për një shërbim dhe skenar dështimi të përcaktuar.
Një objektiv disponueshmërie përshkruan performancën e shërbimit gjatë një periudhe. RTO dhe RPO përshkruajnë pritshmëritë e rikuperimit. Ato u përgjigjen pyetjeve të ndryshme.
Për një shërbim imagjinar porosish, personi përgjegjës vendos RTO në 60 minuta dhe RPO në 15 minuta. Këto janë vlera shembull, jo rekomandime të përgjithshme. Një shërbim tjetër mund të kërkojë kufij të ndryshëm, sepse porositë e humbura dhe raportet e vonuara kanë pasoja të ndryshme.
Matni rikuperimin e plotë
Shërbimi ndalet në orën 10:00. Ekipi regjistron këtë ushtrim:
| Faza | Kohëzgjatja | Ora |
|---|---|---|
| Zbuloni ndërprerjen | 8 minuta | 10:08 |
| Vlerësoni dhe autorizoni rikuperimin | 12 minuta | 10:20 |
| Restauroni shërbimin dhe të dhënat | 25 minuta | 10:45 |
| Verifikoni funksionimin e dobishëm | 10 minuta | 10:55 |
Koha e kaluar e rikuperimit është 55 minuta. Ushtrimi plotëson RTO prej 60 minutash. Numërimi vetëm i veprimit 25-minutësh të restaurimit do të fshihte pjesën më të madhe të ndërprerjes.
Pika më e fundit e përdorshme e rikuperimit përkon me orën 09:40. Intervali deri te ndërprerja në 10:00 është 20 minuta. Kjo tejkalon RPO prej 15 minutash me 5 minuta. Restaurimi më i shpejtë i të njëjtave të dhëna nuk do ta mbyllte atë diferencë.
Shqyrtoni regjistrimet reale që mungojnë ose nuk përputhen. Një interval kohor përshkruan ekspozimin; ai nuk numëron porositë e prekura. Rakordoni regjistrimet e jashtme të pagesave dhe përmbushjes së porosive para se të rifilloni përpunimin normal. Provoni supozime të ndryshme në ushtrimin e rikuperimit.
Zgjidhni një strategji rikuperimi
Një strategji duhet të mbulojë shërbimin, të dhënat dhe varësitë e kërkuara. Krahasoni këto modele me objektivat e matur:
| Modeli | Çfarë përgatitet para ngjarjes |
|---|---|
| Backup and restore | Të dhëna të rikuperueshme dhe një mënyrë për të rikrijuar mjedisin |
| Pilot light | Shërbimet thelbësore të të dhënave; komponentët e tjerë kërkojnë aktivizim ose krijim |
| Warm standby | Një mjedis që funksionon me kapacitet të reduktuar |
| Active/active | Më shumë se një mjedis tashmë shërben trafik |
Nuk ka kohë universale rikuperimi për këto modele. Zbatimi, vëllimi i të dhënave, varësitë dhe kushtet e testimit përcaktojnë rezultatin. Përfshini koston e funksionimit dhe aftësinë e ekipit në vendim.
Mbrohuni nga më shumë se një ndërprerje
Një kopje e replikuar mund të kopjojë një fshirje të padëshiruar ose një regjistrim të dëmtuar. Mbani versione të rikuperueshme ose aftësi rikuperimi në një pikë kohore kur kërkohet. Verifikoni afatin e ruajtjes, lejet e restaurimit dhe aksesin te çelësat e enkriptimit. Përshtateni izolimin e kopjeve rezervë me skenarin, përfshirë humbjen e aksesit në llogarinë kryesore.
Për rikuperim rajonal, kontrolloni vendndodhjen e lejuar të të dhënave dhe zinxhirin e plotë të varësive. Përfshini identitetin, DNS, certifikatat, sekretet, artefaktet e vendosjes, kuotat dhe aksesin në rrjet. Një mjedis rikuperimi të cilit i mungon një çelës i kërkuar mund të jetë i papërdorshëm.
Përcaktoni kush mund ta deklarojë ngjarjen, kush e kryen rikuperimin dhe kush e pranon shërbimin e restauruar. Planifikoni kthimin në mjedisin fillestar ose vazhdimin e funksionimit në mjedisin e rikuperimit. Parandaloni shkrimet kundërshtuese nga komponentë të ndryshëm dhe rakordoni të dhënat para një kalimi tjetër.
Kthejeni planin në evidencë
Shkruani një udhëzues veprimi dhe ushtrojeni në kushte të kontrolluara. Regjistroni skenarin, madhësinë e grupit të të dhënave, kohën e fillimit dhe mbarimit, pikën kohore të të dhënave të rikuperuara, hapat e dështuar dhe personat përgjegjës. Verifikoni një veprim real biznesi me regjistrime të sigurta testimi.
Përsëriteni ushtrimin pas ndryshimeve përkatëse dhe sipas orarit të dakorduar. Një ndryshim skeme, varësi e re e jashtme ose vëllim i ndryshëm të dhënash mund t’i bëjë rezultatet e mëparshme të pavlefshme. Lidheni evidencën e ushtrimit me publikimin dhe përgjegjësitë e funksionimit.
Bëni ushtrimin
Një shërbim imagjinar ndalet në orën 10:00. Zbulimi merr 8 minuta, vendimi 12, restaurimi 25 dhe verifikimi 10. Të dhënat më të fundit të përdorshme janë nga ora 09:40. Krahasoni rezultatin me RTO 60 minuta dhe RPO 15 minuta. Propozoni një përmirësim për secilin objektiv.
Shkarkoni fletën e punës (Markdown)Heqja e kësaj zgjedhjeje fshin të gjithë përparimin e ruajtur në këtë shfletues.
Përparimi mbetet në këtë shfletues. Pa llogari, pa gjurmim.
Burime dhe lexime të mëtejshme
- AWS: Define recovery objectives for downtime and data loss ↗
- AWS: Use defined recovery strategies ↗
- AWS: Testing disaster recovery ↗