SRE
wpisy (6)
- Recovery od podstaw: rollback, PITR i powrót po awarii5/5
Po recovery: zielone wykresy to nie koniec
Recovery kończy wpływ incydentu, ale nie kończy pracy. Trzeba odtworzyć przebieg zdarzeń, poprawić runbook i sprawdzić, czy założone RPO oraz RTO były…
- Recovery od podstaw: rollback, PITR i powrót po awarii4/5
PITR jednego tenanta: odtworzenie jednej bazy
Prosty przykład PITR w systemie multi-tenant: jeden tenant ma osobną bazę, więc odtwarzamy tylko tę bazę i nie cofamy całej produkcji.
- Recovery od podstaw: rollback, PITR i powrót po awarii3/5
PITR całego serwera: restore to dopiero początek
PITR całego serwera nie kończy się na odtworzeniu bazy. Trzeba jeszcze zamrozić zapisy, sprawdzić stan, przepiąć ruch i świadomie porzucić albo przenieść dane…
- Recovery od podstaw: rollback, PITR i powrót po awarii2/5
Cofanie wydania: kod to najłatwiejsza część
Rollback wydania często wygląda jak powrót do poprzedniego obrazu aplikacji. W praktyce najtrudniejsze są dane, migracje i skutki uboczne, które już wyszły…
- Recovery od podstaw: rollback, PITR i powrót po awarii1/5
PITR, RPO, RTO, SLI, SLO i SLA: słownik recovery
Recovery ma swój słownik, ale najważniejsze pojęcia opisują proste pytania: do kiedy wracamy, ile tracimy, jak długo to trwa i jaką obietnicę złamaliśmy.
- seria · 5 części
Recovery od podstaw: rollback, PITR i powrót po awarii
Recovery nie zaczyna się od dużego planu disaster recovery. Zaczyna się od prostego pytania: do czego dokładnie chcemy wrócić i ile możemy stracić.