Plany ciągłości działania opisują kryzys jako uporządkowaną sekwencję kroków. Rzeczywistość pisze inny scenariusz. Jeśli firma nie ma odpornej architektury, pierwsze 24 godziny po incydencie wyglądają zupełnie inaczej niż w planach na papierze. Warto prześledzić tę dobę krok po kroku, bo dopiero wtedy widać, dlaczego awaria to nie jest techniczny incydent, tylko bardzo szybko rozwijający się kryzys operacyjny i zarządczy.
Wszystko zaczyna się niepozornie. Systemy przestają działać albo zachowują się dziwnie. Użytkownicy zgłaszają problemy z różnych stron, każdy trochę inny. Brakuje jednej spójnej informacji o tym, co się właściwie stało. Dział IT doraźnie naprawia objawy, bo nikt jeszcze nie widzi całości. Biznes zaczyna się niepokoić i zadaje pierwsze pytanie: czy to chwilowe?
W kolejnym kroku okazuje się, że problem jest większy niż jeden niedziałający system. Przestają działać kolejne zależności, a awaria zaczyna realnie wpływać na operacje biznesowe. IT próbuje restartów, obejść i przywracania fragmentów aplikacji oraz systemów. Biznes w tym samym czasie podejmuje próby ręcznego działania: dzwoni do klientów, przeprasza, łata procesy ludźmi.

Potem następuje chwila prawdy. Padają pytania, na które nie ma odpowiedzi. Gdzie są aktualne dane? Co działa, a co nie? Czy kopia zapasowa jest dobra? Czy możemy coś odtworzyć? Każde z tych pytań powinno mieć odpowiedź przygotowaną na długo przed kryzysem. Jeżeli pada po raz pierwszy w jego trakcie, samo szukanie odpowiedzi zabiera czas, którego właśnie najbardziej brakuje. W tym momencie kryzys techniczny staje się już oficjalnie kryzysem zarządczym.
Ostatni krok to pełnoskalowy kryzys biznesowy. Firma przestaje produkować i sprzedawać. Zatrzymują się procesy finansowe, w tym fakturowanie i regulowanie zobowiązań. Organizacja wchodzi w obszar nieodwracalnych konsekwencji rynkowych. To moment, w którym kryzys przestaje być historią o systemach, a staje się historią o przetrwaniu firmy.
W każdej z opisanych sytuacji wraca jeden i ten sam problem. Firma nie ma punktu, od którego może zacząć od nowa w kontrolowany sposób. To zdanie warto zapamiętać, bo zawiera całą diagnozę. Chaos pierwszej doby nie bierze się z braku starań ani z braku kompetencji ludzi. Bierze się z braku miejsca, do którego można się cofnąć, żeby odbudowywać działanie po kolei, a nie wszystko naraz.
Dobra wiadomość jest taka, że ten punkt startu da się przygotować zawczasu. Temu właśnie służy architektura odporności, o której cechach pisaliśmy wcześniej: redundancji, odwracalności, autonomii operacyjnej, widoczności i ograniczaniu zależności od pojedynczych dostawców. Firma, która ją ma, przechodzi przez te same pierwsze godziny, ale według scenariusza, który zna i który przećwiczyła. Różnica nie polega na tym, że nic się nie psuje. Polega na tym, że wiadomo, co robić.
Pierwszej doby kryzysu nie da się uniknąć decyzją. Da się natomiast zdecydować, czym ona będzie: realizacją przygotowanego planu czy improwizacją pod presją. Tę decyzję firma podejmuje na długo przed incydentem. Najczęściej wtedy, gdy wszystko jeszcze działa i temat łatwo odłożyć na później.
