Cyfryzacja to miecz obosieczny. Z jednej strony rewolucjonizuje sposób prowadzenia biznesu, ale z drugiej tworzy nowe, nieznane wcześniej zagrożenia. Współczesne przedsiębiorstwa uzależniły się od cyfrowych technik na każdym poziomie działania: od obsługi klientów, przez raportowanie finansowe, aż po procesy produkcyjne. Gdy wszystko działa sprawnie, efektywność osiąga poziomy, o których do niedawna można było jedynie pomarzyć. Jednak, gdy rozwiązania zawodzą, następuje kaskada problemów.

Liczby mówią same za siebie. Według raportu „The Hidden Costs of Downtime” autorstwa Splunk i Oxford Economics, firmy z listy Global 2000 tracą rocznie 400 mld dol. z powodu nieplanowanych przestojów IT. To średnio 200 mln dol. na każdą z nich, co stanowi sumę składającą się z utraconych przychodów i kar nakładanych przez regulatorów rynku. Co więcej, to jedynie wierzchołek góry lodowej, która składa się z szeregu ukrytych kosztów: zniszczonej reputacji, spadku kapitalizacji rynkowej czy utraconego zaufania poszkodowanych klientów. Te niematerialne szkody mogą czasami zadać firmom cios o wiele bardziej bolesny niż bezpośrednie koszty przestoju.

Niemniej, straty różnią się, w zależności od branży. Najbardziej cierpi handel detaliczny (287 mln dol. rocznie), a w dalszej kolejności produkcja (255 mln), transport i logistyka (213 mln) oraz energetyka i usługi komunalne (211 mln). Co gorsza, współczesna gospodarka tworzy system naczyń połączonych. W efekcie awaria jednego elementu natychmiast przekłada się na funkcjonowanie całości. Przykładowo, paraliż systemu bankowego błyskawicznie zatrzymuje działalność podmiotów z dziesiątek innych branż. Przestój linii produkcyjnej rozprzestrzenia się jak fala uderzeniowa przez cały łańcuch dostaw, dotykając sprzedawców detalicznych, firmy logistyczne i końcowych konsumentów.

Szczególnie niebezpieczne są awarie w branży komunikacji i mediów. Mogą one odciąć obywateli od służb ratunkowych lub sparaliżować koordynowanie działań podczas katastrof naturalnych. Podczas gdy media rozpisują się o spektakularnych atakach na globalne korporacje, tysiące małych przedsiębiorstw cierpi w ciszy. Te mniejsze incydenty nie mają wartości informacyjnej dla szerokiej publiczności, tworząc błędne koło nieświadomości. A właściciele lokalnych biznesów nie zdają sobie sprawy z realnych zagrożeń, co czyni je jeszcze bardziej podatnymi na ataki.

Luksus vs. racjonalność

W idealnym świecie każdy szef IT mógłby cieszyć się zielonymi lampkami na monitorach, ciszą w serwerowni i regularnymi premiami za stabilność systemów. Rzeczywistość jednak bywa brutalna, co wynika między innymi z faktu, że przedsiębiorstwa często wpadają w kosztowną pułapkę, myląc wysoką dostępność (high availability) z odpornością na awarie (fault tolerance).

– Korporacje często stawiają na fault tolerance, chociaż w zupełności wystarczyłoby wdrożyć mechanizmy wysokiej dostępności. Według szacunków branżowych zapewnienie odporności na awarię dla systemu transakcyjnego w banku kosztuje 2,5-krotnie więcej niż w przypadku podstawowej infrastruktury. Z kolei w firmach z branży HR uruchomienie systemu wysokiej dostępności kosztuje 1,5–2 razy więcej niż rozwiązanie bazowe. Nie raz spotkałem firmy przepłacające miliony, bo ktoś zdecydował się na opcję fault tolerant – mówi Paweł Mączka, CEO Storware’u.

Oczywiście istnieje wiele firm i zastosowań, w których wysoka dostępność i odporność na awarie nie są krytyczne. W związku z tym nie muszą one inwestować w kosztowne rozwiązania redundantne, klastry wysokiej dostępności czy zaawansowane systemy backupu i disaster recovery. Do tej grupy należą przede wszystkim małe firmy lokalne (restauracje, sklepy, małe biura rachunkowe), a także szkoły, muzea czy biblioteki.

Walka o pięć „dziewiątek”

Najbardziej wymagające przedsiębiorstwa dążą do poziomu 99,999 proc. dostępności, co oznacza zaledwie 5 minut i 15 sekund przestoju w ciągu całego roku. To matematyczna perfekcja w świecie, gdzie każda sekunda kosztuje tysiące dolarów. Rzecz jasna, osiągnięcie tego poziomu nie jest proste.

– Największym wyzwaniem nie są same rozwiązania techniczne, lecz ich właściwe zintegrowanie z procesami biznesowymi. Dążenie do pełnej dostępności każdego elementu infrastruktury nie zawsze jest możliwe, a często nawet nie jest konieczne. Znacznie ważniejsze jest wiedzieć, co naprawdę musi być dostępne zawsze, a co może chwilowo poczekać – zauważa Wojciech Furmankiewicz, dyrektor Red Hat ds. technologii i rozwiązań w regionie Europy Środkowo-Wschodniej.

Dane z raportu Veeam „Ransomware Trends and Proactive Strategies 2025” obnażają bolesną rzeczywistość. Tylko 44 proc. podmiotów ma jasno określoną w swoich playbookach częstotliwość i metodę weryfikowania możliwości odzyskania danych z kopii backupowych, a zaledwie 37 proc. posiada alternatywną infrastrukturę na wypadek awarii podstawowej. Jeszcze bardziej niepokojące jest to, iż 52 proc. respondentów przyznaje, że ich zespoły IT i bezpieczeństwa wymagają znaczącej poprawy lub całkowitej restrukturyzacji, aby skutecznie radzić sobie z wyzwaniami.

– To jasno pokazuje, że strategia ciągłości działania musi wykraczać poza sferę rozwiązań technicznych i uwzględniać cały ekosystem organizacyjny. Warto też uzmysłowić sobie kluczową rzecz: zachowanie wysokiej dostępności to wprawdzie ważny element strategii działania, ale nie gwarantuje bezpieczeństwa danych. Jeśli dojdzie do ich zaszyfrowania w wyniku ataku ransomware, HA nie pomoże w ich odzyskaniu – ostrzega Tomasz Krajewski, dyrektor techniczny sprzedaży na Europę Wschodnią w polskim oddziale Veeama.

Radosław Piedziuk, Storage Platforms & Solutions Sales Leader, Dell Technologies Radosław Piedziuk, Storage Platforms & Solutions Sales Leader, Dell Technologies  

Konteneryzacja zmienia podejście do wysokiej dostępności, umożliwiając łatwe skalowanie, szybkie odtwarzanie usług i automatyczne przełączanie między instancjami. Firmy wdrażają zwirtualizowane aplikacje nie tylko dla elastyczności, ale również celem uproszczenia i zwiększenia ich dostępności. Rozwiązania automatyzujące, w rodzaju Infrastructure as Code, czy systemy samonaprawiające się, istotnie zwiększają poziom wysokiej dostępności, eliminując błędy ludzkie, przyspieszając odtwarzanie środowisk i umożliwiając szybką reakcję na awarie. Dzięki nim infrastruktura może być odtwarzana i skalowana automatycznie, co podnosi bezpieczeństwo i ogranicza ryzyko operacyjne. Trend ten jest już widoczny w Polsce, co obrazuje zainteresowanie narzędziami Terraform, Ansible czy wykorzystaniem funkcji auto-healing w środowiskach Kubernetes.

Dell zdobył certyfikat Channel Master 2025