Jira Service Management jako usługa oferowana w ramach Service Collection oferuje teraz jeszcze większe możliwości. Odblokuj wyjątkowe doświadczenia serwisowe dzięki Rovo, Zasobom i naszej nowej aplikacji Customer Service Management.Wypróbuj teraz

Zestaw narzędzi do planowania ciągłości działania IT

Kluczowe wnioski

  • Plan ciągłości działania IT zapewnia nieprzerwane funkcjonowanie kluczowych systemów i usług podczas zakłóceń.

  • ITSCM, odzyskiwanie awaryjne oraz szeroko rozumiane zarządzanie ciągłością działania mają różne cele i osie czasu, jednak najlepiej sprawdzają się, gdy są ze sobą zintegrowane.

  • Szablony do analizy wpływu na działalność, śledzenie RTO/RPO, wykazy procedur oraz planowanie komunikacji zapewniają zespołom przewagę na starcie przy tworzeniu solidnego programu ciągłości.

  • Automatyzacja i sztuczna inteligencja ułatwiają monitorowanie ryzyka, wyzwalanie alertów oraz weryfikację gotowości do odzyskiwania danych bez ręcznego wykonywania wielu czynności.

Gdy system przestaje działać lub dochodzi do cyberataku, samo posiadanie planu to za mało — potrzebne są odpowiedni plan, odpowiednie narzędzia i zespół gotowy do działania. Plan ciągłości działania IT (ITBCP) odróżnia zespół, który działa chaotycznie od zespołu reagującego z pewnością siebie.

Kolekcja szablonów zarządzania usługami w Jira Service Management oferuje zespołom IT gotowe ramy m.in. do planowania ciągłości działania i reakcji na incydenty, dzięki czemu można poświęcić mniej czasu na tworzenie wszystkiego od podstaw, a więcej na realizację zadań.

Czytaj dalej, aby poznać definicje, omówienia szablonów, porównanie ram oraz wskazówki dotyczące wykorzystania automatyzacji do wzmocnienia programu ciągłości działania, niezależnie od tego, czy tworzysz swój pierwszy plan ITBCP, czy przeprowadzasz audyt już istniejącego.

Czym jest plan ciągłości działania IT?

Plan ciągłości działania IT to udokumentowana strategia określająca, w jaki sposób organizacja zapewni funkcjonowanie kluczowych systemów i usług technologicznych podczas zakłóceń oraz po ich ustaniu. Takie zakłócenie może być spowodowane cyberatakiem, klęską żywiołową, przerwą w dostawie prądu lub poważną awarią systemu. Celem jest nie tylko odzyskiwanie, ale przede wszystkim utrzymanie ciągłości, aby działalność biznesowa nie została wstrzymana.

Zarządzanie ciągłością usług IT (ITSCM) to praktyka stanowiąca część szerszego obszaru ciągłości działania organizacji. Koncentruje się przede wszystkim na usługach technologicznych wspierających funkcje biznesowe, takie jak infrastruktura, aplikacje, dane oraz procesy wsparcia oparte na najlepszych praktykach ITIL i oprogramowania ITSM.

Warto rozróżnić trzy pojęcia, które często są używane zamiennie:

  • Planowanie ciągłości działania IT: koncentruje się na zapewnieniu dostępności systemów i usług podczas zakłóceń. To aktywne podejście obejmujące zapobieganie, przygotowanie i reagowanie.

  • Odzyskiwanie awaryjne (DR): element planowania ciągłości działania, który skupia się na przywróceniu systemów IT i danych po awarii. Odzyskiwanie awaryjne ma charakter reaktywny. Wkracza do gry, gdy wystąpi problem.

  • Zarządzanie ciągłością działania (BCM): najszersze z tych trzech pojęć. BCM obejmuje całą organizację, a nie tylko dział IT, i poza technologią uwzględnia też ludzi, procesy, obiekty i komunikację.

Podstawowe szablony i narzędzia ITSCM

Dobre planowanie ciągłości działania wymaga przygotowania odpowiedniej dokumentacji jeszcze przed wystąpieniem problemów. Poniższe szablony obejmują najważniejsze elementy planu ciągłości działania IT. Kolekcja szablonów zarządzania usługami Atlassian to solidna baza na początek, a szablon zarządzania usługami IT został stworzony specjalnie po to, aby ułatwić zespołom IT porządkowanie już od pierwszego dnia przepływów pracy z zakresu obsługi i zapewnienia ciągłości usług.

Oto szablony, które powinien mieć pod ręką każdy zespół IT:

Szablon zasad i zakresu

Pomaga określić cele i zakres programu ciągłości działania oraz nadzór nad nim. Bez niego w sytuacji kryzysowej zespoły często nie są zgodne co do tego, co mieści się w zakresie.

Analiza wpływu na działalność biznesową (BIA)

Pomaga ocenić kluczowe systemy, aplikacje oraz ich zależności. Analiza wpływu na działalność biznesową wskazuje, co ulega awarii jako pierwsze, jakie są tego koszty oraz które elementy wymagają najszybszego odzyskania.

Tabela RTO/RPO

Śledzi cele dotyczące czasu odzyskiwania (jak długo system może być niedostępny) oraz cele dotyczące punktu odzyskiwania (jaka utrata danych jest akceptowalna) w przypadku każdego systemu.

Plan komunikacji

Zawiera wstępnie zdefiniowane kontakty, ścieżki eskalacji oraz protokoły komunikacyjne. Jasna komunikacja dotycząca incydentów podczas przestoju ogranicza nieporozumienia i przyspiesza rozwiązanie problemu.

Plan testowania procedur odzyskiwania awaryjnego / program ćwiczeń symulacyjnych

Zawiera uporządkowane środowisko testowe umożliwiające weryfikację gotowości do odzyskiwania danych. Regularne testowanie pozwala wykryć luki, zanim zrobi to prawdziwy incydent.

Struktura wykazu procedur

Operacyjne porady strategiczne dotyczące reagowania na incydenty, przestoje i awarie systemu Dzięki dobrze przygotowanemu wykazowi procedur osoby reagujące nie muszą improwizować pod presją.

ITSCM vs DR vs BCM vs zarządzanie poważnymi incydentami

Te cztery ramy częściowo się pokrywają, co może prowadzić do faktycznych nieporozumień, zwłaszcza podczas kryzysu, gdy zespoły nie mają pewności, kto za co odpowiada. Oto, czym się różnią i kiedy mają zastosowanie:

Ramy

Focus

Zakres

Czas

Cel

Kiedy stosować / nakładanie się

Zarządzanie ciągłością usług IT (ITSCM)

Utrzymanie i odzyskiwanie usług IT

Systemy i usługi IT

Ciągłe i aktywne

Zapewnić ciągłość usług IT przy minimalnym wpływie zakłóceń

Wykorzystaj jako podstawę programu ciągłości działania IT. Nakłada się na DR przy planowaniu odzyskiwania oraz na BCM przy ocenie zagrożeń.

Odzyskiwanie awaryjne (DR)

Przywracanie systemów IT i danych po awarii

Infrastruktura, aplikacje i dane

Reaktywne; wyzwalane przez zdarzenie

Jak najszybciej przywrócić działanie systemów

Stosuj, gdy wystąpiła awaria i konieczne jest przywrócenie działania systemów. Plany DR są oparte na ITSCM i uruchamiane podczas poważnych incydentów.

Zarządzanie ciągłością działalności biznesowej (BCM)

Zapewnienie ciągłości działania całej organizacji

Ludzie, obiekty, procesy i technologie

Strategiczne i długoterminowe

Utrzymać działanie całej firmy w trudnych warunkach

Stosuj na poziomie organizacji, gdy zakłócenie dotyka nie tylko działu IT. BCM obejmuje ITSCM i DR jako elementy szerszej strategii.

Zarządzanie poważnymi incydentami

Usuwanie awarii systemów IT o dużym wpływie w czasie rzeczywistym

Konkretny incydent

Natychmiastowe

Szybko przywrócić normalne działanie usługi, jednocześnie jasno informując interesariuszy

Używaj, gdy ma miejsce poważny incydent. Uruchamia wykazy procedur DR i dostarcza dane do przeglądów po incydentach, które usprawniają planowanie ITSCM.

W praktyce te ramy nie działają niezależnie. ITSCM wspiera planowanie DR. DR zasila BCM. A zarządzanie incydentami uruchamia wykazy procedur DR, gdy wystąpi poważne zdarzenie. To nakładanie się jest zamierzone. Liczy się wiedza, które ramy w danym momencie odgrywają wiodącą rolę.

Jak unowocześnić zapewnianie ciągłości działania IT dzięki automatyzacji i sztucznej inteligencji

Ręczne procesy zapewniania ciągłości mają swoje ograniczenia. Działają wolno, są niejednolite i w dużym stopniu zależą od tego, kto jest dostępny w momencie wystąpienia problemu. Automatyzacja i sztuczna inteligencja poszerzają możliwości, a zespoły IT, które je stosują, tworzą bardziej odporne programy przy mniejszym nakładzie pracy.

Oto obszary, w których automatyzacja przynosi największą wartość:

  • Zautomatyzowane monitorowanie i powiadamianie: skonfiguruj monitorowanie w czasie rzeczywistym stanu systemu, progów wydajności oraz nieprawidłowości. Automatyczne alerty informują zespół o potencjalnej awarii, zanim przerodzi się ona w pełny przestój.

  • Automatyzacja kopii zapasowych: zaplanowane, zautomatyzowane kopie zapasowe ograniczają ryzyko ludzkich błędów i zapewniają realizację założonych celów dotyczących punktów odzyskiwania. Połącz je z automatycznymi kontrolami poprawności, aby mieć pewność, że kopie zapasowe są użyteczne.

  • Analiza wpływu oparta na sztucznej inteligencji: narzędzia oparte na sztucznej inteligencji mogą analizować zależności systemowe i modelować skutki awarii w kolejnych elementach systemu szybciej niż jakikolwiek ręczny proces BIA. Jest to szczególnie przydatne w złożonych środowiskach, w których występują setki wzajemnych zależności.

  • Testowanie predykcyjne: zamiast czekać na kwartalne ćwiczenia symulacyjne, SI może nieustannie symulować scenariusze awarii i oznaczać słabe punkty w planie odzyskiwania. Dzięki temu testowanie staje się ciągłą praktyką, a nie okresowym zdarzeniem.

  • Szybsza automatyzacja odzyskiwania: wykazy procedur można częściowo lub w pełni zautomatyzować, dzięki czemu po wystąpieniu incydentu pierwsze kroki odzyskiwania są wykonywane natychmiast, bez konieczności oczekiwania na uruchomienie procesu przez człowieka.

Automatyzacja nie zastępuje dobrego planowania — wzmacnia jego efekty. Najlepsze rezultaty osiągają zespoły, które rozpoczynają pracę od sprawdzonych szablonów i procesów, a następnie wdrażają automatyzację, aby ograniczyć ręczne czynności. Ciągłe doskonalenie jest integralną częścią tego modelu. Każdy zautomatyzowany test i alert dostarcza dane, które z czasem pomagają udoskonalić plan.

Wdrożenie zestawu narzędzi do zapewnienia ciągłości działania IT

Jira Service Management oferuje zespołom IT jedno miejsce do koordynowania ćwiczeń symulacyjnych, śledzenia postępów w odzyskiwaniu oraz zarządzania pełnym cyklem życia działań zapewniających ciągłość. Dzięki wbudowanym narzędziom do zarządzania incydentami oraz konfigurowalnym przepływom pracy, JSM pełni rolę operacyjnego fundamentu planu ciągłości działania IT, łącząc ludzi, procesy i dokumentację, na których bazują programy ciągłości działania.

Użyj tej strony jako punktu odniesienia podczas tworzenia lub aktualizowania programu ciągłości działania. Dostępne tutaj szablony, ramy i wskazówki zaprojektowano tak, aby wzajemnie się uzupełniały. Zacznij od tego, co jest najpilniejsze — analizy wpływu na działalność (BIA), planu komunikacji lub tabeli RTO/RPO — i na tym się oprzyj. Celem jest stworzenie programu, który sprawdzi się w krytycznych momentach.

Polecane dla Ciebie

Podręcznik

Podręcznik firmy Atlassian na temat zarządzania incydentami

Niniejszy podręcznik zawiera opis rzeczywistych procesów zarządzania incydentami, które opracowaliśmy jako globalna firma zatrudniająca tysiące pracowników i obsługujące ponad 200 000 klientów.

Zarządzanie problemami w ITIL: przewodnik po procesie i wdrożeniu

Zarządzanie problemami pozwala zespołom IT zapobiegać incydentom poprzez rozpoznawanie głównej przyczyny. Dowiedz się więcej na temat ogólnego procesu, jego zalet oraz najlepszych praktyk.

Dowiedz się więcej o ITSM

Znajdź więcej przewodników i zasobów ITSM w tym centrum.