Czym jest AIOps?
AIOps, skrót od artificial intelligence for IT operations, wykorzystuje AI, uczenie maszynowe, analitykę i automatyzację, aby pomóc zespołom IT zarządzać złożoną infrastrukturą, wykrywać anomalie, ograniczać szum alertów, identyfikować przyczyny źródłowe i szybciej reagować na incydenty.
W nowoczesnych centrach danych AIOps zyskuje na wartości, gdy łączy oprogramowanie, sprzęt, sieć, zasilanie, środowisko, zasoby, alarmy i usługi biznesowe w jeden widok operacyjny. Pomaga to zespołom przejść od reaktywnego rozwiązywania problemów do proaktywnych operacji opartych na danych.
W platformie Sensaka realizuje to SmartBSM, który rozszerza platformę iDCOS o AIOps i mapowanie usług biznesowych, korelując zdarzenia i wiążąc usterki infrastruktury z wpływem na usługi.
AIOps wyjaśnione
Czym jest AIOps?
AIOps oznacza stosowanie sztucznej inteligencji, uczenia maszynowego, analityki big data i automatyzacji w operacjach IT. Jego celem jest zbieranie danych operacyjnych z wielu systemów, wyodrębnianie istotnych sygnałów, korelowanie zdarzeń, wykrywanie nietypowego zachowania oraz pomoc zespołom w szybszym rozwiązywaniu incydentów.
Platformy AIOps wykorzystują takie możliwości jak przetwarzanie języka naturalnego i modele uczenia maszynowego, aby automatyzować, usprawniać i optymalizować zarządzanie usługami IT oraz przepływy pracy operacyjnej.
Dlaczego AIOps ma znaczenie
Środowiska IT są dziś zbyt złożone dla wyłącznie ręcznych operacji. Pojedyncza usługa biznesowa może zależeć od aplikacji, baz danych, middleware, systemów operacyjnych, maszyn wirtualnych, serwerów, pamięci masowej, urządzeń sieciowych, systemów zasilania, systemów chłodzenia i fizycznych zasobów centrum danych.
Zbyt wiele alertów, zbyt mało kontekstu
Gdy coś się psuje, zespoły często mierzą się z nadmiarem alertów, rozproszonymi panelami, niejasną odpowiedzialnością i wolną analizą przyczyn źródłowych.
AIOps pomaga, pobierając dane z wielu źródeł, oddzielając istotne sygnały od szumu, identyfikując wzorce i wspierając szybszą reakcję.
Jak działa AIOps
Praktyczny przepływ pracy AIOps zwykle obejmuje pięć warstw: od zbierania surowych danych, przez korelację i wykrywanie, aż po zautomatyzowaną reakcję.
Zbieranie danych
Pobieranie metryk, logów, zdarzeń, zgłoszeń, danych z czujników sprzętowych, telemetrii sieciowej oraz relacji między usługami z całego stosu.
Korelacja danych
Łączenie powiązanych alertów, dotkniętych systemów, zależności i usług biznesowych w jeden widok operacyjny.
Wykrywanie anomalii
Identyfikacja nietypowego zachowania wydajności, ruchu, zasilania, temperatury lub wzorców systemowych, zanim incydenty eskalują.
Analiza przyczyn źródłowych
Śledzenie objawów aż do najbardziej prawdopodobnego źródła, zamiast gonienia za powierzchownymi alertami.
Automatyzacja
Kierowanie incydentów, uruchamianie przepływów pracy, powiadamianie zespołów lub wykonywanie predefiniowanych działań naprawczych.
Zastosowania AIOps
Korelacja incydentów
Łączenie powiązanych zdarzeń w różnych systemach zamiast ręcznego porównywania setek alertów.
Wykrywanie anomalii
Wykrywanie nietypowych wzorców w metrykach, logach, zasilaniu, temperaturze, ruchu lub zachowaniu systemu.
Analiza przyczyn źródłowych
Śledzenie spowolnień usług i awarii aż do najbardziej prawdopodobnego źródła w różnych środowiskach.
Konserwacja predykcyjna
Wcześniejsze identyfikowanie ryzyk sprzętowych, pojemnościowych, energetycznych lub wydajnościowych na podstawie trendów operacyjnych.
Zautomatyzowana reakcja
Wsparcie automatycznego tworzenia zgłoszeń, kierowania alarmów, przepływów pracy reagowania i działań naprawczych.
Monitoring usług biznesowych
Mapowanie kondycji infrastruktury na aplikacje, transakcje i usługi biznesowe.
AIOps dla centrów danych
Wiele dyskusji o AIOps koncentruje się na aplikacjach chmurowych i obserwowalności oprogramowania. To przydatne, ale centra danych potrzebują też widoczności sprzętu, zasilania, przestrzeni, środowiska, sieci i zasobów fizycznych.
Pełna inteligencja operacyjna na wszystkich warstwach
- • Monitoring aplikacji i usług biznesowych
- • Monitoring systemów operacyjnych, baz danych, middleware, maszyn wirtualnych, chmury i kontenerów
- • Monitoring serwerów, pamięci masowej, sieci, urządzeń bezpieczeństwa i sprzętu
- • Monitoring zasilania, chłodzenia, UPS, PDU, temperatury, wilgotności, kontroli dostępu i środowiska
- • Zarządzanie cyklem życia zasobów i dokładność konfiguracji
- • Wizualizacja topologii i mapowanie zależności
- • Scentralizowane zarządzanie alarmami i raporty operacyjne
- • Integracja z ITSM i CMDB
- • Operacje zdalne i zarządzanie out-of-band
Korzyści z AIOps
AIOps a tradycyjny monitoring
Tradycyjny monitoring informuje zespoły, co się dzieje. AIOps pomaga wyjaśnić, dlaczego tak się dzieje, co jest tym dotknięte i jakie działanie powinno nastąpić.
Podstawowe narzędzie monitoringu może pokazać, że serwer, baza danych lub łącze sieciowe zgłasza alert. AIOps koreluje ten alert z powiązanymi systemami, zależnościami usług, wzorcami historycznymi, danymi o zasobach, topologią i wpływem na biznes. To przenosi operacje z odizolowanych alertów do połączonej inteligencji.
Na co zwrócić uwagę przy wyborze platformy AIOps
AIOps z pełną widocznością wszystkich warstw
Sensaka łączy AIOps z obserwowalnością centrum danych, monitoringiem sprzętu out-of-band, inteligentną ewidencją zasobów, widocznością energii i mapowaniem usług biznesowych. Zamiast zatrzymywać się na warstwie aplikacji, Sensaka rozszerza inteligencję operacyjną na infrastrukturę fizyczną, która wspiera każdą usługę cyfrową.
Efektem jest mniej martwych pól, mniej nieprzeanalizowanych alarmów, szybsza analiza przyczyn źródłowych oraz wyraźniejszy związek między kondycją infrastruktury a wpływem na usługi biznesowe.
Źródło: AIOps (Wikipedia).
