Šta raditi posle analize: od nalaza do prakse
Skoro svaki izveštaj završava se pitanjem „šta da radimo s ovim“. Univerzalnog recepta nema, ali svaki nalaz ima tipičan uzrok i ITIL 4 praksu koja se njime bavi. Ispod je tabela svih nalaza koje pokazuje naš izveštaj: šta obično stoji iza njih, koja praksa je odgovorna i kakav treba da bude prvi korak. Ispod tabele - odakle početi ako je nalaza više i kako proveriti da je pomoglo. Nazivi praksi su kao u tekstu „Prakse koje biznis vidi“.
| Šta je analiza pokazala | Šta obično stoji iza toga | ITIL 4 praksa | Prvi korak |
|---|---|---|---|
| Koliko u dnevniku nisu kvarovi, nego zahtevi zahtevi za pristup, lozinke, instalaciju programa u istom redu sa kvarovima kako to nalazimo → | Zahtevi i kvarovi se beleže kao jedan tip prijave, pa zastoj i kvarovi izgledaju veći nego što jesu | Upravljanje zahtevima za uslugu; upravljanje incidentima | Razdvojiti tipove prijava u sistemu i ponovo izračunati zastoj bez zahteva. Odavde je bolje početi: ostali brojevi postaju pošteniji |
| Koncentracija zastoja mali udeo incidenata daje veći deo zastoja kako to nalazimo → | Nekoliko hroničnih defekata koji se svaki put zaobilaze, a ne uklanjaju | Upravljanje problemima | Otvoriti karticu problema za svaki od gornjih incidenata - sa vlasnikom i rokom |
| Retko pada, ali se dugo popravlja visoko vreme između kvarova (MTBF), dugo vreme oporavka (MTTR) kako to nalazimo → | Vreme ne odlazi na popravku, nego na traženje odgovornog, pristupa i odluke | Upravljanje incidentima, eskalacija | Razložiti pet najdužih incidenata po fazama: otkrivanje, dodela, popravka. Više - matrica eskalacije |
| Često pada, ali se brzo popravlja nisko vreme između kvarova uz kratak oporavak kako to nalazimo → | Jedan te isti defekt koji je tim naučio da brzo zaobiđe | Upravljanje problemima | Naći zajednički uzrok čestih kvarova i tražiti njegovo uklanjanje, umesto ubrzavanja zaobilaženja |
| Objekat se kvari iznova jedna kasa, jedan čvor, jedna lokacija - češće od susednih kako to nalazimo → | Popravka po normativu bez uklanjanja uzroka; habanje konkretne opreme | Upravljanje problemima; upravljanje IT imovinom | Kartica problema za objekat i odluka: popravka uzroka ili zamena |
| Jedni kvarovi povlače druge posle jednog kvara stižu prijave za druge sisteme kako to nalazimo → | Jedan uzrok stvara nekoliko prijava, a različite grupe popravljaju „različite“ kvarove | Monitoring i upravljanje događajima (povezivanje događaja); upravljanje problemima | Spajati takve prijave u jedan incident; opisati zavisnosti ključne usluge |
| Postalo je gore posle izmene učestalost kvarova je porasla od određenog datuma, i to nije slučajnost kako to nalazimo → | Izmene idu bez procene rizika i bez praćenja posle | Upravljanje izmenama | Uvesti period praćenja posle izmena i unapred zapisan uslov vraćanja |
| Kvarovi se gomilaju u određenim satima i danima vrhovi u iste sate, dane u nedelji, datume u mesecu kako to nalazimo → | Planirani zadaci, rezervno kopiranje, izveštajni periodi se otimaju za resurse; radovi u loše vreme | Upravljanje kapacitetom i performansama; upravljanje izmenama | Postaviti raspored pozadinskih zadataka i radova preko mape vrhova i razmaknuti ih u vremenu |
| Kvar se vraća u ciklusu na svakih nekoliko dana, krajem meseca - sa datumom sledećeg kako to nalazimo → | Zadatak po rasporedu, nešto što se gomila (logovi, memorija, prostor), izveštajni period | Upravljanje problemima; upravljanje kapacitetom i performansama | Naći šta se pokreće ili gomila sa tim periodom i proveriti to pre sledećeg očekivanog datuma |
| Metrika koja upozorava na kvar pokazatelj se ponaša neobično satima pre kvara kako to nalazimo → | Signal je postojao, ali upozorenja na njega nema | Monitoring i upravljanje događajima | Postaviti upozorenje na pronađenu metriku sa pronađenom vremenskom rezervom i posle mesec dana izbrojati koliko je bilo lažnih |
| Prognoza: kvarova će biti više ili raste rizik dugog zastoja očekivani broj kvarova i verovatnoća dugog kvara kako to nalazimo → | Opterećenje raste, oprema stari, stara rezerva sigurnosti se troši | Upravljanje nivoom usluge; upravljanje kontinuitetom usluga; upravljanje kapacitetom | Razgovarati sa biznisom o ciljnom nivou i uneti prognozu u plan dežurstava, nabavki i vežbi oporavka |
Odakle početi ako je nalaza više
Skoro svaki izveštaj ima više nalaza, a snage za sve odjednom nema. Redosled ispod je naš, iz iskustva: svaki korak čini sledeći preciznijim ili jeftinijim.
- Prvo očistiti podatke. Ako u dnevniku ima mnogo zahteva, svi ostali brojevi su uvećani. Razdvojite zahteve i kvarove - i ponovo izračunajte.
- Zatim izmene. Najjeftiniji korak sa najbržim povraćajem: prema podacima Google-a, oko 70% kvarova izazvano je izmenama u sistemu koji radi. Period praćenja i uslov vraćanja ne traže ni nove sisteme ni ljude.
- Zatim veze, i tek onda koncentracija i ponavljanja. Najgori sistem po zastoju može biti žrtva tuđeg kvara. Prvo proverite da li njegov kvar ne povlači neki drugi, inače će se kartica problema otvoriti za pogrešan sistem. Više - zašto jedan metod nije dovoljan.
- Ponavljanja i koncentracija - u upravljanje problemima. Ne sve odjednom, nego tri gornja. Praksa započeta široko obično utihne već u prvom kvartalu.
- Dug oporavak - u eskalaciju. Ko saznaje, za koliko, ko je sledeći po tajmeru. Vidljiv rezultat - za nekoliko nedelja.
- Sati, ciklusi, predznaci, prognoza - koliko se stigne. To je rad sa resursima, rasporedom i monitoringom. Jeftiniji je kada su prvi koraci već urađeni.
Kako proveriti da je pomoglo
Uzmite početni nivo pre početka radova i ponovite merenje za kvartal na isti način - najbolje istim izveštajem po svežem izvozu. Bez početnog nivoa svaki rezultat ostaje tvrdnja, a prvo skeptično pitanje na sastanku će ga poništiti.
- Upravljanje problemima: udeo ponovljenih incidenata i udeo zastoja koji daju gornji redovi spiska.
- Upravljanje izmenama: učestalost kvarova posle izmena i udeo neuspešnih izmena - onih koje su zahtevale vraćanje ili hitnu ispravku.
- Eskalacija: vreme do početka rada odvojeno od vremena popravke.
- Monitoring: udeo kvarova za koje se saznalo pre klijenta.
Povezane analize: rangiranje vrsta kvarova - kako označiti svoje incidente po izvorima; kako izgleda idealna eksploatacija - kuda se na kraju kretati.
Tabela nije dogma: isti nalaz se u različitim kompanijama rešava različitim praksama. Ona daje smer traženja, a tačan odgovor daju vaši podaci i razgovor sa timom.
Izveštaj obično prolazimo zajedno sa timom naručioca: biramo jedan ili dva cilja, pravimo plan za kvartal i posle kvartala proveravamo rezultat ponovnim pokretanjem. Ako je to vaš slučaj - .