ftetoai Na čekací listinu

Kennisbank

Monitorování výkonu systémů: co zde AI již dělá

Stručně

Sledování systémů z hlediska dostupnosti a rychlosti a signalizace odchylek dříve, než je pocítí uživatelé, je úkol, který lze do velké míry převzít. Ne proto, že by AI náhle rozuměla infrastruktuře, ale protože samotný úkol je už léta postaven na měřených hodnotách, prahových hodnotách a opakování. To je jiný závěr než u úkolů, jejichž jádrem je úsudek nebo vyjednávání.

Proč se tato práce k tomu hodí

Rozhodující jsou zde tři osy: objem, strukturovanost a náklady na chyby.

Objem je vysoký. Monitorování probíhá nepřetržitě, ve dne i v noci, přes stovky až tisíce měřicích bodů. Člověk, který by to sledoval manuálně, se dívá na dashboardy v intervalech a to, co se stane mezitím, mu unikne. Systém, který měří každou sekundu a porovnává s prahovou hodnotou, to neunikne.

Strukturovanost je vysoká. Úkol se skládá z: měření, porovnání s normou a v případě odchylky vydání signálu. Jde o pevný postup, nikoli otevřenou otázku. Srovnejte to se zodpovídáním uživatelského dotazu o softwaru, kde je otázka pokaždé formulována jinak a vyžaduje kontext.

Náklady na chyby jsou nízké až střední. Zmeškané nebo pozdní upozornění je nepříjemné, ale většinou napravitelné: systém odešle nové upozornění, jakmile odchylka trvá, a většina prahových hodnot je nastavena s rezervou. To se liší od úkolu, kde jeden zmeškaný krok přímo vede k uživateli bez funkční aplikace, jako je řešení incidentu první linie IT podpory.

Kde to naráží

Dvě osy tento obraz brzdí: prostor pro úsudek a kreativita jsou na hodnotě 2, respektive 1.

Signalizace odchylky je jiná věc než pochopení toho, co tato odchylka znamená pro organizaci. Nárůst využití paměti může být neškodný, nebo to může být začátek problému, který za dvě hodiny vyřadí e-shop z provozu. Určení tohoto významu a rozhodnutí o eskalaci na inženýra, který zasáhne, zůstává lidskou prací. AI signalizuje odchylku; osoba se znalostí prostředí posuzuje, jakou má tato odchylka hodnotu.

Proto tento úkol také nestojí izolovaně. Signál, který nástroj pro monitorování vydá, musí někam dorazit: jako zaregistrovaný incident se správnou úrovní naléhavosti. Jak to probíhá dál, je popsáno v části Registrace a prioritizace IT incidentů, což je úkol, který je o něco méně striktně vymezený než samotné monitorování.

Co AI dnes v tomto zvládne

Odhad je: agent. Nikoli samostatný skript, který kontroluje jedinou prahovou hodnotu, ale systém, který nepřetržitě měří, kombinuje více signálů a sám určuje, zda si vzorec zaslouží upozornění, ještě než ho spatří člověk. To je krok dál než pouhé upozorňování a krok zpět od úplné autonomie: agent signalizuje a kategorizuje, správce rozhoduje, co se se signálem stane.

Dvě podmínky určují, zda to funguje. Musí existovat nastavené prahové hodnoty, odpovídající tomu, co je pro dané konkrétní systémy normální: prahová hodnota, která je pro jednu aplikaci dostatečně striktní, může u jiné neustále spouštět falešné poplachy. A musí existovat automatizované upozorňování, které signál skutečně doručí konkrétní osobě. Bez těchto dvou podmínek není co převzít: chybí norma, podle které se porovnává, chybí kanál, kterým se to předává.

Odkud pramení rozdíl

Ve firmě s několika servery a pevnou pracovní dobou je monitorování často stále záležitostí příležitostné kontroly. Přínos automatizace v objemu je tam pak omezený, prostě proto, že objem je nízký. Ve firmě s mnoha systémy, klienty, kteří očekávají přístup v kteroukoli denní dobu, a historií incidentů, které vznikly v noci, je obraz jiný: tam kapacita fte, která se uvolní díky nepřetržitému automatizovanému dohledu, rychle narůstá, protože alternativou je člověk, který musí být neustále v pohotovosti.

Osa nákladů na chyby se také liší podle firmy. V interním testovacím prostředí je zmeškané upozornění bez následků. U systému, který se přímo dotýká platebního styku nebo zdravotních údajů, je laťka pro compliance vyšší, a to posouvá osu compliance, která je zde už na hodnotě 4, ještě více směrem k povinné evidenci a prokazatelnému sledování.

Co toto není

Toto není výrok o personálu. Zda a jak organizace uvolněnou kapacitu správce systému využije jinak, je rozhodnutí zaměstnavatele, s vlastními zákonnými požadavky tam, kde se to dotýká rozhodování o pracovních pozicích. Tato stránka popisuje pouze práci samotnou, nikoli lidi, kteří ji nyní vykonávají.

Jak to zapadá do širšího celku

Monitorování je jen zřídka izolovaný úkol. Souvisí s prováděním a kontrolou zálohování, s řešením incidentů a s plánováním toho, kdo musí být kdy k dispozici pro následnou reakci. Kdo chce širší přehled o tom, co může AI převzít v IT funkci jako celku, najde výchozí bod na stránce o práci a plánování.

Co můžete udělat nyní

Tato stránka podává odhad na základě úkolu v obecné formě. Kolik to znamená pro konkrétní firmu, závisí na počtu systémů, nastavených prahových hodnotách a důsledcích zmeškaného upozornění. Indikaci pro vlastní situaci lze získat pomocí bezplatného quickscanu: dvanáct otázek, bez nutnosti účtu, s indikací, jakou část hodin v tomto profilu lze dnes převést na AI. Kompletní pracovní scan, který rozebírá práci celé firmy na jednotlivé úkoly, se stále připravuje.

KIPPde assistent van de werkscan

Vraag maar. Ik ken de kennisbank van deze site; wat ik niet weet, zeg ik erbij.

Answers come from this site’s knowledge base. Not tailored advice, and not a scan of your company.