ftetoai Na zoznam čakateľov

Kennisbank

Monitorovanie výkonu systémov: čo tu už dnes robí AI

Skrátená verzia

Sledovanie dostupnosti a rýchlosti systémov a signalizovanie odchýlok skôr, než ich pocítia užívatelia, je úloha, ktorú je z veľkej časti možné prevziať. Nie preto, že by AI náhle rozumela infrastruktúre, ale preto, že samotná úloha je už roky vybudovaná okolo meraných hodnôt, prahov a opakovania. To je iný záver ako pri úlohách, kde jadro tvorí úsudok alebo vyjednávanie.

Prečo sa táto práca na to hodí

Rozhodujúce sú tu tri osi: objem, štruktúrovanosť a náklady na chyby.

Objem je vysoký. Monitorovanie prebieha nepretržite, vo dne v noci, cez stovky až tisíce meracích bodov. Človek, ktorý by to sledoval manuálne, sa pozerá na dashboardy s prestávkami a to, čo sa stane medzitým, mu unikne. Systém, ktorý meria každú sekundu a porovnáva s prahovou hodnotou, to neprehliadne.

Štruktúrovanosť je vysoká. Úloha spočíva v: meraní, porovnaní s normou a pri odchýlke vydaní signálu. Je to pevný postup, nie otvorená otázka. Porovnajte to so zodpovedaním otázky užívateľa o softvéri, kde je otázka vždy inak formulovaná a vyžaduje kontext.

Náklady na chyby sú nízke až priemerné. Zmeškané alebo neskoré upozornenie je nepríjemné, ale väčšinou napraviteľné: systém vyšle nové upozornenie, keď odchýlka pretrváva, a väčšina prahových hodnôt je nastavená s rezervou. To je odlišné od úlohy, kde jeden zmeškaný krok priamo znamená, že užívateľ zostane bez funkčnej aplikácie, ako pri riešení incidentu IT prvej linky.

Kde to naráža na limity

Dve osi tento obraz brzdia: priestor na úsudok a kreativita sú na úrovni 2, respektíve 1.

Signalizovanie odchýlky je niečo iné ako pochopenie toho, čo táto odchýlka znamená pre organizáciu. Nárast využitia pamäte môže byť nevinný, alebo môže byť začiatkom problému, ktorý o dve hodiny vyradí z prevádzky e-shop. Určenie tohto významu a rozhodnutie eskalovať vec na inžiniera, ktorý zasiahne, zostáva prácou pre človeka. AI signalizuje odchýlku; osoba so znalosťou prostredia posudzuje, čo táto odchýlka znamená.

Práve preto táto úloha nestojí izolovane. Signál, ktorý vydá monitorovací nástroj, musí niekde skončiť: ako zaregistrovaný incident so správnou naliehavosťou. Ako to prebieha ďalej, je popísané na stránke Registrácia a prioritizácia IT incidentov, úlohe, ktorá je o niečo menej pevne zovretá pravidlami než samotné monitorovanie.

Čo AI dnes v tejto oblasti dokáže

Odhad je: agent. Nie samostatný skript, ktorý kontroluje jednu prahovú hodnotu, ale systém, ktorý nepretržite meria, kombinuje viacero signálov a sám určuje, či si vzorec zaslúži upozornenie, skôr než ho vidí človek. To je krok ďalej než len alerting a krok späť od úplnej autonómie: agent signalizuje a kategorizuje, správca rozhoduje, čo sa so signálom stane.

O tom, či to funguje, rozhodujú dve okrajové podmienky. Musia existovať zavedené prahové hodnoty, prispôsobené tomu, čo je pre dané konkrétne systémy normálne: prah, ktorý je pre jednu aplikáciu dostatočne striktný, môže pri inej neustále spúšťať falošné poplachy. A musí existovať automatizovaný alerting, ktorý signál skutočne doručí konkrétnej osobe. Bez týchto dvoch vecí nie je čo prevziať: chýba norma, voči ktorej sa dá porovnávať, a chýba kanál, cez ktorý sa dá signál doručiť.

Odkiaľ pochádza rozdiel

V podniku s pár servermi a pevným pracovným časom je monitorovanie často ešte otázkou príležitostného pozerania. Prínos automatizácie v objeme je tam obmedzený, jednoducho pretože objem je nízky. V podniku s mnohými systémami, klientmi, ktorí očakávajú prístup kedykoľvek počas dňa, a históriou incidentov, ktoré vznikli počas noci, je obraz iný: tam kapacita fte, ktorá sa uvoľní pri nepretržitom automatizovanom dohľade, rýchlo narastá, pretože alternatívou je človek, ktorý musí byť trvalo v pohotovosti.

Aj os nákladov na chyby sa mení podľa podniku. V internom testovacom prostredí je zmeškané upozornenie bez následkov. Pri systéme, ktorý sa priamo dotýka platobného styku alebo zdravotných údajov, je latka compliance vyššia, a to posúva os compliance, ktorá je tu už na úrovni 4, ešte viac smerom k povinnému zaznamenávaniu a preukázateľnému nadväzujúcemu postupu.

Čo toto nie je

Toto nie je výrok o personáli. Či a ako organizácia inak nasadí uvoľnenú kapacitu správcu systémov, je rozhodnutím zamestnávateľa, s vlastnými zákonnými požiadavkami tam, kde sa to dotýka rozhodnutí o pracovných miestach. Táto stránka popisuje len prácu, nie ľudí, ktorí ju momentálne vykonávajú.

Ako to zapadá do širšieho celku

Monitorovanie je málokedy izolovaná úloha. Súvisí s vykonávaním a kontrolou zálohovania, so spracovaním incidentov a s plánovaním toho, kto a kedy musí byť k dispozícii pre nadväzujúce kroky. Kto chce širší obraz o tom, čo AI môže prevziať v IT funkcii ako celku, nájde východiskový bod na stránke o práci a plánovaní.

Čo môžete urobiť teraz

Táto stránka poskytuje odhad na základe úlohy vo všeobecnej forme. Koľko to znamená pre konkrétny podnik, závisí od počtu systémov, zavedených prahových hodnôt a dôsledkov zmeškaného upozornenia. Indikáciu pre vlastnú situáciu je možné získať pomocou bezplatného quickscanu: dvanásť otázok, bez potreby účtu, s indikáciou, akú časť hodín v tomto profile je dnes možné prevziať pomocou AI. Kompletný werkscan, ktorý rozloží prácu celého podniku na jednotlivé úlohy, sa ešte pripravuje.

KIPPde assistent van de werkscan

Vraag maar. Ik ken de kennisbank van deze site; wat ik niet weet, zeg ik erbij.

Answers come from this site’s knowledge base. Not tailored advice, and not a scan of your company.