ftetoai På venteliste

Kennisbank

Hvad en fornyet måling viser

En opgave, der sidste år lå i kategori tre — menneskeligt arbejde, ingen tvivl mulig — kan dette år ende i kategori to: delvist overtagelig, med menneskeligt tilsyn der godkender eller afviser med begrundelse. Det er ikke en fejl i den første måling. Det er en konsekvens af, hvordan vi måler, og hvorfor et resultat altid er et øjebliksbillede.

Hvad der ændrer sig, og hvad ikke

Deres virksomhed ændrer sig måske ikke. Men de otte akser, som vi bedømmer en opgave på, gør det, uafhængigt af Deres organisation. Vi ser på struktureringsgraden af input, vurderingsrum, kundekontakt-følsomhed, fysisk komponent, kreativitet, fejlomkostninger, compliance-følsomhed og volumen/gentagelse. Af disse otte er der to, der er mest udsat for forandring uden for Deres virksomhed: struktureringsgraden af input og vurderingsrum.

Struktureringsgraden af input forbedres, når de underliggende modeller bliver bedre til at behandle rodet, ustruktureret tekst — en håndskrevet notat, en e-mail med tre emner på én gang, en telefonsamtale med baggrundsstøj. Hvad der sidste år var for ustruktureret til at kunne behandles pålideligt, kan dette år ligge inden for rækkevidde. Det er netop derfor, kan AI overtage telefonbesvarelse og viderestilling giver et andet svar end for to år siden: ikke fordi Deres telefoni har ændret sig, men fordi talegenkendelse og samtaleklassificering har flyttet sig et hak.

Vurderingsrum forskydes langsommere, men heller ikke denne akse er statisk. I takt med at systemer bliver bedre til at genkende grænsetilfælde — og til eksplicit at angive, når de er i tvivl — forskydes en del af det, der tidligere var rent menneskeligt arbejde, til det område, hvor AI fremlægger et forslag, og et menneske vurderer. Det er kernen i kategori to: ikke AI, der beslutter, men AI, der forelægger med begrundelse, og et menneske, der godkender eller afviser.

Hvorfor spændet kan være bredt

Hvis to af de otte akser kan forskyde sig, og de øvrige seks er relativt stabile, fordi de afhænger af selve arbejdets natur — fejlomkostninger og compliance-følsomhed ændrer sig ikke, fordi en sprogmodel bliver bedre — så er resultatet af en måling altid en kombination af noget stabilt og noget bevægeligt. Det oversætter sig til et spænd, ikke til en procentsats.

Et bredt spænd er ikke en svaghed i målingen. Det er en ærlig afspejling af den usikkerhed, der reelt findes. Ved en opgave som kan AI overtage triagering af generel e-mail-postkasse afhænger resultatet stærkt af, hvor meget af den indkommende e-mail der reelt er ustruktureret, og hvor meget der allerede følger et genkendeligt mønster. En postkasse med primært standardspørgsmål scorer anderledes end en postkasse, hvor halvdelen af beskederne beskriver en unik situation. Ét mærke for "e-mail-triagering" findes derfor ikke uden den nuance, og et spænd, der anerkender dette, er mere nøjagtigt end et tal, der virker præcist.

Når et resultat ikke siger noget

Der findes situationer, hvor en score på et givet tidspunkt har ringe forudsigelsesværdi for det følgende år. Det gælder især for opgaver, der ligger tæt på grænsen mellem kategori to og tre, og hvor vurderingsrummet stærkt afhænger af undtagelser, der sjældent forekommer, men vejer tungt. Ved dokumenthåndtering rører spørgsmålet kan AI overtage arkivering af dokumenter og kontrol mod opbevaringsfrister f.eks. stærkt ved compliance-følsomhed: en forkert vurdering af en opbevaringsfrist kan have juridiske konsekvenser, der ikke står i forhold til, hvor ofte fejlen forekommer. Ved sådanne opgaver kan en score dette år falde ud gunstigt på grund af teknisk fremskridt, mens aksen fejlomkostninger fortsat er afgørende, og opgaven alligevel forbliver i kategori to eller tre.

En score siger også kun lidt, når den underliggende opgavebeskrivelse er for bred. "Kundekontakt" eller "administration" er ikke opgaver, men kategorier af opgaver, og en fornyet måling af disse fortæller Dem primært, at De skal opdele opgaven yderligere, før resultatet betyder noget.

Hvad dette betyder for gentagne målinger

Fordi to af de otte akser er bevægelige, giver en fornyet måling over tid faktisk mening — ikke som en årlig formalitet, men som en reaktion på konkrete signaler: en ny version af en underliggende model, en opgave, der i mellemtiden er organiseret anderledes, eller tvivl, der sidste år endnu ikke kunne afklares. En fornyet måling, der ikke gør andet end at gentage det foregående resultat, var ikke værd besværet; en fornyet måling, der afdækker en forskydning i strukturering eller vurderingsrum, var det.

Denne metode handler ikke om, hvad en arbejdsgiver gør med det resultat. Beslutninger om personale og indsættelse har deres egne lovmæssige krav, og disse behandles eller understøttes ikke her.

Hvad De kan gøre nu

Den gratis quickscan fra ftetoai består af tolv spørgsmål, uden konto, og giver en indikation af, hvor stor en del af timerne i Deres profil der i dag kan overtages af AI. Den fulde arbejdsscan, der bedømmer opgaver på de otte akser separat, er stadig under opbygning — den tilbyder vi bevidst ikke her endnu, men quickscanen giver allerede nu en første retning.

KIPPde assistent van de werkscan

Vraag maar. Ik ken de kennisbank van deze site; wat ik niet weet, zeg ik erbij.

Answers come from this site’s knowledge base. Not tailored advice, and not a scan of your company.