O sarcină care anul trecut se încadra în categoria trei — muncă umană, fără îndoială posibilă — poate ajunge anul acesta în categoria doi: parțial de preluat, cu supraveghere umană care aprobă sau respinge cu motiv. Aceasta nu este o eroare în prima măsurare. Este consecința modului în care măsurăm, și motivul pentru care un rezultat este întotdeauna o fotografie a unui moment dat.
Firma dumneavoastră poate să nu se schimbe. Dar cele opt axe pe baza cărora evaluăm o sarcină se schimbă, independent de organizația dumneavoastră. Ne uităm la gradul de structurare a datelor de intrare, spațiul de judecată, sensibilitatea la contactul cu clienții, componenta fizică, creativitatea, costul erorilor, sensibilitatea la conformitate și volum/repetiție. Dintre aceste opt, două sunt cele mai supuse schimbării din exteriorul firmei dumneavoastră: gradul de structurare a datelor de intrare și spațiul de judecată.
Gradul de structurare a datelor de intrare se îmbunătățește atunci când modelele care stau la bază devin mai bune în procesarea textului dezordonat, nestructurat — o notă scrisă de mână, un e-mail cu trei subiecte deodată, o convorbire telefonică cu zgomot de fond. Ceea ce anul trecut era prea nestructurat pentru a fi procesat cu fiabilitate poate fi anul acesta la îndemână. Exact de aceea poate AI să preia răspunsul la telefon și transferul apelurilor oferă un răspuns diferit față de acum doi ani: nu pentru că telefonia dumneavoastră s-a schimbat, ci pentru că recunoașterea vorbirii și clasificarea conversațiilor au avansat cu un pas.
Spațiul de judecată se schimbă mai lent, dar nici această axă nu este statică. Pe măsură ce sistemele devin mai bune în recunoașterea cazurilor limită — și în a indica explicit când au îndoieli — o parte din ceea ce anterior era muncă umană integrală se deplasează spre zona în care AI propune o soluție și un om o evaluează. Aceasta este esența categoriei doi: nu AI care decide, ci AI care propune cu motivare, și un om care aprobă sau respinge.
Dacă două dintre cele opt axe se pot schimba, iar celelalte șase sunt relativ stabile pentru că depind de natura muncii în sine — costul erorilor și sensibilitatea la conformitate nu se schimbă pentru că un model lingvistic devine mai bun — atunci rezultatul unei măsurări este întotdeauna o combinație între ceva stabil și ceva mobil. Aceasta se traduce într-un interval, nu într-un procent.
Un interval larg nu este o slăbiciune a măsurării. Este o reprezentare onestă a incertitudinii care există în realitate. La o sarcină precum poate AI să preia triajul cutiei poștale generale de e-mail, rezultatul depinde puternic de cât de mult din e-mailurile primite este cu adevărat nestructurat și cât urmează deja un pattern recognoscibil. O cutie poștală cu în principal întrebări standard obține un scor diferit față de o cutie poștală în care jumătate din mesaje descriu o situație unică. O singură etichetă pentru „triajul e-mailurilor” nu există deci fără această nuanță, și un interval care ține cont de acest lucru este mai precis decât o cifră aparent exactă.
Există situații în care un scor la un moment dat are o valoare predictivă redusă pentru anul următor. Acest lucru este valabil mai ales pentru sarcinile aflate în apropierea limitei dintre categoria doi și trei, și a căror sferă de judecată depinde puternic de excepții rare, dar cu impact mare. La gestionarea documentelor, de exemplu, întrebarea poate AI să preia arhivarea documentelor și verificarea termenelor de păstrare este strâns legată de sensibilitatea la conformitate: o verificare greșită a unui termen de păstrare poate avea consecințe juridice disproporționate față de frecvența cu care apare eroarea. La astfel de sarcini, un scor poate fi favorabil anul acesta pe baza progresului tehnic, în timp ce axa costului erorilor rămâne decisivă, iar sarcina rămâne totuși în categoria doi sau trei.
Un scor spune, de asemenea, puțin atunci când descrierea sarcinii de bază este prea largă. „Contactul cu clienții” sau „administrația” nu sunt sarcini, ci categorii de sarcini, iar o remăsurare a acestora vă spune mai ales că trebuie să divizați sarcina în continuare înainte ca rezultatul să aibă vreo semnificație.
Deoarece două dintre cele opt axe sunt mobile, o remăsurare după o perioadă de timp are într-adevăr sens — nu ca formalitate anuală, ci ca reacție la semnale concrete: o versiune nouă a unui model de bază, o sarcină care a fost reorganizată între timp, sau o îndoială care anul trecut nu putea fi încă înlăturată. O remăsurare care nu face altceva decât să repete rezultatul anterior nu ar merita efortul; o remăsurare care dezvăluie o schimbare în gradul de structurare sau în spațiul de judecată, da.
Această metodă nu se referă la ce face un angajator cu acest rezultat. Deciziile privind personalul și angajarea au propriile cerințe legale, care nu sunt tratate sau fundamentate aici.
Scanarea rapidă gratuită de la ftetoai constă din douăsprezece întrebări, fără cont, și oferă o indicație a ce parte din orele din profilul dumneavoastră poate fi preluată astăzi de AI. Scanarea completă a muncii, care evaluează sarcinile separat pe cele opt axe, este încă în construcție — pe aceasta nu o oferim aici în mod deliberat, dar scanarea rapidă oferă deja o primă orientare.
Vraag maar. Ik ken de kennisbank van deze site; wat ik niet weet, zeg ik erbij.
Answers come from this site’s knowledge base. Not tailored advice, and not a scan of your company.