ftetoai En la lista de espera

Kennisbank

Lo que muestra una nueva medición

Una tarea que el año pasado caía en la categoría tres — trabajo humano, sin duda posible — puede este año recaer en la categoría dos: parcialmente asumible, con supervisión humana que aprueba o rechaza con motivo. Eso no es un error en la primera medición. Es la consecuencia de cómo medimos, y de por qué un resultado siempre es una fotografía de un momento determinado.

Qué cambia, y qué no

Su empresa quizá no cambie. Pero los ocho ejes con los que evaluamos una tarea sí lo hacen, independientemente de su organización. Observamos la estructuración de la entrada, el margen de juicio, la sensibilidad del contacto con el cliente, el componente físico, la creatividad, el coste del error, la sensibilidad de cumplimiento normativo y el volumen/repetición. De estos ocho, hay dos que están más sujetos a cambios ajenos a su empresa: la estructuración de la entrada y el margen de juicio.

La estructuración de la entrada mejora cuando los modelos subyacentes se vuelven mejores en procesar texto desordenado y no estructurado — una nota manuscrita, un correo con tres asuntos a la vez, una llamada telefónica con ruido de fondo. Lo que el año pasado era demasiado desestructurado para procesarse de forma fiable, este año puede estar dentro del alcance. Es precisamente por eso que puede la IA asumir la respuesta y transferencia de llamadas telefónicas da una respuesta distinta a la de hace dos años: no porque su telefonía haya cambiado, sino porque el reconocimiento de voz y la clasificación de conversaciones han avanzado un escalón.

El margen de juicio se desplaza más lentamente, pero tampoco ese eje es estático. A medida que los sistemas se vuelven mejores en reconocer casos límite — y en indicar explícitamente cuándo dudan — una parte de lo que antes era trabajo humano por completo se desplaza hacia el terreno en el que la IA propone con motivo y una persona evalúa. Eso es el núcleo de la categoría dos: no una IA que decide, sino una IA que presenta con motivo, y una persona que aprueba o rechaza.

Por qué el margen puede ser amplio

Si dos de los ocho ejes pueden desplazarse, y los otros seis son relativamente estables porque dependen de la naturaleza del trabajo en sí — el coste del error y la sensibilidad de cumplimiento normativo no cambian porque un modelo de lenguaje mejore —, entonces el resultado de una medición siempre es una combinación de algo estable y algo móvil. Eso se traduce en un margen, no en un porcentaje.

Un margen amplio no es una debilidad de la medición. Es una representación honesta de la incertidumbre que realmente existe. En una tarea como puede la IA asumir la clasificación del buzón de correo general, el resultado depende en gran medida de cuánto del correo entrante es realmente no estructurado y cuánto ya sigue un patrón reconocible. Un buzón con sobre todo preguntas estándar puntúa de forma distinta a un buzón donde la mitad de los mensajes describe una situación única. Por tanto, no existe una etiqueta única para la «clasificación de correo» sin ese matiz, y un margen que lo reconoce es más preciso que una cifra aparentemente exacta.

Cuándo un resultado no dice nada

Hay situaciones en las que una puntuación en un momento dado tiene poco valor predictivo para el año siguiente. Esto se aplica sobre todo a tareas que se encuentran cerca del límite entre la categoría dos y tres, y cuyo margen de juicio depende en gran medida de excepciones que ocurren raramente pero que pesan mucho. En la gestión documental, por ejemplo, la pregunta puede la IA asumir el archivo de documentos y su verificación frente a los plazos de conservación toca de cerca la sensibilidad de cumplimiento normativo: una verificación incorrecta de un plazo de conservación puede tener consecuencias jurídicas desproporcionadas respecto a la frecuencia con que ocurre el error. En tareas así, una puntuación puede resultar favorable este año por los avances técnicos, mientras que el eje del coste del error sigue siendo determinante y la tarea permanece de todos modos en la categoría dos o tres.

Una puntuación tampoco dice mucho cuando la descripción subyacente de la tarea es demasiado amplia. «Contacto con el cliente» o «administración» no son tareas sino categorías de tareas, y una nueva medición de ellas le indica sobre todo que debe desglosar la tarea antes de que el resultado tenga algún significado.

Qué significa esto para las mediciones repetidas

Como dos de los ocho ejes son móviles, una nueva medición transcurrido cierto tiempo sí tiene sentido — no como formalidad anual, sino como respuesta a señales concretas: una nueva versión de un modelo subyacente, una tarea que en el ínterin se ha organizado de otra manera, o una duda que el año pasado aún no se podía despejar. Una nueva medición que no haga más que repetir el resultado anterior no habría merecido la pena; una nueva medición que revele un desplazamiento en la estructuración o el margen de juicio, sí.

Este método no trata de lo que un empleador hace con ese resultado. Las decisiones sobre personal y despliegue tienen sus propios requisitos legales, que no se abordan ni se fundamentan aquí.

Qué puede hacer ahora

El análisis rápido gratuito de ftetoai consta de doce preguntas, sin necesidad de cuenta, y ofrece una indicación de qué parte de las horas de su perfil es hoy asumible por la IA. El análisis de trabajo completo, que evalúa las tareas en los ocho ejes por separado, todavía está en construcción — deliberadamente no lo ofrecemos aquí todavía, pero el análisis rápido ya proporciona una primera orientación.

KIPPde assistent van de werkscan

Vraag maar. Ik ken de kennisbank van deze site; wat ik niet weet, zeg ik erbij.

Answers come from this site’s knowledge base. Not tailored advice, and not a scan of your company.