Feedback: el que empeora las cosas
El metaanálisis de Kluger y DeNisi: qué separa el feedback que mejora del que hunde, y por qué la diferencia está en dónde pone la atención.
Nadia dice «esto no está a tu nivel» y la semana siguiente es peor
Javi lleva cuatro años alicatando. En la reforma de la calle Sagunto dejó una junta que hubo que rehacer. Nadia se lo dijo el jueves, en corto y sin levantar la voz: «Javi, esto no está a tu nivel». No hubo bronca. La semana siguiente Javi trabajó peor.
Ese mismo jueves le dijo a Rocío que las medidas del hueco de la cocina se toman después del enfoscado, no antes. Rocío no se lo tomó a mal. Lo apuntó, y desde entonces las toma después.
Las dos frases son feedback. Una hundió y la otra no, y el tono era el mismo. Se diferencian en dónde ponen la atención de quien escucha. Este módulo va de eso, y trae el número más incómodo del máster.
📋 Guía docente del módulo
Objetivos
- Conocer el resultado central de Kluger y DeNisi y saber qué mide exactamente.
- Distinguir los tres niveles de atención de la teoría de la intervención de feedback.
- Ordenar el feedback por contenido de información y asociar cada clase con su tamaño de efecto.
- Traducir un tamaño de efecto medio y una proporción de fracasos a la desviación típica que los une.
- Reescribir una frase de feedback moviendo la atención del yo a la tarea, sin ablandar el contenido.
Resultados de aprendizaje
- RA1. Explicar por qué «el feedback mejora el rendimiento» y «un tercio del feedback lo empeora» son la misma frase.
- RA2. Clasificar una frase real de feedback en refuerzo, correctivo o de alta información, y justificar la clase.
- RA3. Calcular, dada una media y una proporción de efectos negativos, la desviación típica implícita.
- RA4. Estimar cuántas conversaciones al año empeoran las cosas en una plantilla de tamaño conocido.
- RA5. Auditar una práctica de feedback de manual localizando qué evidencia la sostiene, si es que hay alguna.
Bibliografía de referencia
- Kluger, A. N. y DeNisi, A.: "The effects of feedback interventions on performance: A historical review, a meta-analysis, and a preliminary feedback intervention theory", Psychological Bulletin, 119(2), 1996, pp. 254-284. La fuente de las dos cifras que sostienen el módulo.
- Kluger, A. N. y DeNisi, A.: "Feedback interventions: Toward the understanding of a double-edged sword", Current Directions in Psychological Science, 1998. La versión corta y legible del anterior.
- Wisniewski, B., Zierer, K. y Hattie, J.: "The power of feedback revisited: A meta-analysis of educational feedback research", Frontiers in Psychology, 10:3087, 2020. De aquí salen los tamaños de efecto por contenido de información.
- Hattie, J. y Timperley, H.: "The power of feedback", Review of Educational Research, 77(1), 2007. Los cuatro niveles: tarea, proceso, autorregulación y persona.
- Locke, E. A. y Latham, G. P.: "Building a practically useful theory of goal setting and task motivation", American Psychologist, 2002. Por qué el feedback sin meta rinde menos que el feedback con meta.
Carga de trabajo estimada
| Lectura del módulo | 40 min |
| Simulador | 10 min |
| Ejercicios resueltos | 30 min |
| Quiz | 10 min |
| Total | 90 min |
La cifra: 607 mediciones y más de un tercio salió al revés
En 1996 Kluger y DeNisi reunieron todo lo publicado sobre dar feedback y medir qué pasa después. Salieron 607 tamaños de efecto sobre 23.663 observaciones. El resultado medio fue positivo: d = 0,41, un efecto entre pequeño y mediano. Ese es el titular que todo el mundo cita.
El segundo resultado casi no se cita, y es este: más de un tercio de las intervenciones empeoró el rendimiento. Alrededor del 38%. No es que no funcionaran. Es que la gente que recibió feedback rindió después peor que la que no recibió ninguno.
Las dos frases son verdad a la vez y no se contradicen. Una media de 0,41 con una tercera parte de casos negativos describe una distribución muy ancha, no un efecto fiable. Es la diferencia entre una herramienta y una moneda cargada: la moneda cargada sale bien más veces, y sigue saliendo mal muchas.
Para Nadia esto tiene una lectura directa. Hace 132 conversaciones al año, once al mes. Si su feedback se comporta como la media de esos 607 estudios, unas 50 al año dejan a la persona peor que si no hubiera dicho nada. Y ella no sabe cuáles.
Qué separa el que mejora del que hunde
Kluger y DeNisi no se quedaron en la cifra. Propusieron una explicación, la teoría de la intervención de feedback, y su idea central es sencilla: el feedback funciona moviendo la atención, y hay tres sitios donde puede caer.
| Dónde cae la atención | Ejemplo en la obra de Nadia | Qué suele pasar |
|---|---|---|
| Los detalles de la tarea | «Las medidas se toman después del enfoscado» | Mejora, sobre todo si la tarea es nueva |
| La tarea en conjunto | «Esta cocina hay que entregarla el día 12» | Mejora si hay meta y se ve el avance |
| La persona | «Esto no está a tu nivel» | Empeora: los recursos se van a defenderse |
La tercera fila es el mecanismo. Cuando el mensaje se lee como información sobre quién eres, la cabeza deja de trabajar en la junta mal hecha y se pone a trabajar en algo mucho más urgente, que es sostener la idea que tienes de ti. Eso consume el mismo recurso. Por eso el rendimiento baja.
Y aquí está el detalle que descoloca a casi todo el mundo: el elogio también apunta a la persona. «Eres un crack» y «esto no está a tu nivel» caen en la misma fila de la tabla. Kluger y DeNisi encontraron que el feedback con elogio o con amenaza a la autoestima empujaba los efectos hacia abajo en los dos casos.
El modelo formal: cuánta información lleva el mensaje
Veinticuatro años después, Wisniewski, Zierer y Hattie repitieron el ejercicio en educación: 435 estudios, más de 61.000 alumnos, media d = 0,48. Y encontraron un moderador que ordena casi todo lo demás, el contenido de información del mensaje.
| Clase de feedback | Qué dice | d | % que empeora |
|---|---|---|---|
| Refuerzo o castigo | «Bien» / «mal» y poco más | 0,24 | 42,9% |
| Correctivo | Qué está mal y cuál era la respuesta buena | 0,46 | 36,6% |
| De alta información | Qué, por qué, cómo se hace y cómo comprobarlo solo | 0,99 | 23,0% |
La columna de la izquierda y la del medio son lo mismo dicho de dos maneras. Cuanta más información lleva el mensaje, mejor va, y la diferencia entre la clase de arriba y la de abajo es de cuatro veces. No es una diferencia de estilo. Es que un mensaje contiene datos y el otro no.
La cuarta columna la calculamos nosotros y conviene decir cómo, porque no está publicada así. Con una media de 0,41 y un 38% de efectos negativos, la desviación típica que une esas dos cifras es 1,34. Aplicando esa misma anchura a cada clase salen los porcentajes de la tabla. Supone que las tres clases tienen la misma dispersión, cosa que nadie ha medido. El orden es sólido; los decimales, no.
La lectura práctica cabe en una línea. Incluso el mejor feedback documentado empeora las cosas una de cada cuatro veces. No existe la versión que siempre funciona, y cualquiera que te la venda no ha leído la literatura.
Simulador: cuántas conversaciones salen al revés
Arranca clavado en la media publicada de Kluger y DeNisi: d = 0,41 y un 38% que empeora las cosas, que son 50 de las 132 conversaciones de Nadia. Desde ahí hay dos cosas que probar. Sube el segundo mando a la mitad, que es donde está casi todo el mundo, y mira dónde queda el saldo. Después bájalo a cero y lleva el primero a la derecha del todo.
Modelo juguete, con avisos. La campana es una normal de desviación típica 1,34, deducida de las dos cifras publicadas de Kluger y DeNisi como se explica arriba. Los tres puntos del primer mando —0,24, 0,46 y 0,99— sí están medidos, y entre ellos se interpola en línea recta, que es un invento cómodo. Lo que resta el segundo mando me lo he inventado entero: la dirección la sostiene la teoría de la intervención de feedback, el tamaño no lo sostiene nadie. Sirve para ver la forma del problema, no para prometerle a nadie un número.
Lo que se enseña en los cursos y no aguanta
Tres prácticas que salen en casi todos los manuales de mando intermedio, y qué hay debajo de cada una.
- El bocadillo —elogio, crítica, elogio— no tiene detrás ningún metaanálisis que lo respalde. Y las dos rebanadas apuntan a la persona, que es justo la fila mala de la tabla. Lo que hace de verdad es dejar al otro sin saber cuál era el mensaje.
- La proporción mágica de cinco elogios por cada crítica circula desde 2005. La cifra famosa, 2,9013, venía de un modelo matemático que se retractó en 2013 por estar mal aplicado. Que el clima positivo ayude puede ser verdad; el número era humo.
- «Céntrate en la conducta, no en la persona» es la única de las tres que sí encaja con la evidencia, y suele enseñarse como cortesía. No lo es. Es la diferencia entre 0,99 y 0,24.
El módulo 11 se ocupa del catálogo entero. Aquí basta con la regla: si un consejo de feedback no dice dónde pone la atención, no está diciendo nada.
✍️ Ejercicios resueltos
Ejercicio 1 — De dos cifras publicadas a la tercera
Enunciado. Kluger y DeNisi publican una media de d = 0,41 y que alrededor del 38% de las intervenciones empeoró el rendimiento. La desviación típica no la vas a encontrar citada por ahí. Dedúcela, y úsala para estimar el año de Nadia.
Paso 1 — Qué se sabe y qué falta
Se sabe la media de una distribución y qué proporción cae por debajo de cero. Si suponemos que la distribución es normal, esas dos cosas fijan la tercera. Con dos datos de una normal se despeja el que falta.
Paso 2 — El despeje
Un 38% por debajo de cero significa que el cero está a 0,3055 desviaciones típicas por debajo de la media, porque ese es el valor de la normal estándar que deja el 38% a la izquierda. Entonces 0,41 = 0,3055 × σ, y de ahí σ = 1,34.
Paso 3 — Comprobación
Al revés tiene que cuadrar. El cero está a 0,41 ÷ 1,34 = 0,306 desviaciones de la media. La normal deja a la izquierda de −0,306 un 38,0%. Cuadra.
Paso 4 — Qué significa un 1,34
Que la dispersión es más de tres veces la media. Traducido: el efecto típico de una conversación de feedback está en cualquier sitio entre −0,9 y +1,7. Comparado con eso, la media de 0,41 es una anécdota estadística.
Paso 5 — El año de Nadia
Once personas, una conversación al mes, 132 al año. Al 38%, unas 50 conversaciones dejan a alguien peor que el silencio. Si mueve el mensaje de correctivo a alta información, el porcentaje baja al 23% y son 30. La diferencia son veinte conversaciones al año que dejan de hacer daño, y no cuestan un euro.
La lección de gestión: antes de mejorar el tono, cuenta cuánta información lleva la frase. El tono no aparece en ninguna de las dos tablas de este módulo; la información aparece en las dos.
Ejercicio 2 — Reescribir la frase que hundió a Javi
Enunciado. «Javi, esto no está a tu nivel». Clasifícala, di por qué falla y reescríbela sin quitarle una gota de exigencia. Después estima qué vale el cambio en la obra de Nadia.
Paso 1 — Clasificar
Contenido de información: casi ninguno. No dice qué junta, ni qué le pasa, ni cómo se hace bien, ni cómo comprobarlo. Es refuerzo negativo puro, la clase de d = 0,24. Y la atención cae entera en la persona, porque «tu nivel» es literalmente un dato sobre Javi.
Paso 2 — Por qué falla, con mecanismo
Javi sale de ahí con una sola tarea: decidir si es verdad que ya no da el nivel. Esa tarea le va a ocupar la cabeza toda la semana. La junta no aparece por ningún lado, así que no hay nada que corregir aunque quiera.
Paso 3 — La reescritura
«Javi, la junta del baño de Sagunto tiene 4 milímetros donde el plano pide 2. Se nota desde la puerta y el cliente la marcó. Cuando la fila queda por encima de 3, mejor rehacerla en fresco antes de que fragüe: te cuesta veinte minutos y luego son dos horas. ¿La miramos mañana juntos?»
Paso 4 — Clasificar la nueva
Dice qué (los 4 milímetros), por qué importa (se ve y el cliente lo marcó), cómo se hace (en fresco), cómo lo comprueba él solo (la regla de los 3 milímetros) y qué pasa después. Es alta información, la clase de d = 0,99. Y no hay una sola palabra sobre Javi.
Paso 5 — Que no se confunda con ablandar
La segunda versión es más exigente, no menos. La primera se podía discutir, porque «tu nivel» es opinable. La segunda trae un número y una regla, y contra eso no hay discusión posible. Quitar la persona del mensaje sube el listón, no lo baja.
Paso 6 — Lo que vale
De las 72 conversaciones difíciles al año, pasar del 36,6% al 23,0% son diez que dejan de hundir a alguien. Con una rotación del 22% y dos bajas al año, y con tres reclamaciones a 2.400 €, no hace falta que el cambio evite mucho para pagarse. Evitar una sola reclamación son 2.400 € por reescribir frases.
La lección de gestión: la frase corta se siente eficiente y es la más cara. Los treinta segundos que ahorras diciendo «esto no está a tu nivel» los pagas en una semana de rendimiento de otra persona.
Quiz — Feedback
12 preguntas — se supera con 70% o más.