Qué significa cuando una prueba predice algo
Una correlación de 0,30 es un hallazgo sólido en la investigación de la personalidad y una base débil para tomar una decisión sobre una persona concreta. Ambas afirmaciones son verdaderas, y la brecha entre ellas explica la mayoría de los usos incorrectos de los resultados de las pruebas.
La investigación sobre personalidad señala que la responsabilidad predice el desempeño laboral. Al leer esa frase, la mayoría de las personas imagina algo mucho más contundente de lo que los datos muestran. La brecha entre la afirmación estadística y el significado cotidiano de "predice" es donde comienza la mayoría de los usos incorrectos de las pruebas psicológicas.
Los números implicados
Los tamaños del efecto en la investigación sobre personalidad suelen expresarse como correlaciones. Los valores metaanalíticos de relaciones bien establecidas tienden a situarse entre 0,20 y 0,35. La relación entre responsabilidad y desempeño laboral ronda entre 0,20 y 0,25. La satisfacción laboral y el desempeño laboral se sitúan en torno a 0,30. La capacidad mental general, el predictor individual más potente en el campo, alcanza aproximadamente 0,50 para trabajos complejos.
Elevando una correlación al cuadrado se obtiene la proporción de varianza explicada. Una correlación de 0,25 explica alrededor del seis por ciento de las diferencias entre personas. El noventa y cuatro por ciento restante es otra cosa: capacidad, oportunidad, formación, gestión, salud, suerte.
Por qué 0,25 es, no obstante, un hallazgo real
A escala poblacional, las correlaciones pequeñas producen efectos agregados considerables. Si se selecciona a mil personas, un predictor de 0,25 mejora el resultado promedio de forma mensurable y reiterada. Las aseguradoras y los epidemiólogos construyen prácticas enteras sobre efectos de este tamaño.
El problema es que el beneficio agregado y la predicción individual son magnitudes distintas. Una correlación de 0,25 significa que entre las personas con puntuaciones altas, más tendrán un buen desempeño que entre las personas con puntuaciones bajas — y también que muchos de quienes puntúan alto tendrán un desempeño deficiente y muchos de quienes puntúan bajo destacarán. Ambas afirmaciones se derivan del mismo número.
El caso individual
Este es el paso que se omite. Una correlación describe la relación entre dos distribuciones. No autoriza a hacer una afirmación sobre ninguna persona en particular.
Si la responsabilidad correlaciona 0,25 con el desempeño, conocer la puntuación de responsabilidad de alguien solo reduce ligeramente el rango plausible de su desempeño. El intervalo de predicción para un individuo concreto sigue siendo lo suficientemente amplio como para incluir casi todo el rango de resultados posibles. Saber que estás en el percentil 80 en responsabilidad te dice muy poco sobre cómo te irá en un trabajo específico.
Por eso, usar las puntuaciones de personalidad como filtro de selección principal está poco respaldado incluso cuando la investigación subyacente es sólida. La investigación avala la afirmación de que el rasgo importa. No avala la afirmación de que una puntuación revele lo que hará un candidato.
Dos precauciones adicionales
Predecir y causar son cosas distintas. Casi toda esta literatura es correlacional. Que la responsabilidad prediga resultados de salud es compatible con que la responsabilidad cause mejores conductas de salud, con que un tercer factor cause ambas cosas, y con la causalidad inversa. Los diseños longitudinales acotan las posibilidades; rara vez las eliminan.
Los criterios de autoinforme inflan los números. Cuando tanto el predictor como el resultado son autoinformados por la misma persona en la misma tarde, la varianza de método común eleva la correlación. Los estudios que utilizan resultados objetivos o valoraciones de informantes externos suelen reportar efectos menores, y esos son los que conviene ponderar con mayor peso.
Para qué sirve realmente una puntuación
Leída como descripción y no como profecía, una puntuación en una prueba es genuinamente útil. Te indica dónde te sitúas en relación con una población de referencia en un rasgo que tiene consecuencias documentadas, y te proporciona un vocabulario para un patrón que quizás hayas notado sin poder nombrarlo.
Eso tiene valor. Pero es algo distinto de un pronóstico, y esa distinción es la que un informe honesto debería explicarte en lugar de dejarte inferir.
Ponlo a prueba
Leer sobre medición es una cosa. Ver tu propia puntuación con su fuente, su muestra normativa y sus límites es otra. Gratis, sin registro.
Sigue leyendo
- ¿Qué es la psicometría?La disciplina que determina si una medición psicológica es válida y confiable, y la razón por la que dos pruebas que formulan preguntas similares pueden diferir enormemente en el valor de sus resultados.
- ¿Qué es la fiabilidad en las pruebas psicológicas?La fiabilidad es la consistencia de la medición, no su exactitud. Una prueba puede ser muy fiable y aun así medir algo equivocado, razón por la cual es la primera pregunta que se formula y nunca la última.
- ¿Qué es la validez en las pruebas psicológicas?La validez no es una propiedad que posea un test. Es un argumento sobre si una interpretación particular de una puntuación particular, para un propósito particular, es defendible — y debe reconstruirse para cada nuevo uso.
- ¿Qué es la validez de constructo?La pregunta más difícil en la medición: si aquello que estás midiendo existe tal como lo has definido, y si tu instrumento lo alcanza a él en lugar de algo adyacente.
- Validez convergente y discriminanteDos requisitos que son imagen especular el uno del otro: una medida debe coincidir con aquello con lo que debería coincidir, y debe mantenerse distinta de aquello de lo que afirma diferenciarse. La mayoría de los instrumentos débiles fallan en el segundo.
- Qué es el alfa de Cronbach y qué no esEl estadístico más reportado en la evaluación psicológica y el más malinterpretado. El alfa no indica que una escala sea unidimensional, y un valor alto suele ser un síntoma más que una virtud.
- Error estándar de medición: cuánto puede desviarse tu puntuaciónToda puntuación lleva un margen de error, y en la mayoría de los tests psicológicos es más amplio de lo que la gente supone. Este es el número que te indica cuándo una diferencia es real y cuándo es ruido.
- Normas y percentiles: con qué se compara tu puntuaciónUna puntuación bruta es ininterpretable por sí sola. Solo adquiere significado frente a un grupo de referencia, y qué grupo se utilizó es uno de los hechos más determinantes y menos divulgados de cualquier test.
- Cómo se construye realmente una prueba psicométricaDesde la definición del constructo hasta las normas publicadas, el proceso lleva años y descarta la mayor parte de lo que se invierte en él. Conocer las etapas hace evidente cuáles omitió un cuestionario rápido en línea.
- ¿Qué significa que un test sea llamado validado?La palabra no está regulada y es utilizada libremente por productos que no han hecho ninguno de los trabajos requeridos. Esto es lo que significa cuando realmente significa algo, y las cuatro preguntas que separan ambos casos.
- Por qué la mayoría de los tests de personalidad en internet no son fiablesNo porque sean deshonestos, sino porque los pasos que hacen que una medición sea confiable son invisibles, costosos y fáciles de omitir, y omitirlos no cambia en nada el aspecto del resultado.
- Lo que la autoinforme puede y no puede medirLos cuestionarios te piden que seas el observador de ti mismo, lo cual funciona mejor para algunas cosas que para otras. Saber dónde el método es sólido y dónde falla cambia la forma en que interpretas cualquier resultado.
- El cribado no es diagnósticoUn cuestionario de cribado está diseñado para detectar el mayor número posible de casos, aceptando una alta tasa de falsos positivos como precio. Interpretar una puntuación de cribado como un diagnóstico invierte aquello para lo que fue concebido.