Normas y percentiles: con qué se compara tu puntuación
Una puntuación bruta es ininterpretable por sí sola. Solo adquiere significado frente a un grupo de referencia, y qué grupo se utilizó es uno de los hechos más determinantes y menos divulgados de cualquier test.
Obtienes 34 puntos en una escala de responsabilidad. ¿Es una puntuación alta?
La pregunta no tiene respuesta sin una comparación. ¿Treinta y cuatro sobre qué máximo, en relación con quién, medido cuándo? Las normas son los datos de referencia que convierten una puntuación bruta en una posición interpretable, y elegirlas es una de las decisiones más determinantes en la construcción de un test.
Cómo funciona la conversión
Una muestra normativa es un grupo de personas que realizaron el instrumento en condiciones estándar, cuya distribución de puntuaciones se convierte en el punto de referencia. Las puntuaciones brutas se expresan entonces como una posición dentro de esa distribución.
Los rangos percentiles indican la proporción de la muestra normativa que puntúa igual o por debajo de ti. El percentil 70 significa que el 70 por ciento de ese grupo de referencia obtuvo una puntuación más baja. Los percentiles son intuitivos y tienen un defecto poco apreciado: exageran las diferencias en la zona central de la distribución y las comprimen en los extremos. Unos pocos puntos brutos alrededor de la media pueden desplazarte muchos lugares en el percentil; los mismos pocos puntos cerca de la cima apenas te mueven.
Las puntuaciones estándar —puntuaciones z, puntuaciones T, estaninos, escalas de estilo CI— expresan la distancia respecto a la media en unidades de desviación típica. Conservan el espaciado real entre puntuaciones, razón por la cual se prefieren para cualquier operación aritmética sobre los resultados.
Por qué el grupo de referencia lo es todo
La misma puntuación bruta puede situarse en percentiles muy diferentes según la muestra normativa. La responsabilidad puntuada frente a una población adulta general y frente a una muestra de contables en ejercicio no producirá el mismo percentil, y ninguno de los dos números es incorrecto: responden a preguntas distintas.
Esto hace que valga la pena conocer varias características de una muestra normativa.
Quién la componía. Las muestras de conveniencia formadas por estudiantes de psicología siguen siendo habituales y representan una franja estrecha de la humanidad: jóvenes, con estudios y desproporcionadamente procedentes de países occidentales ricos. Una norma construida sobre ellas se generaliza mal.
Qué tamaño tenía. Las estimaciones percentiles estables en los extremos requieren muestras grandes. Unos pocos cientos de personas ofrecen una imagen poco fiable de cómo es el percentil 95.
Cuándo se recogió. Las normas varían con el tiempo. Las medias poblacionales en una amplia gama de medidas psicológicas han cambiado de forma mensurable a lo largo de décadas, y una muestra normativa de 1995 ya no describe a la población que realiza el test en 2026.
Si está estratificada. Muchos rasgos varían de forma sistemática según la edad y el sexo. La búsqueda de sensaciones disminuye marcadamente con la edad; el cronotipo cambia a lo largo de la vida. Comparar a una persona de 55 años con una norma de todas las edades produce una posición engañosa en ambos casos.
Qué buscar, y qué significa su ausencia
Un instrumento bien documentado indica el tamaño, la composición, el país y el año de su muestra normativa, y especifica si las normas están estratificadas. Los manuales de test serios dedican capítulos enteros a esto.
La mayoría de los tests gratuitos en línea no reportan nada de esto. Te dan un percentil sin indicar a qué población hace referencia. Ese percentil se obtiene de una muestra de conveniencia no declarada, se toma prestado de una norma publicada recogida en una población diferente, o se genera a partir de las personas que han realizado previamente el test en ese sitio web: un grupo autoseleccionado cuya composición es desconocida incluso para el operador del sitio.
El percentil sigue apareciendo en pantalla y tiene el mismo aspecto que uno real. Es la documentación que lo acompaña, y solo esa, lo que distingue a los dos.
Ponlo a prueba
Leer sobre medición es una cosa. Ver tu propia puntuación con su fuente, su muestra normativa y sus límites es otra. Gratis, sin registro.
Sigue leyendo
- ¿Qué es la psicometría?La disciplina que determina si una medición psicológica es válida y confiable, y la razón por la que dos pruebas que formulan preguntas similares pueden diferir enormemente en el valor de sus resultados.
- ¿Qué es la fiabilidad en las pruebas psicológicas?La fiabilidad es la consistencia de la medición, no su exactitud. Una prueba puede ser muy fiable y aun así medir algo equivocado, razón por la cual es la primera pregunta que se formula y nunca la última.
- ¿Qué es la validez en las pruebas psicológicas?La validez no es una propiedad que posea un test. Es un argumento sobre si una interpretación particular de una puntuación particular, para un propósito particular, es defendible — y debe reconstruirse para cada nuevo uso.
- ¿Qué es la validez de constructo?La pregunta más difícil en la medición: si aquello que estás midiendo existe tal como lo has definido, y si tu instrumento lo alcanza a él en lugar de algo adyacente.
- Validez convergente y discriminanteDos requisitos que son imagen especular el uno del otro: una medida debe coincidir con aquello con lo que debería coincidir, y debe mantenerse distinta de aquello de lo que afirma diferenciarse. La mayoría de los instrumentos débiles fallan en el segundo.
- Qué es el alfa de Cronbach y qué no esEl estadístico más reportado en la evaluación psicológica y el más malinterpretado. El alfa no indica que una escala sea unidimensional, y un valor alto suele ser un síntoma más que una virtud.
- Error estándar de medición: cuánto puede desviarse tu puntuaciónToda puntuación lleva un margen de error, y en la mayoría de los tests psicológicos es más amplio de lo que la gente supone. Este es el número que te indica cuándo una diferencia es real y cuándo es ruido.
- Cómo se construye realmente una prueba psicométricaDesde la definición del constructo hasta las normas publicadas, el proceso lleva años y descarta la mayor parte de lo que se invierte en él. Conocer las etapas hace evidente cuáles omitió un cuestionario rápido en línea.
- ¿Qué significa que un test sea llamado validado?La palabra no está regulada y es utilizada libremente por productos que no han hecho ninguno de los trabajos requeridos. Esto es lo que significa cuando realmente significa algo, y las cuatro preguntas que separan ambos casos.
- Por qué la mayoría de los tests de personalidad en internet no son fiablesNo porque sean deshonestos, sino porque los pasos que hacen que una medición sea confiable son invisibles, costosos y fáciles de omitir, y omitirlos no cambia en nada el aspecto del resultado.
- Lo que la autoinforme puede y no puede medirLos cuestionarios te piden que seas el observador de ti mismo, lo cual funciona mejor para algunas cosas que para otras. Saber dónde el método es sólido y dónde falla cambia la forma en que interpretas cualquier resultado.
- Qué significa cuando una prueba predice algoUna correlación de 0,30 es un hallazgo sólido en la investigación de la personalidad y una base débil para tomar una decisión sobre una persona concreta. Ambas afirmaciones son verdaderas, y la brecha entre ellas explica la mayoría de los usos incorrectos de los resultados de las pruebas.
- El cribado no es diagnósticoUn cuestionario de cribado está diseñado para detectar el mayor número posible de casos, aceptando una alta tasa de falsos positivos como precio. Interpretar una puntuación de cribado como un diagnóstico invierte aquello para lo que fue concebido.