¿Qué es la validez de constructo?
La pregunta más difícil en la medición: si aquello que estás midiendo existe tal como lo has definido, y si tu instrumento lo alcanza a él en lugar de algo adyacente.
La validez de constructo pregunta si un instrumento mide el constructo teórico que dice medir, en lugar de algo correlacionado con él, algo más estrecho que él, o nada coherente en absoluto. Es la forma más profunda de evidencia de validez y la que requiere años, en lugar de un solo estudio, para establecerse.
La dificultad es estructural. Un constructo como la resiliencia o la inteligencia emocional no es un objeto; es una regularidad propuesta en el comportamiento. Para demostrar que una escala lo mide, hay que defender simultáneamente la afirmación de que el constructo existe tal como se describe y que estos ítems particulares lo alcanzan. Ambas afirmaciones no pueden separarse, razón por la cual Cronbach y Meehl, quienes introdujeron la idea en 1955, la plantearon como la evaluación de toda una red teórica y no de un único instrumento.
Cómo se construye el argumento
Patrones de correlación predichos. La teoría indica con qué cosas debería relacionarse el constructo y con qué intensidad. La autocompasión debería correlacionar positivamente con la satisfacción vital, negativamente con la depresión, y solo moderadamente con la autoestima; si correlacionara 0,9 con la autoestima, no sería un constructo distinto. Cada una de esas predicciones es una afirmación comprobable, y fallar en una es informativo.
Diferencias grupales esperadas. Si la teoría sostiene que un rasgo se desarrolla con la edad, o que está elevado en una población clínica, el instrumento debería reflejarlo. No encontrar una diferencia que la teoría exige es evidencia en contra del instrumento, de la teoría, o de ambos.
Respuesta a la intervención. Si se supone que un constructo es entrenable, las puntuaciones deberían cambiar tras el entrenamiento y no hacerlo en un grupo de control. Los constructos que nunca responden a nada son difíciles de distinguir de los artefactos.
Estructura interna. La estructura factorial debería coincidir con la estructura teorizada y, de manera importante, en una muestra nueva. El análisis factorial exploratorio sobre los datos de desarrollo encontrará la estructura que fue diseñada; el análisis confirmatorio sobre datos nuevos es donde la afirmación se pone a prueba realmente.
La idea multirrasgo-multimétodo
La contribución de Campbell y Fiske en 1959 fue insistir en que la validez de constructo requiere dos cosas a la vez: las medidas del mismo rasgo por diferentes métodos deben concordar, y las medidas de rasgos diferentes por el mismo método no deben hacerlo.
Esa segunda parte es donde la mayoría de los instrumentos tienen dificultades. Si tu empatía autoinformada correlaciona 0,7 con tu amabilidad autoinformada y 0,2 con la empatía evaluada por un observador, lo que tu cuestionario mide con mayor fuerza no es la empatía, sino tu forma general de describirse en cuestionarios. La varianza de método es uno de los problemas más persistentes en la investigación de autoinforme, y es la razón por la que el trabajo de validación riguroso busca un criterio externo al cuestionario siempre que exista uno.
Por qué esto importa al leer tus resultados
La validez de constructo es lo que se interpone entre una puntuación y su interpretación. Cuando un instrumento bien validado informa que obtienes una puntuación alta en un rasgo, la cadena de razonamiento detrás de esa afirmación incluye décadas de trabajo publicado que establecen que el rasgo se comporta como una cantidad coherente, que estos ítems lo rastrean y que la puntuación significa algo similar en las distintas personas que lo realizan.
Cuando una prueba sin validación de constructo informa lo mismo, la puntuación es un número generado por un algoritmo que nadie ha verificado. Ambas lucen idénticas en la pantalla de resultados. La diferencia está enteramente en la documentación, razón por la cual vale la pena buscarla.
Ponlo a prueba
Leer sobre medición es una cosa. Ver tu propia puntuación con su fuente, su muestra normativa y sus límites es otra. Gratis, sin registro.
Sigue leyendo
- ¿Qué es la psicometría?La disciplina que determina si una medición psicológica es válida y confiable, y la razón por la que dos pruebas que formulan preguntas similares pueden diferir enormemente en el valor de sus resultados.
- ¿Qué es la fiabilidad en las pruebas psicológicas?La fiabilidad es la consistencia de la medición, no su exactitud. Una prueba puede ser muy fiable y aun así medir algo equivocado, razón por la cual es la primera pregunta que se formula y nunca la última.
- ¿Qué es la validez en las pruebas psicológicas?La validez no es una propiedad que posea un test. Es un argumento sobre si una interpretación particular de una puntuación particular, para un propósito particular, es defendible — y debe reconstruirse para cada nuevo uso.
- Validez convergente y discriminanteDos requisitos que son imagen especular el uno del otro: una medida debe coincidir con aquello con lo que debería coincidir, y debe mantenerse distinta de aquello de lo que afirma diferenciarse. La mayoría de los instrumentos débiles fallan en el segundo.
- Qué es el alfa de Cronbach y qué no esEl estadístico más reportado en la evaluación psicológica y el más malinterpretado. El alfa no indica que una escala sea unidimensional, y un valor alto suele ser un síntoma más que una virtud.
- Error estándar de medición: cuánto puede desviarse tu puntuaciónToda puntuación lleva un margen de error, y en la mayoría de los tests psicológicos es más amplio de lo que la gente supone. Este es el número que te indica cuándo una diferencia es real y cuándo es ruido.
- Normas y percentiles: con qué se compara tu puntuaciónUna puntuación bruta es ininterpretable por sí sola. Solo adquiere significado frente a un grupo de referencia, y qué grupo se utilizó es uno de los hechos más determinantes y menos divulgados de cualquier test.
- Cómo se construye realmente una prueba psicométricaDesde la definición del constructo hasta las normas publicadas, el proceso lleva años y descarta la mayor parte de lo que se invierte en él. Conocer las etapas hace evidente cuáles omitió un cuestionario rápido en línea.
- ¿Qué significa que un test sea llamado validado?La palabra no está regulada y es utilizada libremente por productos que no han hecho ninguno de los trabajos requeridos. Esto es lo que significa cuando realmente significa algo, y las cuatro preguntas que separan ambos casos.
- Por qué la mayoría de los tests de personalidad en internet no son fiablesNo porque sean deshonestos, sino porque los pasos que hacen que una medición sea confiable son invisibles, costosos y fáciles de omitir, y omitirlos no cambia en nada el aspecto del resultado.
- Lo que la autoinforme puede y no puede medirLos cuestionarios te piden que seas el observador de ti mismo, lo cual funciona mejor para algunas cosas que para otras. Saber dónde el método es sólido y dónde falla cambia la forma en que interpretas cualquier resultado.
- Qué significa cuando una prueba predice algoUna correlación de 0,30 es un hallazgo sólido en la investigación de la personalidad y una base débil para tomar una decisión sobre una persona concreta. Ambas afirmaciones son verdaderas, y la brecha entre ellas explica la mayoría de los usos incorrectos de los resultados de las pruebas.
- El cribado no es diagnósticoUn cuestionario de cribado está diseñado para detectar el mayor número posible de casos, aceptando una alta tasa de falsos positivos como precio. Interpretar una puntuación de cribado como un diagnóstico invierte aquello para lo que fue concebido.