¿Qué significa que un test sea llamado validado?
La palabra no está regulada y es utilizada libremente por productos que no han hecho ninguno de los trabajos requeridos. Esto es lo que significa cuando realmente significa algo, y las cuatro preguntas que separan ambos casos.
"Científicamente validado" no es un término protegido. Nadie lo certifica, ningún organismo lo audita, y aparece en productos cuya única base de evidencia es que mucha gente los ha utilizado. Vale la pena saber qué significa cuando se usa correctamente.
La versión breve
Un instrumento validado tiene un historial publicado que muestra qué mide, con qué precisión, en qué poblaciones y para qué usos legítimos pueden emplearse sus puntuaciones. La validación no es un certificado. Es un conjunto de evidencias, generalmente acumuladas durante años, que suele incluir hallazgos que limitan el uso del instrumento en lugar de elogiarlo.
La presencia de limitaciones documentadas es una de las mejores señales. La literatura de validación genuina está llena de ellas: esta escala funciona mal en adolescentes, tal faceta no se replica, el punto de corte depende de la población. Un producto que solo reporta fortalezas no ha publicado su validación; ha publicado su marketing.
Cuatro preguntas que hacen el trabajo
¿Cuál es la publicación de origen? Un instrumento validado tiene un artículo original en una revista revisada por pares, con autores, año y generalmente un DOI. Ese artículo describe cómo se desarrollaron los ítems y cuáles fueron las propiedades psicométricas iniciales. Si nadie puede nombrar el artículo, no hay validación de la que hablar.
¿Fue confirmada la estructura por alguien más? El equipo de desarrollo recuperará la estructura que diseñó. Lo que importa es si un grupo independiente, con datos independientes, encontró lo mismo. Esta es la pregunta más informativa que se puede hacer, y la que más frecuentemente queda sin respuesta.
¿En qué población se construyeron las normas y cuándo? Una puntuación es una posición en una distribución de referencia. Un instrumento que reporta un percentil sin indicar a qué población se refiere le ha dado un número sin denominador.
¿Qué añade? Validez incremental sobre una medida establecida. Muchos constructos de marca fracasan aquí, correlacionando tan altamente con un rasgo existente que no explican varianza adicional en nada. Este es un resultado normal del escrutinio científico, y es invisible a menos que alguien realice la prueba.
Dónde complica las cosas la traducción
Un instrumento validado en inglés no está por ello validado en alemán. Una adaptación transcultural adecuada requiere traducción directa e inversa, revisión por expertos, entrevistas cognitivas y luego un estudio psicométrico nuevo en el nuevo idioma que compruebe si la estructura factorial se mantiene y si los ítems individuales funcionan de manera equivalente entre grupos.
Los instrumentos que omiten este proceso son comunes. Un cuestionario cuya validación original es impecable puede comportarse de manera bastante diferente en un idioma donde un ítem clave tiene una connotación distinta, y no hay forma de saberlo sin el estudio. Cuando un test se ofrece en diez idiomas, la pregunta útil es si fue validado en diez idiomas o validado en uno y traducido a nueve.
Lo que la validación no garantiza
No hace que una puntuación sea certera. Un instrumento validado sigue teniendo error de medición, sigue describiendo una regularidad a nivel poblacional en lugar de un destino individual, y sigue midiendo solo lo que sus ítems alcanzan.
Lo que la validación garantiza son límites conocibles. Se puede saber cuánto error existe, en qué población y para qué propósito. Eso es una afirmación más modesta que "este test revela quién eres realmente", y es la única que se sostiene.
Si desea ver cómo es la documentación cuando existe, cada test en el catálogo de NOESIS nombra el instrumento que implementa, sus autores y año, su método de puntuación y la evidencia que lo respalda, incluyendo dónde esa evidencia es debatida.
Ponlo a prueba
Leer sobre medición es una cosa. Ver tu propia puntuación con su fuente, su muestra normativa y sus límites es otra. Gratis, sin registro.
Sigue leyendo
- ¿Qué es la psicometría?La disciplina que determina si una medición psicológica es válida y confiable, y la razón por la que dos pruebas que formulan preguntas similares pueden diferir enormemente en el valor de sus resultados.
- ¿Qué es la fiabilidad en las pruebas psicológicas?La fiabilidad es la consistencia de la medición, no su exactitud. Una prueba puede ser muy fiable y aun así medir algo equivocado, razón por la cual es la primera pregunta que se formula y nunca la última.
- ¿Qué es la validez en las pruebas psicológicas?La validez no es una propiedad que posea un test. Es un argumento sobre si una interpretación particular de una puntuación particular, para un propósito particular, es defendible — y debe reconstruirse para cada nuevo uso.
- ¿Qué es la validez de constructo?La pregunta más difícil en la medición: si aquello que estás midiendo existe tal como lo has definido, y si tu instrumento lo alcanza a él en lugar de algo adyacente.
- Validez convergente y discriminanteDos requisitos que son imagen especular el uno del otro: una medida debe coincidir con aquello con lo que debería coincidir, y debe mantenerse distinta de aquello de lo que afirma diferenciarse. La mayoría de los instrumentos débiles fallan en el segundo.
- Qué es el alfa de Cronbach y qué no esEl estadístico más reportado en la evaluación psicológica y el más malinterpretado. El alfa no indica que una escala sea unidimensional, y un valor alto suele ser un síntoma más que una virtud.
- Error estándar de medición: cuánto puede desviarse tu puntuaciónToda puntuación lleva un margen de error, y en la mayoría de los tests psicológicos es más amplio de lo que la gente supone. Este es el número que te indica cuándo una diferencia es real y cuándo es ruido.
- Normas y percentiles: con qué se compara tu puntuaciónUna puntuación bruta es ininterpretable por sí sola. Solo adquiere significado frente a un grupo de referencia, y qué grupo se utilizó es uno de los hechos más determinantes y menos divulgados de cualquier test.
- Cómo se construye realmente una prueba psicométricaDesde la definición del constructo hasta las normas publicadas, el proceso lleva años y descarta la mayor parte de lo que se invierte en él. Conocer las etapas hace evidente cuáles omitió un cuestionario rápido en línea.
- Por qué la mayoría de los tests de personalidad en internet no son fiablesNo porque sean deshonestos, sino porque los pasos que hacen que una medición sea confiable son invisibles, costosos y fáciles de omitir, y omitirlos no cambia en nada el aspecto del resultado.
- Lo que la autoinforme puede y no puede medirLos cuestionarios te piden que seas el observador de ti mismo, lo cual funciona mejor para algunas cosas que para otras. Saber dónde el método es sólido y dónde falla cambia la forma en que interpretas cualquier resultado.
- Qué significa cuando una prueba predice algoUna correlación de 0,30 es un hallazgo sólido en la investigación de la personalidad y una base débil para tomar una decisión sobre una persona concreta. Ambas afirmaciones son verdaderas, y la brecha entre ellas explica la mayoría de los usos incorrectos de los resultados de las pruebas.
- El cribado no es diagnósticoUn cuestionario de cribado está diseñado para detectar el mayor número posible de casos, aceptando una alta tasa de falsos positivos como precio. Interpretar una puntuación de cribado como un diagnóstico invierte aquello para lo que fue concebido.