Lo que la autoinforme puede y no puede medir
Los cuestionarios te piden que seas el observador de ti mismo, lo cual funciona mejor para algunas cosas que para otras. Saber dónde el método es sólido y dónde falla cambia la forma en que interpretas cualquier resultado.
Casi todos los instrumentos de personalidad y bienestar de uso generalizado son cuestionarios de autoinforme. Lees una afirmación, valoras qué tan bien te describe, y las puntuaciones se suman. Es económico, rápido, escalable y tiene fortalezas genuinas, pero también tiene modos de fallo que vale la pena conocer antes de leer tus propios resultados.
Dónde funciona bien
Estados internos que nadie más puede observar. Satisfacción con la vida, estrés percibido, sentido de vida, ansiedad subjetiva. Para estos, la persona no es simplemente una fuente conveniente; es la única válida. Un observador externo que valora tu bienestar subjetivo está haciendo suposiciones.
Conducta típica agregada a lo largo del tiempo. Las personas son razonablemente buenas para reportar lo que suelen hacer, incluso cuando son malas para predecir un caso concreto. Las medidas de rasgos funcionan porque promedian a lo largo de situaciones.
La autopercepción como objeto de interés en sí misma. Cuán capaz te crees influye en lo que intentas, independientemente de cuán capaz seas en realidad. La autoeficacia es un constructo legítimo precisamente porque la creencia tiene consecuencias.
Dónde falla
Respuestas socialmente deseables. Las personas se describen a sí mismas como más responsables, más empáticas y menos hostiles de lo que son, y el efecto se acentúa conforme aumentan los stakes. En un contexto de autoconocimiento sin consecuencias, la distorsión es modesta. En procesos de selección, es severa: la redacción transparente de la mayoría de los ítems de personalidad los hace fáciles de falsear, y los candidatos más motivados para hacerlo son precisamente los que el empleador más desea identificar.
Escasa introspección. Los autoinformes correlacionan solo moderadamente con los informes de personas cercanas que conocen bien al individuo, y la brecha es mayor exactamente donde uno esperaría: en rasgos con peso evaluativo y en personas cuya autoimagen es menos precisa. Alguien que no nota su propia falta de atención no está en buena posición para reportarla.
Capacidad versus creencia. Un autoinforme no puede medir una habilidad. La inteligencia emocional autoinformada mide qué tan capaz emocionalmente te crees, lo cual correlaciona solo modestamente con el rendimiento en tareas que requieren juicio emocional. Ambos son constructos reales; no son el mismo, y confundirlos es uno de los errores más comunes en el mercado de evaluaciones comerciales.
Efectos del grupo de referencia. «Trabajo duro» se valora en relación con un grupo de comparación implícito que varía según la persona y la cultura. Esto hace que la comparación transcultural de medias brutas de autoinforme sea poco confiable de maneras fáciles de pasar por alto y difíciles de corregir.
Estado de ánimo en el momento de responder. El afecto presente colorea sistemáticamente los juicios retrospectivos. Una puntuación obtenida en una sola ocasión sobre un constructo supuestamente estable contiene más varianza de estado de lo que el encuadre de rasgo sugiere.
Estilos de respuesta. La aquiescencia —estar de acuerdo independientemente del contenido— y las respuestas extremas varían entre individuos y culturas. Las escalas bien construidas mitigan esto con ítems de redacción inversa, lo cual introduce su propio artefacto: las escalas con redacción mixta producen sistemáticamente un segundo factor espurio que refleja la redacción, no el contenido.
Cómo interpretar tus propios resultados a la luz de esto
Trata una puntuación de autoinforme como un relato bien estructurado de cómo te ves a ti mismo, lo cual es genuinamente informativo y no equivale a un relato de cómo eres.
La brecha entre ambos suele ser la parte más interesante. Cuando una puntuación te sorprende, la pregunta que vale la pena considerar no es si la prueba está equivocada, sino cuál de las dos lecturas —la tuya o la del instrumento— reconocerían las personas que te rodean.
Ese es también el límite honesto de lo que un cuestionario puede ofrecer, y una buena razón para tratar cualquier puntuación individual como un insumo más, no como un veredicto.
Ponlo a prueba
Leer sobre medición es una cosa. Ver tu propia puntuación con su fuente, su muestra normativa y sus límites es otra. Gratis, sin registro.
Sigue leyendo
- ¿Qué es la psicometría?La disciplina que determina si una medición psicológica es válida y confiable, y la razón por la que dos pruebas que formulan preguntas similares pueden diferir enormemente en el valor de sus resultados.
- ¿Qué es la fiabilidad en las pruebas psicológicas?La fiabilidad es la consistencia de la medición, no su exactitud. Una prueba puede ser muy fiable y aun así medir algo equivocado, razón por la cual es la primera pregunta que se formula y nunca la última.
- ¿Qué es la validez en las pruebas psicológicas?La validez no es una propiedad que posea un test. Es un argumento sobre si una interpretación particular de una puntuación particular, para un propósito particular, es defendible — y debe reconstruirse para cada nuevo uso.
- ¿Qué es la validez de constructo?La pregunta más difícil en la medición: si aquello que estás midiendo existe tal como lo has definido, y si tu instrumento lo alcanza a él en lugar de algo adyacente.
- Validez convergente y discriminanteDos requisitos que son imagen especular el uno del otro: una medida debe coincidir con aquello con lo que debería coincidir, y debe mantenerse distinta de aquello de lo que afirma diferenciarse. La mayoría de los instrumentos débiles fallan en el segundo.
- Qué es el alfa de Cronbach y qué no esEl estadístico más reportado en la evaluación psicológica y el más malinterpretado. El alfa no indica que una escala sea unidimensional, y un valor alto suele ser un síntoma más que una virtud.
- Error estándar de medición: cuánto puede desviarse tu puntuaciónToda puntuación lleva un margen de error, y en la mayoría de los tests psicológicos es más amplio de lo que la gente supone. Este es el número que te indica cuándo una diferencia es real y cuándo es ruido.
- Normas y percentiles: con qué se compara tu puntuaciónUna puntuación bruta es ininterpretable por sí sola. Solo adquiere significado frente a un grupo de referencia, y qué grupo se utilizó es uno de los hechos más determinantes y menos divulgados de cualquier test.
- Cómo se construye realmente una prueba psicométricaDesde la definición del constructo hasta las normas publicadas, el proceso lleva años y descarta la mayor parte de lo que se invierte en él. Conocer las etapas hace evidente cuáles omitió un cuestionario rápido en línea.
- ¿Qué significa que un test sea llamado validado?La palabra no está regulada y es utilizada libremente por productos que no han hecho ninguno de los trabajos requeridos. Esto es lo que significa cuando realmente significa algo, y las cuatro preguntas que separan ambos casos.
- Por qué la mayoría de los tests de personalidad en internet no son fiablesNo porque sean deshonestos, sino porque los pasos que hacen que una medición sea confiable son invisibles, costosos y fáciles de omitir, y omitirlos no cambia en nada el aspecto del resultado.
- Qué significa cuando una prueba predice algoUna correlación de 0,30 es un hallazgo sólido en la investigación de la personalidad y una base débil para tomar una decisión sobre una persona concreta. Ambas afirmaciones son verdaderas, y la brecha entre ellas explica la mayoría de los usos incorrectos de los resultados de las pruebas.
- El cribado no es diagnósticoUn cuestionario de cribado está diseñado para detectar el mayor número posible de casos, aceptando una alta tasa de falsos positivos como precio. Interpretar una puntuación de cribado como un diagnóstico invierte aquello para lo que fue concebido.