noesisnoesis
Cómo se mide

Qué es el alfa de Cronbach y qué no es

El estadístico más reportado en la evaluación psicológica y el más malinterpretado. El alfa no indica que una escala sea unidimensional, y un valor alto suele ser un síntoma más que una virtud.

El alfa de Cronbach es un coeficiente de consistencia interna: el grado en que los ítems de una escala se correlacionan entre sí. Publicado en 1951, es el estadístico psicométrico más reportado, y su ubicuidad ha superado su utilidad.

El alfa varía de 0 a 1 y está determinado por dos factores: la correlación promedio entre los ítems y el número de ítems. Esta segunda dependencia es la fuente de la mayor parte de los malentendidos.

Lo que un alfa alto no significa

No significa que la escala mida una sola cosa. Este es el error más común. El alfa puede ser alto en una escala con dos o tres factores distintos, siempre que los ítems se correlacionen suficientemente en conjunto. La unidimensionalidad debe establecerse mediante análisis factorial; el alfa no puede establecerla y nunca fue concebido para ello.

No significa que la escala sea válida. El alfa no dice nada sobre lo que miden los ítems. Veinte preguntas sobre el tamaño del calzado tendrían una excelente consistencia interna y ninguna validez como medida de cualquier constructo psicológico.

No significa que la escala sea buena. Dado que el alfa aumenta con el número de ítems, una escala larga de ítems mediocres superará en puntuación a una escala corta de ítems excelentes. Una escala de cuarenta ítems con una correlación inter-ítem promedio de 0,2 supera el 0,90.

Un alfa muy alto suele ser una señal de advertencia. Por encima de aproximadamente 0,95, los ítems son por lo general paráfrasis casi idénticas. Esto compra consistencia a costa de la cobertura del constructo: la escala mide una faceta muy estrecha con gran precisión y omite el resto del constructo. Esto se denomina paradoja de atenuación, y es la razón por la que más consistencia no es monotónicamente mejor.

Lo que asume

El alfa es una cota inferior de la fiabilidad bajo un supuesto específico: la tau-equivalencia, que implica que cada ítem contribuye igualmente al rasgo subyacente. Las escalas reales casi nunca satisfacen este supuesto. Los ítems difieren en la intensidad con que saturan el factor, y cuando esto ocurre, el alfa subestima la fiabilidad.

El omega de McDonald abandona el supuesto de contribución igual y estima la fiabilidad a partir de las saturaciones factoriales reales. Los metodólogos lo han recomendado por encima del alfa durante dos décadas. Las prácticas de reporte han tardado en seguir esta recomendación, en gran medida porque el alfa se obtiene con una sola línea en cualquier paquete estadístico y el omega no.

Cómo interpretarlo en la práctica

Convenciones aproximadas: 0,70 o más es aceptable para investigaciones que comparan grupos; 0,80 o más para uso aplicado; 0,90 o más cuando una puntuación influye en una decisión individual. Trátelas como orientación, no como umbrales: el nivel requerido depende de las consecuencias de la decisión que informa la puntuación.

Los datos más informativos suelen encontrarse en otras partes del mismo artículo. La correlación inter-ítem promedio (entre 0,15 y 0,50 es un rango saludable) indica si un alfa alto proviene de la calidad o de la cantidad de ítems. El número de ítems transmite lo mismo desde la dirección opuesta. La fiabilidad test-retest aporta algo que el alfa estructuralmente no puede: si la puntuación es estable en la misma persona a lo largo del tiempo.

Una escala que reporta únicamente el alfa ha reportado el más fácil de obtener de todos los índices de fiabilidad, y el menos exigente de superar.

Ponlo a prueba

Leer sobre medición es una cosa. Ver tu propia puntuación con su fuente, su muestra normativa y sus límites es otra. Gratis, sin registro.

Sigue leyendo