El cribado no es diagnóstico
Un cuestionario de cribado está diseñado para detectar el mayor número posible de casos, aceptando una alta tasa de falsos positivos como precio. Interpretar una puntuación de cribado como un diagnóstico invierte aquello para lo que fue concebido.
Un cuestionario de cribado para la depresión, un cribador de ansiedad, un cribador de consumo de alcohol: estos se encuentran entre los instrumentos mejor validados que existen, y habitualmente se interpretan de forma errónea. Una puntuación por encima del punto de corte no significa que usted tenga la afección. Nunca fue diseñado para eso.
La compensación de diseño
Todo instrumento de cribado se sitúa en un equilibrio entre dos tipos de error: pasar por alto a personas que tienen la afección, y señalar a personas que no la tienen. Las herramientas de cribado están deliberadamente ajustadas hacia el segundo tipo. Pasar por alto un caso de depresión en atención primaria tiene un coste alto; un falso positivo solo cuesta una conversación con un clínico.
La consecuencia se desprende aritméticamente. Un cribador con una sensibilidad del 88 por ciento y una especificidad del 85 por ciento parece excelente. Aplíquelo en una población donde el 5 por ciento realmente tiene la afección, y de cada 100 personas que dan positivo en el cribado, aproximadamente 74 no la tienen. El instrumento funciona exactamente según lo especificado. La mayoría de los positivos siguen siendo falsos.
Esta es la aritmética de la tasa base, y es la razón por la que el cribado universal en entornos de baja prevalencia es objeto de debate incluso para instrumentos bien validados.
Qué es un punto de corte
Un punto de corte es un umbral de decisión elegido para un propósito en una población, no un límite natural. El punto de corte convencional de 10 del PHQ-9 se derivó en poblaciones con prevalencia relativamente alta; aplicado en otros contextos, se comporta de manera diferente. Los metaanálisis de participantes individuales han demostrado que las estimaciones de precisión publicadas para ese punto de corte estaban sistemáticamente infladas por la notificación selectiva de umbrales optimizados.
Para algunos instrumentos, deliberadamente no existe ningún punto de corte universal. El SRQ-20 de la Organización Mundial de la Salud se utiliza en decenas de países, y su umbral óptimo varía lo suficiente según el país, el idioma y el sexo como para que publicar un único número global hiciera más daño que dejarlo a la validación local.
El diagnóstico es un procedimiento distinto
Un diagnóstico requiere que un clínico establezca la presencia y duración de los síntomas, su impacto funcional y la exclusión de explicaciones alternativas: afecciones médicas, sustancias, otros trastornos que se presentan de forma similar. Tiene en cuenta la historia clínica y el contexto. Un cuestionario no hace nada de esto. Cuenta la frecuencia de síntomas autoinformados durante un período determinado.
Dos personas pueden obtener puntuaciones idénticas a partir de cuadros clínicos completamente diferentes, ya que el total comprime varios síntomas heterogéneos en un solo número. La puntuación es una señal para profundizar; profundizar es el diagnóstico.
Para qué sirve legítimamente la puntuación
Un estímulo. Una puntuación alta es una razón para hablar con un profesional. Ese es el uso previsto y es genuinamente valioso.
Seguimiento del cambio. Esta es la función infrautilizada. La medición repetida a lo largo del tratamiento muestra si algo está funcionando, y es mucho más informativa que cualquier puntuación aislada. La atención basada en la medición se sustenta en esto.
Descripción poblacional. En investigación y salud pública, estos instrumentos estiman la carga sintomática en grupos, que es aquello en lo que mejor destacan.
Cómo interpretar su propio resultado
Si obtiene una puntuación por encima de un umbral en un cribador, la interpretación correcta es: esto justifica una conversación con alguien cualificado. No: tengo esta afección.
Si obtiene una puntuación por debajo, la interpretación correcta es: este cribado en particular no detectó nada. No: estoy bien. Los cribadores pasan por alto casos, que es la otra cara del equilibrio, y una puntuación baja en alguien que no se siente bien no es una garantía de tranquilidad.
Cuando NOESIS publica instrumentos de cribado, los informes indican los umbrales publicados, nombran la fuente y señalan claramente que el resultado no es un diagnóstico. Ese enfoque no es una formalidad legal; es lo que los propios instrumentos indican sobre su uso.
Ponlo a prueba
Leer sobre medición es una cosa. Ver tu propia puntuación con su fuente, su muestra normativa y sus límites es otra. Gratis, sin registro.
Sigue leyendo
- ¿Qué es la psicometría?La disciplina que determina si una medición psicológica es válida y confiable, y la razón por la que dos pruebas que formulan preguntas similares pueden diferir enormemente en el valor de sus resultados.
- ¿Qué es la fiabilidad en las pruebas psicológicas?La fiabilidad es la consistencia de la medición, no su exactitud. Una prueba puede ser muy fiable y aun así medir algo equivocado, razón por la cual es la primera pregunta que se formula y nunca la última.
- ¿Qué es la validez en las pruebas psicológicas?La validez no es una propiedad que posea un test. Es un argumento sobre si una interpretación particular de una puntuación particular, para un propósito particular, es defendible — y debe reconstruirse para cada nuevo uso.
- ¿Qué es la validez de constructo?La pregunta más difícil en la medición: si aquello que estás midiendo existe tal como lo has definido, y si tu instrumento lo alcanza a él en lugar de algo adyacente.
- Validez convergente y discriminanteDos requisitos que son imagen especular el uno del otro: una medida debe coincidir con aquello con lo que debería coincidir, y debe mantenerse distinta de aquello de lo que afirma diferenciarse. La mayoría de los instrumentos débiles fallan en el segundo.
- Qué es el alfa de Cronbach y qué no esEl estadístico más reportado en la evaluación psicológica y el más malinterpretado. El alfa no indica que una escala sea unidimensional, y un valor alto suele ser un síntoma más que una virtud.
- Error estándar de medición: cuánto puede desviarse tu puntuaciónToda puntuación lleva un margen de error, y en la mayoría de los tests psicológicos es más amplio de lo que la gente supone. Este es el número que te indica cuándo una diferencia es real y cuándo es ruido.
- Normas y percentiles: con qué se compara tu puntuaciónUna puntuación bruta es ininterpretable por sí sola. Solo adquiere significado frente a un grupo de referencia, y qué grupo se utilizó es uno de los hechos más determinantes y menos divulgados de cualquier test.
- Cómo se construye realmente una prueba psicométricaDesde la definición del constructo hasta las normas publicadas, el proceso lleva años y descarta la mayor parte de lo que se invierte en él. Conocer las etapas hace evidente cuáles omitió un cuestionario rápido en línea.
- ¿Qué significa que un test sea llamado validado?La palabra no está regulada y es utilizada libremente por productos que no han hecho ninguno de los trabajos requeridos. Esto es lo que significa cuando realmente significa algo, y las cuatro preguntas que separan ambos casos.
- Por qué la mayoría de los tests de personalidad en internet no son fiablesNo porque sean deshonestos, sino porque los pasos que hacen que una medición sea confiable son invisibles, costosos y fáciles de omitir, y omitirlos no cambia en nada el aspecto del resultado.
- Lo que la autoinforme puede y no puede medirLos cuestionarios te piden que seas el observador de ti mismo, lo cual funciona mejor para algunas cosas que para otras. Saber dónde el método es sólido y dónde falla cambia la forma en que interpretas cualquier resultado.
- Qué significa cuando una prueba predice algoUna correlación de 0,30 es un hallazgo sólido en la investigación de la personalidad y una base débil para tomar una decisión sobre una persona concreta. Ambas afirmaciones son verdaderas, y la brecha entre ellas explica la mayoría de los usos incorrectos de los resultados de las pruebas.