noesisnoesis
MixtoEvidencia sólida

Teoría de Respuesta al Ítem

Lord, F. M. · 1980

También conocida como: IRT · Rasch

La Teoría de Respuesta al Ítem es una familia de modelos matemáticos que describen la relación entre los rasgos latentes (habilidades, actitudes) y las respuestas a los ítems de un test, permitiendo la calibración de ítems independiente de la muestra y la medición de personas independiente del test. A diferencia de la Teoría Clásica de los Tests, la TRI modela las características a nivel de ítem (dificultad, discriminación, adivinación) y la habilidad de la persona en una escala común, proporcionando estimaciones de la precisión de medición en cada nivel de habilidad. La TRI sustenta los tests adaptativos computarizados modernos, las evaluaciones educativas a gran escala (PISA, GRE, GMAT) y las medidas clínicas de resultados reportados por el paciente.

Marco metodológico (no de contenido de rasgo) que modela la probabilidad de una respuesta como función del nivel de rasgo latente y los parámetros del ítem (dificultad, discriminación, adivinación). Respalda la administración adaptativa/CAT en lugar del contenido de un instrumento específico.

Fuente:
Lord, F. M. (1980). Applications of Item Response Theory to Practical Testing Problems.

Contexto Histórico

Los fundamentos de la TRI fueron establecidos de forma independiente por Georg Rasch en Dinamarca (1960) y por Frederic Lord y Allan Birnbaum en Estados Unidos (años 60), y el libro de Lord y Novick de 1968 'Statistical Theories of Mental Test Scores' proporcionó las bases matemáticas. El libro de Lord de 1980 'Applications of Item Response Theory to Practical Testing Problems' consolidó el campo al demostrar aplicaciones prácticas en la construcción de tests, la equiparación y la detección de sesgo. La teoría ganó una adopción generalizada en las décadas de 1980-1990 con el aumento de la capacidad computacional, lo que hizo factible la estimación de parámetros para programas de evaluación a gran escala.

Constructos

Aún no hay constructos documentados.

Instrumentos

Aún no hay instrumentos basados en esta teoría.

Tests basados en esta teoría

Aún no hay tests basados en esta teoría.

Aplicaciones Prácticas

La TRI es el fundamento de los tests adaptativos computarizados (TAC), utilizados en evaluaciones de alto impacto como el GRE, el GMAT, el examen de licenciatura en enfermería NCLEX y la batería militar CAT-ASVAB, permitiendo tests más cortos pero más precisos al seleccionar ítems adaptados al nivel de habilidad de cada examinado. En entornos clínicos, la TRI impulsa la iniciativa PROMIS (Patient-Reported Outcomes Measurement Information System), permitiendo una medición eficiente de los resultados de salud. Los métodos de la TRI también respaldan la equiparación de tests entre formas, la detección del funcionamiento diferencial del ítem (DIF) para el análisis de equidad, y el desarrollo de bancos de ítems para programas de evaluación estandarizada en todo el mundo.

Cómo Se Mide

La TRI es en sí misma una metodología de medición más que una teoría psicológica sustantiva. Los modelos comunes incluyen los modelos logísticos de un parámetro (1PL/Rasch), dos parámetros (2PL) y tres parámetros (3PL) para ítems dicotómicos, y el Graded Response Model y el Partial Credit Model para ítems politómicos. La estimación de parámetros utiliza máxima verosimilitud o métodos bayesianos.

Críticas y Limitaciones

Una crítica clave son los fuertes supuestos paramétricos requeridos por los modelos de TRI (como la unidimensionalidad y la independencia local), que pueden no cumplirse en constructos psicológicos complejos, lo que lleva a un ajuste deficiente del modelo. La comunidad del modelo Rasch y la comunidad más amplia de la TRI discrepan fundamentalmente sobre si el modelo debe ajustarse a los datos (enfoque TRI) o si los datos deben cumplir los requisitos del modelo para una medición fundamental (enfoque Rasch). La TRI requiere tamaños de muestra relativamente grandes para una estimación estable de parámetros (típicamente entre 200 y más de 1000 examinados, según el modelo), lo que limita su aplicabilidad en evaluaciones a pequeña escala.

Publicaciones Clave

  • Lord, F. M.. (1980). Applications of Item Response Theory to Practical Testing Problems.
  • Lord, F. M. & Novick, M. R.. (1968). Statistical Theories of Mental Test Scores.
  • Rasch, G.. (1960). Probabilistic Models for Some Intelligence and Attainment Tests.
  • Hambleton, R. K., Swaminathan, H. & Rogers, H. J.. (1991). Fundamentals of Item Response Theory.
  • Embretson, S. E. & Reise, S. P.. (2000). Item Response Theory for Psychologists. 10.4324/9781410605269

Teorías Relacionadas

Classical Test TheoryRasch Measurement TheoryGeneralizability TheoryLatent Trait TheoryFactor Analysis