noesisnoesis
СмесеноСилни доказателства

Теория на отговора на твърденията

Lord, F. M. · 1980

Известен също като: IRT · Rasch · Rasch Measurement Theory · Latent Trait Theory

Item Response Theory е семейство от математически модели, които описват връзката между латентните черти (способности, нагласи) и отговорите на твърденията в теста, позволявайки калибриране на твърденията независимо от извадката и измерване на хората независимо от теста. За разлика от класическата теория на тестовете, IRT моделира характеристики на ниво твърдение (трудност, дискриминация, налучкване) и способността на човека по обща скала, осигурявайки оценки на точността на измерването на всяко ниво на способност. IRT е в основата на съвременното компютризирано адаптивно тестване, мащабни образователни оценки (PISA, GRE, GMAT) и клинични измервания на резултатите, докладвани от пациентите.

Методологична (не отнасяща се до съдържанието на черти) рамка, моделираща вероятността за даден отговор като функция от нивото на латентната черта и параметрите на твърдението (трудност, дискриминация, налучкване). Подкрепя адаптивно/CAT провеждане, а не съдържанието на един-единствен инструмент.

Източник:
Lord, F. M. (1980). Applications of Item Response Theory to Practical Testing Problems.

Доказателства с един поглед

Емпирична подкрепа
Силни доказателства
Репликация
Добре репликирано
Крос-културни
Универсално
Мета-анализи
10 индексирани
Изследователски областиПсихометрияОбразователно измерванеКлинично оценяванеРазработка на тестовеКомпютърно адаптивно тестване

Тези оценки обобщават публикуваната литература относно теорията, а не качеството на отделен тест, изграден върху нея. Те са редакционни преценки въз основа на изброените по-долу източници и се променят с натрупването на доказателства.

Исторически контекст

Основите на IRT са положени независимо от Georg Rasch в Дания (1960 г.) и Frederic Lord и Allan Birnbaum в САЩ (през 1960-те години), като статистическите теории за резултатите от умствените тестове ("Statistical Theories of Mental Test Scores") на Lord и Novick от 1968 г. осигуряват математическата основа. "Applications of Item Response Theory to Practical Testing Problems" на Lord от 1980 г. консолидира областта, демонстрирайки практически приложения при конструирането на тестове, приравняването и откриването на отклонения. Теорията получава широко разпространение през 1980-те и 1990-те години с нарастването на изчислителната мощ, което прави възможна оценката на параметрите за мащабни програми за тестване.

Конструкти

Все още няма документирани конструкти.

Инструменти

Все още няма инструменти, изградени върху тази теория.

Тестове, изградени върху тази теория

Все още няма тестове, изградени върху тази теория.

Практически приложения

IRT е основата на компютризираното адаптивно тестване (CAT), използвано при оценяване с висок залог като GRE, GMAT, изпита за медицински сестри NCLEX и военната батерия CAT-ASVAB, позволявайки по-кратки, но по-прецизни тестове чрез избиране на твърдения, съобразени с нивото на способности на всеки изпитван. В клинична среда IRT захранва инициативата PROMIS (Информационна система за измерване на резултатите, докладвани от пациентите), позволяваща ефективно измерване на здравните резултати. Методите на IRT също така поддържат приравняване на тестове между различни форми, откриване на диференциално функциониране на твърденията (DIF) за анализ на честността и разработване на банки с твърдения за стандартизирани програми за тестване по целия свят.

Как се измерва

IRT сама по себе си е методология за измерване, а не същинска психологическа теория. Често срещаните модели включват еднопараметричен (1PL/Rasch), двупараметричен (2PL) и трипараметричен (3PL) логистичен модел за дихотомни твърдения, както и Graded Response Model и Partial Credit Model за политомни твърдения. Оценката на параметрите използва метода на максималното правдоподобие или байесови методи.

Критики и ограничения

Ключова критика са силните параметрични допускания, изисквани от IRT моделите (като едномерност и локална независимост), които може да не са валидни за сложни психологически конструкти, което води до несъответствие на модела. Общността на модела на Rasch и по-широката IRT общност фундаментално не са съгласни дали моделът трябва да бъде адаптиран към данните (IRT подход) или данните трябва да отговарят на изискванията на модела за фундаментално измерване (подход на Rasch). IRT изисква сравнително големи размери на извадките за стабилна оценка на параметрите (обикновено 200-1000+ изследвани лица в зависимост от модела), което ограничава приложимостта му за малки по мащаб оценявания.

Ключови публикации

  • Lord, F. M.. (1980). Applications of Item Response Theory to Practical Testing Problems.
  • Lord, F. M. & Novick, M. R.. (1968). Statistical Theories of Mental Test Scores.
  • Rasch, G.. (1960). Probabilistic Models for Some Intelligence and Attainment Tests.
  • Hambleton, R. K., Swaminathan, H. & Rogers, H. J.. (1991). Fundamentals of Item Response Theory.
  • Embretson, S. E. & Reise, S. P.. (2000). Item Response Theory for Psychologists. 10.4324/9781410605269

Свързани теории

Classical Test TheoryRasch Measurement TheoryGeneralizability TheoryLatent Trait TheoryFactor Analysis
Теория на отговора на твърденията: дефиниция, доказателства и как се измерва | NOESIS