noesisnoesis
ZmiešanéSilné dôkazy

Teória odpovede na položku

Lord, F. M. · 1980

Známe aj ako: IRT · Rasch · Rasch Measurement Theory · Latent Trait Theory

Teória odpovede na položku je skupina matematických modelov, ktoré opisujú vzťah medzi latentnými črtami (schopnosťami, postojmi) a odpoveďami na položky testu, čo umožňuje kalibráciu položiek nezávislú od vzorky a meranie osôb nezávislé od testu. Na rozdiel od klasickej teórie testov IRT modeluje charakteristiky na úrovni položiek (obťažnosť, diskrimináciu, hádanie) a schopnosť osoby na spoločnej škále a poskytuje odhady presnosti merania na každej úrovni schopnosti. IRT je základom moderného počítačového adaptívneho testovania, rozsiahlych vzdelávacích hodnotení (PISA, GRE, GMAT) a klinických meraní výsledkov hlásených pacientmi.

Metodologický (nie obsahovo zameraný na črty) rámec, ktorý modeluje pravdepodobnosť odpovede ako funkciu úrovne latentnej črty a parametrov položky (obťažnosť, diskriminácia, hádanie). Podporuje adaptívnu administráciu/CAT, nie obsah konkrétneho nástroja.

Zdroj:
Lord, F. M. (1980). Applications of Item Response Theory to Practical Testing Problems.

Dôkazy v skratke

Empirická podpora
Silné dôkazy
Replikácia
Dobre replikované
Medzikultúrne
Univerzálne
Metaanalýzy
10 indexovaných
Oblasti výskumuPsychometriaPedagogické meranieKlinické hodnotenieVývoj testovPočítačové adaptívne testovanie

Tieto hodnotenia zhŕňajú publikovanú literatúru o teórii, nie kvalitu konkrétneho testu, ktorý na nej stavia. Sú to redakčné úsudky založené na nižšie uvedených zdrojoch a menia sa s pribúdajúcimi dôkazmi.

Historický kontext

Základy IRT nezávisle položili Georg Rasch v Dánsku (1960) a Frederic Lord a Allan Birnbaum v Spojených štátoch (60. roky 20. storočia), pričom matematické základy poskytla kniha Lorda a Novicka z roku 1968 "Statistical Theories of Mental Test Scores". Lordova práca z roku 1980 "Applications of Item Response Theory to Practical Testing Problems" konsolidovala odbor demonštráciou praktických aplikácií pri konštrukcii testov, ekvivalizácii a detekcii skreslenia. Teória sa široko rozšírila v 80. a 90. rokoch s rastúcim výpočtovým výkonom, ktorý umožnil odhad parametrov pre rozsiahle testovacie programy.

Konštrukty

Zatiaľ nie sú zdokumentované žiadne konštrukty.

Nástroje

Na tejto teórii zatiaľ nie sú postavené žiadne nástroje.

Testy založené na tejto teórii

Na tejto teórii zatiaľ nie sú postavené žiadne testy.

Praktické využitie

IRT je základom počítačového adaptívneho testovania (CAT), ktoré sa používa pri hodnoteniach s vysokými stávkami, ako sú GRE, GMAT, licenčná skúška pre sestry NCLEX a vojenská batéria CAT-ASVAB; umožňuje kratšie, a pritom presnejšie testy výberom položiek prispôsobených úrovni schopnosti každého testovaného. V klinickom prostredí IRT poháňa iniciatívu PROMIS (Patient-Reported Outcomes Measurement Information System), ktorá umožňuje efektívne meranie zdravotných výsledkov. Metódy IRT podporujú aj ekvivalizáciu testov naprieč formami, detekciu diferenciálneho fungovania položiek (DIF) pri analýze férovosti a tvorbu bánk položiek pre štandardizované testovacie programy na celom svete.

Ako sa meria

IRT je sama osebe metodológiou merania, a nie vecnou psychologickou teóriou. Medzi bežné modely patria jednoparametrový (1PL/Rasch), dvojparametrový (2PL) a trojparametrový (3PL) logistický model pre dichotomické položky a Graded Response Model a Partial Credit Model pre polytomické položky. Parametre sa odhadujú metódou maximálnej vierohodnosti alebo bayesovskými metódami.

Kritiky a obmedzenia

Kľúčovou kritikou sú silné parametrické predpoklady, ktoré modely IRT vyžadujú (napríklad jednodimenzionalita a lokálna nezávislosť); pri zložitých psychologických konštruktoch nemusia platiť, čo vedie k nezhode modelu s dátami. Komunita Raschovho modelu a širšia komunita IRT sa zásadne nezhodujú v tom, či sa má model prispôsobiť dátam (prístup IRT), alebo majú dáta spĺňať požiadavky modelu na fundamentálne meranie (Raschov prístup). IRT vyžaduje pomerne veľké vzorky na stabilný odhad parametrov (zvyčajne 200-1000+ respondentov v závislosti od modelu), čo obmedzuje jej použiteľnosť pri hodnoteniach malého rozsahu.

Kľúčové publikácie

  • Lord, F. M.. (1980). Applications of Item Response Theory to Practical Testing Problems.
  • Lord, F. M. & Novick, M. R.. (1968). Statistical Theories of Mental Test Scores.
  • Rasch, G.. (1960). Probabilistic Models for Some Intelligence and Attainment Tests.
  • Hambleton, R. K., Swaminathan, H. & Rogers, H. J.. (1991). Fundamentals of Item Response Theory.
  • Embretson, S. E. & Reise, S. P.. (2000). Item Response Theory for Psychologists. 10.4324/9781410605269

Súvisiace teórie

Classical Test TheoryRasch Measurement TheoryGeneralizability TheoryLatent Trait TheoryFactor Analysis
Teória odpovede na položku: definícia, dôkazy a spôsob merania | NOESIS