noesisnoesis
SmíšenéSilné důkazy

Teorie odpovědi na položku

Lord, F. M. · 1980

Také známé jako: IRT · Rasch · Rasch Measurement Theory · Latent Trait Theory

Teorie odpovědi na položku je soubor matematických modelů popisujících vztah mezi latentními rysy (schopnostmi, postoji) a odpověďmi na položky testu. Umožňuje kalibraci položek nezávislou na vzorku a měření osob nezávislé na konkrétním testu. Na rozdíl od klasické teorie testů modeluje IRT charakteristiky jednotlivých položek (obtížnost, rozlišovací schopnost, hádání) a schopnost osoby na společné škále a poskytuje odhady přesnosti měření pro každou úroveň schopnosti. IRT je základem moderního počítačově adaptivního testování, rozsáhlých vzdělávacích hodnocení (PISA, GRE, GMAT) a klinických měření výsledků uváděných pacienty.

Metodologický rámec (nikoli rámec obsahu rysů), který modeluje pravděpodobnost odpovědi jako funkci úrovně latentního rysu a parametrů položky (obtížnosti, diskriminační schopnosti, hádání). Slouží jako základ adaptivní administrace/CAT, nikoli obsahu kteréhokoli jednotlivého nástroje.

Zdroj:
Lord, F. M. (1980). Applications of Item Response Theory to Practical Testing Problems.

Přehled důkazů

Empirická opora
Silné důkazy
Replikace
Dobře replikováno
Mezikulturní
Univerzální
Metaanalýzy
10 zaindexováno
Oblasti výzkumuPsychometrieVzdělávací měřeníKlinické hodnoceníVývoj testuPočítačové adaptivní testování

Tato hodnocení shrnují publikovanou literaturu o teorii, nikoli kvalitu jednotlivých testů, které z ní vycházejí. Jde o redakční posouzení založená na níže uvedených zdrojích, která se mění s přibývajícími důkazy.

Historický kontext

Základy IRT položili nezávisle na sobě Georg Rasch v Dánsku (1960) a Frederic Lord s Allanem Birnbaumem ve Spojených státech (60. léta 20. století). Matematický základ poskytla kniha Lorda a Novicka z roku 1968 "Statistical Theories of Mental Test Scores". Lordova kniha z roku 1980 "Applications of Item Response Theory to Practical Testing Problems" obor sjednotila tím, že ukázala praktické využití při tvorbě testů, srovnávání výsledků různých forem a odhalování zkreslení. Teorie se široce rozšířila v 80. a 90. letech 20. století s rostoucím výpočetním výkonem, který umožnil odhadovat parametry ve velkých testovacích programech.

Konstrukty

Zatím nejsou zdokumentovány žádné konstrukty.

Nástroje

Zatím nebyly vytvořeny žádné nástroje založené na této teorii.

Testy založené na této teorii

Zatím nebyly vytvořeny žádné testy založené na této teorii.

Praktické aplikace

IRT tvoří základ počítačově adaptivního testování (CAT), používaného při hodnoceních s významnými důsledky, jako jsou GRE, GMAT, licenční zkouška pro zdravotní sestry NCLEX a vojenská testová baterie CAT-ASVAB. Výběrem položek přizpůsobených úrovni schopností každého testovaného umožňuje kratší, a přitom přesnější testy. V klinickém prostředí IRT pohání iniciativu PROMIS (Patient-Reported Outcomes Measurement Information System), která umožňuje efektivně měřit zdravotní výsledky. Metody IRT také podporují srovnávání výsledků různých forem testu, zjišťování rozdílného fungování položek (DIF) při analýze spravedlivosti a tvorbu bank položek pro programy standardizovaného testování po celém světě.

Jak se měří

IRT je metodologie měření, nikoli psychologická teorie vysvětlující konkrétní jev. Mezi běžné modely pro dichotomické položky patří jednoparametrový (1PL/Rasch), dvouparametrový (2PL) a tříparametrový (3PL) logistický model; pro polytomické položky pak model odstupňované odpovědi a model částečného kreditu. Parametry se odhadují metodou maximální věrohodnosti nebo bayesovskými metodami.

Kritika a omezení

Jednou z hlavních výtek jsou silné parametrické předpoklady, které modely IRT vyžadují, například jednorozměrnost a lokální nezávislost. U složitých psychologických konstruktů nemusí být splněny, což vede k nesouladu modelu s daty. Zastánci Raschova modelu a širší komunita IRT se zásadně neshodují v tom, zda se má model přizpůsobit datům (přístup IRT), nebo zda mají data splňovat požadavky modelu pro fundamentální měření (Raschův přístup). IRT vyžaduje pro stabilní odhad parametrů poměrně velké vzorky, obvykle 200-1000+ testovaných osob v závislosti na modelu, což omezuje její použitelnost u hodnocení v malém měřítku.

Klíčové publikace

  • Lord, F. M.. (1980). Applications of Item Response Theory to Practical Testing Problems.
  • Lord, F. M. & Novick, M. R.. (1968). Statistical Theories of Mental Test Scores.
  • Rasch, G.. (1960). Probabilistic Models for Some Intelligence and Attainment Tests.
  • Hambleton, R. K., Swaminathan, H. & Rogers, H. J.. (1991). Fundamentals of Item Response Theory.
  • Embretson, S. E. & Reise, S. P.. (2000). Item Response Theory for Psychologists. 10.4324/9781410605269

Související teorie

Classical Test TheoryRasch Measurement TheoryGeneralizability TheoryLatent Trait TheoryFactor Analysis
Teorie odpovědi na položku, definice, důkazy a způsob měření | NOESIS