Teorija odgovora na čestice
Lord, F. M. · 1980
Poznato i kao: IRT · Rasch · Rasch Measurement Theory · Latent Trait Theory
Teorija odgovora na čestice obitelj je matematičkih modela koji opisuju odnos između latentnih crta (sposobnosti, stavova) i odgovora na čestice testa, omogućujući kalibraciju čestica neovisnu o uzorku i mjerenje osoba neovisno o testu. Za razliku od klasične teorije testova, IRT modelira obilježja na razini čestice (težinu, diskriminativnost, pogađanje) i sposobnost osobe na zajedničkoj ljestvici, dajući procjene preciznosti mjerenja na svakoj razini sposobnosti. IRT je temelj suvremenog računalnog adaptivnog testiranja, obrazovnih procjena velikih razmjera (PISA, GRE, GMAT) i kliničkih mjera ishoda koje izvještavaju sami pacijenti.
Metodološki okvir (a ne okvir sadržaja crta) koji modelira vjerojatnost odgovora kao funkciju razine latentne crte i parametara čestice (težina, diskriminativnost, pogađanje). Podupire adaptivnu primjenu (CAT), a ne sadržaj nekog pojedinačnog instrumenta.
- Izvor:
- Lord, F. M. (1980). Applications of Item Response Theory to Practical Testing Problems.
Dokazi na prvi pogled
- Empirijska potpora
- Snažni dokazi
- Replikacija
- Dobro repliciran
- Međukulturno
- Univerzalno
- Metaanalize
- 10 indeksirano
Ove ocjene sažimaju objavljenu literaturu o teoriji, a ne kvalitetu pojedinog testa koji se na njoj temelji. Riječ je o uredničkim procjenama na temelju dolje navedenih izvora i mijenjaju se kako se dokazi gomilaju.
Povijesni kontekst
Temelje IRT-a neovisno su postavili Georg Rasch u Danskoj (1960.) te Frederic Lord i Allan Birnbaum u Sjedinjenim Američkim Državama (1960-ih), a matematičku podlogu dala je knjiga Lorda i Novicka iz 1968. "Statistical Theories of Mental Test Scores". Lordova knjiga iz 1980. "Applications of Item Response Theory to Practical Testing Problems" učvrstila je područje pokazujući praktične primjene u konstrukciji testova, izjednačavanju i otkrivanju pristranosti. Teorija je široko prihvaćena 1980-ih i 1990-ih s rastom računalne snage, koja je procjenu parametara učinila izvedivom za programe testiranja velikih razmjera.
Konstrukti
Još nema dokumentiranih konstrukata.
Instrumenti
Još nema instrumenata izgrađenih na ovoj teoriji.
Testovi utemeljeni na ovoj teoriji
Još nema testova izgrađenih na ovoj teoriji.
Praktične primjene
IRT je temelj računalnog adaptivnog testiranja (CAT) koje se koristi u procjenama s velikim posljedicama, poput GRE, GMAT, ispita za licenciranje medicinskih sestara NCLEX i vojne baterije CAT-ASVAB, a omogućuje kraće, ali preciznije testove odabirom čestica prilagođenih razini sposobnosti svakog ispitanika. U kliničkom okruženju IRT pokreće inicijativu PROMIS (Patient-Reported Outcomes Measurement Information System), omogućujući učinkovito mjerenje zdravstvenih ishoda. IRT metode podržavaju i izjednačavanje testova među oblicima, otkrivanje diferencijalnog funkcioniranja čestica (DIF) za analizu pravednosti te razvoj banki čestica za standardizirane programe testiranja diljem svijeta.
Kako se mjeri
IRT je sama po sebi metodologija mjerenja, a ne sadržajna psihološka teorija. Uobičajeni modeli uključuju jednoparametarski (1PL/Rasch), dvoparametarski (2PL) i troparametarski (3PL) logistički model za dihotomne čestice te model stupnjevanih odgovora (Graded Response Model) i model djelomičnog bodovanja (Partial Credit Model) za politomne čestice. Parametri se procjenjuju metodom najveće vjerojatnosti ili bayesovskim metodama.
Kritike i ograničenja
Ključna kritika odnosi se na stroge parametarske pretpostavke koje zahtijevaju IRT modeli (poput jednodimenzionalnosti i lokalne neovisnosti), a koje možda ne vrijede za složene psihološke konstrukte, što dovodi do neslaganja modela s podacima. Zajednica Raschova modela i šira IRT zajednica temeljno se ne slažu oko toga treba li model prilagoditi podacima (IRT pristup) ili podaci trebaju zadovoljiti zahtjeve modela za temeljno mjerenje (Raschov pristup). IRT zahtijeva relativno velike uzorke za stabilnu procjenu parametara (obično 200-1000+ ispitanika, ovisno o modelu), što ograničava njegovu primjenjivost u procjenama malog opsega.
Ključne publikacije
- Lord, F. M.. (1980). Applications of Item Response Theory to Practical Testing Problems.
- Lord, F. M. & Novick, M. R.. (1968). Statistical Theories of Mental Test Scores.
- Rasch, G.. (1960). Probabilistic Models for Some Intelligence and Attainment Tests.
- Hambleton, R. K., Swaminathan, H. & Rogers, H. J.. (1991). Fundamentals of Item Response Theory.
- Embretson, S. E. & Reise, S. P.. (2000). Item Response Theory for Psychologists. 10.4324/9781410605269