noesisnoesis
MješovitoSnažni dokazi

Teorija odgovora na čestice

Lord, F. M. · 1980

Poznato i kao: IRT · Rasch · Rasch Measurement Theory · Latent Trait Theory

Teorija odgovora na čestice obitelj je matematičkih modela koji opisuju odnos između latentnih crta (sposobnosti, stavova) i odgovora na čestice testa, omogućujući kalibraciju čestica neovisnu o uzorku i mjerenje osoba neovisno o testu. Za razliku od klasične teorije testova, IRT modelira obilježja na razini čestice (težinu, diskriminativnost, pogađanje) i sposobnost osobe na zajedničkoj ljestvici, dajući procjene preciznosti mjerenja na svakoj razini sposobnosti. IRT je temelj suvremenog računalnog adaptivnog testiranja, obrazovnih procjena velikih razmjera (PISA, GRE, GMAT) i kliničkih mjera ishoda koje izvještavaju sami pacijenti.

Metodološki okvir (a ne okvir sadržaja crta) koji modelira vjerojatnost odgovora kao funkciju razine latentne crte i parametara čestice (težina, diskriminativnost, pogađanje). Podupire adaptivnu primjenu (CAT), a ne sadržaj nekog pojedinačnog instrumenta.

Izvor:
Lord, F. M. (1980). Applications of Item Response Theory to Practical Testing Problems.

Dokazi na prvi pogled

Empirijska potpora
Snažni dokazi
Replikacija
Dobro repliciran
Međukulturno
Univerzalno
Metaanalize
10 indeksirano
Područja istraživanjaPsihometrijaObrazovno mjerenjeKlinička procjenaRazvoj testovaRačunalno adaptivno testiranje

Ove ocjene sažimaju objavljenu literaturu o teoriji, a ne kvalitetu pojedinog testa koji se na njoj temelji. Riječ je o uredničkim procjenama na temelju dolje navedenih izvora i mijenjaju se kako se dokazi gomilaju.

Povijesni kontekst

Temelje IRT-a neovisno su postavili Georg Rasch u Danskoj (1960.) te Frederic Lord i Allan Birnbaum u Sjedinjenim Američkim Državama (1960-ih), a matematičku podlogu dala je knjiga Lorda i Novicka iz 1968. "Statistical Theories of Mental Test Scores". Lordova knjiga iz 1980. "Applications of Item Response Theory to Practical Testing Problems" učvrstila je područje pokazujući praktične primjene u konstrukciji testova, izjednačavanju i otkrivanju pristranosti. Teorija je široko prihvaćena 1980-ih i 1990-ih s rastom računalne snage, koja je procjenu parametara učinila izvedivom za programe testiranja velikih razmjera.

Konstrukti

Još nema dokumentiranih konstrukata.

Instrumenti

Još nema instrumenata izgrađenih na ovoj teoriji.

Testovi utemeljeni na ovoj teoriji

Još nema testova izgrađenih na ovoj teoriji.

Praktične primjene

IRT je temelj računalnog adaptivnog testiranja (CAT) koje se koristi u procjenama s velikim posljedicama, poput GRE, GMAT, ispita za licenciranje medicinskih sestara NCLEX i vojne baterije CAT-ASVAB, a omogućuje kraće, ali preciznije testove odabirom čestica prilagođenih razini sposobnosti svakog ispitanika. U kliničkom okruženju IRT pokreće inicijativu PROMIS (Patient-Reported Outcomes Measurement Information System), omogućujući učinkovito mjerenje zdravstvenih ishoda. IRT metode podržavaju i izjednačavanje testova među oblicima, otkrivanje diferencijalnog funkcioniranja čestica (DIF) za analizu pravednosti te razvoj banki čestica za standardizirane programe testiranja diljem svijeta.

Kako se mjeri

IRT je sama po sebi metodologija mjerenja, a ne sadržajna psihološka teorija. Uobičajeni modeli uključuju jednoparametarski (1PL/Rasch), dvoparametarski (2PL) i troparametarski (3PL) logistički model za dihotomne čestice te model stupnjevanih odgovora (Graded Response Model) i model djelomičnog bodovanja (Partial Credit Model) za politomne čestice. Parametri se procjenjuju metodom najveće vjerojatnosti ili bayesovskim metodama.

Kritike i ograničenja

Ključna kritika odnosi se na stroge parametarske pretpostavke koje zahtijevaju IRT modeli (poput jednodimenzionalnosti i lokalne neovisnosti), a koje možda ne vrijede za složene psihološke konstrukte, što dovodi do neslaganja modela s podacima. Zajednica Raschova modela i šira IRT zajednica temeljno se ne slažu oko toga treba li model prilagoditi podacima (IRT pristup) ili podaci trebaju zadovoljiti zahtjeve modela za temeljno mjerenje (Raschov pristup). IRT zahtijeva relativno velike uzorke za stabilnu procjenu parametara (obično 200-1000+ ispitanika, ovisno o modelu), što ograničava njegovu primjenjivost u procjenama malog opsega.

Ključne publikacije

  • Lord, F. M.. (1980). Applications of Item Response Theory to Practical Testing Problems.
  • Lord, F. M. & Novick, M. R.. (1968). Statistical Theories of Mental Test Scores.
  • Rasch, G.. (1960). Probabilistic Models for Some Intelligence and Attainment Tests.
  • Hambleton, R. K., Swaminathan, H. & Rogers, H. J.. (1991). Fundamentals of Item Response Theory.
  • Embretson, S. E. & Reise, S. P.. (2000). Item Response Theory for Psychologists. 10.4324/9781410605269

Povezane teorije

Classical Test TheoryRasch Measurement TheoryGeneralizability TheoryLatent Trait TheoryFactor Analysis
Teorija odgovora na čestice: definicija, dokazi i način mjerenja | NOESIS