Osioresponssiteoria
Lord, F. M. · 1980
Tunnetaan myös nimellä: IRT · Rasch · Rasch Measurement Theory · Latent Trait Theory
Osioresponssiteoria on joukko matemaattisia malleja, jotka kuvaavat piilevien piirteiden (kyvyt, asenteet) ja testiosioihin annettujen vastausten välistä suhdetta, ja se mahdollistaa otoksesta riippumattoman osioiden kalibroinnin ja testistä riippumattoman henkilön mittaamisen. Toisin kuin klassinen testiteoria, IRT mallintaa osiotason ominaisuuksia (vaikeus, erottelukyky, arvaaminen) ja henkilön kykyä yhteisellä asteikolla ja antaa mittaustarkkuuden arviot kullakin kykytasolla. IRT on nykyaikaisen tietokoneistetun adaptiivisen testauksen, laajojen koulutusarviointien (PISA, GRE, GMAT) ja kliinisten potilaan raportoimien tulosmittareiden perusta.
Metodologinen (ei piirteen sisältöön liittyvä) viitekehys, joka mallintaa vastauksen todennäköisyyttä latentin piirteen tason ja osioparametrien (vaikeus, erottelukyky, arvaaminen) funktiona. Tukee adaptiivista/CAT-pohjaista testin suorittamista eikä minkään yksittäisen mittarin sisältöä.
- Lähde:
- Lord, F. M. (1980). Applications of Item Response Theory to Practical Testing Problems.
Näyttö yhdellä silmäyksellä
- Empiirinen tuki
- Vahva näyttö
- Replikointi
- Hyvin toistettu
- Kulttuurienvälinen
- Universaali
- Meta-analyysit
- 10 indeksoitua
Nämä arviot tiivistävät teoriaa koskevan julkaistun kirjallisuuden, eivät minkään yksittäisen siihen perustuvan testin laatua. Ne ovat toimituksellisia arvioita alla luetelluista lähteistä, ja ne muuttuvat näytön karttuessa.
Historiallinen konteksti
IRT:n perustan loivat toisistaan riippumatta Georg Rasch Tanskassa (1960) sekä Frederic Lord ja Allan Birnbaum Yhdysvalloissa (1960-luvulla), ja Lordin ja Novickin vuonna 1968 julkaisema 'Statistical Theories of Mental Test Scores' antoi sille matemaattisen pohjan. Lordin vuonna 1980 julkaisema 'Applications of Item Response Theory to Practical Testing Problems' vakiinnutti alan osoittamalla käytännön sovelluksia testien laadinnassa, yhtäläistämisessä ja vinoumien havaitsemisessa. Teoria yleistyi laajasti 1980- ja 1990-luvuilla laskentatehon kasvaessa, mikä teki parametrien estimoinnista mahdollista laajoissa testausohjelmissa.
Konstruktit
Konstrukteja ei ole vielä dokumentoitu.
Mittarit
Tälle teorialle ei ole vielä rakennettu mittareita.
Tähän teoriaan perustuvat testit
Tälle teorialle ei ole vielä rakennettu testejä.
Käytännön sovellukset
IRT on tietokoneistetun adaptiivisen testauksen (CAT) perusta. Sitä käytetään suuren panoksen arvioinneissa, kuten GRE, GMAT, NCLEX-sairaanhoitajien laillistamiskoe ja sotilaallinen CAT-ASVAB-testipatteristo, ja se mahdollistaa lyhyemmät mutta tarkemmat testit valitsemalla osiot kunkin testattavan kykytason mukaan. Kliinisessä työssä IRT on PROMIS (Patient-Reported Outcomes Measurement Information System) -hankkeen perusta, mikä mahdollistaa terveystulosten tehokkaan mittaamisen. IRT-menetelmät tukevat myös testiversioiden yhtäläistämistä, osioiden differentiaalisen toiminnan (DIF) havaitsemista oikeudenmukaisuusanalyysissä ja osiopankkien kehittämistä standardoituihin testausohjelmiin kaikkialla maailmassa.
Miten sitä mitataan
IRT on itsessään mittausmenetelmä eikä sisällöllinen psykologinen teoria. Yleisiä malleja ovat yksiparametrinen (1PL/Rasch), kaksiparametrinen (2PL) ja kolmiparametrinen (3PL) logistinen malli kaksiluokkaisille osioille sekä Graded Response Model ja Partial Credit Model moniluokkaisille osioille. Parametrien estimoinnissa käytetään suurimman uskottavuuden tai bayesiläisiä menetelmiä.
Kritiikki ja rajoitukset
Keskeinen kritiikki kohdistuu IRT-mallien edellyttämiin vahvoihin parametrisiin oletuksiin (kuten yksiulotteisuus ja paikallinen riippumattomuus), jotka eivät välttämättä päde monimutkaisiin psykologisiin konstrukteihin, mikä johtaa mallin huonoon yhteensopivuuteen. Rasch-mallin tutkijayhteisö ja laajempi IRT-yhteisö ovat perustavasti eri mieltä siitä, pitäisikö malli sovittaa aineistoon (IRT-lähestymistapa) vai pitäisikö aineiston täyttää mallin vaatimukset perustavaa mittaamista varten (Rasch-lähestymistapa). IRT vaatii suhteellisen suuria otoskokoja vakaaseen parametrien estimointiin (tyypillisesti 200-1000+ vastaajaa mallista riippuen), mikä rajoittaa sen soveltuvuutta pienimuotoisiin arviointeihin.
Keskeiset julkaisut
- Lord, F. M.. (1980). Applications of Item Response Theory to Practical Testing Problems.
- Lord, F. M. & Novick, M. R.. (1968). Statistical Theories of Mental Test Scores.
- Rasch, G.. (1960). Probabilistic Models for Some Intelligence and Attainment Tests.
- Hambleton, R. K., Swaminathan, H. & Rogers, H. J.. (1991). Fundamentals of Item Response Theory.
- Embretson, S. E. & Reise, S. P.. (2000). Item Response Theory for Psychologists. 10.4324/9781410605269