noesisnoesis
VaihtelevaVahva näyttö

Osioresponssiteoria

Lord, F. M. · 1980

Tunnetaan myös nimellä: IRT · Rasch · Rasch Measurement Theory · Latent Trait Theory

Osioresponssiteoria on joukko matemaattisia malleja, jotka kuvaavat piilevien piirteiden (kyvyt, asenteet) ja testiosioihin annettujen vastausten välistä suhdetta, ja se mahdollistaa otoksesta riippumattoman osioiden kalibroinnin ja testistä riippumattoman henkilön mittaamisen. Toisin kuin klassinen testiteoria, IRT mallintaa osiotason ominaisuuksia (vaikeus, erottelukyky, arvaaminen) ja henkilön kykyä yhteisellä asteikolla ja antaa mittaustarkkuuden arviot kullakin kykytasolla. IRT on nykyaikaisen tietokoneistetun adaptiivisen testauksen, laajojen koulutusarviointien (PISA, GRE, GMAT) ja kliinisten potilaan raportoimien tulosmittareiden perusta.

Metodologinen (ei piirteen sisältöön liittyvä) viitekehys, joka mallintaa vastauksen todennäköisyyttä latentin piirteen tason ja osioparametrien (vaikeus, erottelukyky, arvaaminen) funktiona. Tukee adaptiivista/CAT-pohjaista testin suorittamista eikä minkään yksittäisen mittarin sisältöä.

Lähde:
Lord, F. M. (1980). Applications of Item Response Theory to Practical Testing Problems.

Näyttö yhdellä silmäyksellä

Empiirinen tuki
Vahva näyttö
Replikointi
Hyvin toistettu
Kulttuurienvälinen
Universaali
Meta-analyysit
10 indeksoitua
TutkimusalueetPsykometriikkaKasvatustieteellinen mittausKliininen arviointiTestien kehittäminenTietokoneistettu adaptiivinen testaus

Nämä arviot tiivistävät teoriaa koskevan julkaistun kirjallisuuden, eivät minkään yksittäisen siihen perustuvan testin laatua. Ne ovat toimituksellisia arvioita alla luetelluista lähteistä, ja ne muuttuvat näytön karttuessa.

Historiallinen konteksti

IRT:n perustan loivat toisistaan riippumatta Georg Rasch Tanskassa (1960) sekä Frederic Lord ja Allan Birnbaum Yhdysvalloissa (1960-luvulla), ja Lordin ja Novickin vuonna 1968 julkaisema 'Statistical Theories of Mental Test Scores' antoi sille matemaattisen pohjan. Lordin vuonna 1980 julkaisema 'Applications of Item Response Theory to Practical Testing Problems' vakiinnutti alan osoittamalla käytännön sovelluksia testien laadinnassa, yhtäläistämisessä ja vinoumien havaitsemisessa. Teoria yleistyi laajasti 1980- ja 1990-luvuilla laskentatehon kasvaessa, mikä teki parametrien estimoinnista mahdollista laajoissa testausohjelmissa.

Konstruktit

Konstrukteja ei ole vielä dokumentoitu.

Mittarit

Tälle teorialle ei ole vielä rakennettu mittareita.

Tähän teoriaan perustuvat testit

Tälle teorialle ei ole vielä rakennettu testejä.

Käytännön sovellukset

IRT on tietokoneistetun adaptiivisen testauksen (CAT) perusta. Sitä käytetään suuren panoksen arvioinneissa, kuten GRE, GMAT, NCLEX-sairaanhoitajien laillistamiskoe ja sotilaallinen CAT-ASVAB-testipatteristo, ja se mahdollistaa lyhyemmät mutta tarkemmat testit valitsemalla osiot kunkin testattavan kykytason mukaan. Kliinisessä työssä IRT on PROMIS (Patient-Reported Outcomes Measurement Information System) -hankkeen perusta, mikä mahdollistaa terveystulosten tehokkaan mittaamisen. IRT-menetelmät tukevat myös testiversioiden yhtäläistämistä, osioiden differentiaalisen toiminnan (DIF) havaitsemista oikeudenmukaisuusanalyysissä ja osiopankkien kehittämistä standardoituihin testausohjelmiin kaikkialla maailmassa.

Miten sitä mitataan

IRT on itsessään mittausmenetelmä eikä sisällöllinen psykologinen teoria. Yleisiä malleja ovat yksiparametrinen (1PL/Rasch), kaksiparametrinen (2PL) ja kolmiparametrinen (3PL) logistinen malli kaksiluokkaisille osioille sekä Graded Response Model ja Partial Credit Model moniluokkaisille osioille. Parametrien estimoinnissa käytetään suurimman uskottavuuden tai bayesiläisiä menetelmiä.

Kritiikki ja rajoitukset

Keskeinen kritiikki kohdistuu IRT-mallien edellyttämiin vahvoihin parametrisiin oletuksiin (kuten yksiulotteisuus ja paikallinen riippumattomuus), jotka eivät välttämättä päde monimutkaisiin psykologisiin konstrukteihin, mikä johtaa mallin huonoon yhteensopivuuteen. Rasch-mallin tutkijayhteisö ja laajempi IRT-yhteisö ovat perustavasti eri mieltä siitä, pitäisikö malli sovittaa aineistoon (IRT-lähestymistapa) vai pitäisikö aineiston täyttää mallin vaatimukset perustavaa mittaamista varten (Rasch-lähestymistapa). IRT vaatii suhteellisen suuria otoskokoja vakaaseen parametrien estimointiin (tyypillisesti 200-1000+ vastaajaa mallista riippuen), mikä rajoittaa sen soveltuvuutta pienimuotoisiin arviointeihin.

Keskeiset julkaisut

  • Lord, F. M.. (1980). Applications of Item Response Theory to Practical Testing Problems.
  • Lord, F. M. & Novick, M. R.. (1968). Statistical Theories of Mental Test Scores.
  • Rasch, G.. (1960). Probabilistic Models for Some Intelligence and Attainment Tests.
  • Hambleton, R. K., Swaminathan, H. & Rogers, H. J.. (1991). Fundamentals of Item Response Theory.
  • Embretson, S. E. & Reise, S. P.. (2000). Item Response Theory for Psychologists. 10.4324/9781410605269

Aiheeseen liittyvät teoriat

Classical Test TheoryRasch Measurement TheoryGeneralizability TheoryLatent Trait TheoryFactor Analysis
Osioresponssiteoria: määritelmä, näyttö ja miten sitä mitataan | NOESIS