noesisnoesis
Halo-haloMatibay na ebidensya

Teorya ng Pagtugon sa Aytem

Lord, F. M. · 1980

Kilala rin bilang: IRT · Rasch · Rasch Measurement Theory · Latent Trait Theory

Ang Item Response Theory ay isang pamilya ng mga modelong matematikal na naglalarawan ng ugnayan ng mga nakatagong katangian (kakayahan, saloobin) at ng mga sagot sa mga aytem ng pagsusulit, na nagbibigay-daan sa kalibrasyon ng aytem na hindi nakadepende sa sample at sa pagsukat ng tao na hindi nakadepende sa pagsusulit. Hindi tulad ng Classical Test Theory, minomodelo ng IRT ang mga katangian sa antas ng aytem (hirap, diskriminasyon, panghuhula) at ang kakayahan ng tao sa iisang sukatan, at nagbibigay ito ng tantiya ng katumpakan ng pagsukat sa bawat antas ng kakayahan. Ang IRT ang batayan ng makabagong computerized adaptive testing, ng malakihang pagtatasang pang-edukasyon (PISA, GRE, GMAT) at ng mga klinikal na sukatan ng patient-reported outcome.

Metodolohikal na balangkas (hindi tungkol sa nilalaman ng katangian) na nagmomodelo sa probabilidad ng isang sagot bilang punsiyon ng antas ng nakatagong katangian at ng mga parameter ng aytem (hirap, diskriminasyon, panghuhula). Sinusuportahan nito ang adaptive/CAT na pagsagot sa pagsusulit sa halip na ang nilalaman ng anumang iisang instrumento.

Pinagmulan:
Lord, F. M. (1980). Applications of Item Response Theory to Practical Testing Problems.

Ebidensya sa isang sulyap

Empirikal na suporta
Matibay na ebidensya
Replikasyon
Mahusay na naulit
Cross-cultural
Pangkalahatan
Mga meta-analysis
10 na-index
Mga larangan ng pananaliksikPsychometricsPagsukat sa edukasyonKlinikal na pagtatasaPagbuo ng pagsusulitComputerized adaptive testing

Binubuod ng mga markang ito ang nailathalang literatura tungkol sa teorya, hindi ang kalidad ng alinmang pagsusulit na nakabatay rito. Ito ay mga editoryal na paghatol batay sa mga sangguniang nakalista sa ibaba, at nagbabago ang mga ito habang dumarami ang ebidensya.

Kontekstong Pangkasaysayan

Inilatag nang magkahiwalay ang mga pundasyon ng IRT ni Georg Rasch sa Denmark (1960) at nina Frederic Lord at Allan Birnbaum sa United States (dekada 1960), at ang 'Statistical Theories of Mental Test Scores' nina Lord at Novick noong 1968 ang nagbigay ng batayang matematikal. Pinagtibay ng 'Applications of Item Response Theory to Practical Testing Problems' ni Lord noong 1980 ang larangan sa pamamagitan ng pagpapakita ng praktikal na gamit sa pagbuo ng pagsusulit, equating at pagtukoy ng bias. Malawak na tinanggap ang teorya noong dekada 1980-1990 dahil sa lumalaking kakayahan ng kompyuter, na nagpangyari sa pagtatantiya ng parameter para sa malakihang programa ng pagsusulit.

Mga Konstruk

Wala pang naidokumentong konstruk.

Mga Instrumento

Wala pang instrumentong nakabatay sa teoryang ito.

Mga pagsusulit na nakabatay sa teoryang ito

Wala pang pagsusulit na nakabatay sa teoryang ito.

Mga Praktikal na Aplikasyon

Ang IRT ang pundasyon ng computerized adaptive testing (CAT), na ginagamit sa mga pagtatasang mataas ang nakataya gaya ng GRE, GMAT, NCLEX na pagsusulit para sa lisensya ng nars, at ng CAT-ASVAB na baterya ng militar, at nagbibigay-daan ito sa mas maiikli ngunit mas tumpak na pagsusulit sa pamamagitan ng pagpili ng mga aytem na angkop sa antas ng kakayahan ng bawat kumukuha. Sa klinikal na larangan, pinatatakbo ng IRT ang inisyatibang PROMIS (Patient-Reported Outcomes Measurement Information System), na nagbibigay-daan sa mahusay na pagsukat ng mga resulta sa kalusugan. Sinusuportahan din ng mga pamamaraan ng IRT ang test equating sa iba't ibang anyo, ang pagtukoy ng differential item functioning (DIF) para sa pagsusuri ng pagkamakatarungan, at ang pagbuo ng item bank para sa mga pamantayang programa ng pagsusulit sa buong mundo.

Paano Ito Sinusukat

Ang IRT mismo ay isang metodolohiya ng pagsukat sa halip na isang makabuluhang teoryang sikolohikal. Kabilang sa mga karaniwang modelo ang one-parameter (1PL/Rasch), two-parameter (2PL) at three-parameter (3PL) logistic model para sa mga dikotomong aytem, at ang Graded Response Model at Partial Credit Model para sa mga politomong aytem. Gumagamit ang pagtatantiya ng parameter ng maximum likelihood o mga pamamaraang Bayesian.

Mga Kritika at Limitasyon

Isang pangunahing puna ang matitibay na parametrikong palagay na hinihingi ng mga modelong IRT (gaya ng unidimensionality at local independence), na maaaring hindi tumutugma sa masasalimuot na sikolohikal na konstruk, kaya nagkakaroon ng hindi pagkakatugma ng modelo. Saligang hindi nagkakasundo ang komunidad ng Rasch model at ang mas malawak na komunidad ng IRT kung ang modelo ba ang dapat iangkop sa datos (pananaw ng IRT) o ang datos ang dapat tumugon sa mga hinihingi ng modelo para sa saligang pagsukat (pananaw ng Rasch). Nangangailangan ang IRT ng medyo malalaking sample para sa matatag na pagtatantiya ng mga parameter (karaniwang 200-1000+ na kumukuha ng pagsusulit depende sa modelo), kaya limitado ang paggamit nito sa maliliit na pagtatasa.

Mga Pangunahing Publikasyon

  • Lord, F. M.. (1980). Applications of Item Response Theory to Practical Testing Problems.
  • Lord, F. M. & Novick, M. R.. (1968). Statistical Theories of Mental Test Scores.
  • Rasch, G.. (1960). Probabilistic Models for Some Intelligence and Attainment Tests.
  • Hambleton, R. K., Swaminathan, H. & Rogers, H. J.. (1991). Fundamentals of Item Response Theory.
  • Embretson, S. E. & Reise, S. P.. (2000). Item Response Theory for Psychologists. 10.4324/9781410605269

Mga Kaugnay na Teorya

Classical Test TheoryRasch Measurement TheoryGeneralizability TheoryLatent Trait TheoryFactor Analysis
Teorya ng Pagtugon sa Aytem: kahulugan, ebidensya at kung paano ito sinusukat | NOESIS