Θεωρία απόκρισης ερωτημάτων (Item Response Theory)
Lord, F. M. · 1980
Γνωστό και ως: IRT · Rasch · Rasch Measurement Theory · Latent Trait Theory
Η θεωρία απόκρισης ερωτημάτων είναι μια οικογένεια μαθηματικών μοντέλων που περιγράφουν τη σχέση μεταξύ λανθανόντων γνωρισμάτων (ικανοτήτων, στάσεων) και απαντήσεων σε ερωτήματα τεστ, επιτρέποντας τη βαθμονόμηση των ερωτημάτων ανεξάρτητα από το δείγμα και τη μέτρηση των ατόμων ανεξάρτητα από το τεστ. Σε αντίθεση με την Κλασική Θεωρία Τεστ, η IRT μοντελοποιεί τα χαρακτηριστικά σε επίπεδο ερωτήματος (δυσκολία, διακριτική ικανότητα, εικασία) και την ικανότητα του ατόμου σε κοινή κλίμακα, παρέχοντας εκτιμήσεις ακρίβειας μέτρησης σε κάθε επίπεδο ικανότητας. Η IRT στηρίζει τα σύγχρονα προσαρμοστικά τεστ μέσω υπολογιστή, τις εκπαιδευτικές αξιολογήσεις μεγάλης κλίμακας (PISA, GRE, GMAT) και τα κλινικά μέτρα αποτελεσμάτων που αναφέρονται από τους ασθενείς.
Μεθοδολογικό (όχι περιεχομένου γνωρίσματος) πλαίσιο που μοντελοποιεί την πιθανότητα μιας απάντησης ως συνάρτηση του λανθάνοντος επιπέδου του γνωρίσματος και των παραμέτρων του ερωτήματος (δυσκολία, διακριτική ικανότητα, εικασία). Στηρίζει την προσαρμοστική χορήγηση/CAT και όχι το περιεχόμενο κάποιου συγκεκριμένου εργαλείου.
- Πηγή:
- Lord, F. M. (1980). Applications of Item Response Theory to Practical Testing Problems.
Τα τεκμήρια με μια ματιά
- Εμπειρική υποστήριξη
- Ισχυρά τεκμήρια
- Αναπαραγωγή
- Με πολλές επιβεβαιώσεις
- Διαπολιτισμικό
- Καθολικό
- Μετα-αναλύσεις
- 10 ευρετηριασμένα
Αυτές οι αξιολογήσεις συνοψίζουν τη δημοσιευμένη βιβλιογραφία για τη θεωρία και όχι την ποιότητα ενός μεμονωμένου τεστ που βασίζεται σε αυτήν. Πρόκειται για συντακτικές κρίσεις βασισμένες στις πηγές που παρατίθενται παρακάτω και μεταβάλλονται καθώς συσσωρεύονται τα τεκμήρια.
Ιστορικό πλαίσιο
Τα θεμέλια της IRT τέθηκαν ανεξάρτητα από τον Georg Rasch στη Δανία (1960) και από τους Frederic Lord και Allan Birnbaum στις Ηνωμένες Πολιτείες (δεκαετία του 1960), με το έργο των Lord και Novick του 1968 «Statistical Theories of Mental Test Scores» να παρέχει τη μαθηματική βάση. Το έργο του Lord του 1980 «Applications of Item Response Theory to Practical Testing Problems» ενοποίησε τον κλάδο, καταδεικνύοντας πρακτικές εφαρμογές στην κατασκευή τεστ, στην εξίσωση και στον εντοπισμό μεροληψίας. Η θεωρία γνώρισε ευρεία υιοθέτηση στις δεκαετίες 1980-1990 με την αύξηση της υπολογιστικής ισχύος, καθιστώντας εφικτή την εκτίμηση παραμέτρων για προγράμματα τεστ μεγάλης κλίμακας.
Κατασκευάσματα
Δεν έχουν τεκμηριωθεί ακόμη κατασκευάσματα.
Εργαλεία
Δεν υπάρχουν ακόμη εργαλεία βασισμένα σε αυτή τη θεωρία.
Τεστ βασισμένα σε αυτή τη θεωρία
Δεν υπάρχουν ακόμη τεστ βασισμένα σε αυτή τη θεωρία.
Πρακτικές εφαρμογές
Η IRT αποτελεί το θεμέλιο των προσαρμοστικών τεστ μέσω υπολογιστή (CAT), που χρησιμοποιούνται σε αξιολογήσεις υψηλού διακυβεύματος όπως τα GRE, GMAT, η εξέταση αδειοδότησης νοσηλευτών NCLEX και η στρατιωτική συστοιχία CAT-ASVAB, επιτρέποντας συντομότερα αλλά ακριβέστερα τεστ μέσω της επιλογής ερωτημάτων προσαρμοσμένων στο επίπεδο ικανότητας κάθε εξεταζόμενου. Σε κλινικά πλαίσια, η IRT στηρίζει την πρωτοβουλία PROMIS (Patient-Reported Outcomes Measurement Information System), επιτρέποντας την αποτελεσματική μέτρηση των αποτελεσμάτων υγείας. Οι μέθοδοι IRT υποστηρίζουν επίσης την εξίσωση τεστ μεταξύ διαφορετικών μορφών, τον εντοπισμό διαφορικής λειτουργίας των ερωτημάτων (DIF) για την ανάλυση της δικαιοσύνης και την ανάπτυξη τραπεζών ερωτημάτων για προγράμματα τυποποιημένων τεστ παγκοσμίως.
Πώς μετριέται
Η IRT είναι η ίδια μια μεθοδολογία μέτρησης και όχι μια ουσιαστική ψυχολογική θεωρία. Συνήθη μοντέλα είναι τα λογιστικά μοντέλα ενός παραμέτρου (1PL/Rasch), δύο παραμέτρων (2PL) και τριών παραμέτρων (3PL) για δίτιμα ερωτήματα, καθώς και το Graded Response Model και το Partial Credit Model για πολύτιμα ερωτήματα. Η εκτίμηση των παραμέτρων γίνεται με μεθόδους μέγιστης πιθανοφάνειας ή Bayes.
Κριτική και περιορισμοί
Μια βασική κριτική αφορά τις ισχυρές παραμετρικές υποθέσεις που απαιτούν τα μοντέλα IRT (όπως η μονοδιαστατικότητα και η τοπική ανεξαρτησία), οι οποίες μπορεί να μην ισχύουν για σύνθετα ψυχολογικά κατασκευάσματα και να οδηγούν σε ανεπαρκή προσαρμογή του μοντέλου. Η κοινότητα του μοντέλου Rasch και η ευρύτερη κοινότητα της IRT διαφωνούν ριζικά για το αν το μοντέλο πρέπει να προσαρμόζεται στα δεδομένα (προσέγγιση IRT) ή αν τα δεδομένα πρέπει να πληρούν τις απαιτήσεις του μοντέλου για θεμελιώδη μέτρηση (προσέγγιση Rasch). Η IRT απαιτεί σχετικά μεγάλα δείγματα για σταθερή εκτίμηση των παραμέτρων (συνήθως 200-1000+ εξεταζόμενοι ανάλογα με το μοντέλο), γεγονός που περιορίζει την εφαρμογή της σε αξιολογήσεις μικρής κλίμακας.
Βασικές δημοσιεύσεις
- Lord, F. M.. (1980). Applications of Item Response Theory to Practical Testing Problems.
- Lord, F. M. & Novick, M. R.. (1968). Statistical Theories of Mental Test Scores.
- Rasch, G.. (1960). Probabilistic Models for Some Intelligence and Attainment Tests.
- Hambleton, R. K., Swaminathan, H. & Rogers, H. J.. (1991). Fundamentals of Item Response Theory.
- Embretson, S. E. & Reise, S. P.. (2000). Item Response Theory for Psychologists. 10.4324/9781410605269