Teoria della Risposta all'Item
Lord, F. M. · 1980
Conosciuta anche come: IRT · Rasch
La Item Response Theory è una famiglia di modelli matematici che descrivono la relazione tra tratti latenti (abilità, atteggiamenti) e risposte agli item di un test, consentendo una calibrazione degli item indipendente dal campione e una misurazione delle persone indipendente dal test. A differenza della Teoria Classica dei Test, la IRT modella le caratteristiche a livello di item (difficoltà, discriminazione, indovinamento) e l'abilità della persona su una scala comune, fornendo stime di precisione della misurazione a ciascun livello di abilità. La IRT è alla base del moderno testing adattivo computerizzato, delle valutazioni educative su larga scala (PISA, GRE, GMAT) e delle misure cliniche di esito riferite dal paziente.
Quadro metodologico (non di contenuto del tratto) che modella la probabilità di una risposta come funzione del livello del tratto latente e dei parametri dell'item (difficoltà, discriminazione, indovinamento). Supporta la somministrazione adattiva/CAT piuttosto che il contenuto di uno strumento specifico.
- Fonte:
- Lord, F. M. (1980). Applications of Item Response Theory to Practical Testing Problems.
Contesto Storico
I fondamenti della IRT furono posti indipendentemente da Georg Rasch in Danimarca (1960) e da Frederic Lord e Allan Birnbaum negli Stati Uniti (anni '60), con 'Statistical Theories of Mental Test Scores' di Lord e Novick (1968) che fornì le basi matematiche. 'Applications of Item Response Theory to Practical Testing Problems' di Lord (1980) consolidò il campo dimostrando applicazioni pratiche nella costruzione dei test, nell'equating e nella rilevazione dei bias. La teoria ottenne un'adozione diffusa negli anni '80-'90 con l'aumento della potenza di calcolo, rendendo fattibile la stima dei parametri per programmi di testing su larga scala.
Costrutti
Nessun costrutto ancora documentato.
Strumenti
Nessuno strumento ancora basato su questa teoria.
Test basati su questa teoria
Nessun test ancora basato su questa teoria.
Applicazioni Pratiche
La IRT è il fondamento del testing adattivo computerizzato (CAT), utilizzato in valutazioni ad alto impatto come il GRE, il GMAT, l'esame di abilitazione infermieristica NCLEX e la batteria militare CAT-ASVAB, consentendo test più brevi ma più precisi grazie alla selezione di item calibrati sul livello di abilità di ciascun esaminando. In ambito clinico, la IRT è alla base dell'iniziativa PROMIS (Patient-Reported Outcomes Measurement Information System), che consente una misurazione efficiente degli esiti di salute. I metodi IRT supportano inoltre l'equating dei test tra forme diverse, il rilevamento del differential item functioning (DIF) per l'analisi dell'equità, e lo sviluppo di banche di item per programmi di testing standardizzato in tutto il mondo.
Come Viene Misurata
La IRT è essa stessa una metodologia di misurazione piuttosto che una teoria psicologica sostanziale. I modelli comuni includono i modelli logistici a un parametro (1PL/Rasch), a due parametri (2PL) e a tre parametri (3PL) per item dicotomici, e il Graded Response Model e il Partial Credit Model per item politomici. La stima dei parametri utilizza metodi di massima verosimiglianza o bayesiani.
Critiche e Limiti
Una critica fondamentale riguarda le forti assunzioni parametriche richieste dai modelli IRT (come unidimensionalità e indipendenza locale), che potrebbero non essere soddisfatte per costrutti psicologici complessi, portando a un cattivo adattamento del modello. La comunità del modello di Rasch e la più ampia comunità IRT sono in disaccordo di fondo sul fatto che il modello debba essere adattato ai dati (approccio IRT) o che i dati debbano soddisfare i requisiti del modello per una misurazione fondamentale (approccio Rasch). La IRT richiede dimensioni campionarie relativamente ampie per una stima stabile dei parametri (tipicamente 200-1000+ esaminandi a seconda del modello), limitandone l'applicabilità a valutazioni su piccola scala.
Pubblicazioni Chiave
- Lord, F. M.. (1980). Applications of Item Response Theory to Practical Testing Problems.
- Lord, F. M. & Novick, M. R.. (1968). Statistical Theories of Mental Test Scores.
- Rasch, G.. (1960). Probabilistic Models for Some Intelligence and Attainment Tests.
- Hambleton, R. K., Swaminathan, H. & Rogers, H. J.. (1991). Fundamentals of Item Response Theory.
- Embretson, S. E. & Reise, S. P.. (2000). Item Response Theory for Psychologists. 10.4324/9781410605269