Cosa può e non può misurare l'autovalutazione
I questionari ti chiedono di osservare te stesso, il che funziona meglio per alcune cose che per altre. Sapere dove il metodo è solido e dove invece fallisce cambia il modo in cui interpreti qualsiasi risultato.
Quasi ogni strumento di personalità e benessere ampiamente utilizzato è un questionario di autovalutazione. Leggi un'affermazione, valuti quanto ti descrive bene e i punteggi vengono sommati. È economico, rapido, scalabile e presenta reali punti di forza — ma ha modalità di fallimento che vale la pena conoscere prima di leggere i propri risultati.
Dove funziona bene
Stati interni che nessun altro può osservare. Soddisfazione di vita, stress percepito, senso del significato, ansia vissuta. Per questi aspetti, la persona non è semplicemente una fonte comoda: è l'unica valida. Chi osserva dall'esterno e valuta il tuo benessere soggettivo non fa altro che intuire.
Comportamenti tipici aggregati nel tempo. Le persone sono ragionevolmente brave a riferire ciò che fanno di solito, anche quando faticano a prevedere un singolo episodio. Le misure di tratto funzionano proprio perché fanno una media tra le diverse occasioni.
La percezione di sé come oggetto di interesse in sé. Quanto credi di essere capace influenza ciò che cerchi di fare, indipendentemente da quanto lo sei davvero. L'autoefficacia è un costrutto legittimo proprio perché la credenza ha conseguenze concrete.
Dove si rompe
Risposte socialmente desiderabili. Le persone si descrivono come più coscienziose, più empatiche e meno ostili di quanto siano in realtà, e questo effetto cresce con la posta in gioco. In un contesto di autoconoscenza a basse stakes, la distorsione è modesta. In ambito di selezione del personale è severa: la formulazione trasparente della maggior parte degli item di personalità li rende facilmente falsificabili, e i candidati più motivati a farlo sono proprio quelli che il datore di lavoro vorrebbe maggiormente identificare.
Scarsa capacità di introspezione. Le autovalutazioni correlano solo moderatamente con le valutazioni di persone che conoscono bene il soggetto, e il divario è maggiore proprio dove lo si prevederebbe — per i tratti con un peso valutativo, e nelle persone la cui visione di sé è meno accurata. Chi non si accorge della propria disattenzione non è nella posizione migliore per riferirla.
Capacità versus credenza. Un'autovalutazione non può misurare una competenza. L'intelligenza emotiva autoriferita misura quanto ti ritieni emotivamente capace, il che correla solo modestamente con la prestazione in compiti che richiedono giudizio emotivo. Entrambi sono costrutti reali, ma non sono la stessa cosa, e confonderli è uno degli errori più comuni nel mercato dei test commerciali.
Effetti del gruppo di riferimento. «Lavoro sodo» viene valutato rispetto a un gruppo di confronto implicito che varia da persona a persona e da cultura a cultura. Questo rende inaffidabili le comparazioni transculturali delle medie grezze dell'autovalutazione in modi facili da trascurare e difficili da correggere.
L'umore al momento della risposta. L'affettività corrente colora sistematicamente i giudizi retrospettivi. Un punteggio rilevato in un'unica occasione su un costrutto che dovrebbe essere stabile porta con sé più varianza di stato di quanto il quadro del tratto lasci intendere.
Stili di risposta. L'acquiescenza — concordare indipendentemente dal contenuto — e le risposte estreme variano tra individui e tra culture. Le scale ben costruite attenuano questo problema con item formulati in modo inverso, il che introduce però un proprio artefatto: le scale con formulazione mista producono sistematicamente un secondo fattore spurio che riflette la formulazione, non il contenuto.
Come leggere i propri risultati alla luce di tutto questo
Considerate il punteggio di un'autovalutazione come un resoconto strutturato di come vedi te stesso, il che è genuinamente informativo e non equivale a un resoconto di come sei.
Il divario tra i due è spesso la parte più interessante. Quando un punteggio ti sorprende, la domanda su cui vale la pena soffermarsi non è se il test sia sbagliato, ma quale delle due letture — la tua o quella dello strumento — le persone intorno a te riconoscerebbero.
Questo è anche il limite onesto di ciò che un questionario può offrire, e un buon motivo per trattare qualsiasi singolo punteggio come un elemento tra tanti, non come un verdetto.
Mettilo alla prova
Leggere di misura è una cosa. Vedere il proprio punteggio con la fonte, il campione normativo e i limiti dichiarati è un'altra. Gratis, senza registrazione.
Continua a leggere
- Cos'è la psicometria?La disciplina che stabilisce se una misurazione psicologica è valida — e il motivo per cui due test che pongono domande simili possono differire enormemente nel valore dei loro risultati.
- Cos'è l'attendibilità nei test psicologici?L'attendibilità è la coerenza della misurazione, non la sua correttezza. Un test può essere altamente attendibile e misurare comunque la cosa sbagliata — ecco perché è la prima domanda da porsi, ma mai l'ultima.
- Cos'è la validità nei test psicologici?La validità non è una proprietà che un test possiede. È un argomento riguardo al fatto che una particolare interpretazione di un particolare punteggio, per uno scopo particolare, sia difendibile — e deve essere ricostruita per ogni nuovo utilizzo.
- Cos'è la validità di costrutto?La domanda più difficile nella misurazione: se ciò che si sta misurando esiste così come lo si è definito, e se lo strumento lo raggiunge anziché qualcosa di adiacente.
- Validità convergente e discriminanteDue requisiti speculari: una misura deve concordare con ciò con cui dovrebbe concordare, e deve restare distinta da ciò da cui afferma di differire. La maggior parte degli strumenti deboli fallisce il secondo.
- Cos'è l'alpha di Cronbach — e cosa non èLa statistica più riportata nei test psicologici, e la più fraintesa. L'alpha non indica che una scala è unidimensionale, e un valore elevato è spesso un sintomo anziché un pregio.
- Errore standard di misurazione: di quanto potrebbe sbagliarsi il tuo punteggioOgni punteggio porta con sé un margine di errore, e per la maggior parte dei test psicologici è più ampio di quanto le persone suppongano. Questo è il numero che ti dice quando una differenza è reale e quando è solo rumore.
- Norme e percentili: con cosa viene confrontato il tuo punteggioUn punteggio grezzo è di per sé ininterpretabile. Diventa significativo solo in relazione a un gruppo di riferimento — e quale gruppo sia stato utilizzato è uno dei fatti più rilevanti e meno pubblicizzati di qualsiasi test.
- Come viene costruito davvero un test psicometricoDalla definizione del costrutto alle norme pubblicate, il processo richiede anni e scarta la maggior parte di ciò che vi viene immesso. Conoscere le fasi rende evidente quali siano quelle che un rapido quiz online ha saltato.
- Cosa significa quando un test viene definito validato?Il termine non è regolamentato e viene usato liberamente da prodotti che non hanno fatto nessuno dei lavori necessari. Ecco cosa significa quando ha un senso concreto, e le quattro domande che separano i due casi.
- Perché la maggior parte dei test di personalità su internet non sono affidabiliNon perché siano disonesti, ma perché i passaggi che rendono una misurazione attendibile sono invisibili, costosi e facili da saltare — e saltarli non cambia nulla all'aspetto del risultato.
- Cosa significa quando un test prevede qualcosaUna correlazione di 0,30 è un risultato solido nella ricerca sulla personalità e una base debole per una decisione su una singola persona. Entrambe le affermazioni sono vere, e il divario tra di esse è la causa principale dell'uso improprio dei risultati dei test.
- Lo screening non è una diagnosiUn questionario di screening è concepito per intercettare il maggior numero possibile di casi, accettando un alto tasso di falsi positivi come prezzo da pagare. Interpretare un punteggio di screening come una diagnosi inverte lo scopo per cui è stato progettato.