noesisnoesis
Slik fungerer måling

Hva er konstruktvaliditet?

Det vanskeligste spørsmålet innen måling: om det du måler, finnes slik du har definert det, og om instrumentet ditt når frem til det og ikke til noe som ligger like ved.

Konstruktvaliditet handler om hvorvidt et instrument måler det teoretiske konstruktet det hevder å måle, og ikke noe som korrelerer med det, noe som er snevrere enn det, eller ikke noe sammenhengende i det hele tatt. Det er den dypeste formen for validitetsevidens, og den som det tar år, ikke én studie, å etablere.

Vanskeligheten er strukturell. Et konstrukt som resiliens eller emosjonell intelligens er ikke en gjenstand; det er en antatt regelmessighet i atferd. For å vise at en skala måler det, må du samtidig forsvare påstanden om at konstruktet eksisterer slik det er beskrevet, og at akkurat disse leddene fanger det opp. De to påstandene kan ikke skilles fra hverandre, og derfor framstilte Cronbach og Meehl, som introduserte ideen i 1955, det som å teste et helt teoretisk nettverk snarere enn ett instrument.

Hvordan argumentasjonen bygges opp

Forventede korrelasjonsmønstre. Teorien sier hva konstruktet bør henge sammen med, og hvor sterkt. Selvmedfølelse bør korrelere positivt med livstilfredshet, negativt med depresjon og bare moderat med selvfølelse; hvis den korrelerte 0,9 med selvfølelse, ville den ikke vært et eget konstrukt. Hver eneste av disse forventningene er en testbar påstand, og det er informativt når én av dem slår feil.

Forventede gruppeforskjeller. Hvis teorien sier at et trekk utvikles med alderen, eller er forhøyet i en klinisk populasjon, bør instrumentet vise det. Å ikke finne en forskjell som teorien krever, er evidens mot instrumentet, teorien eller begge.

Respons på intervensjon. Hvis et konstrukt skal kunne trenes, bør skårene endre seg etter trening og ikke endre seg i en kontrollgruppe. Konstrukter som aldri responderer på noe, er vanskelige å skille fra artefakter.

Indre struktur. Faktorstrukturen bør samsvare med den teoretiske strukturen, og, viktigst, i et nytt utvalg. Eksplorerende faktoranalyse på utviklingsdataene vil finne den strukturen som ble bygget inn; det er i bekreftende analyse på nye data at påstanden faktisk testes.

Multitrekk-multimetode-ideen

Campbell og Fiskes bidrag fra 1959 var å insistere på at konstruktvaliditet krever to ting samtidig: mål på det samme trekket med ulike metoder bør stemme overens, og mål på ulike trekk med samme metode bør ikke det.

Det er i den andre halvdelen de fleste instrumenter kommer til kort. Hvis den selvrapporterte empatien din korrelerer 0,7 med den selvrapporterte medmenneskeligheten din og 0,2 med observatørvurdert empati, er det sterkeste spørreskjemaet ditt måler ikke empati; det er din generelle måte å beskrive deg selv på i spørreskjemaer. Metodevarians er et av de mest vedvarende problemene i forskning basert på selvrapportering, og det er grunnen til at seriøst valideringsarbeid søker et kriterium som ikke er et spørreskjema, der det finnes et.

Hvorfor dette betyr noe når du leser resultatene dine

Konstruktvaliditet er det som står mellom en skår og tolkningen av den. Når et godt validert instrument rapporterer at du skårer høyt på et trekk, omfatter resonnementet bak den påstanden flere tiår med publisert arbeid som har vist at trekket oppfører seg som en sammenhengende størrelse, at disse leddene fanger det opp, og at skåren betyr omtrent det samme for dem som tar testen.

Når en test uten konstruktvalidering rapporterer det samme, er skåren et tall generert av en algoritme ingen har kontrollert. Begge ser like ut på resultatskjermen. Forskjellen ligger utelukkende i dokumentasjonen, og derfor er dokumentasjonen verdt å lete etter.

Sett det på prøve

Å lese om måling er én ting. Å se din egen skår rapportert med kilde, normutvalg og begrensninger er noe annet. Gratis å ta, ingen registrering nødvendig.

Les videre

Hva er konstruktvaliditet? | NOESIS