Hvad selvrapportering kan og ikke kan måle
Spørgeskemaer beder dig om at være observatør af dig selv, og det fungerer bedre for nogle ting end for andre. Når du ved, hvor metoden er stærk, og hvor den svigter, ændrer det måden, du læser ethvert resultat på.
Næsten alle udbredte instrumenter til måling af personlighed og trivsel er spørgeskemaer baseret på selvrapportering. Du læser et udsagn, du vurderer, hvor godt det beskriver dig, og vurderingerne lægges sammen. Det er billigt, hurtigt og skalerbart, og det har reelle styrker, men det har også svagheder, som er værd at kende, før du læser dine egne resultater.
Hvor det fungerer godt
Indre tilstande, som ingen andre kan observere. Livstilfredshed, oplevet stress, mening, følt angst. Her er personen ikke blot en bekvem kilde; personen er den eneste valide kilde. En observatør, der vurderer din subjektive trivsel, gætter.
Typisk adfærd samlet over tid. Mennesker er rimeligt gode til at rapportere, hvad de som regel gør, selv når de er dårlige til at forudsige et enkelt tilfælde. Mål for træk fungerer, fordi de udligner på tværs af situationer.
Selvopfattelse som et selvstændigt interessefelt. Hvor kompetent du tror, du er, former, hvad du forsøger dig med, uafhængigt af hvor kompetent du faktisk er. Mestringstro er et legitimt konstrukt, netop fordi overbevisningen har konsekvenser.
Hvor det bryder sammen
Socialt ønskværdige svar. Folk beskriver sig selv som mere samvittighedsfulde, mere empatiske og mindre fjendtlige, end de er, og effekten vokser med, hvad der står på spil. I en sammenhæng med selvindsigt og lav indsats er forvrængningen beskeden. Ved ansættelser er den alvorlig: den gennemsigtige formulering af de fleste personlighedsitems gør dem lette at manipulere, og de kandidater, der er mest motiverede for at manipulere, er netop dem, arbejdsgiveren helst vil identificere.
Begrænset selvindsigt. Selvrapporteringer korrelerer kun moderat med vurderinger fra personer, der kender personen godt, og forskellen er størst præcis der, hvor man ville forvente det: ved træk med vurderende vægt og hos de personer, hvis selvbillede er mindst præcist. Den, der ikke bemærker sin egen uopmærksomhed, er ikke godt rustet til at rapportere den.
Evne kontra overbevisning. En selvrapportering kan ikke måle en evne. Selvrapporteret emotionel intelligens måler, hvor følelsesmæssigt kompetent du tror, du er, og det korrelerer kun beskedent med præstationen i opgaver, der kræver følelsesmæssig dømmekraft. Begge er reelle konstrukter; de er ikke det samme, og at blande dem sammen er en af de mest almindelige fejl på det kommercielle testmarked.
Effekter af referencegruppe. "Jeg arbejder hårdt" vurderes i forhold til en underforstået sammenligningsgruppe, der varierer fra person til person og fra kultur til kultur. Det gør tværkulturelle sammenligninger af gennemsnit af rå selvrapportering upålidelige på måder, der er lette at overse og svære at korrigere.
Humøret i svarøjeblikket. Den aktuelle sindsstemning farver systematisk tilbageskuende vurderinger. En score fra én enkelt lejlighed på et konstrukt, der formodes at være stabilt, rummer mere tilstandsvarians, end rammen om træk antyder.
Svarstile. Ja-siger-tendens, altså at være enig uanset indhold, og ekstreme svar varierer mellem personer og mellem kulturer. Velkonstruerede skalaer modvirker dette med omvendt formulerede items, hvilket skaber sin egen artefakt: skalaer med blandede formuleringer giver jævnligt en falsk anden faktor, der afspejler formuleringen og ikke indholdet.
Sådan læser du dine egne resultater i lyset af dette
Betragt en score fra selvrapportering som en velstruktureret beskrivelse af, hvordan du ser dig selv. Den er reelt informativ, men den er ikke det samme som en beskrivelse af, hvordan du er.
Forskellen mellem de to er ofte den mest interessante del. Hvor en score overrasker dig, er det spørgsmål, der er værd at dvæle ved, ikke om testen tager fejl, men hvilken af de to læsninger, din eller instrumentets, menneskene omkring dig ville genkende.
Det er også den ærlige grænse for, hvad et spørgeskema kan levere, og en god grund til at betragte enhver enkelt score som ét input snarere end en dom.
Sæt det på prøve
At læse om måling er én ting. At se din egen score rapporteret med kilde, normstikprøve og begrænsninger er noget andet. Gratis at tage, ingen tilmelding nødvendig.
Læs videre
- Hvad er psykometri?Den disciplin, der afgør, om en psykologisk måling er god nok, og grunden til, at to test, der stiller lignende spørgsmål, kan have meget forskellig værdi i deres resultater.
- Hvad er reliabilitet i psykologisk testning?Reliabilitet er målingens konsistens, ikke dens korrekthed. En test kan have høj reliabilitet og alligevel måle den forkerte ting. Derfor er det det første spørgsmål, man stiller, og aldrig det sidste.
- Hvad er validitet i psykologisk testning?Validitet er ikke en egenskab, som en test har. Det er et argument for, om en bestemt fortolkning af en bestemt score til et bestemt formål kan forsvares, og det skal bygges op på ny ved hver ny anvendelse.
- Hvad er konstruktvaliditet?Det sværeste spørgsmål inden for måling: om det, du måler, findes, sådan som du har defineret det, og om dit instrument rammer netop det og ikke noget beslægtet.
- Konvergent og diskriminant validitetTo spejlvendte krav: et mål skal stemme overens med det, det bør stemme overens med, og skal forblive adskilt fra det, det hævder ikke at være. De fleste svage instrumenter fejler på det andet.
- Hvad er Cronbachs alfa, og hvad er det ikke?Den mest rapporterede statistik i psykologisk testning og den mest misforståede. Alpha fortæller dig ikke, at en skala er endimensionel, og en høj værdi er ofte et symptom snarere end en dyd.
- Standardmålefejl: hvor meget din score kan afvigeEnhver score har en fejlmargin, og for de fleste psykologiske test er den bredere, end folk tror. Det er dette tal, der fortæller dig, hvornår en forskel er reel, og hvornår den er støj.
- Normer og percentiler: hvad din score sammenlignes medEn råscore kan ikke fortolkes alene. Den får først mening, når den sammenholdes med en referencegruppe, og hvilken gruppe der er brugt, er et af de mest betydningsfulde og mindst omtalte forhold ved enhver test.
- Sådan bliver en psykometrisk test faktisk udvikletFra definitionen af konstruktet til publicerede normer tager forløbet år og kasserer det meste af det, der indgår i det. Når du kender trinene, bliver det tydeligt, hvilke af dem en hurtig online-quiz har sprunget over.
- Hvad betyder det, når en test kaldes valideret?Ordet er ikke beskyttet og bruges frit af produkter, der ikke har gjort noget af arbejdet. Her er, hvad det betyder, når det betyder noget, og de fire spørgsmål, der adskiller de to tilfælde.
- Hvorfor de fleste personlighedstest på internettet ikke er reliableIkke fordi de er uærlige, men fordi de trin, der gør en måling troværdig, er usynlige, dyre og lette at springe over, og at springe dem over ændrer intet ved, hvordan resultatet ser ud.
- Hvad det betyder, når en test forudsiger nogetEn korrelation på 0,30 er et stærkt fund i personlighedsforskning og et svagt grundlag for en beslutning om en enkelt person. Begge udsagn er sande, og kløften mellem dem er årsagen til det meste misbrug af testresultater.
- Screening er ikke diagnoseEt screeningspørgeskema er udviklet til at fange så mange mulige tilfælde som muligt og accepterer en høj andel falsk positive som prisen for det. At læse en screeningscore som en diagnose vender op og ned på det, den er designet til.