Normer og percentiler: hvad din score sammenlignes med
En råscore kan ikke fortolkes alene. Den får først mening, når den sammenholdes med en referencegruppe, og hvilken gruppe der er brugt, er et af de mest betydningsfulde og mindst omtalte forhold ved enhver test.
Du får 34 på en skala for samvittighedsfuldhed. Er det højt?
Spørgsmålet har intet svar uden en sammenligning. Fireogtredive ud af hvilket maksimum, i forhold til hvem, målt hvornår? Normer er de referencedata, der gør en råscore til en fortolkelig position, og valget af dem er en af de mere betydningsfulde beslutninger i testkonstruktion.
Sådan fungerer omregningen
En normstikprøve er en gruppe mennesker, der har taget instrumentet under standardiserede forhold, og hvis scorefordeling bliver målestokken. Råscorer udtrykkes derefter som en position i den fordeling.
Percentilrang angiver den andel af normstikprøven, der scorer på eller under dig. Den 70. percentil betyder, at 70 procent af referencegruppen scorede lavere. Percentiler er intuitive og har en undervurderet svaghed: de strækker forskellene ud i den tætbefolkede midte af fordelingen og presser dem sammen i enderne. Nogle få råpoint omkring gennemsnittet kan flytte dig mange percentilpladser; de samme få point nær toppen flytter dig næsten ingenting.
Standardscorer, dvs. z-scorer, T-scorer, staniner og IQ-lignende skalaer, udtrykker afstanden fra gennemsnittet i standardafvigelsesenheder. De bevarer den faktiske afstand mellem scorer, og derfor foretrækkes de til alt, der indebærer regning med resultaterne.
Hvorfor referencegruppen er altafgørende
Den samme råscore kan lande på meget forskellige percentiler afhængigt af normstikprøven. Samvittighedsfuldhed scoret mod en generel voksenbefolkning og mod en stikprøve af praktiserende revisorer giver ikke den samme percentil, og ingen af tallene er forkerte: de besvarer forskellige spørgsmål.
Derfor er der flere egenskaber ved en normstikprøve, som er værd at kende.
Hvem der indgik. Bekvemmelighedsstikprøver af psykologistuderende er stadig almindelige og repræsenterer et snævert udsnit af menneskeheden: unge, uddannede og uforholdsmæssigt ofte fra velhavende vestlige lande. En norm bygget på dem kan vanskeligt overføres til andre grupper.
Hvor stor den var. Stabile percentilestimater i halerne kræver store stikprøver. Nogle få hundrede mennesker giver et upålideligt billede af, hvordan den 95. percentil ser ud.
Hvornår den blev indsamlet. Normer forskyder sig. Befolkningsgennemsnit på en række psykologiske mål har ændret sig målbart over årtier, og en normstikprøve fra 1995 beskriver ikke længere den befolkning, der tager testen i 2026.
Om den er stratificeret. Mange træk varierer systematisk med alder og køn. Spændingssøgning falder markant med alderen; kronotype ændrer sig gennem livet. At sammenligne en 55-årig med en norm for alle aldre giver en misvisende position på begge.
Hvad du skal kigge efter, og hvad det betyder, når det mangler
Et veldokumenteret instrument angiver størrelse, sammensætning, land og årstal for sin normstikprøve og oplyser, om normerne er stratificerede. Seriøse testmanualer bruger hele kapitler på dette.
De fleste gratis onlinetests oplyser intet af det. De giver dig en percentil uden at oplyse, hvilken population den henviser til. Den percentil er enten afledt af en uoplyst bekvemmelighedsstikprøve, lånt fra en publiceret norm indsamlet på en anden population eller beregnet ud fra de mennesker, der tidligere har taget hjemmesidens test: en selvselekteret gruppe, hvis sammensætning er ukendt selv for den, der driver siden.
Percentilen vises stadig på skærmen og ser ud som en rigtig. Det er den medfølgende dokumentation, og kun den, der adskiller de to.
Sæt det på prøve
At læse om måling er én ting. At se din egen score rapporteret med kilde, normstikprøve og begrænsninger er noget andet. Gratis at tage, ingen tilmelding nødvendig.
Læs videre
- Hvad er psykometri?Den disciplin, der afgør, om en psykologisk måling er god nok, og grunden til, at to test, der stiller lignende spørgsmål, kan have meget forskellig værdi i deres resultater.
- Hvad er reliabilitet i psykologisk testning?Reliabilitet er målingens konsistens, ikke dens korrekthed. En test kan have høj reliabilitet og alligevel måle den forkerte ting. Derfor er det det første spørgsmål, man stiller, og aldrig det sidste.
- Hvad er validitet i psykologisk testning?Validitet er ikke en egenskab, som en test har. Det er et argument for, om en bestemt fortolkning af en bestemt score til et bestemt formål kan forsvares, og det skal bygges op på ny ved hver ny anvendelse.
- Hvad er konstruktvaliditet?Det sværeste spørgsmål inden for måling: om det, du måler, findes, sådan som du har defineret det, og om dit instrument rammer netop det og ikke noget beslægtet.
- Konvergent og diskriminant validitetTo spejlvendte krav: et mål skal stemme overens med det, det bør stemme overens med, og skal forblive adskilt fra det, det hævder ikke at være. De fleste svage instrumenter fejler på det andet.
- Hvad er Cronbachs alfa, og hvad er det ikke?Den mest rapporterede statistik i psykologisk testning og den mest misforståede. Alpha fortæller dig ikke, at en skala er endimensionel, og en høj værdi er ofte et symptom snarere end en dyd.
- Standardmålefejl: hvor meget din score kan afvigeEnhver score har en fejlmargin, og for de fleste psykologiske test er den bredere, end folk tror. Det er dette tal, der fortæller dig, hvornår en forskel er reel, og hvornår den er støj.
- Sådan bliver en psykometrisk test faktisk udvikletFra definitionen af konstruktet til publicerede normer tager forløbet år og kasserer det meste af det, der indgår i det. Når du kender trinene, bliver det tydeligt, hvilke af dem en hurtig online-quiz har sprunget over.
- Hvad betyder det, når en test kaldes valideret?Ordet er ikke beskyttet og bruges frit af produkter, der ikke har gjort noget af arbejdet. Her er, hvad det betyder, når det betyder noget, og de fire spørgsmål, der adskiller de to tilfælde.
- Hvorfor de fleste personlighedstest på internettet ikke er reliableIkke fordi de er uærlige, men fordi de trin, der gør en måling troværdig, er usynlige, dyre og lette at springe over, og at springe dem over ændrer intet ved, hvordan resultatet ser ud.
- Hvad selvrapportering kan og ikke kan måleSpørgeskemaer beder dig om at være observatør af dig selv, og det fungerer bedre for nogle ting end for andre. Når du ved, hvor metoden er stærk, og hvor den svigter, ændrer det måden, du læser ethvert resultat på.
- Hvad det betyder, når en test forudsiger nogetEn korrelation på 0,30 er et stærkt fund i personlighedsforskning og et svagt grundlag for en beslutning om en enkelt person. Begge udsagn er sande, og kløften mellem dem er årsagen til det meste misbrug af testresultater.
- Screening er ikke diagnoseEt screeningspørgeskema er udviklet til at fange så mange mulige tilfælde som muligt og accepterer en høj andel falsk positive som prisen for det. At læse en screeningscore som en diagnose vender op og ned på det, den er designet til.