noesisnoesis
Vetenskap & evidens

Hur psykologisk mätning egentligen fungerar

Begreppen bakom varje test i katalogen, reliabilitet, validitet, normer, mätfel, förklarade utan jargongbarriären, plus raka svar på de ramverksfrågor som folk faktiskt ställer.

Hur mätning fungerar

Vad som gör ett psykologiskt poäng tillförlitligt, hur stor del av det som är fel, och vilka frågor som skiljer ett validerat instrument från ett frågeformulär någon skrev på en eftermiddag.

Vad är psykometri?

Disciplinen som avgör om en psykologisk mätning är bra, och anledningen till att två test som ställer liknande frågor kan skilja sig enormt åt i vad deras resultat är värda.

Vad är reliabilitet vid psykologisk testning?

Reliabilitet är mätningens konsekvens, inte dess korrekthet. Ett test kan vara mycket reliabelt och ändå mäta fel sak, vilket är varför det är den första frågan som ställs och aldrig den sista.

Vad är validitet inom psykologisk testning?

Validitet är inte en egenskap som ett test har. Det är ett argument för om en viss tolkning av ett visst poäng, för ett visst syfte, är försvarbar, och det måste byggas upp på nytt för varje ny användning.

Vad är begreppsvaliditet?

Den svåraste frågan inom mätning: om det du mäter existerar som du har definierat det, och om ditt instrument når fram till det snarare än till något närliggande.

Konvergent och diskriminant validitet

Två spegelbildskrav: ett mått måste överensstämma med det det ska överensstämma med, och samtidigt förbli distinkt från det det påstår sig inte vara. De flesta svaga instrument misslyckas med det andra kravet.

Vad är Cronbachs alfa, och vad det inte är

Den mest rapporterade statistiken inom psykologisk testning, och den mest missförstådda. Alfa säger inte att en skala är endimensionell, och ett högt värde är ofta ett symptom snarare än en dygd.

Mätningens standardfel: hur mycket din poäng kan avvika

Varje poäng har en felmarginal, och för de flesta psykologiska test är den bredare än vad folk antar. Det här är talet som talar om när en skillnad är verklig och när den är brus.

Normer och percentiler: vad din poäng jämförs med

En rå poäng är omöjlig att tolka på egen hand. Den blir meningsfull först i jämförelse med en referensgrupp, och vilken grupp som använts är ett av de mest avgörande och minst annonserade fakta om något test.

Hur ett psykometriskt test faktiskt byggs

Från konstruktdefinition till publicerade normer tar sekvensen år och gallrar bort det mesta av det som går in i den. Att känna till stegen gör det uppenbart vilka som ett snabbt onlinetest hoppade över.

Vad innebär det när ett test kallas validerat?

Ordet är oreglerat och används fritt av produkter som inte gjort något av arbetet. Här är vad det betyder när det betyder något, och de fyra frågorna som skiljer de två fallen åt.

Varför de flesta personlighetstest på internet inte är reliabla

Inte för att de är oärliga, utan för att de steg som gör en mätning pålitlig är osynliga, kostsamma och lätta att hoppa över, och att hoppa över dem förändrar ingenting i hur resultatet ser ut.

Vad självskattning kan och inte kan mäta

Frågeformulär ber dig vara observatör av dig själv, vilket fungerar bättre för vissa saker än andra. Att veta var metoden är stark och var den brister förändrar hur du läser vilket resultat som helst.

Vad det innebär när ett test förutsäger något

En korrelation på 0,30 är ett starkt fynd inom personlighetsforskning och en svag grund för ett beslut om en enskild person. Båda påståendena är sanna, och glappet mellan dem orsakar det mesta av missbruket av testresultat.

Screening är inte diagnos

Ett screeningformulär är byggt för att fånga upp så många möjliga fall som möjligt, och accepterar en hög andel falska positiva som priset för det. Att läsa ett screeningresultat som en diagnos vänder upp och ner på vad det var utformat för att göra.

Ramverk jämförda

MBTI, DISC, femfaktormodellen och frågorna som ställs om dem. NOESIS publicerar inget av de två första, vilket är exakt varför dessa svar kan vara raka.

Är MBTI vetenskapligt?

Det ärliga svaret är mer specifikt än ja eller nej: frågeformuläret är rimligt väl konstruerat, och den typteori som resultaten redovisas utifrån saknar stöd. Dessa två fakta slås ofta samman till ett enda argument.

Big Five kontra MBTI: vad som egentligen skiljer sig åt

De mäter delvis samma saker. Skillnaden ligger inte i vilka drag de täcker utan i vad de gör med siffrorna, och ett av dessa val kastar bort information som det andra behåller.

Är DISC ett personlighetstest?

DISC beskriver beteendestil på jobbet snarare än personlighetsstruktur, vilket de bättre utgivarna säger rakt ut. Problemen börjar när en arbetsstilsprofil används som om den mätte personen.

Big Five vs DISC: vad varje test används till

De är inte konkurrerande mått på samma sak. Det ena är en strukturell modell av personlighet byggd på data, det andra är ett ramverk för arbetsstil byggt för facilitering. Att jämföra dem på träffsäkerhet missar poängen med båda.

Personlighet och temperament: vad är skillnaden?

Temperament är det biologiskt grundade råmaterialet som syns redan i spädbarnsåldern; personlighet är det som utvecklas ovanpå det genom erfarenhet. Distinktionen är verklig, och gränsen är mer flytande än läroböcker antyder.

Förändras personligheten under livets gång?

Ja, i en riktning de flesta finner betryggande, och långsammare än vad självhjälpslöften utlovar. Beläggen för både förändringen och dess takt är ovanligt goda.

Är introversion samma sak som blyghet?

Nej, och förväxlingen orsakar verklig skada. Det ena är en preferens för hur du spenderar energi, det andra är ångest över att bli bedömd. Det är separata drag som råkar ge upphov till liknande beteenden.

Kan emotionell intelligens mätas?

Delvis, och svaret beror på vilket av två mycket olika begrepp du menar med termen. Det ena kan mätas som en förmåga, det andra som en självuppfattning. De säljs oftast som samma sak.

Se hur ett dokumenterat test ser ut

Varje test i katalogen anger vilket publicerat instrument det bygger på, dess författare och år, hur det poängsätts, och vad dess resultat inte fastställer. Den sista delen är jämförelsen värd att göra.