noesisnoesis
Hoe meting werkt

Waarom de meeste persoonlijkheidstests op internet niet betrouwbaar zijn

Niet omdat ze oneerlijk zijn, maar omdat de stappen die een meting betrouwbaar maken onzichtbaar, duur en makkelijk over te slaan zijn, en het overslaan ervan verandert niets aan hoe het resultaat eruitziet.

Een gratis persoonlijkheidstest online en een gevalideerd psychometrisch instrument leveren output op die identiek oogt: een score, een percentiel, een alinea die je beschrijft. Het verschil zit volledig in werk dat je niet ziet op het resultatenscherm.

Het loont om hier precies over te zijn, want de gebruikelijke framing, dat internettests oplichterij zijn, klopt meestal niet en is niet erg nuttig. De meeste worden gemaakt door mensen zonder de intentie te misleiden. Ze zijn onbetrouwbaar om structurele redenen.

Wat er doorgaans wordt overgeslagen

Itemanalyse. In een goed opgebouwde schaal wordt het merendeel van de opgestelde items na een pilot verwijderd: items waarop niemand varieert, items die slecht correleren met het totaal, items die op meer dan één factor laden, items die zich anders gedragen tussen leeftijds- of taalgroepen. Een test die geschreven en gepubliceerd wordt zonder pilot heeft alles behouden, inclusief de items die niet werken.

Onafhankelijke structurele bevestiging. Factoranalyse op de data waarmee je de schaal hebt gebouwd, zal de structuur terugvinden die je hebt ontworpen. Die bevestigen in een nieuwe steekproef is een aparte studie, en het is de stap waarop een groot deel van de schalen faalt.

Normen. Het percentiel moet ergens vandaan komen. Als de site zijn referentiepopulatie niet vermeldt, is het getal afgeleid van eerdere bezoekers, een zelfgeselecteerde groep van onbekende samenstelling, of van niets in het bijzonder.

Test-hertestgegevens. Vaststellen dat mensen volgende maand dezelfde score behalen, vereist dat je ze opnieuw vindt. Bijna niemand doet dit, wat betekent dat de stabiliteit die het woord "eigenschap" impliceert, niet is aangetoond.

De ontwerpprikkels werken de verkeerde kant op

Een test die gebouwd is voor engagement, is geoptimaliseerd voor een ander resultaat dan een test die gebouwd is voor nauwkeurigheid, en de twee lopen op voorspelbare manieren uiteen.

Vleiende resultaten presteren beter. Een resultaat dat je iets onwelkoms vertelt, wordt minder gedeeld, dus resultaten drijven af naar beschrijvingen die iedereen in zichzelf herkent. Dit is het Barnumeffect, aangetoond in de jaren 1940 en sindsdien betrouwbaar gereproduceerd: mensen beoordelen generieke persoonlijkheidsbeschrijvingen als zeer accuraat specifiek over henzelf.

Types presteren beter dan dimensies. "Je bent een Architect" is deelbaarder dan "je zit op het 68e percentiel voor openheid met een breed betrouwbaarheidsinterval". Types verhullen ook meetfouten, aangezien iemand die één punt aan weerszijden van een categoriegrens zit, volledig verschillende labels krijgt.

Kort presteert beter dan toereikend. Elke extra vraag kost respondenten, dus tests worden ingekort tot een lengte die de voltooiing maximaliseert in plaats van een lengte die het construct dekt.

Geen van deze zijn leugens. Het is optimalisatie voor een andere maatstaf dan nauwkeurigheid.

Hoe je het in ongeveer dertig seconden kunt herkennen

Zoek naar een genoemd bronsysteem met auteurs en een jaartal. Zoek naar een vermelding van welke populatie de normen bevat. Zoek naar enige erkenning van beperkingen of meetfouten. Kijk of het resultaat een continue score is of een categorie. Kijk of dezelfde pagina ook belooft je ideale carrière, partner of levensdoel te achterhalen op basis van twintig vragen.

Een test die zijn instrument noemt, zijn bron citeert, zijn normen vermeldt en zegt wat hij niet kan vaststellen, heeft het werk gedaan. Een test die niets daarvan doet, kan nog steeds een aangename manier zijn om vijf minuten door te brengen, maar het getal dat hij oplevert is versiering.

Elk instrument in de NOESIS-catalogus vermeldt welke gepubliceerde test het implementeert, wie hem heeft geschreven, in welk jaar, hoe hij wordt gescoord, en wat de resultaten ervan niet aantonen. Dat laatste is het deel dat de moeite waard is om te vergelijken.

Doe de test zelf

Lezen over meting is één ding. Je eigen score zien gerapporteerd met de bron, de normgroep en de beperkingen ervan is iets anders. Gratis te doen, geen aanmelding vereist.

Lees verder

Waarom de meeste persoonlijkheidstests op internet niet betrouwbaar zijn | NOESIS