noesisnoesis
Hogyan működik a mérés

A mérés standard hibája: mennyivel térhet el az Ön pontszáma

Minden pontszámnak van hibahatára, és a legtöbb pszichológiai teszt esetében ez szélesebb, mint azt az emberek gondolnák. Ez az a szám, amely megmutatja, mikor valódi egy különbség, és mikor csupán zaj.

A mérés standard hibája egy elvont megbízhatósági együtthatót kézzelfogható dologgá alakít: egy pontszám körüli plusz-mínusz sávvá. Arra a kérdésre válaszol, amelyet a legtöbb eredményképernyő megválaszolatlanul hagy: mennyivel lehetett volna más ez a szám, ha egy másik délutánon töltöttem volna ki a tesztet?

A képlet egyszerű. Szorozza meg a skála szórását az egy mínusz megbízhatóság négyzetgyökével. Egy 10-es szórású és 0,85-ös megbízhatóságú skála esetén a standard hiba körülbelül 3,9 pont.

Mit fed le valójában ez a sáv

Az esetek nagyjából kétharmadában a személy valódi helyzete a megfigyelt pontszámától legfeljebb egy standard hibányira van. Ahhoz, hogy körülbelül 95 százalékos biztonsággal állíthasson valamit, nagyjából két standard hibányi sávra van szükség mindkét irányban.

Vegyük a fenti példát. Valaki 62 pontot ér el. A 95 százalékos intervallum körülbelül 54-től 70-ig terjed. Ez egy tizenhat pontos ablak egy olyan skálán, ahol az átlagos és az egyértelműen átlag feletti érték közötti szokásos különbség talán tíz pont.

Ez nem az adott teszt hibája. A 0,85-ös megbízhatóság tisztességes érték. Ez a pszichológiai mérés szokásos pontossága, és ez az oka annak, hogy a gondos jelentések sávokat mutatnak be, nem pontokat.

A következmények, amelyek elkerülik a figyelmet

A skálák közötti kis különbségek általában értelmetlenek. Ha az Ön extraverziója 58, a nyitottsága pedig 54, akkor a becsületes értelmezés az, hogy a kettő megkülönböztethetetlen. Azok a profilértelmezések, amelyek négypontos különbségekből építenek történetet, a zajt olvassák.

Az idő múlásával bekövetkező kis változások is általában értelmetlenek. Ha valaki újra kitölt egy tesztet, és öt pontot mozdul, az a legtöbb mérőeszköz esetén a hibahatáron belül van. A vonások valódi változása évek alatt megy végbe, és a hibasávon jóval kívül eső elmozdulásként jelenik meg, nem hónapról hónapra néhány pontként.

A rangsorok felnagyítják a problémát. Néhány nyers pontnyi különbség tíz percentilishellyel is elmozdíthat valakit az eloszlás sűrű közepén, mert az emberek többsége ott helyezkedik el. A percentilis rangok pontosnak tűnnek, mégis ez a pontszám kifejezésének legkevésbé stabil módja.

A pontosság nem egyenletes a skála mentén. A klasszikus tesztelmélet minden pontszámhoz egyetlen hibaértéket feltételez, ami egyszerűsítés. Az itemválasz-elmélet a vonás minden szintjén külön modellezi a hibát, és az szinte mindig nagyobb a szélsőségeknél, vagyis éppen ott, ahol a legnagyobb következményekkel járó értelmezések születnek. Egy nagyon magas vagy nagyon alacsony pontszám jellemzően kevésbé pontos, mint egy közepes, nem pedig pontosabb.

Miért tűnik kevésbé lenyűgözőnek a becsületes beszámolás

Az a mérőeszköz, amely konfidenciasávokat közöl, homályosabbnak tűnik, mint az, amely egyetlen számot ad meg egy tizedesjegy pontossággal. A homályosabb mondja az igazat. A pontosnak látszó ugyanakkora mögöttes hibával rendelkezik, csak úgy döntött, hogy nem mutatja meg.

Erre érdemes emlékezni, amikor egy tudományosan dokumentált tesztet egy olyan kereskedelmi termékkel hasonlít össze, amely egy kategóriába sorolja Önt. A kategóriahatár egy adott pontszámnál húzódik, és aki egy ponttal alatta, illetve aki egy ponttal felette van, statisztikailag ugyanaz a személy. A típuscímke ezt teljesen elfedi. Ez a típusalapú mérőeszközök elleni egyik komolyabb érv, és ez az oka annak, hogy a kutatásban a megadott hibával kísért folytonos pontszámok jelentik a standardot.

Tegye próbára

Egy dolog a mérésről olvasni. Más dolog látni a saját pontszámát a forrásával, a normamintájával és a korlátaival együtt. Ingyenes, regisztráció nem szükséges.

Olvasson tovább