A mérés standard hibája: mennyivel térhet el az Ön pontszáma
Minden pontszámnak van hibahatára, és a legtöbb pszichológiai teszt esetében ez szélesebb, mint azt az emberek gondolnák. Ez az a szám, amely megmutatja, mikor valódi egy különbség, és mikor csupán zaj.
A mérés standard hibája egy elvont megbízhatósági együtthatót kézzelfogható dologgá alakít: egy pontszám körüli plusz-mínusz sávvá. Arra a kérdésre válaszol, amelyet a legtöbb eredményképernyő megválaszolatlanul hagy: mennyivel lehetett volna más ez a szám, ha egy másik délutánon töltöttem volna ki a tesztet?
A képlet egyszerű. Szorozza meg a skála szórását az egy mínusz megbízhatóság négyzetgyökével. Egy 10-es szórású és 0,85-ös megbízhatóságú skála esetén a standard hiba körülbelül 3,9 pont.
Mit fed le valójában ez a sáv
Az esetek nagyjából kétharmadában a személy valódi helyzete a megfigyelt pontszámától legfeljebb egy standard hibányira van. Ahhoz, hogy körülbelül 95 százalékos biztonsággal állíthasson valamit, nagyjából két standard hibányi sávra van szükség mindkét irányban.
Vegyük a fenti példát. Valaki 62 pontot ér el. A 95 százalékos intervallum körülbelül 54-től 70-ig terjed. Ez egy tizenhat pontos ablak egy olyan skálán, ahol az átlagos és az egyértelműen átlag feletti érték közötti szokásos különbség talán tíz pont.
Ez nem az adott teszt hibája. A 0,85-ös megbízhatóság tisztességes érték. Ez a pszichológiai mérés szokásos pontossága, és ez az oka annak, hogy a gondos jelentések sávokat mutatnak be, nem pontokat.
A következmények, amelyek elkerülik a figyelmet
A skálák közötti kis különbségek általában értelmetlenek. Ha az Ön extraverziója 58, a nyitottsága pedig 54, akkor a becsületes értelmezés az, hogy a kettő megkülönböztethetetlen. Azok a profilértelmezések, amelyek négypontos különbségekből építenek történetet, a zajt olvassák.
Az idő múlásával bekövetkező kis változások is általában értelmetlenek. Ha valaki újra kitölt egy tesztet, és öt pontot mozdul, az a legtöbb mérőeszköz esetén a hibahatáron belül van. A vonások valódi változása évek alatt megy végbe, és a hibasávon jóval kívül eső elmozdulásként jelenik meg, nem hónapról hónapra néhány pontként.
A rangsorok felnagyítják a problémát. Néhány nyers pontnyi különbség tíz percentilishellyel is elmozdíthat valakit az eloszlás sűrű közepén, mert az emberek többsége ott helyezkedik el. A percentilis rangok pontosnak tűnnek, mégis ez a pontszám kifejezésének legkevésbé stabil módja.
A pontosság nem egyenletes a skála mentén. A klasszikus tesztelmélet minden pontszámhoz egyetlen hibaértéket feltételez, ami egyszerűsítés. Az itemválasz-elmélet a vonás minden szintjén külön modellezi a hibát, és az szinte mindig nagyobb a szélsőségeknél, vagyis éppen ott, ahol a legnagyobb következményekkel járó értelmezések születnek. Egy nagyon magas vagy nagyon alacsony pontszám jellemzően kevésbé pontos, mint egy közepes, nem pedig pontosabb.
Miért tűnik kevésbé lenyűgözőnek a becsületes beszámolás
Az a mérőeszköz, amely konfidenciasávokat közöl, homályosabbnak tűnik, mint az, amely egyetlen számot ad meg egy tizedesjegy pontossággal. A homályosabb mondja az igazat. A pontosnak látszó ugyanakkora mögöttes hibával rendelkezik, csak úgy döntött, hogy nem mutatja meg.
Erre érdemes emlékezni, amikor egy tudományosan dokumentált tesztet egy olyan kereskedelmi termékkel hasonlít össze, amely egy kategóriába sorolja Önt. A kategóriahatár egy adott pontszámnál húzódik, és aki egy ponttal alatta, illetve aki egy ponttal felette van, statisztikailag ugyanaz a személy. A típuscímke ezt teljesen elfedi. Ez a típusalapú mérőeszközök elleni egyik komolyabb érv, és ez az oka annak, hogy a kutatásban a megadott hibával kísért folytonos pontszámok jelentik a standardot.
Tegye próbára
Egy dolog a mérésről olvasni. Más dolog látni a saját pontszámát a forrásával, a normamintájával és a korlátaival együtt. Ingyenes, regisztráció nem szükséges.
Olvasson tovább
- Mi a pszichometria?Az a tudományág, amely megállapítja, hogy egy pszichológiai mérés megfelelő-e; és ez az oka annak, hogy két, hasonló kérdéseket feltevő teszt eredményeinek értéke rendkívül eltérő lehet.
- Mi a megbízhatóság a pszichológiai tesztelésben?A megbízhatóság a mérés következetességét jelenti, nem a helyességét. Egy teszt lehet nagyon megbízható, és mégis rossz dolgot mérhet. Ezért ez az első kérdés, amelyet felteszünk, és soha nem az utolsó.
- Mi az érvényesség a pszichológiai tesztelésben?Az érvényesség nem olyan tulajdonság, amellyel egy teszt rendelkezik. Az érvényesség érvelés arról, hogy egy adott pontszám adott értelmezése adott célra védhető-e, és ezt minden új felhasználásnál újra fel kell építeni.
- Mi a konstruktumérvényesség?A mérés legnehezebb kérdése: létezik-e az, amit mér, úgy, ahogyan Ön meghatározta, és valóban azt éri-e el a mérőeszköze, nem pedig valami ahhoz közel esőt.
- Konvergens és diszkrimináns érvényességKét egymást tükröző követelmény: egy mérésnek egyeznie kell azzal, amivel egyeznie kell, és elkülönülnie attól, aminek állítása szerint nem azonos. A legtöbb gyenge mérőeszköz a második követelménynek nem felel meg.
- Mi a Cronbach-alfa, és mi nemA pszichológiai tesztelés leggyakrabban közölt statisztikai mutatója, és egyben a leggyakrabban félreértett is. Az alfa nem árulja el, hogy egy skála egydimenziós-e, és a magas érték gyakran inkább tünet, mint erény.
- Normák és percentilisek: mihez hasonlítják az Ön pontszámátEgy nyers pontszám önmagában nem értelmezhető. Csak egy referenciacsoporthoz viszonyítva válik jelentésessé, és az, hogy melyik csoportot használták, az egyik legnagyobb következményekkel járó és legkevésbé hangoztatott tény bármely tesztről.
- Hogyan készül valójában egy pszichometriai tesztA konstruktum meghatározásától a közzétett normákig a folyamat évekig tart, és a beletett anyag nagy részét elveti. Ha ismeri a lépéseket, nyilvánvalóvá válik, melyeket hagyott ki egy gyors online kvíz.
- Mit jelent, ha egy tesztet validáltnak neveznek?A kifejezés nem szabályozott, és szabadon használják olyan termékek is, amelyek semmit sem tettek meg érte. Az alábbiakban bemutatjuk, mit jelent, amikor valóban jelent valamit, és azt a négy kérdést, amely elválasztja egymástól a két esetet.
- Miért nem megbízható a legtöbb internetes személyiségtesztNem azért, mert nem őszinték, hanem mert azok a lépések, amelyektől egy mérés megbízhatóvá válik, láthatatlanok, költségesek és könnyen kihagyhatók; kihagyásuk pedig semmit sem változtat azon, hogyan néz ki az eredmény.
- Mit képes mérni az önbeszámoló, és mit nemA kérdőívek arra kérik Önt, hogy saját maga megfigyelője legyen, ami bizonyos dolgok esetében jobban működik, mint másoknál. Ha tudja, hol erős és hol mond csődöt ez a módszer, másképp fog olvasni bármilyen eredményt.
- Mit jelent, ha egy teszt bejósol valamitA 0,30-as korreláció erős eredménynek számít a személyiségkutatásban, ugyanakkor gyenge alapot nyújt egy adott személyre vonatkozó döntéshez. Mindkét állítás igaz, és a kettő közötti szakadék okozza a teszteredményekkel való visszaélések többségét.
- A szűrés nem diagnózisEgy szűrő kérdőívet arra terveznek, hogy a lehető legtöbb lehetséges esetet kiszűrje, és ennek áraként elfogadja a magas álpozitív arányt. Ha egy szűrési pontszámot diagnózisként olvasunk, azzal éppen az ellenkezőjére fordítjuk azt, amire tervezték.