Mi a megbízhatóság a pszichológiai tesztelésben?
A megbízhatóság a mérés következetességét jelenti, nem a helyességét. Egy teszt lehet nagyon megbízható, és mégis rossz dolgot mérhet. Ezért ez az első kérdés, amelyet felteszünk, és soha nem az utolsó.
A megbízhatóság azt fejezi ki, hogy egy mérés milyen mértékben ismételhető, és nem csupán zaj. Ha egy percen belül háromszor megmérné a testsúlyát, és 71, 78, majd 66 kilogrammot kapna, a mérleg megbízhatatlan volna, és semmiképpen sem tudhatná meg belőle valódi testsúlyát. A pszichológiai mérés ugyanezzel a problémával szembesül, csak sokkal kevésbé pontos eszközökkel.
A megbízhatósággal kapcsolatban a legfontosabb annak megértése, hogy mit nem állít. Az a fürdőszobai mérleg, amely következetesen nyolc kilogrammal többet mutat, tökéletesen megbízható, és teljesen téves. A megbízhatóság a következetességről szól; az, hogy a szám a megfelelő dolgot jelenti-e, külön kérdés, amelyet érvényességnek nevezünk. A megbízhatóság szükséges feltétele az érvényességnek, de távolról sem elégséges.
Formái
A belső konzisztencia azt vizsgálja, hogy egy skála tételei összhangban vannak-e egymással. Ha tíz kérdésnek ugyanazt a mögöttes vonást kell megragadnia, akkor azok, akik az egyikre magas értékkel válaszolnak, a többire is jellemzően magas értékkel válaszolnak. Ezt rendszerint Cronbach-alfával, vagy ami jobb, McDonald-omegával adják meg.
A teszt-reteszt megbízhatóság azt vizsgálja, hogy ugyanaz a személy két alkalommal hasonló pontszámot ér-e el. Ez a forma a legfontosabb a vonások esetében, amelyeknek definíció szerint stabilnak kell lenniük. Ugyanakkor ezt hagyják a leggyakrabban közöletlenül, mert ehhez hetekkel később fel kell kutatni ugyanazokat a résztvevőket.
Az értékelők közötti megbízhatóság akkor alkalmazandó, amikor a mérőeszközt emberek pontozzák: klinikai interjúk, projektív technikák, viselkedésmegfigyelés. Azt vizsgálja, hogy két képzett értékelő ugyanazt az anyagot megvizsgálva ugyanarra a következtetésre jut-e.
A párhuzamos formák megbízhatósága azt vizsgálja, hogy ugyanannak a tesztnek két különböző, egyenértékűnek szánt változata ugyanazokat a pontszámokat adja-e. Mindenhol számít, ahol egy tesztet többször vesznek fel, és a tételek ismertté válása aggodalomra ad okot.
A számok értelmezése
A megbízhatósági együtthatók 0 és 1 között mozognak. A konvenciók durvák és széles körben helytelenül alkalmazzák őket, de nagyjából: 0,90 felett szükséges ott, ahol egy pontszám hatással van az egyén életére; 0,80 és 0,90 között a legtöbb gyakorlati alkalmazáshoz szilárd; 0,70 és 0,80 között elfogadható kutatáshoz és csoportok összehasonlításához; 0,70 alatt pedig a pontszám több zajt tartalmaz, mint amennyit a legtöbb következtetés elbír.
Két figyelmeztetés ezekkel a határértékekkel kapcsolatban. Először: ezek konvenciók, nem törvények; az elfogadható szint teljes mértékben attól függ, mire fogják használni a pontszámot. Másodszor: egy rövid skála nagyon magas alfája rendszerint arra utal, hogy a tételek egymás közeli átfogalmazásai, ami a konstruktum lefedésének árán vásárol következetességet. Az a tízkérdéses skála, amelynek minden kérdése kissé eltérő szavakkal azt kérdezi: "szervezett Ön?", kiváló belső konzisztenciával és a lelkiismeretesség szűk értelmezésével rendelkezik majd.
Mit jelent ez az Ön saját pontszámára nézve
A megbízhatóság közvetlenül meghatározza, mennyi bizalmat érdemel egyetlen szám. Egy 0,85-ös megbízhatóságú teszt mérési hibája elég nagy ahhoz, hogy két ember között, vagy az Ön mai és múlt havi pontszáma között néhány pontnyi különbség nagy valószínűséggel zaj legyen, nem pedig valódi jel.
Ez a gyakorlati következmény: egy jó mérőeszköz közli a megbízhatóságát, hogy Ön tudja, milyen széles a pontszáma körüli bizonytalanság. Ennek a bizonytalanságnak a szakmai kifejezése a mérés standard hibája, amely a megbízhatósági együtthatót a pontszám körüli plusz-mínusz sávvá alakítja át.
Az a mérőeszköz, amely egyáltalán nem közöl megbízhatósági adatot, ettől még nem pontosabb. Egyszerűen nem hajlandó elárulni Önnek, mennyire pontatlan.
Tegye próbára
Egy dolog a mérésről olvasni. Más dolog látni a saját pontszámát a forrásával, a normamintájával és a korlátaival együtt. Ingyenes, regisztráció nem szükséges.
Olvasson tovább
- Mi a pszichometria?Az a tudományág, amely megállapítja, hogy egy pszichológiai mérés megfelelő-e; és ez az oka annak, hogy két, hasonló kérdéseket feltevő teszt eredményeinek értéke rendkívül eltérő lehet.
- Mi az érvényesség a pszichológiai tesztelésben?Az érvényesség nem olyan tulajdonság, amellyel egy teszt rendelkezik. Az érvényesség érvelés arról, hogy egy adott pontszám adott értelmezése adott célra védhető-e, és ezt minden új felhasználásnál újra fel kell építeni.
- Mi a konstruktumérvényesség?A mérés legnehezebb kérdése: létezik-e az, amit mér, úgy, ahogyan Ön meghatározta, és valóban azt éri-e el a mérőeszköze, nem pedig valami ahhoz közel esőt.
- Konvergens és diszkrimináns érvényességKét egymást tükröző követelmény: egy mérésnek egyeznie kell azzal, amivel egyeznie kell, és elkülönülnie attól, aminek állítása szerint nem azonos. A legtöbb gyenge mérőeszköz a második követelménynek nem felel meg.
- Mi a Cronbach-alfa, és mi nemA pszichológiai tesztelés leggyakrabban közölt statisztikai mutatója, és egyben a leggyakrabban félreértett is. Az alfa nem árulja el, hogy egy skála egydimenziós-e, és a magas érték gyakran inkább tünet, mint erény.
- A mérés standard hibája: mennyivel térhet el az Ön pontszámaMinden pontszámnak van hibahatára, és a legtöbb pszichológiai teszt esetében ez szélesebb, mint azt az emberek gondolnák. Ez az a szám, amely megmutatja, mikor valódi egy különbség, és mikor csupán zaj.
- Normák és percentilisek: mihez hasonlítják az Ön pontszámátEgy nyers pontszám önmagában nem értelmezhető. Csak egy referenciacsoporthoz viszonyítva válik jelentésessé, és az, hogy melyik csoportot használták, az egyik legnagyobb következményekkel járó és legkevésbé hangoztatott tény bármely tesztről.
- Hogyan készül valójában egy pszichometriai tesztA konstruktum meghatározásától a közzétett normákig a folyamat évekig tart, és a beletett anyag nagy részét elveti. Ha ismeri a lépéseket, nyilvánvalóvá válik, melyeket hagyott ki egy gyors online kvíz.
- Mit jelent, ha egy tesztet validáltnak neveznek?A kifejezés nem szabályozott, és szabadon használják olyan termékek is, amelyek semmit sem tettek meg érte. Az alábbiakban bemutatjuk, mit jelent, amikor valóban jelent valamit, és azt a négy kérdést, amely elválasztja egymástól a két esetet.
- Miért nem megbízható a legtöbb internetes személyiségtesztNem azért, mert nem őszinték, hanem mert azok a lépések, amelyektől egy mérés megbízhatóvá válik, láthatatlanok, költségesek és könnyen kihagyhatók; kihagyásuk pedig semmit sem változtat azon, hogyan néz ki az eredmény.
- Mit képes mérni az önbeszámoló, és mit nemA kérdőívek arra kérik Önt, hogy saját maga megfigyelője legyen, ami bizonyos dolgok esetében jobban működik, mint másoknál. Ha tudja, hol erős és hol mond csődöt ez a módszer, másképp fog olvasni bármilyen eredményt.
- Mit jelent, ha egy teszt bejósol valamitA 0,30-as korreláció erős eredménynek számít a személyiségkutatásban, ugyanakkor gyenge alapot nyújt egy adott személyre vonatkozó döntéshez. Mindkét állítás igaz, és a kettő közötti szakadék okozza a teszteredményekkel való visszaélések többségét.
- A szűrés nem diagnózisEgy szűrő kérdőívet arra terveznek, hogy a lehető legtöbb lehetséges esetet kiszűrje, és ennek áraként elfogadja a magas álpozitív arányt. Ha egy szűrési pontszámot diagnózisként olvasunk, azzal éppen az ellenkezőjére fordítjuk azt, amire tervezték.