Mi a Cronbach-alfa, és mi nem
A pszichológiai tesztelés leggyakrabban közölt statisztikai mutatója, és egyben a leggyakrabban félreértett is. Az alfa nem árulja el, hogy egy skála egydimenziós-e, és a magas érték gyakran inkább tünet, mint erény.
A Cronbach-alfa a belső konzisztencia együtthatója: azt mutatja meg, hogy egy skála tételei milyen mértékben korrelálnak egymással. Az 1951-ben publikált mutató a leggyakrabban közölt pszichometriai statisztika, elterjedtsége azonban messze túlnőtt a hasznosságán.
Az alfa értéke 0 és 1 között mozog, és két tényező határozza meg: a tételek közötti átlagos korreláció és a tételek száma. A félreértések többsége ebből a második függésből ered.
Mit nem jelent a magas alfa
Nem jelenti azt, hogy a skála egyetlen dolgot mér. Ez a leggyakoribb tévedés. Az alfa két vagy három különálló faktort tartalmazó skála esetén is lehet magas, feltéve, hogy a tételek összességében elég erősen korrelálnak. Az egydimenziósságot faktorelemzéssel kell igazolni; az alfa erre nem alkalmas, és soha nem is erre szánták.
Nem jelenti azt, hogy a skála érvényes. Az alfa semmit sem árul el arról, hogy a tételek mit mérnek. Húsz, a cipőméretre vonatkozó kérdés kiváló belső konzisztenciát mutatna, miközben bármely pszichológiai jellemző méréseként nulla lenne az érvényessége.
Nem jelenti azt, hogy a skála jó. Mivel az alfa a tételek számával nő, egy közepes minőségű tételekből álló hosszú skála magasabb értéket ér el, mint egy kiváló tételekből álló rövid skála. Egy negyventételes skála 0,2-es átlagos tételközi korreláció mellett is 0,90 fölé kerül.
A nagyon magas alfa gyakran figyelmeztető jel. Nagyjából 0,95 fölött a tételek általában egymás közeli átfogalmazásai. Ez a konzisztenciát a konstruktum lefedettségének rovására növeli: a skála egyetlen szűk aspektust mér nagyon pontosan, a konstruktum többi részét pedig figyelmen kívül hagyja. Ezt nevezik attenuációs paradoxonnak, és ez az oka annak, hogy a nagyobb konzisztencia nem mindig jobb.
Milyen feltevésekre épül
Az alfa egy meghatározott feltevés mellett a megbízhatóság alsó becslése: ez a tau-ekvivalencia, vagyis hogy minden tétel azonos mértékben járul hozzá a mögöttes vonáshoz. A valós skálák ezt szinte soha nem teljesítik. A tételek eltérő erősséggel töltenek a faktorra, és ilyenkor az alfa alábecsüli a megbízhatóságot.
A McDonald-féle omega elveti az azonos hozzájárulás feltevését, és a tényleges faktortöltésekből becsüli a megbízhatóságot. A módszertani szakemberek két évtizede javasolják az alfa helyett. A közlési gyakorlat lassan követi ezt, nagyrészt azért, mert az alfa minden statisztikai programban egyetlen sor, az omega viszont nem.
Értelmezés a gyakorlatban
Durva konvenciók: csoportokat összehasonlító kutatásban 0,70 vagy afölött elfogadható, alkalmazott felhasználásnál 0,80 vagy afölött, ahol pedig a pontszám egyéni döntést befolyásol, ott 0,90 vagy afölött. Ezeket tájékozódási pontként, ne határértékként kezelje: a szükséges szint attól függ, mekkora a tétje annak a döntésnek, amelyet a pontszám megalapoz.
A beszédesebb adatok általában ugyanazon tanulmány más részeiben találhatók. Az átlagos tételközi korreláció (a 0,15 és 0,50 közötti tartomány egészséges) megmutatja, hogy a magas alfa a tételek minőségéből vagy mennyiségéből fakad-e. A tételek száma ugyanezt a másik irányból mutatja meg. A teszt-reteszt megbízhatóság pedig olyasmit árul el, amire az alfa szerkezeténél fogva képtelen: hogy a pontszám ugyanannál a személynél stabil-e az idő múlásával.
Az a skála, amely csak az alfát közli, a megbízhatósági mutatók közül a legkönnyebben előállíthatót közölte, és azt, amelyen a legkönnyebb megfelelni.
Tegye próbára
Egy dolog a mérésről olvasni. Más dolog látni a saját pontszámát a forrásával, a normamintájával és a korlátaival együtt. Ingyenes, regisztráció nem szükséges.
Olvasson tovább
- Mi a pszichometria?Az a tudományág, amely megállapítja, hogy egy pszichológiai mérés megfelelő-e; és ez az oka annak, hogy két, hasonló kérdéseket feltevő teszt eredményeinek értéke rendkívül eltérő lehet.
- Mi a megbízhatóság a pszichológiai tesztelésben?A megbízhatóság a mérés következetességét jelenti, nem a helyességét. Egy teszt lehet nagyon megbízható, és mégis rossz dolgot mérhet. Ezért ez az első kérdés, amelyet felteszünk, és soha nem az utolsó.
- Mi az érvényesség a pszichológiai tesztelésben?Az érvényesség nem olyan tulajdonság, amellyel egy teszt rendelkezik. Az érvényesség érvelés arról, hogy egy adott pontszám adott értelmezése adott célra védhető-e, és ezt minden új felhasználásnál újra fel kell építeni.
- Mi a konstruktumérvényesség?A mérés legnehezebb kérdése: létezik-e az, amit mér, úgy, ahogyan Ön meghatározta, és valóban azt éri-e el a mérőeszköze, nem pedig valami ahhoz közel esőt.
- Konvergens és diszkrimináns érvényességKét egymást tükröző követelmény: egy mérésnek egyeznie kell azzal, amivel egyeznie kell, és elkülönülnie attól, aminek állítása szerint nem azonos. A legtöbb gyenge mérőeszköz a második követelménynek nem felel meg.
- A mérés standard hibája: mennyivel térhet el az Ön pontszámaMinden pontszámnak van hibahatára, és a legtöbb pszichológiai teszt esetében ez szélesebb, mint azt az emberek gondolnák. Ez az a szám, amely megmutatja, mikor valódi egy különbség, és mikor csupán zaj.
- Normák és percentilisek: mihez hasonlítják az Ön pontszámátEgy nyers pontszám önmagában nem értelmezhető. Csak egy referenciacsoporthoz viszonyítva válik jelentésessé, és az, hogy melyik csoportot használták, az egyik legnagyobb következményekkel járó és legkevésbé hangoztatott tény bármely tesztről.
- Hogyan készül valójában egy pszichometriai tesztA konstruktum meghatározásától a közzétett normákig a folyamat évekig tart, és a beletett anyag nagy részét elveti. Ha ismeri a lépéseket, nyilvánvalóvá válik, melyeket hagyott ki egy gyors online kvíz.
- Mit jelent, ha egy tesztet validáltnak neveznek?A kifejezés nem szabályozott, és szabadon használják olyan termékek is, amelyek semmit sem tettek meg érte. Az alábbiakban bemutatjuk, mit jelent, amikor valóban jelent valamit, és azt a négy kérdést, amely elválasztja egymástól a két esetet.
- Miért nem megbízható a legtöbb internetes személyiségtesztNem azért, mert nem őszinték, hanem mert azok a lépések, amelyektől egy mérés megbízhatóvá válik, láthatatlanok, költségesek és könnyen kihagyhatók; kihagyásuk pedig semmit sem változtat azon, hogyan néz ki az eredmény.
- Mit képes mérni az önbeszámoló, és mit nemA kérdőívek arra kérik Önt, hogy saját maga megfigyelője legyen, ami bizonyos dolgok esetében jobban működik, mint másoknál. Ha tudja, hol erős és hol mond csődöt ez a módszer, másképp fog olvasni bármilyen eredményt.
- Mit jelent, ha egy teszt bejósol valamitA 0,30-as korreláció erős eredménynek számít a személyiségkutatásban, ugyanakkor gyenge alapot nyújt egy adott személyre vonatkozó döntéshez. Mindkét állítás igaz, és a kettő közötti szakadék okozza a teszteredményekkel való visszaélések többségét.
- A szűrés nem diagnózisEgy szűrő kérdőívet arra terveznek, hogy a lehető legtöbb lehetséges esetet kiszűrje, és ennek áraként elfogadja a magas álpozitív arányt. Ha egy szűrési pontszámot diagnózisként olvasunk, azzal éppen az ellenkezőjére fordítjuk azt, amire tervezték.