Konvergens és diszkrimináns érvényesség
Két egymást tükröző követelmény: egy mérésnek egyeznie kell azzal, amivel egyeznie kell, és elkülönülnie attól, aminek állítása szerint nem azonos. A legtöbb gyenge mérőeszköz a második követelménynek nem felel meg.
A konvergens és a diszkriminatív érvényesség egyetlen követelmény két fele. Egy mérésnek korrelálnia kell azzal, amivel elméletileg kell, és nem korrelálhat túlságosan erősen azzal, amitől elvileg különbözik. Ha csak az egyik teljesül, az nem részleges siker; rendszerint annak jele, hogy a konstruktum nem az, aminek mondja magát.
Konvergens érvényesség
A konvergens bizonyíték azt mutatja, hogy a mérés összhangban van ugyanannak a dolognak más mutatóival. Egy új szorongásskálának jelentős mértékben korrelálnia kell a bevált szorongásskálákkal, a klinikusi értékelésekkel, és ideális esetben valamivel, ami nem újabb kérdőív, például fiziológiai mérésekkel vagy megfigyelt elkerülő viselkedéssel.
Itt a korrelációkat általában 0,50 fölött várják, gyakran 0,70 fölött, ha az összehasonlító mérés ugyanarra a konstruktumra vonatkozó, jól bevált mérőeszköz. Ez alatt vagy az új skála, vagy az összehasonlító mérés valami mást mér.
Van itt egy csapda. Egy meglévő skálával mért 0,95-ös korreláció nem diadal: azt jelenti, hogy az új mérőeszköz csak újracsomagolás, és az őszinte kérdés az lesz, mit tesz hozzá. A konvergens érvényesség alsó határ, nem pedig maximalizálandó cél.
Diszkriminatív érvényesség
A diszkriminatív bizonyíték azt mutatja, hogy a mérés elkülönül azoktól a konstruktumoktól, amelyektől állítása szerint különbözik. Itt találhatók az érdekes kudarcok.
A minta visszatérő a szakirodalomban. A kitartás (grit) körülbelül 0,84-es korrelációt mutat a lelkiismeretességgel, ami annyira közeli, hogy egy metaanalízis szerint a lelkiismeretesség kontrollálása után szinte semmit sem tesz hozzá a tanulmányi teljesítmény előrejelzéséhez. Az önbeszámolós érzelmi intelligencia erősen átfed az érzelmi stabilitás, az extraverzió és a lelkiismeretesség együttesével. A sötét triász közös varianciája nagyrészt eltűnik, ha figyelembe vesszük a HEXACO-modell Honesty-Humility dimenzióját. Minden esetben új területként mutatták be a konstruktumot, és kiderült, hogy egy meglévő térkép átnevezett része.
A diszkriminatív érvényességnél bukkannak fel a módszerhatások is. Ha egy vizsgálatban minden önbeszámolóval mért konstruktum 0,4-es korrelációt mutat minden másikkal, a közös tényező valószínűleg a válaszadó válaszstílusa, nem pedig valamilyen közös pszichológiai jellemző.
A döntő próba
A döntő eljárás az inkrementális érvényesség: először a bevált mérést kell bevinni a regresszióba, majd az újat, és megnézni, hogy az új magyaráz-e további varianciát a kimenetben. Ha nem, a konstruktum elméletileg még lehet érdekes, de a mérőeszköz semmi olyat nem mér, ami ne lett volna már meg a területen.
Ez szigorú mérce, és rengeteg publikált skálát soha nem vetettek alá ennek. Amikor mégis, az eredmény gyakran a fent leírt redundancia. Ez nem botrány, hanem a tudomány szokásos tisztulási folyamata, de azt jelenti, hogy egy konstruktum népszerűsége semmit sem árul el arról, hogy kiállja-e a próbát.
Mit jelent ez az olvasó számára
Ha egy teszt több pontszámot közöl, a hasznos kérdés az, hogy ezek a pontszámok valóban különbözőek-e. Négy dimenzió, amelyek egymással 0,8-es korrelációt mutatnak, valójában egyetlen dimenzió négy címkével, és a belőlük épített profil differenciáltnak tűnik, miközben szinte semmilyen független információt nem hordoz.
Azok a mérőeszközök, amelyek közlik a skálák közötti korrelációkat, lehetővé teszik, hogy ezt Ön maga ellenőrizze. Azok a mérőeszközök, amelyek négy kvadránsos típust mutatnak be anélkül, hogy valaha megmutatnák a kvadránsok egymáshoz való viszonyát, lehetetlenné tették az ellenőrzést, és rendszerint éppen ez a cél.
Tegye próbára
Egy dolog a mérésről olvasni. Más dolog látni a saját pontszámát a forrásával, a normamintájával és a korlátaival együtt. Ingyenes, regisztráció nem szükséges.
Olvasson tovább
- Mi a pszichometria?Az a tudományág, amely megállapítja, hogy egy pszichológiai mérés megfelelő-e; és ez az oka annak, hogy két, hasonló kérdéseket feltevő teszt eredményeinek értéke rendkívül eltérő lehet.
- Mi a megbízhatóság a pszichológiai tesztelésben?A megbízhatóság a mérés következetességét jelenti, nem a helyességét. Egy teszt lehet nagyon megbízható, és mégis rossz dolgot mérhet. Ezért ez az első kérdés, amelyet felteszünk, és soha nem az utolsó.
- Mi az érvényesség a pszichológiai tesztelésben?Az érvényesség nem olyan tulajdonság, amellyel egy teszt rendelkezik. Az érvényesség érvelés arról, hogy egy adott pontszám adott értelmezése adott célra védhető-e, és ezt minden új felhasználásnál újra fel kell építeni.
- Mi a konstruktumérvényesség?A mérés legnehezebb kérdése: létezik-e az, amit mér, úgy, ahogyan Ön meghatározta, és valóban azt éri-e el a mérőeszköze, nem pedig valami ahhoz közel esőt.
- Mi a Cronbach-alfa, és mi nemA pszichológiai tesztelés leggyakrabban közölt statisztikai mutatója, és egyben a leggyakrabban félreértett is. Az alfa nem árulja el, hogy egy skála egydimenziós-e, és a magas érték gyakran inkább tünet, mint erény.
- A mérés standard hibája: mennyivel térhet el az Ön pontszámaMinden pontszámnak van hibahatára, és a legtöbb pszichológiai teszt esetében ez szélesebb, mint azt az emberek gondolnák. Ez az a szám, amely megmutatja, mikor valódi egy különbség, és mikor csupán zaj.
- Normák és percentilisek: mihez hasonlítják az Ön pontszámátEgy nyers pontszám önmagában nem értelmezhető. Csak egy referenciacsoporthoz viszonyítva válik jelentésessé, és az, hogy melyik csoportot használták, az egyik legnagyobb következményekkel járó és legkevésbé hangoztatott tény bármely tesztről.
- Hogyan készül valójában egy pszichometriai tesztA konstruktum meghatározásától a közzétett normákig a folyamat évekig tart, és a beletett anyag nagy részét elveti. Ha ismeri a lépéseket, nyilvánvalóvá válik, melyeket hagyott ki egy gyors online kvíz.
- Mit jelent, ha egy tesztet validáltnak neveznek?A kifejezés nem szabályozott, és szabadon használják olyan termékek is, amelyek semmit sem tettek meg érte. Az alábbiakban bemutatjuk, mit jelent, amikor valóban jelent valamit, és azt a négy kérdést, amely elválasztja egymástól a két esetet.
- Miért nem megbízható a legtöbb internetes személyiségtesztNem azért, mert nem őszinték, hanem mert azok a lépések, amelyektől egy mérés megbízhatóvá válik, láthatatlanok, költségesek és könnyen kihagyhatók; kihagyásuk pedig semmit sem változtat azon, hogyan néz ki az eredmény.
- Mit képes mérni az önbeszámoló, és mit nemA kérdőívek arra kérik Önt, hogy saját maga megfigyelője legyen, ami bizonyos dolgok esetében jobban működik, mint másoknál. Ha tudja, hol erős és hol mond csődöt ez a módszer, másképp fog olvasni bármilyen eredményt.
- Mit jelent, ha egy teszt bejósol valamitA 0,30-as korreláció erős eredménynek számít a személyiségkutatásban, ugyanakkor gyenge alapot nyújt egy adott személyre vonatkozó döntéshez. Mindkét állítás igaz, és a kettő közötti szakadék okozza a teszteredményekkel való visszaélések többségét.
- A szűrés nem diagnózisEgy szűrő kérdőívet arra terveznek, hogy a lehető legtöbb lehetséges esetet kiszűrje, és ennek áraként elfogadja a magas álpozitív arányt. Ha egy szűrési pontszámot diagnózisként olvasunk, azzal éppen az ellenkezőjére fordítjuk azt, amire tervezték.