Co je psychometrie?
Obor, který zjišťuje, zda je psychologické měření kvalitní. Vysvětluje také, proč se dva testy s podobnými otázkami mohou výrazně lišit v hodnotě svých výsledků.
Psychometrie je odvětví psychologie, které se zabývá samotným měřením. Ne tím, co znamená extraverze, ale tím, zda daný soubor otázek extraverzi skutečně měří, kolik chyby obsahuje výsledné číslo a co lze na jeho základě oprávněně předvídat.
Na tomto rozdílu záleží víc, než se může zdát. Kdokoli může napsat dvacet otázek o tom, jak je člověk společenský, a sečíst odpovědi. Psychometrie se zabývá tím, co následuje: prokázat, že těch dvacet otázek tvoří soudržný celek, že měří jednu věc, a ne tři, že stejný člověk dosáhne příští měsíc přibližně stejného skóre, že skóre souvisí s tím, jak se skutečně chová, a že celý postup funguje stejně u 22letého člověka v Lisabonu jako u 55letého člověka v Mnichově.
Proč byla potřeba samostatná disciplína
Fyzikální měření má oproti psychologii jednu výhodu: k tomu, co měříš, můžeš přiložit metr. Pro svědomitost žádný metr neexistuje. Tento rys nelze přímo pozorovat. Vyvozujeme ho z chování a odpovědi v dotazníku představují další vrstvu nepřímého usuzování.
Tomu psychometrici říkají latentní proměnná: něco, co je dostatečně skutečné na to, aby to mělo důsledky, ale k čemu se lze dostat jen prostřednictvím nepřímých ukazatelů. Právě kvůli této nepřímosti existuje celý soubor metodických postupů. Každá metoda, se kterou se setkáš, ať už jde o faktorovou analýzu, koeficienty reliability, teorii odpovědi na položku nebo normativní vzorky, je pokusem říct něco obhajitelného o veličině, kterou nikdo nemůže přímo pozorovat.
Tři otázky
Když odhlédneme od odborných pojmů, psychometrie klade každému nástroji tři otázky.
Je měření konzistentní? Pokud výsledek tvoří převážně šum, na ničem dalším nezáleží. Konzistence se ověřuje mezi položkami (odpovídají si otázky navzájem?), v čase (dosáhne stejný člověk příští měsíc stejného skóre?) a tam, kde je to relevantní, mezi hodnotiteli. To je reliabilita.
Měří to, co tvrdí? Dotazník může být dokonale konzistentní, a přesto měřit něco jiného. Škála, která tvrdí, že měří vůdčí potenciál, ale koreluje hodnotou 0,8 s obyčejnou sebeúctou, měří sebeúctu. To je otázka validity. Nejde o vlastnost, kterou nástroj buď má, nebo nemá. Jde o závěr podložený nahromaděnými důkazy.
Ve srovnání s kým? Hrubé skóre 34 samo o sobě nic neznamená. Interpretovat ho lze pouze ve vztahu k referenční skupině: ve srovnání s jakou populací je 34 vysoké, kdy a kde byla měřena? Tím se zabývají normy a právě tento krok většina spotřebitelských testů zcela vynechává.
Jak vypadá dobrá praxe
Kvalitně vytvořený nástroj má zdokumentovaný vývoj. Někdo zveřejnil, jak byly položky formulovány a které byly vyřazeny. Někdo uvedl koeficienty reliability u konkrétně popsaných vzorků včetně jejich velikosti. Někdo ověřil, zda faktorová struktura obstojí i v druhém, nezávislém vzorku, nikoli jen v tom, na němž byl nástroj vytvořen. Někdo zkontroloval, zda se položky chovají stejně v různých jazycích a věkových skupinách. A někdo další, ideálně bez vlastního zájmu na nástroji, se pokusil zjištění zopakovat a zveřejnil, jak to dopadlo.
Nic z toho neznamená, že je test neomylný. Znamená to, že jeho omezení lze poznat, což je jiná a užitečnější vlastnost. Nástroj s doloženou chybou měření ti říká, nakolik můžeš důvěřovat malému rozdílu mezi dvěma skóre. Nástroj bez zveřejněného odhadu chyby není přesnější. Jen o své nepřesnosti méně mluví.
Co si z toho můžeš odnést
Psychometrie ti neřekne, že je test pravdivý. Řekne ti, kam až lze zajít při interpretaci skóre, než přestane cokoli znamenat: na které otázky může odpovědět, na jakých populacích byl kalibrován a jak velký musí být rozdíl, aby stálo za to si ho všimnout.
To je skromnější příslib, než jaký dává většina produktů zaměřených na osobnost. Je to ale také jediný příslib, který obstojí ve světle důkazů.
Vyzkoušej to
Číst si o měření je jedna věc. Vidět své vlastní skóre společně s jeho zdrojem, normativním vzorkem a omezeními je něco jiného. Test je zdarma a registrace není nutná.
Pokračovat ve čtení
- Co je reliabilita v psychologickém testování?Reliabilita znamená konzistenci měření, ne jeho správnost. Test může mít vysokou reliabilitu, a přesto měřit něco jiného, než má. Proto je reliabilita první otázkou, kterou je třeba položit, ale nikdy ne poslední.
- Co je validita v psychologickém testování?Validita není vlastnost, kterou test má. Jde o argument, zda je určitá interpretace konkrétního skóre pro konkrétní účel obhajitelná, a pro každé nové použití je třeba tento argument znovu vybudovat.
- Co je konstruktová validita?Nejtěžší otázka měření: zda to, co měříš, existuje tak, jak jsi to definoval/a, a zda tvůj nástroj zachycuje právě to, a ne něco příbuzného.
- Konvergentní a diskriminační validitaDva vzájemně zrcadlové požadavky: měření musí odpovídat tomu, čemu by odpovídat mělo, a zároveň se musí odlišovat od toho, čím podle svého tvrzení není. Většina slabých nástrojů nesplňuje druhý požadavek.
- Co je Cronbachovo alfa a co neníNejčastěji uváděná statistika v psychologickém testování a zároveň nejčastěji chybně vykládaná. Alfa ti neřekne, zda je škála jednodimenzionální, a vysoká hodnota je často spíše příznakem problému než předností.
- Standardní chyba měření: o kolik se může tvé skóre lišitKaždé skóre má určitou míru chyby a u většiny psychologických testů je větší, než si lidé myslí. Právě tato hodnota ti říká, kdy je rozdíl skutečný a kdy jde jen o šum.
- Normy a percentily: s čím se porovnává tvé skóreHrubé skóre samo o sobě nelze interpretovat. Smysl získává teprve ve vztahu k referenční skupině. To, která skupina byla použita, patří k nejdůležitějším, ale nejméně uváděným informacím o jakémkoli testu.
- Jak se skutečně vytváří psychometrický testOd definice konstruktu po zveřejnění norem trvá celý postup roky a většina původních návrhů neprojde. Když znáš jednotlivé kroky, snadno poznáš, které z nich rychlý online kvíz vynechal.
- Co znamená, když se o testu říká, že byl validován?Toto označení nepodléhá regulaci a volně ho používají produkty, které pro jeho oprávněné použití nic neudělaly. Tady se dozvíš, co znamená, když má skutečný obsah, a které čtyři otázky ti pomohou oba případy rozlišit.
- Proč většina internetových testů osobnosti není reliabilníNe proto, že by byli nepoctiví, ale proto, že kroky, díky nimž je měření důvěryhodné, nejsou vidět, jsou nákladné a dají se snadno vynechat. Když je vynecháš, na vzhledu výsledku se nic nezmění.
- Co může a nemůže měřit sebehodnoceníDotazníky tě žádají, abys pozoroval/a sám/sama sebe. U některých věcí to funguje lépe než u jiných. Když víš, v čem je tato metoda silná a kde selhává, mění to způsob, jakým čteš každý výsledek.
- Co znamená, když test něco předpovídáKorelace 0,30 je ve výzkumu osobnosti významným zjištěním, ale slabým základem pro rozhodnutí o jednom člověku. Obě tvrzení jsou pravdivá a rozdíl mezi nimi vede k většině případů nesprávného použití výsledků testů.
- Screening není diagnózaScreeningový dotazník je navržen tak, aby zachytil co nejvíce možných případů, i za cenu vysokého podílu falešně pozitivních výsledků. Považovat skóre ze screeningu za diagnózu znamená připisovat mu účel, pro který nebylo určeno.