noesisnoesis
Jak funguje měření

Standardní chyba měření: o kolik se může tvé skóre lišit

Každé skóre má určitou míru chyby a u většiny psychologických testů je větší, než si lidé myslí. Právě tato hodnota ti říká, kdy je rozdíl skutečný a kdy jde jen o šum.

Standardní chyba měření převádí abstraktní koeficient reliability na něco konkrétního: interval kolem skóre. Odpovídá na otázku, kterou většina obrazovek s výsledky nechává bez odpovědi: o kolik se toto číslo mohlo lišit, kdybys test absolvoval/a jiné odpoledne?

Vzorec je jednoduchý. Vynásob směrodatnou odchylku škály druhou odmocninou z jedné minus její reliabilita. U škály se směrodatnou odchylkou 10 a reliabilitou 0,85 činí standardní chyba přibližně 3,9 bodu.

Co tento interval skutečně zahrnuje

Přibližně ve dvou třetinách případů leží skutečná úroveň člověka nejvýše jednu standardní chybu od jeho naměřeného skóre. Pro přibližně 95procentní jistotu je potřeba počítat se zhruba dvěma standardními chybami na každou stranu.

Vezmi si předchozí příklad. Někdo dosáhne skóre 62. Interval pro 95procentní jistotu sahá přibližně od 54 do 70. To je rozpětí šestnácti bodů na škále, kde typický rozdíl mezi průměrem a zřetelně nadprůměrným výsledkem může být deset bodů.

Není to vada tohoto konkrétního testu. Reliabilita 0,85 je solidní. Taková je běžná přesnost psychologického měření a právě proto pečlivě zpracované zprávy uvádějí intervaly, nikoli jednotlivé hodnoty.

Důsledky, které lidé přehlížejí

Malé rozdíly mezi škálami obvykle nic neznamenají. Pokud máš v extraverzi skóre 58 a v otevřenosti 54, poctivý závěr je, že se tato skóre nedají rozlišit. Interpretace profilu, které stavějí příběh na čtyřbodových rozdílech, vyvozují závěry ze šumu.

Malé změny v čase obvykle také nic neznamenají. Když test absolvuješ znovu a tvoje skóre se posune o pět bodů, u většiny nástrojů to spadá do chyby měření. Skutečná změna rysu probíhá v průběhu let a projevuje se posunem výrazně přesahujícím interval chyby, nikoli několika body z měsíce na měsíc.

Řazení podle pořadí problém zesiluje. Rozdíl několika bodů hrubého skóre může někoho posunout o deset percentilových pozic v hustě obsazeném středu rozdělení, protože právě tam se nachází většina lidí. Percentilová pořadí vypadají přesně, ale jsou nejméně stabilním způsobem vyjádření skóre.

Přesnost není v celé škále stejná. Klasická testová teorie předpokládá jednu hodnotu chyby pro každé skóre, což je zjednodušení. Teorie odpovědi na položku modeluje chybu zvlášť na každé úrovni rysu a na krajích škály je téměř vždy větší, tedy právě tam, kde vznikají interpretace s nejzávažnějšími důsledky. Velmi vysoké nebo velmi nízké skóre je zpravidla méně přesné než skóre kolem středu, nikoli přesnější.

Proč poctivé uvádění výsledků působí méně přesvědčivě

Nástroj, který uvádí intervaly spolehlivosti, působí méně určitě než nástroj, který uvádí jediné číslo na jedno desetinné místo. Ten méně určitý říká pravdu. Ten zdánlivě přesný má stejnou základní chybu měření a rozhodl se ji neukázat.

Na to je dobré pamatovat při srovnávání vědecky zdokumentovaného testu s komerčním produktem, který tě zařadí do kategorie. Hranice kategorie leží na konkrétním skóre, ale člověk jeden bod pod ní a člověk jeden bod nad ní se statisticky neliší. Označení typu tuto skutečnost zcela zakrývá. To je jeden ze závažnějších argumentů proti nástrojům založeným na typech a důvod, proč jsou ve výzkumu standardem spojitá skóre s uvedenou chybou měření.

Vyzkoušej to

Číst si o měření je jedna věc. Vidět své vlastní skóre společně s jeho zdrojem, normativním vzorkem a omezeními je něco jiného. Test je zdarma a registrace není nutná.

Pokračovat ve čtení