Co znamená, když se o testu říká, že byl validován?
Toto označení nepodléhá regulaci a volně ho používají produkty, které pro jeho oprávněné použití nic neudělaly. Tady se dozvíš, co znamená, když má skutečný obsah, a které čtyři otázky ti pomohou oba případy rozlišit.
"Vědecky validovaný" není chráněné označení. Nikdo ho neuděluje, žádný orgán nekontroluje jeho používání a objevuje se i u produktů, jejichž veškeré důkazy spočívají v tom, že je vyzkoušelo hodně lidí. Stojí za to vědět, co toto označení znamená, když se používá správně.
Stručně
Validovaný nástroj má publikované důkazy o tom, co měří, s jakou přesností, v jakých populacích a k čemu lze jeho skóre oprávněně použít. Validace není certifikát. Je to soubor důkazů, obvykle shromažďovaných po léta, který zpravidla zahrnuje i zjištění omezující použití nástroje, místo aby ho jen vyzdvihovala.
Přítomnost zdokumentovaných omezení patří k lepším vodítkům. Odborná literatura věnovaná skutečné validaci je jich plná: tato škála funguje u dospívajících špatně, tuto fasetu se nepodařilo potvrdit v další studii, hraniční hodnota závisí na populaci. Produkt, který uvádí jen silné stránky, nezveřejnil svou validaci; zveřejnil svůj marketing.
Čtyři zásadní otázky
Jaká je původní publikace? Validovaný nástroj má původní článek v recenzovaném odborném časopise, u něhož jsou uvedeni autoři, rok a obvykle i DOI. Tento článek popisuje, jak byly položky vytvořeny a jaké byly počáteční psychometrické vlastnosti nástroje. Pokud nikdo nedokáže článek pojmenovat, není o jaké validaci mluvit.
Potvrdil strukturu někdo další? Vývojový tým zpravidla nalezne strukturu, kterou sám navrhl. Důležité je, zda ke stejnému závěru dospěla nezávislá skupina na základě nezávislých dat. To je nejvýmluvnější otázka, kterou můžeš položit, a zároveň ta, která nejčastěji zůstává bez odpovědi.
Na jaké populaci a kdy byly vytvořeny normy? Skóre vyjadřuje pozici v referenčním rozdělení. Nástroj, který uvádí percentil, aniž by řekl, k jaké populaci se vztahuje, ti dal číslo bez základu pro srovnání.
Co přináší navíc? Jde o inkrementální validitu oproti zavedenému měřítku. Mnoho konstruktů prodávaných pod vlastní značkou zde neobstojí: s již známým rysem korelují natolik silně, že při vysvětlování čehokoli dalšího nepřidávají žádnou vysvětlenou varianci. To je běžný výsledek vědeckého prověřování a zůstane skrytý, pokud to někdo neotestuje.
Co komplikuje překlad
Nástroj validovaný v angličtině tím není automaticky validovaný v němčině. Řádná mezikulturní adaptace vyžaduje překlad do cílového jazyka a zpětný překlad, posouzení odborníky, kognitivní rozhovory a následně novou psychometrickou studii v cílovém jazyce, která ověří, zda platí faktorová struktura a zda jednotlivé položky fungují v různých skupinách rovnocenně.
Nástroje, které tyto kroky vynechávají, jsou běžné. Dotazník s bezvadnou původní validací se může chovat docela jinak v jazyce, v němž má klíčová položka odlišný významový odstín, a bez studie to nelze zjistit. Když je test nabízen v deseti jazycích, užitečná otázka zní, zda byl validován v deseti jazycích, nebo v jednom a do devíti dalších pouze přeložen.
Co validace nezaručuje
Neznamená, že je skóre jisté. I validovaný nástroj je zatížen chybou měření, stále popisuje pravidelnost na úrovni populace, nikoli osud jednotlivce, a měří jen to, co dokážou zachytit jeho položky.
Validace ti umožňuje poznat hranice nástroje. Můžeš zjistit, jak velká je chyba, v jaké populaci a pro jaký účel. To je skromnější tvrzení než "tento test odhalí, kým skutečně jsi", a jediné, které obstojí.
Pokud chceš vidět, jak taková dokumentace vypadá, když existuje, u každého testu v katalogu NOESIS najdeš název nástroje, z něhož vychází, jeho autory a rok vzniku, způsob výpočtu skóre i důkazy, o které se opírá, včetně toho, kde jsou tyto důkazy předmětem sporů.
Vyzkoušej to
Číst si o měření je jedna věc. Vidět své vlastní skóre společně s jeho zdrojem, normativním vzorkem a omezeními je něco jiného. Test je zdarma a registrace není nutná.
Pokračovat ve čtení
- Co je psychometrie?Obor, který zjišťuje, zda je psychologické měření kvalitní. Vysvětluje také, proč se dva testy s podobnými otázkami mohou výrazně lišit v hodnotě svých výsledků.
- Co je reliabilita v psychologickém testování?Reliabilita znamená konzistenci měření, ne jeho správnost. Test může mít vysokou reliabilitu, a přesto měřit něco jiného, než má. Proto je reliabilita první otázkou, kterou je třeba položit, ale nikdy ne poslední.
- Co je validita v psychologickém testování?Validita není vlastnost, kterou test má. Jde o argument, zda je určitá interpretace konkrétního skóre pro konkrétní účel obhajitelná, a pro každé nové použití je třeba tento argument znovu vybudovat.
- Co je konstruktová validita?Nejtěžší otázka měření: zda to, co měříš, existuje tak, jak jsi to definoval/a, a zda tvůj nástroj zachycuje právě to, a ne něco příbuzného.
- Konvergentní a diskriminační validitaDva vzájemně zrcadlové požadavky: měření musí odpovídat tomu, čemu by odpovídat mělo, a zároveň se musí odlišovat od toho, čím podle svého tvrzení není. Většina slabých nástrojů nesplňuje druhý požadavek.
- Co je Cronbachovo alfa a co neníNejčastěji uváděná statistika v psychologickém testování a zároveň nejčastěji chybně vykládaná. Alfa ti neřekne, zda je škála jednodimenzionální, a vysoká hodnota je často spíše příznakem problému než předností.
- Standardní chyba měření: o kolik se může tvé skóre lišitKaždé skóre má určitou míru chyby a u většiny psychologických testů je větší, než si lidé myslí. Právě tato hodnota ti říká, kdy je rozdíl skutečný a kdy jde jen o šum.
- Normy a percentily: s čím se porovnává tvé skóreHrubé skóre samo o sobě nelze interpretovat. Smysl získává teprve ve vztahu k referenční skupině. To, která skupina byla použita, patří k nejdůležitějším, ale nejméně uváděným informacím o jakémkoli testu.
- Jak se skutečně vytváří psychometrický testOd definice konstruktu po zveřejnění norem trvá celý postup roky a většina původních návrhů neprojde. Když znáš jednotlivé kroky, snadno poznáš, které z nich rychlý online kvíz vynechal.
- Proč většina internetových testů osobnosti není reliabilníNe proto, že by byli nepoctiví, ale proto, že kroky, díky nimž je měření důvěryhodné, nejsou vidět, jsou nákladné a dají se snadno vynechat. Když je vynecháš, na vzhledu výsledku se nic nezmění.
- Co může a nemůže měřit sebehodnoceníDotazníky tě žádají, abys pozoroval/a sám/sama sebe. U některých věcí to funguje lépe než u jiných. Když víš, v čem je tato metoda silná a kde selhává, mění to způsob, jakým čteš každý výsledek.
- Co znamená, když test něco předpovídáKorelace 0,30 je ve výzkumu osobnosti významným zjištěním, ale slabým základem pro rozhodnutí o jednom člověku. Obě tvrzení jsou pravdivá a rozdíl mezi nimi vede k většině případů nesprávného použití výsledků testů.
- Screening není diagnózaScreeningový dotazník je navržen tak, aby zachytil co nejvíce možných případů, i za cenu vysokého podílu falešně pozitivních výsledků. Považovat skóre ze screeningu za diagnózu znamená připisovat mu účel, pro který nebylo určeno.