Конвергентна и дискриминантна валидност
Две огледални изисквания: един измерител трябва да съответства на това, на което трябва да съответства, и трябва да остане разграничим от това, което твърди, че не е. Повечето слаби инструменти се провалят на второто.
Конвергентната и дискриминантната валидност са двете половини на едно единствено изискване. Едно средство за измерване трябва да корелира с неща, с които теоретично би трябвало, и не трябва да корелира твърде силно с неща, от които би трябвало да се различава. Постигането на едното без другото не е частичен успех; обикновено това е знак, че конструктът не е това, за което се представя.
Конвергентна валидност
Доказателствата за конвергентност показват, че измерването съвпада с други индикатори за същото нещо. Една нова скала за тревожност би трябвало да корелира значително с утвърдени скали за тревожност, с оценки на клиницисти и, в идеалния случай, с нещо, което не е поредният въпросник, като например физиологични измервания или наблюдавано поведение на избягване.
Тук обикновено се очакват корелации над 0,50, често над 0,70, когато средството за сравнение е добре утвърден инструмент за същия конструкт. Под тези стойности или новата скала, или скалата за сравнение измерва нещо друго.
Тук има уловка. Корелация от 0,95 със съществуваща скала не е триумф, това означава, че новият инструмент е просто преопакован продукт, и честният въпрос става какво добавя той. Конвергентната валидност е минимум, а не цел за максимизиране.
Дискриминантна валидност
Доказателствата за дискриминантност показват, че измерването остава отделено от конструктите, от които твърди, че се различава. Именно тук се крият интересните провали.
Този модел се повтаря в литературата. Твърдостта (Grit) корелира около 0,84 с добросъвестност, достатъчно близо, за да установи мета-анализът, че тя не добавя почти нищо към академичното прогнозиране, след като добросъвестността бъде контролирана. Емоционалната интелигентност чрез самооценка се припокрива силно с емоционалната стабилност, екстраверсията и добросъвестността взети заедно. Споделената дисперсия в Тъмната триада до голяма степен изчезва, след като се вземе предвид Честност-Скромност от модела HEXACO. Във всеки от случаите конструктът е представен като нова територия, но се оказва преименуван регион от вече съществуваща карта.
Дискриминантната валидност е и мястото, където излизат наяве ефектите на метода. Ако всеки конструкт, базиран на самооценка в дадено проучване, корелира 0,4 с всеки друг, общият фактор вероятно е стилът на отговаряне на респондента, а не някаква споделена психология.
Тестът, който решава въпроса
Решаващата процедура е инкременталната валидност: първо въведи утвърденото измерване в регресия, след това новото и виж дали новото обяснява някаква допълнителна дисперсия в резултата. Ако не, конструктът може все пак да е теоретично интересен, но инструментът не измерва нищо, с което областта вече да не е разполагала.
Това е взискателен стандарт и много публикувани скали никога не са били подлагани на него. Когато бъдат, резултатът често е констатацията за излишност по-горе. Това не е скандал, това е нормално научно отсяване, но означава, че популярността на даден конструкт не дава информация за това дали той издържа теста.
Какво променя това за читателя
Когато даден тест отчита няколко резултата, полезният въпрос е дали тези резултати са действително различни. Четири измерения, които корелират 0,8 едно с друго, са едно измерение с четири етикета, а профил, изграден от тях, ще изглежда диференциран, въпреки че не носи почти никаква независима информация.
Инструментите, които отчитат своите вътрешноскалови корелации, ти позволяват да провериш това сам. Инструментите, които представят тип с четири квадранта, без изобщо да показват как са свързани квадрантите, са направили проверката невъзможна, каквато обикновено е и целта.
Подложи го на тест
Четенето за измерванията е едно. Да видиш собствения си резултат с неговия източник, извадка за норма и ограничения е съвсем друго. Безплатен за попълване, не се изисква регистрация.
Продължи да четеш
- Какво е психометрия?Дисциплината, която установява дали дадено психологическо измерване е добро, и причината два теста, задаващи подобни въпроси, да се различават изключително много по стойността на своите резултати.
- Какво е надеждност в психологическото тестване?Надеждността е съгласуваност на измерването, а не точност. Един тест може да бъде много надежден и въпреки това да измерва грешното нещо, поради което това е първият зададен въпрос, но никога последният.
- Какво е валидност в психологическото тестване?Валидността не е свойство, което един тест притежава. Тя е аргумент за това дали определена интерпретация на даден резултат за определена цел е защитима и трябва да се изгражда наново за всяка нова употреба.
- Какво е конструктна валидност?Най-трудният въпрос при измерването: дали нещото, което измерваш, съществува така, както си го дефинирал, и дали твоят инструмент достига до него, а не до нещо сходно.
- Какво е алфа на Кронбах и какво не еНай-често отчитаната статистика в психологическото тестване и най-погрешно тълкуваната. Алфа не ти казва, че дадена скала е едноизмерна, а високата стойност често е по-скоро симптом, отколкото предимство.
- Стандартна грешка на измерването: с колко може да се отклонява твоят резултатВсеки резултат съдържа допустима грешка, а при повечето психологически тестове тя е по-голяма, отколкото хората предполагат. Това е числото, което ти показва кога една разлика е реална и кога е шум.
- Норми и перцентили: с какво се сравнява твоят резултатСуровият резултат не може да се интерпретира сам по себе си. Той придобива смисъл само спрямо референтна група, а коя група е използвана, е един от най-важните и най-слабо огласявани факти за всеки тест.
- Как всъщност се създава един психометричен тестОт дефинирането на конструкта до публикуваните норми, процесът отнема години и отхвърля по-голямата част от това, което е вложено в него. Ако познаваш стъпките, става очевидно кои от тях са пропуснати при един бърз онлайн тест.
- Какво означава, когато един тест се нарича валидиран?Думата е нерегулирана и се използва свободно от продукти, които не са положили нужните усилия. Ето какво означава тя, когато наистина има смисъл, и четирите въпроса, които разграничават двата случая.
- Защо повечето интернет тестове за личността не са надеждниНе защото са нечестни, а защото стъпките, които правят едно измерване надеждно, са невидими, скъпи и лесни за пропускане, а пропускането им не променя с нищо начина, по който изглежда резултатът.
- Какво може и какво не може да измери една самооценкаВъпросниците изискват от теб да бъдеш наблюдател на самия себе си, което работи по-добре за някои неща, отколкото за други. Да знаеш къде методът е силен и къде се проваля, променя начина, по който четеш всеки резултат.
- Какво означава, когато един тест предсказва нещоКорелация от 0,30 е силно откритие в изследванията на личността и слаба основа за решение за един човек. И двете твърдения са верни, а разминаването между тях причинява повечето злоупотреби с резултатите от тестовете.
- Скринингът не е диагнозаСкрининговият въпросник е създаден, за да улови възможно най-много потенциални случаи, приемайки висок процент на фалшиво положителни резултати като цена за това. Интерпретирането на скринингов резултат като диагноза противоречи на целта, за която е създаден.