Какво е конструктна валидност?
Най-трудният въпрос при измерването: дали нещото, което измерваш, съществува така, както си го дефинирал, и дали твоят инструмент достига до него, а не до нещо сходно.
Конструктната валидност задава въпроса дали даден инструмент измерва теоретичния конструкт, който твърди, че измерва, а не нещо корелиращо с него, нещо по-тясно от него или изобщо нищо кохерентно. Това е най-дълбоката форма на доказателства за валидност и тази, чието установяване отнема години, а не едно-единствено проучване.
Трудността е структурна. Даден конструкт като устойчивост или емоционална интелигентност не е обект; това е предполагаема закономерност в поведението. За да покажеш, че дадена скала го измерва, трябва едновременно да защитиш твърдението, че конструктът съществува така, както е описан, и че тези конкретни твърдения го достигат. Двете твърдения не могат да бъдат разделени, поради което Cronbach и Meehl, които въвеждат идеята през 1955 г., я формулират като тестване на цяла теоретична мрежа, а не на един инструмент.
Как се изгражда аргументацията
Прогнозирани модели на корелация. Теорията казва с кои неща трябва да се свързва конструктът и колко силно. Състраданието към себе си трябва да корелира положително с удовлетвореност от живота, отрицателно с депресия и само умерено със самочувствие: ако корелираше 0,9 със самочувствието, то не би било отделен конструкт. Всяко едно от тези предвиждания е проверимо твърдение и неуспехът при някое от тях е информативен.
Очаквани разлики между групите. Ако теорията казва, че дадена черта се развива с възрастта или е повишена в клинична популация, инструментът трябва да го покаже. Неуспехът да се открие разлика, която теорията изисква, е доказателство срещу инструмента, теорията или и двете.
Реакция на интервенция. Ако се предполага, че даден конструкт подлежи на трениране, резултатите трябва да се променят след обучение и да не се променят в контролна група. Конструкти, които никога не реагират на нищо, трудно се различават от артефакти.
Вътрешна структура. Факторната структура трябва да съответства на теоретизираната структура, и което е важно, в нова извадка. Експлораторният факторен анализ на данните от разработката ще открие всяка структура, която е била заложена в нея; конфирматорният анализ на нови данни е мястото, където твърдението действително се тества.
Идеята за множество черти и множество методи
Приносът на Campbell и Fiske от 1959 г. е да настояват, че конструктната валидност изисква две неща едновременно: измерванията на една и съща черта чрез различни методи трябва да съвпадат, а измерванията на различни черти чрез един и същ метод не трябва.
Точно в тази втора част повечето инструменти изпитват затруднения. Ако твоята самооценена емпатия корелира 0,7 с твоята самооценена доброжелателност и 0,2 с оценената от наблюдател емпатия, най-силното нещо, което твоят въпросник измерва, не е емпатията, а твоят общ начин да описваш себе си във въпросници. Дисперсията на метода е един от най-упоритите проблеми в изследванията, базирани на самооценка, и това е причината сериозната работа по валидността да търси критерий извън въпросника, където такъв съществува.
Защо това е важно, когато четеш твоите резултати
Конструктната валидност е това, което стои между даден резултат и неговата интерпретация. Когато един добре валидиран инструмент отчита, че имаш висок резултат за дадена черта, веригата от разсъждения зад това твърдение включва десетилетия публикувани трудове, установяващи, че чертата се държи като кохерентна величина, че тези твърдения я проследяват и че резултатът означава нещо сходно за хората, които го попълват.
Когато един тест без конструктна валидност отчита същото нещо, резултатът е число, генерирано от алгоритъм, който никой не е проверил. И двете изглеждат идентично на екрана с резултатите. Разликата е изцяло в документацията, поради което си струва да се потърси документацията.
Подложи го на тест
Четенето за измерванията е едно. Да видиш собствения си резултат с неговия източник, извадка за норма и ограничения е съвсем друго. Безплатен за попълване, не се изисква регистрация.
Продължи да четеш
- Какво е психометрия?Дисциплината, която установява дали дадено психологическо измерване е добро, и причината два теста, задаващи подобни въпроси, да се различават изключително много по стойността на своите резултати.
- Какво е надеждност в психологическото тестване?Надеждността е съгласуваност на измерването, а не точност. Един тест може да бъде много надежден и въпреки това да измерва грешното нещо, поради което това е първият зададен въпрос, но никога последният.
- Какво е валидност в психологическото тестване?Валидността не е свойство, което един тест притежава. Тя е аргумент за това дали определена интерпретация на даден резултат за определена цел е защитима и трябва да се изгражда наново за всяка нова употреба.
- Конвергентна и дискриминантна валидностДве огледални изисквания: един измерител трябва да съответства на това, на което трябва да съответства, и трябва да остане разграничим от това, което твърди, че не е. Повечето слаби инструменти се провалят на второто.
- Какво е алфа на Кронбах и какво не еНай-често отчитаната статистика в психологическото тестване и най-погрешно тълкуваната. Алфа не ти казва, че дадена скала е едноизмерна, а високата стойност често е по-скоро симптом, отколкото предимство.
- Стандартна грешка на измерването: с колко може да се отклонява твоят резултатВсеки резултат съдържа допустима грешка, а при повечето психологически тестове тя е по-голяма, отколкото хората предполагат. Това е числото, което ти показва кога една разлика е реална и кога е шум.
- Норми и перцентили: с какво се сравнява твоят резултатСуровият резултат не може да се интерпретира сам по себе си. Той придобива смисъл само спрямо референтна група, а коя група е използвана, е един от най-важните и най-слабо огласявани факти за всеки тест.
- Как всъщност се създава един психометричен тестОт дефинирането на конструкта до публикуваните норми, процесът отнема години и отхвърля по-голямата част от това, което е вложено в него. Ако познаваш стъпките, става очевидно кои от тях са пропуснати при един бърз онлайн тест.
- Какво означава, когато един тест се нарича валидиран?Думата е нерегулирана и се използва свободно от продукти, които не са положили нужните усилия. Ето какво означава тя, когато наистина има смисъл, и четирите въпроса, които разграничават двата случая.
- Защо повечето интернет тестове за личността не са надеждниНе защото са нечестни, а защото стъпките, които правят едно измерване надеждно, са невидими, скъпи и лесни за пропускане, а пропускането им не променя с нищо начина, по който изглежда резултатът.
- Какво може и какво не може да измери една самооценкаВъпросниците изискват от теб да бъдеш наблюдател на самия себе си, което работи по-добре за някои неща, отколкото за други. Да знаеш къде методът е силен и къде се проваля, променя начина, по който четеш всеки резултат.
- Какво означава, когато един тест предсказва нещоКорелация от 0,30 е силно откритие в изследванията на личността и слаба основа за решение за един човек. И двете твърдения са верни, а разминаването между тях причинява повечето злоупотреби с резултатите от тестовете.
- Скринингът не е диагнозаСкрининговият въпросник е създаден, за да улови възможно най-много потенциални случаи, приемайки висок процент на фалшиво положителни резултати като цена за това. Интерпретирането на скринингов резултат като диагноза противоречи на целта, за която е създаден.