noesisnoesis
Як працює вимірювання

Конвергентна та дискримінантна валідність

Дві дзеркальні вимоги: вимір має узгоджуватися з тим, з чим має узгоджуватися, і має залишатися відмінним від того, чим він заявляє, що не є. Більшість слабких інструментів не виконують другу вимогу.

Конвергентна та дискримінантна валідність це дві половини єдиної вимоги. Показник має корелювати з тим, з чим теоретично повинен, і не повинен корелювати надто високо з тим, від чого, як стверджується, він відрізняється. Виконання однієї умови без іншої це не частковий успіх, це зазвичай ознака того, що конструкт не є тим, за що себе видає.

Конвергентна валідність

Конвергентні докази показують, що показник узгоджується з іншими індикаторами того самого явища. Нова шкала тривожності повинна суттєво корелювати з усталеними шкалами тривожності, з оцінками клініцистів і, в ідеалі, з чимось, що не є іншим опитувальником, наприклад з фізіологічними показниками або спостережуваною поведінкою уникнення.

Кореляції тут зазвичай очікуються вище 0.50, часто вище 0.70, коли показник для порівняння є добре усталеним інструментом для того самого конструкту. Нижче цього рівня або нова шкала, або показник для порівняння вимірює щось інше.

Тут є пастка. Кореляція 0.95 з наявною шкалою це не тріумф, це означає, що новий інструмент є перепакуванням, і чесним запитанням стає те, що він додає. Конвергентна валідність це мінімальний рівень, а не мета, яку треба максимізувати.

Дискримінантна валідність

Дискримінантні докази показують, що показник залишається відокремленим від конструктів, від яких він, за твердженням, відрізняється. Саме тут трапляються цікаві невдачі.

Цей шаблон повторюється в літературі. Наполегливість корелює приблизно на рівні 0.84 із сумлінністю, настільки близько, що метааналіз показав: вона майже нічого не додає до прогнозування академічної успішності, коли сумлінність контролюється. Самозвітний емоційний інтелект значною мірою перетинається з емоційною стабільністю, екстраверсією та сумлінністю разом узятими. Спільна дисперсія в межах Темної тріади значною мірою зникає, коли враховується Чесність-Скромність з моделі HEXACO. У кожному випадку конструкт подавався як нова територія, а виявився перейменованою ділянкою наявної карти.

Дискримінантна валідність це також місце, де виявляються ефекти методу. Якщо кожен конструкт самозвіту в дослідженні корелює на рівні 0.4 з кожним іншим, спільним чинником, імовірно, є стиль відповідей респондента, а не будь-яка спільна психологія.

Тест, який це вирішує

Вирішальною процедурою є інкрементна валідність: спочатку введіть усталений показник у регресію, потім новий, і подивіться, чи пояснює новий додаткову дисперсію результату. Якщо ні, конструкт може й далі бути теоретично цікавим, але інструмент не вимірює нічого такого, чого в цій галузі ще не було.

Це вимогливий стандарт, і дуже багато опублікованих шкал ніколи йому не піддавалися. Коли їх йому піддають, результатом часто є наведене вище виявлення надмірності. Це не скандал, це нормальне наукове відсікання, але це означає, що популярність конструкту нічого не говорить про те, чи витримає він перевірку.

Що це змінює для читача

Коли тест повідомляє кілька балів, корисне запитання полягає в тому, чи ці бали справді відмінні. Чотири виміри, які корелюють на рівні 0.8 один з одним, це один вимір із чотирма назвами, а профіль, побудований на них, виглядатиме диференційованим, хоча нестиме майже незалежну інформацію.

Інструменти, які повідомляють свої міжшкальні кореляції, дозволяють вам перевірити це самостійно. Інструменти, які презентують тип із чотирьох квадрантів, але ніколи не показують, як квадранти пов'язані між собою, зробили таку перевірку неможливою, в чому зазвичай і полягає суть.

Перевірте себе

Читати про вимірювання одне. Побачити власний бал із зазначенням джерела, нормативної вибірки та обмежень зовсім інше. Безкоштовно, без реєстрації.

Читати далі