noesisnoesis
Як працює вимірювання

Що таке валідність конструкту?

Найскладніше запитання у вимірюванні: чи існує те, що ви вимірюєте, так, як ви це визначили, і чи ваш інструмент досягає саме його, а не чогось суміжного.

Конструктна валідність ставить питання, чи вимірює інструмент той теоретичний конструкт, на який він претендує, а не щось корельоване з ним, щось вужче за нього або взагалі нічого узгодженого. Це найглибша форма доказів валідності й та, для встановлення якої потрібні роки, а не одне дослідження.

Складність є структурною. Такий конструкт, як резильєнтність або емоційний інтелект, не є об'єктом; це передбачувана регулярність у поведінці. Щоб показати, що шкала його вимірює, потрібно одночасно обґрунтувати твердження, що конструкт існує саме в такому вигляді, і що ці конкретні пункти його охоплюють. Ці два твердження неможливо розділити, тому Кронбах і Міел, які запропонували цю ідею у 1955 році, описали її як перевірку цілої теоретичної мережі, а не одного інструмента.

Як будується обґрунтування

Прогнозовані патерни кореляцій. Теорія визначає, з чим має пов'язуватися конструкт і наскільки сильно. Самоспівчуття має позитивно корелювати із задоволеністю життям, негативно з депресією і лише помірно із самооцінкою: якби воно корелювало із самооцінкою на рівні 0.9, це не був би окремий конструкт. Кожне з цих передбачень є твердженням, яке можна перевірити, і його несправдження є інформативним.

Очікувані групові відмінності. Якщо теорія стверджує, що риса розвивається з віком або є підвищеною в клінічній популяції, інструмент має це показати. Відсутність відмінності, яку вимагає теорія, є доказом проти інструмента, проти теорії або проти обох.

Реакція на втручання. Якщо конструкт вважається таким, що піддається тренуванню, бали мають змінюватися після тренування і не змінюватися в контрольній групі. Конструкти, які ніколи ні на що не реагують, важко відрізнити від артефактів.

Внутрішня структура. Факторна структура має відповідати теоретично обґрунтованій структурі, і, що важливо, на новій вибірці. Експлораторний факторний аналіз на даних розробки знайде будь-яку структуру, яка була закладена; конфірматорний аналіз на нових даних є тим місцем, де твердження справді перевіряється.

Ідея мультириса, мультиметод

Внесок Кемпбелла і Фіске 1959 року полягав у наполяганні, що конструктна валідність вимагає одночасно двох речей: вимірювання однієї риси різними методами мають узгоджуватися, а вимірювання різних рис одним методом: ні.

Саме з другою половиною більшість інструментів мають труднощі. Якщо ваша емпатія за самозвітом корелює на рівні 0.7 з вашою доброзичливістю за самозвітом і на рівні 0.2 з емпатією за оцінкою спостерігача, то найсильніше, що вимірює ваш опитувальник, це не емпатія, а ваш загальний спосіб описувати себе в опитувальниках. Дисперсія методу є однією з найстійкіших проблем у дослідженнях самозвітів, і саме тому серйозна валідизаційна робота шукає критерій, відмінний від опитувальника, скрізь, де він існує.

Чому це важливо, коли ви читаєте свої результати

Конструктна валідність це те, що стоїть між балом та його інтерпретацією. Коли добре валідизований інструмент повідомляє, що ви маєте високий бал за рисою, ланцюг міркувань, що стоїть за цим твердженням, включає десятиліття опублікованих праць, які встановили, що риса поводиться як узгоджена величина, що ці пункти її відстежують і що бал означає щось подібне для різних людей, які його проходять.

Коли тест без конструктної валідизації повідомляє те саме, цей бал є числом, згенерованим алгоритмом, який ніхто не перевіряв. На екрані результатів обидва виглядають однаково. Різниця полягає виключно в документації, тому документацію варто шукати.

Перевірте себе

Читати про вимірювання одне. Побачити власний бал із зазначенням джерела, нормативної вибірки та обмежень зовсім інше. Безкоштовно, без реєстрації.

Читати далі