Что такое конструктная валидность?
Самый сложный вопрос в измерении: существует ли то, что вы измеряете, в том виде, в каком вы это определили, и достигает ли ваша методика именно этого, а не чего-то смежного.
Конструктная валидность отвечает на вопрос, измеряет ли инструмент тот теоретический конструкт, на который он претендует, а не что-то коррелирующее с ним, что-то более узкое или вообще ничего связного. Это самая глубокая форма доказательства валидности, для установления которой требуются годы, а не одно исследование.
Сложность здесь структурная. Такой конструкт, как жизнестойкость или эмоциональный интеллект, не является объектом; это предполагаемая закономерность в поведении. Чтобы показать, что шкала измеряет этот конструкт, нужно одновременно отстаивать утверждение, что конструкт существует в заявленном виде, и что именно эти пункты его улавливают. Два этих утверждения нельзя разделить, поэтому Кронбах и Мил, предложившие эту идею в 1955 году, описывали её как проверку целой теоретической сети, а не одного инструмента.
Как строится доказательство
Предсказанные паттерны корреляций. Теория указывает, с чем и насколько сильно должен быть связан конструкт. Самосострадание должно положительно коррелировать с удовлетворённостью жизнью, отрицательно с депрессией и лишь умеренно с самооценкой. Если бы корреляция с самооценкой составляла 0,9, это не был бы отдельный конструкт. Каждое из этих предсказаний представляет собой проверяемое утверждение, и неподтверждение любого из них информативно.
Ожидаемые различия между группами. Если теория утверждает, что черта развивается с возрастом или повышена в клинической популяции, инструмент должен это показывать. Отсутствие различия, которое требует теория, служит доказательством против инструмента, теории или обоих сразу.
Реакция на вмешательство. Если конструкт предположительно поддаётся тренировке, баллы должны меняться после тренировки и не меняться в контрольной группе. Конструкты, которые никогда ни на что не реагируют, сложно отличить от артефактов.
Внутренняя структура. Факторная структура должна соответствовать теоретически предполагаемой структуре, причём, что важно, на новой выборке. Разведочный факторный анализ на данных разработки найдёт ту структуру, которая была заложена изначально; настоящая проверка утверждения происходит при конфирматорном анализе на новых данных.
Идея мультичерта-мультиметод
Вклад Кэмпбелла и Фиске в 1959 году состоял в том, чтобы настоять: конструктная валидность требует одновременного выполнения двух условий: показатели одной и той же черты, полученные разными методами, должны согласовываться, а показатели разных черт, полученные одним и тем же методом, не должны.
Именно со второй частью у большинства инструментов возникают трудности. Если ваша самооценка эмпатии коррелирует на 0,7 с вашей самооценкой доброжелательности и лишь на 0,2 с оценкой эмпатии наблюдателем, то сильнее всего ваш опросник измеряет не эмпатию, а вашу общую манеру описывать себя в опросниках. Дисперсия метода, одна из самых устойчивых проблем в исследованиях самоотчёта, и именно поэтому серьёзная валидизационная работа стремится найти критерий, не основанный на опроснике, там, где он существует.
Почему это важно при чтении ваших результатов
Конструктная валидность стоит между баллом и его интерпретацией. Когда хорошо валидизированный инструмент сообщает, что у вас высокий балл по черте, цепочка рассуждений за этим утверждением включает десятилетия опубликованных работ, устанавливающих, что черта ведёт себя как согласованная величина, что эти пункты её отслеживают и что балл означает примерно одно и то же у разных людей, проходящих тест.
Когда тест без конструктной валидизации сообщает то же самое, балл представляет собой число, порождённое алгоритмом, который никто не проверял. На экране результатов оба выглядят одинаково. Различие целиком заключено в документации, поэтому её стоит искать.
Проверьте это на практике
Читать об измерении, это одно. Увидеть собственный балл с указанием источника, нормативной выборки и ограничений, это другое. Прохождение бесплатно, регистрация не требуется.
Продолжить чтение
- Что такое психометрика?Дисциплина, которая определяет, насколько хорошо психологическое измерение выполняет свою задачу, и причина того, что два теста, задающих похожие вопросы, могут сильно различаться по ценности своих результатов.
- Что такое надёжность в психологическом тестировании?Надёжность, это постоянство измерения, а не его правильность. Тест может быть высоко надёжным и при этом измерять не то, что нужно, поэтому это первый вопрос, который задают, и никогда не последний.
- Что такое валидность в психологическом тестировании?Валидность, это не свойство, которым обладает тест. Это аргументация о том, можно ли считать обоснованной конкретную интерпретацию конкретного балла для конкретной цели, и её нужно выстраивать заново для каждого нового применения.
- Конвергентная и дискриминантная валидностьДва взаимно противоположных требования: методика должна согласовываться с тем, с чем должна согласовываться, и оставаться отличимой от того, чем она заявляет, что не является. Большинство слабых методик не справляются со вторым.
- Что такое альфа Кронбаха и чем она не являетсяСамая часто упоминаемая статистика в психологическом тестировании и самая неправильно понимаемая. Альфа не говорит о том, что шкала одномерна, а высокое значение часто является симптомом, а не достоинством.
- Стандартная ошибка измерения: насколько ваш балл может отличаться от истинного значенияКаждый балл несёт погрешность измерения, и для большинства психологических тестов она шире, чем принято считать. Именно эта величина подсказывает, когда различие реально, а когда это просто шум.
- Нормы и процентили: с чем сравнивается ваш баллНеобработанный балл сам по себе неинтерпретируем. Он приобретает смысл только в сравнении с референтной группой, и то, какая группа использовалась, один из самых значимых и наименее освещаемых фактов о любом тесте.
- Как на самом деле создаётся психометрический тестОт определения конструкта до опубликованных норм этот путь занимает годы и отбрасывает большую часть того, что в него вложено. Знание этих этапов делает очевидным, какие из них были пропущены быстрым онлайн-квизом.
- Что значит, что тест является валидированным?Это слово никем не регулируется и свободно используется продуктами, которые не проделали никакой соответствующей работы. Вот что оно означает, когда действительно что-то значит, и четыре вопроса, которые отличают один случай от другого.
- Почему большинство интернет-тестов личности не являются надёжнымиНе потому, что они нечестны, а потому, что шаги, делающие измерение надёжным, невидимы, дороги и легко пропускаются, а их пропуск никак не меняет внешний вид результата.
- Что может и не может измерить самоотчётОпросники просят вас быть наблюдателем самого себя, а это работает лучше для одних вещей и хуже для других. Понимание того, где метод силён, а где даёт сбои, меняет то, как вы читаете любой результат.
- Что значит, когда тест что-то предсказываетКорреляция 0,30, это весомый результат в исследованиях личности и слабое основание для решения об одном конкретном человеке. Оба утверждения верны, и разрыв между ними является причиной большинства случаев неправильного использования результатов теста.
- Скрининг не является диагностикойСкрининговый опросник создан для того, чтобы выявить как можно больше возможных случаев, принимая высокую долю ложноположительных результатов как цену за это. Восприятие скринингового балла как диагноза искажает саму цель, ради которой он был создан.