Скрининг не является диагностикой
Скрининговый опросник создан для того, чтобы выявить как можно больше возможных случаев, принимая высокую долю ложноположительных результатов как цену за это. Восприятие скринингового балла как диагноза искажает саму цель, ради которой он был создан.
Опросник для скрининга депрессии, скрининг тревожности, скрининг употребления алкоголя, эти инструменты входят в число наиболее валидированных из существующих, и их регулярно неправильно интерпретируют. Балл выше порогового значения не означает, что у вас есть данное состояние. Он никогда не был предназначен для этого.
Компромисс в конструкции инструмента
Каждый скрининговый инструмент строится на компромиссе между двумя видами ошибок: пропуском людей, у которых состояние присутствует, и ложным выявлением у тех, у кого его нет. Скрининговые инструменты сознательно настроены в сторону второй ошибки. Пропустить случай депрессии в первичной медицинской помощи обходится дорого; ложноположительный результат стоит разговора с клиницистом.
Следствие вытекает арифметически. Скрининговый инструмент с чувствительностью 88 процентов и специфичностью 85 процентов звучит превосходно. Примените его в популяции, где данным состоянием реально страдают 5 процентов, и из каждых 100 человек с положительным результатом скрининга примерно 74 его не имеют. Инструмент работает именно так, как задумано. Большинство положительных результатов при этом остаются ложными.
Это арифметика базовой частоты, и именно поэтому универсальный скрининг в условиях низкой распространённости остаётся спорным даже для хорошо валидированных инструментов.
Что такое пороговое значение
Пороговое значение, это порог принятия решения, выбранный для конкретной цели в конкретной популяции, а не природная граница. Общепринятый порог PHQ-9, равный 10, был получен в популяциях с относительно высокой распространённостью; при применении в других условиях он ведёт себя иначе. Метаанализ на уровне отдельных участников показал, что опубликованные оценки точности для этого порога были систематически завышены из-за избирательной публикации оптимизированных пороговых значений.
Для некоторых инструментов универсального порогового значения намеренно не существует вовсе. SRQ-20 Всемирной организации здравоохранения используется в десятках стран, и его оптимальный порог настолько различается по странам, языку и полу, что публикация единого глобального значения принесла бы больше вреда, чем передача этого вопроса локальной валидации.
Диагностика, это другая процедура
Диагностика требует, чтобы клиницист установил наличие и продолжительность симптомов, их функциональное влияние и исключил альтернативные объяснения: медицинские состояния, вещества, другие расстройства со схожей картиной. Она учитывает анамнез и контекст. Опросник ничего этого не делает. Он подсчитывает частоту самоотчётных симптомов за определённый период.
Два человека могут получить одинаковые баллы при совершенно разной клинической картине, поскольку итоговый балл сжимает несколько разнородных симптомов в одно число. Балл, это сигнал для дальнейшего изучения; само изучение и есть диагностика.
Для чего балл действительно предназначен
Побуждение к действию. Высокий балл, это повод обратиться к специалисту. Это и есть предполагаемое использование, и оно по-настоящему ценно.
Отслеживание изменений. Это недооценённая функция. Повторное измерение в ходе лечения показывает, работает ли что-то, и это гораздо информативнее любого единичного балла. На этом строится оказание помощи, основанное на измерениях.
Описание популяции. В исследованиях и общественном здравоохранении эти инструменты оценивают выраженность симптомов в группах, и именно в этом они наиболее эффективны.
Как читать собственный результат
Если ваш балл превышает порог в скрининговом опроснике, правильная интерпретация такова: это повод для разговора с квалифицированным специалистом. Не: у меня есть это состояние.
Если ваш балл ниже порога, правильная интерпретация такова: этот конкретный скрининг не выявил ничего. Не: у меня всё в порядке. Скрининговые инструменты пропускают случаи, это другая сторона того же компромисса, и низкий балл у человека, который чувствует себя нездоровым, не является успокоительным подтверждением.
В тех случаях, когда NOESIS публикует скрининговые инструменты, в отчётах указываются опубликованные пороговые значения, называется источник, и прямо говорится, что результат не является диагнозом. Эта формулировка, не юридическая формальность; это то, что сами инструменты говорят о своём собственном применении.
Проверьте это на практике
Читать об измерении, это одно. Увидеть собственный балл с указанием источника, нормативной выборки и ограничений, это другое. Прохождение бесплатно, регистрация не требуется.
Продолжить чтение
- Что такое психометрика?Дисциплина, которая определяет, насколько хорошо психологическое измерение выполняет свою задачу, и причина того, что два теста, задающих похожие вопросы, могут сильно различаться по ценности своих результатов.
- Что такое надёжность в психологическом тестировании?Надёжность, это постоянство измерения, а не его правильность. Тест может быть высоко надёжным и при этом измерять не то, что нужно, поэтому это первый вопрос, который задают, и никогда не последний.
- Что такое валидность в психологическом тестировании?Валидность, это не свойство, которым обладает тест. Это аргументация о том, можно ли считать обоснованной конкретную интерпретацию конкретного балла для конкретной цели, и её нужно выстраивать заново для каждого нового применения.
- Что такое конструктная валидность?Самый сложный вопрос в измерении: существует ли то, что вы измеряете, в том виде, в каком вы это определили, и достигает ли ваша методика именно этого, а не чего-то смежного.
- Конвергентная и дискриминантная валидностьДва взаимно противоположных требования: методика должна согласовываться с тем, с чем должна согласовываться, и оставаться отличимой от того, чем она заявляет, что не является. Большинство слабых методик не справляются со вторым.
- Что такое альфа Кронбаха и чем она не являетсяСамая часто упоминаемая статистика в психологическом тестировании и самая неправильно понимаемая. Альфа не говорит о том, что шкала одномерна, а высокое значение часто является симптомом, а не достоинством.
- Стандартная ошибка измерения: насколько ваш балл может отличаться от истинного значенияКаждый балл несёт погрешность измерения, и для большинства психологических тестов она шире, чем принято считать. Именно эта величина подсказывает, когда различие реально, а когда это просто шум.
- Нормы и процентили: с чем сравнивается ваш баллНеобработанный балл сам по себе неинтерпретируем. Он приобретает смысл только в сравнении с референтной группой, и то, какая группа использовалась, один из самых значимых и наименее освещаемых фактов о любом тесте.
- Как на самом деле создаётся психометрический тестОт определения конструкта до опубликованных норм этот путь занимает годы и отбрасывает большую часть того, что в него вложено. Знание этих этапов делает очевидным, какие из них были пропущены быстрым онлайн-квизом.
- Что значит, что тест является валидированным?Это слово никем не регулируется и свободно используется продуктами, которые не проделали никакой соответствующей работы. Вот что оно означает, когда действительно что-то значит, и четыре вопроса, которые отличают один случай от другого.
- Почему большинство интернет-тестов личности не являются надёжнымиНе потому, что они нечестны, а потому, что шаги, делающие измерение надёжным, невидимы, дороги и легко пропускаются, а их пропуск никак не меняет внешний вид результата.
- Что может и не может измерить самоотчётОпросники просят вас быть наблюдателем самого себя, а это работает лучше для одних вещей и хуже для других. Понимание того, где метод силён, а где даёт сбои, меняет то, как вы читаете любой результат.
- Что значит, когда тест что-то предсказываетКорреляция 0,30, это весомый результат в исследованиях личности и слабое основание для решения об одном конкретном человеке. Оба утверждения верны, и разрыв между ними является причиной большинства случаев неправильного использования результатов теста.