Скринингът не е диагноза
Скрининговият въпросник е създаден, за да улови възможно най-много потенциални случаи, приемайки висок процент на фалшиво положителни резултати като цена за това. Интерпретирането на скринингов резултат като диагноза противоречи на целта, за която е създаден.
Въпросник за скрининг на депресия, инструмент за скрининг на тревожност, инструмент за скрининг на употребата на алкохол: това са едни от най-добре валидираните съществуващи инструменти, които редовно се тълкуват погрешно. Резултат над граничната стойност не означава, че имаш съответното състояние. Той никога не е бил създаден с тази цел.
Компромисът в дизайна
Всеки скринингов инструмент се основава на компромис между две грешки: пропускане на хора, които имат състоянието, и маркиране на хора, които го нямат. Инструментите за скрининг са умишлено настроени към второто. Пропускането на случай на депресия в първичната медицинска помощ струва скъпо; фалшиво положителният резултат струва един разговор с клиницист.
Последствието следва аритметично. Скринингов инструмент с 88 процента чувствителност и 85 процента специфичност звучи отлично. Приложи го в популация, в която 5 процента действително имат състоянието, и от всеки 100 души, които дадат положителен резултат при скрининга, приблизително 74 няма да го имат. Инструментът работи точно според спецификациите си. Повечето положителни резултати все пак са фалшиви.
Това е аритметика на базовата честота и е причината универсалният скрининг в среди с ниско разпространение да се оспорва дори за добре валидирани инструменти.
Какво е гранична стойност
Граничната стойност е праг за вземане на решение, избран за определена цел в дадена популация, а не естествена граница. Конвенционалната гранична стойност на PHQ-9 от 10 е изведена в популации с относително високо разпространение; приложена другаде, тя се държи по различен начин. Мета-анализ на ниво отделен участник показва, че публикуваните оценки на точността за тази гранична стойност са системно завишавани чрез селективно докладване на оптимизирани прагове.
За някои инструменти умишлено изобщо няма универсална гранична стойност. SRQ-20 на Световната здравна организация се използва в десетки държави и неговият оптимален праг варира дотолкова според държавата, езика и пола, че публикуването на едно глобално число би нанесло повече вреда, отколкото оставянето му за локално валидиране.
Диагнозата е различна процедура
Диагнозата изисква клиницист да установи наличието и продължителността на симптомите, тяхното функционално въздействие и изключването на алтернативни обяснения: медицински състояния, вещества, други разстройства, които се проявяват по подобен начин. Тя взема предвид историята и контекста. Един въпросник не прави нищо от това. Той отчита честотата на симптомите чрез самооценка за определен период.
Двама души могат да получат идентични резултати от напълно различни клинични картини, тъй като общият брой компресира няколко разнородни симптома в едно число. Резултатът е сигнал да се търси по-задълбочено; това търсене е диагнозата.
За какво легитимно служи резултатът
Подтик. Високият резултат е причина да говориш с професионалист. Това е предназначението му и то е наистина ценно.
Проследяване на промяната. Това е недостатъчно използвана функция. Повторното измерване в хода на лечението показва дали нещо работи и е много по-информативно от всеки отделен резултат. Грижата, базирана на измервания, е изградена върху това.
Описание на популацията. В научните изследвания и общественото здравеопазване тези инструменти оценяват тежестта на симптомите в различните групи, в което те са най-добри.
Как да четеш собствения си резултат
Ако получиш резултат над прага на даден скрининг, правилната интерпретация е: това оправдава разговор с квалифицирано лице. А не: аз имам това състояние.
Ако получиш резултат под прага, правилната интерпретация е: този конкретен скрининг не е отчел нищо. А не: аз съм добре. Скрининговите инструменти пропускат случаи, което е другата половина от компромиса, и ниският резултат при човек, който не се чувства добре, не е успокоение.
Там, където NOESIS публикува инструменти за скрининг, отчетите посочват публикуваните прагове, назовават източника и ясно казват, че резултатът не е диагноза. Това формулиране не е правна формалност; това е, което самите инструменти казват за собствената си употреба.
Подложи го на тест
Четенето за измерванията е едно. Да видиш собствения си резултат с неговия източник, извадка за норма и ограничения е съвсем друго. Безплатен за попълване, не се изисква регистрация.
Продължи да четеш
- Какво е психометрия?Дисциплината, която установява дали дадено психологическо измерване е добро, и причината два теста, задаващи подобни въпроси, да се различават изключително много по стойността на своите резултати.
- Какво е надеждност в психологическото тестване?Надеждността е съгласуваност на измерването, а не точност. Един тест може да бъде много надежден и въпреки това да измерва грешното нещо, поради което това е първият зададен въпрос, но никога последният.
- Какво е валидност в психологическото тестване?Валидността не е свойство, което един тест притежава. Тя е аргумент за това дали определена интерпретация на даден резултат за определена цел е защитима и трябва да се изгражда наново за всяка нова употреба.
- Какво е конструктна валидност?Най-трудният въпрос при измерването: дали нещото, което измерваш, съществува така, както си го дефинирал, и дали твоят инструмент достига до него, а не до нещо сходно.
- Конвергентна и дискриминантна валидностДве огледални изисквания: един измерител трябва да съответства на това, на което трябва да съответства, и трябва да остане разграничим от това, което твърди, че не е. Повечето слаби инструменти се провалят на второто.
- Какво е алфа на Кронбах и какво не еНай-често отчитаната статистика в психологическото тестване и най-погрешно тълкуваната. Алфа не ти казва, че дадена скала е едноизмерна, а високата стойност често е по-скоро симптом, отколкото предимство.
- Стандартна грешка на измерването: с колко може да се отклонява твоят резултатВсеки резултат съдържа допустима грешка, а при повечето психологически тестове тя е по-голяма, отколкото хората предполагат. Това е числото, което ти показва кога една разлика е реална и кога е шум.
- Норми и перцентили: с какво се сравнява твоят резултатСуровият резултат не може да се интерпретира сам по себе си. Той придобива смисъл само спрямо референтна група, а коя група е използвана, е един от най-важните и най-слабо огласявани факти за всеки тест.
- Как всъщност се създава един психометричен тестОт дефинирането на конструкта до публикуваните норми, процесът отнема години и отхвърля по-голямата част от това, което е вложено в него. Ако познаваш стъпките, става очевидно кои от тях са пропуснати при един бърз онлайн тест.
- Какво означава, когато един тест се нарича валидиран?Думата е нерегулирана и се използва свободно от продукти, които не са положили нужните усилия. Ето какво означава тя, когато наистина има смисъл, и четирите въпроса, които разграничават двата случая.
- Защо повечето интернет тестове за личността не са надеждниНе защото са нечестни, а защото стъпките, които правят едно измерване надеждно, са невидими, скъпи и лесни за пропускане, а пропускането им не променя с нищо начина, по който изглежда резултатът.
- Какво може и какво не може да измери една самооценкаВъпросниците изискват от теб да бъдеш наблюдател на самия себе си, което работи по-добре за някои неща, отколкото за други. Да знаеш къде методът е силен и къде се проваля, променя начина, по който четеш всеки резултат.
- Какво означава, когато един тест предсказва нещоКорелация от 0,30 е силно откритие в изследванията на личността и слаба основа за решение за един човек. И двете твърдения са верни, а разминаването между тях причинява повечето злоупотреби с резултатите от тестовете.