Норми та процентилі: з чим порівнюється ваш бал
Сирий бал сам по собі не піддається інтерпретації. Він набуває значення лише у порівнянні з референтною групою, і те, яка саме група була використана, є одним із найважливіших і найменш розголошуваних фактів про будь-який тест.
Ви набрали 34 бали за шкалою сумлінності. Це багато?
Це запитання не має відповіді без порівняння. 34 із якого максимуму, відносно кого, виміряні коли? Норми це довідкові дані, які перетворюють сирий бал на зрозумілу позицію, і їхній вибір є одним із найбільш відповідальних рішень під час створення тесту.
Як відбувається перетворення
Вибірка нормування це група людей, які пройшли інструмент у стандартних умовах і розподіл балів яких стає мірилом. Сирі бали потім виражаються як позиція в межах цього розподілу.
Процентильні ранги вказують частку вибірки нормування, яка набрала стільки ж балів, скільки ви, або менше. 70-й процентиль означає, що 70 відсотків цієї референтної групи набрали менше балів. Процентилі інтуїтивно зрозумілі та мають недооцінений недолік: вони розтягують відмінності в переповненій середині розподілу та стискають їх на краях. Кілька сирих балів навколо середнього значення можуть перемістити вас на багато процентильних місць; ті самі кілька балів біля верхівки майже не перемістять вас.
Стандартні бали, z-бали, T-бали, станайни, шкали типу IQ, виражають відстань від середнього значення в одиницях стандартного відхилення. Вони зберігають фактичні інтервали між балами, тому їм надають перевагу для будь-чого, що передбачає арифметичні дії з результатами.
Чому референтна група вирішує все
Той самий сирий бал може відповідати дуже різним процентилям залежно від вибірки нормування. Сумлінність, оцінена відносно загальної дорослої популяції та відносно вибірки практикуючих бухгалтерів, не дасть однакового процентилю, і жодне з цих чисел не є неправильним, вони відповідають на різні запитання.
Тому варто знати кілька властивостей вибірки нормування.
Хто до неї входив. Зручні вибірки зі студентів-психологів досі поширені та представляють вузький зріз людства: молоді, освічені люди, переважно із заможних західних країн. Норма, побудована на них, погано переноситься на інші групи.
Наскільки великою вона була. Стабільні оцінки процентилів на краях потребують великих вибірок. Кілька сотень людей дають ненадійне уявлення про те, як виглядає 95-й процентиль.
Коли її було зібрано. Норми дрейфують. Середні значення в популяції за низкою психологічних показників помітно змістилися за десятиліття, і вибірка нормування з 1995 року вже не описує популяцію, яка проходить тест у 2026 році.
Чи вона стратифікована. Багато рис систематично різняться за віком і статтю. Пошук гострих відчуттів різко знижується з віком; хронотип змінюється протягом життя. Порівняння 55-річної людини із загальновіковою нормою дає оманливу позицію в обох випадках.
На що звертати увагу і що означає її відсутність
У добре документованого інструменту зазначено розмір, склад, країну та рік вибірки нормування, а також сказано, чи стратифіковані норми. Серйозні посібники до тестів присвячують цьому розділи.
Більшість безкоштовних онлайн-тестів не повідомляють нічого з цього. Вони дають вам процентиль без зазначення того, якої популяції він стосується. Цей процентиль або отримано з неописаної зручної вибірки, або запозичено з опублікованої норми, зібраної на іншій популяції, або обчислено на основі людей, які раніше проходили тест на цьому сайті, самовибіркової групи, склад якої невідомий навіть оператору сайту.
Процентиль однаково з'являється на екрані та виглядає так само, як справжній. Їх розрізняє лише супровідна документація, і тільки вона.
Перевірте себе
Читати про вимірювання одне. Побачити власний бал із зазначенням джерела, нормативної вибірки та обмежень зовсім інше. Безкоштовно, без реєстрації.
Читати далі
- Що таке психометрика?Дисципліна, яка визначає, чи якісним є психологічне вимірювання, і причина, чому два тести зі схожими запитаннями можуть надзвичайно різнитися за цінністю своїх результатів.
- Що таке надійність у психологічному тестуванні?Надійність це узгодженість вимірювання, а не правильність. Тест може мати високу надійність і все одно вимірювати не те. Саме тому це перше запитання, яке ставлять, але ніколи не останнє.
- Що таке валідність у психологічному тестуванні?Валідність це не властивість, яку має тест. Це аргумент про те, чи є конкретна інтерпретація конкретного бала для конкретної мети обґрунтованою, і його потрібно заново вибудовувати для кожного нового застосування.
- Що таке валідність конструкту?Найскладніше запитання у вимірюванні: чи існує те, що ви вимірюєте, так, як ви це визначили, і чи ваш інструмент досягає саме його, а не чогось суміжного.
- Конвергентна та дискримінантна валідністьДві дзеркальні вимоги: вимір має узгоджуватися з тим, з чим має узгоджуватися, і має залишатися відмінним від того, чим він заявляє, що не є. Більшість слабких інструментів не виконують другу вимогу.
- Що таке альфа Кронбаха і чим вона не єНайчастіше повідомлювана статистика в психологічному тестуванні і та, яку найчастіше неправильно тлумачать. Альфа не говорить вам, що шкала є одновимірною, а високе значення часто є радше симптомом, ніж перевагою.
- Стандартна похибка вимірювання: наскільки ваш бал може відхилятисяКожен бал має похибку вимірювання, і для більшості психологічних тестів вона ширша, ніж ви припускаєте. Саме це число показує, коли різниця є реальною, а коли це шум.
- Як насправді створюється психометричний тестВід визначення конструкту до опублікованих норм послідовність триває роки і відсіює більшу частину того, з чого вона починалася. Знання цих етапів робить очевидним, які з них пропустив швидкий онлайн-тест.
- Що означає, коли тест називають валідизованим?Це слово не регулюється і вільно використовується продуктами, які не виконали жодної роботи. Ось що воно означає, коли воно щось означає, і чотири запитання, які розрізняють ці два випадки.
- Чому більшість особистісних тестів в інтернеті не є надійнимиНе тому, що вони нечесні, а тому, що кроки, які роблять вимірювання надійним, непомітні, дорогі, і їх легко пропустити. Їх пропуск жодним чином не змінює вигляд результату.
- Що самозвіт може і не може вимірюватиОпитувальники пропонують вам бути спостерігачем себе, що працює краще для одних речей, ніж для інших. Розуміння того, де метод сильний, а де він не спрацьовує, змінює те, як ви читаєте будь-який результат.
- Що означає, коли тест щось прогнозуєКореляція 0.30 є сильним результатом у дослідженнях особистості та слабкою підставою для рішення щодо однієї людини. Обидва твердження правдиві, і розрив між ними спричиняє більшість випадків неправильного використання результатів тестів.
- Скринінг не є діагнозомСкринінговий опитувальник створений для виявлення якомога більшої кількості можливих випадків, приймаючи високу частоту хибнопозитивних результатів як ціну. Тлумачення скринінгового бала як діагнозу спотворює те, для чого він був створений.