Normy i percentyle: z czym porównywany jest twój wynik
Wynik surowy jest niemożliwy do zinterpretowania sam w sobie. Nabiera znaczenia tylko w odniesieniu do grupy odniesienia, a to, która grupa została użyta, jest jednym z najbardziej istotnych i najmniej ujawnianych faktów o każdym teście.
Masz wynik 34 na skali sumienności. Czy to dużo?
To pytanie nie ma odpowiedzi bez punktu odniesienia. Trzydzieści cztery na ile maksymalnie, w porównaniu do kogo, mierzone kiedy? Normy to dane referencyjne, które zamieniają wynik surowy w interpretowalną pozycję, a ich dobór jest jedną z bardziej istotnych decyzji w konstruowaniu testu.
Jak działa przeliczanie
Próba normalizacyjna to grupa osób, które wypełniły narzędzie w standardowych warunkach, a rozkład ich wyników staje się miarą odniesienia. Wyniki surowe są następnie wyrażane jako pozycja w tym rozkładzie.
Rangi percentylowe określają, jaki odsetek próby normalizacyjnej uzyskał wynik taki sam jak twój lub niższy. 70. percentyl oznacza, że 70 procent tej grupy odniesienia uzyskało niższy wynik. Percentyle są intuicyjne i mają niedocenianą wadę: rozciągają różnice w gęsto obsadzonym środku rozkładu, a kompresują je na krańcach. Kilka punktów surowych wokół średniej może przesunąć cię o wiele miejsc percentylowych; te same kilka punktów blisko szczytu przesuwa cię niemal wcale.
Wyniki standardowe, takie jak wyniki z, wyniki T, staniny czy skale w stylu IQ, wyrażają odległość od średniej w jednostkach odchylenia standardowego. Zachowują rzeczywiste odstępy między wynikami, dlatego są preferowane wszędzie tam, gdzie na wynikach wykonuje się obliczenia.
Dlaczego grupa odniesienia jest kluczowa
Ten sam wynik surowy może odpowiadać bardzo różnym percentylom w zależności od próby normalizacyjnej. Sumienność oceniana względem ogólnej populacji dorosłych i względem próby praktykujących księgowych nie da tego samego percentyla, i żadna z tych liczb nie jest błędna: odpowiadają po prostu na różne pytania.
Dlatego warto znać kilka cech próby normalizacyjnej.
Kto się w niej znalazł. Próby dogodne złożone ze studentów psychologii są wciąż powszechne i reprezentują wąski wycinek ludzkości: młody, wykształcony i nieproporcjonalnie często pochodzący z zamożnych krajów zachodnich. Norma zbudowana na takiej próbie słabo się generalizuje.
Jak duża była. Stabilne oszacowania percentyli na krańcach rozkładu wymagają dużych prób. Kilkaset osób daje niewiarygodny obraz tego, jak wygląda 95. percentyl.
Kiedy została zebrana. Normy zmieniają się w czasie. Średnie populacyjne dla wielu miar psychologicznych przesunęły się w sposób mierzalny na przestrzeni dekad, a próba normalizacyjna z 1995 roku nie opisuje już populacji przystępującej do testu w 2026 roku.
Czy jest zestratyfikowana. Wiele cech różni się systematycznie w zależności od wieku i płci. Poszukiwanie doznań gwałtownie spada z wiekiem; chronotyp zmienia się w ciągu życia. Porównywanie 55-latka z normą obejmującą wszystkie grupy wiekowe daje mylącą pozycję w obu przypadkach.
Czego szukać i co oznacza brak tych informacji
Dobrze udokumentowane narzędzie podaje wielkość, skład, kraj i rok zebrania próby normalizacyjnej oraz informuje, czy normy są zestratyfikowane. Poważne podręczniki testowe poświęcają temu całe rozdziały.
Większość darmowych testów internetowych nie podaje niczego z tych informacji. Otrzymujesz percentyl bez żadnego stwierdzenia, jakiej populacji dotyczy. Taki percentyl pochodzi albo z niesprecyzowanej próby dogodnej, albo jest zapożyczony z opublikowanej normy zebranej na innej populacji, albo powstał na podstawie osób, które wcześniej wypełniły test na danej stronie, czyli grupy samoselekcjonującej się, której skład jest nieznany nawet operatorowi strony.
Percentyl i tak pojawia się na ekranie i wygląda tak samo jak prawdziwy. To właśnie towarzysząca mu dokumentacja, i tylko ona, odróżnia jedno od drugiego.
Wypróbuj to sam
Czytanie o pomiarze to jedno. Zobaczenie własnego wyniku wraz z jego źródłem, próbą normalizacyjną i ograniczeniami to drugie. Bezpłatny test, bez rejestracji.
Czytaj dalej
- Czym jest psychometria?Dyscyplina, która rozstrzyga, czy pomiar psychologiczny jest dobry, i powód, dla którego dwa testy zadające podobne pytania mogą się ogromnie różnić pod względem wartości swoich wyników.
- Czym jest rzetelność w testach psychologicznych?Rzetelność to spójność pomiaru, nie poprawność. Test może być bardzo rzetelny i wciąż mierzyć niewłaściwą rzecz, dlatego jest to pierwsze pytanie, które się zadaje, i nigdy ostatnie.
- Czym jest trafność w testach psychologicznych?Trafność nie jest właściwością, którą test posiada. Jest to argument dotyczący tego, czy konkretna interpretacja konkretnego wyniku, dla konkretnego celu, jest uzasadniona i musi być odbudowywana na nowo dla każdego nowego zastosowania.
- Czym jest trafność konstruktu?Najtrudniejsze pytanie w pomiarze: czy rzecz, którą mierzysz, istnieje tak, jak ją zdefiniowałeś, i czy twoje narzędzie dociera do niej, a nie do czegoś zbliżonego.
- Trafność zbieżna i różnicowaDwa wymagania będące odbiciem siebie nawzajem: miara musi zgadzać się z tym, z czym powinna się zgadzać, i musi pozostać odrębna od tego, czym twierdzi, że nie jest. Większość słabych narzędzi zawodzi w drugim z nich.
- Co to jest alfa Cronbacha i czym nie jestNajczęściej podawana statystyka w testowaniu psychologicznym i najczęściej błędnie odczytywana. Alfa nie mówi ci, że skala jest jednowymiarowa, a wysoka wartość jest często symptomem, a nie zaletą.
- Standardowy błąd pomiaru: o ile twój wynik może się różnić od rzeczywistegoKażdy wynik niesie ze sobą margines błędu, a w przypadku większości testów psychologicznych jest on szerszy, niż się zwykle przypuszcza. To liczba, która mówi ci, kiedy różnica jest rzeczywista, a kiedy jest szumem.
- Jak faktycznie powstaje test psychometrycznyOd definicji konstruktu do opublikowanych norm, ta sekwencja trwa latami i odrzuca większość tego, co do niej wchodzi. Znajomość tych kroków sprawia, że oczywiste staje się, które z nich zostały pominięte w szybkim quizie online.
- Co to znaczy, że test jest zwalidowany?To słowo jest nieregulowane i swobodnie używane przez produkty, które nie wykonały żadnej z potrzebnej pracy. Oto co znaczy, gdy naprawdę coś znaczy, oraz cztery pytania, które oddzielają jeden przypadek od drugiego.
- Dlaczego większość internetowych testów osobowości nie jest rzetelnaNie dlatego, że są nieuczciwe, ale dlatego, że kroki, które czynią pomiar wiarygodnym, są niewidoczne, kosztowne i łatwe do pominięcia, a ich pominięcie niczego nie zmienia w wyglądzie wyniku.
- Co samoopis może, a czego nie może zmierzyćKwestionariusze proszą cię o bycie obserwatorem samego siebie, co działa lepiej w przypadku niektórych rzeczy niż innych. Wiedza o tym, gdzie ta metoda jest silna a gdzie zawodzi, zmienia sposób, w jaki odczytujesz jakikolwiek wynik.
- Co to znaczy, że test coś przewidujeKorelacja na poziomie 0,30 to silny wynik w badaniach osobowości i słaba podstawa do decyzji dotyczącej jednej osoby. Obie stwierdzenia są prawdziwe, a rozbieżność między nimi powoduje większość niewłaściwych zastosowań wyników testów.
- Badanie przesiewowe to nie diagnozaKwestionariusz przesiewowy jest skonstruowany tak, aby wychwycić jak najwięcej możliwych przypadków, przyjmując wysoki wskaźnik wyników fałszywie pozytywnych jako cenę. Odczytywanie wyniku przesiewowego jako diagnozy odwraca to, do czego został on stworzony.