Co to jest alfa Cronbacha i czym nie jest
Najczęściej podawana statystyka w testowaniu psychologicznym i najczęściej błędnie odczytywana. Alfa nie mówi ci, że skala jest jednowymiarowa, a wysoka wartość jest często symptomem, a nie zaletą.
Alfa Cronbacha to współczynnik spójności wewnętrznej: stopień, w jakim pozycje danej skali korelują ze sobą. Opublikowana w 1951 roku, jest najczęściej raportowaną statystyką psychometryczną, a jej wszechobecność przerosła jej użyteczność.
Alfa przyjmuje wartości od 0 do 1 i zależy od dwóch czynników: średniej korelacji między pozycjami oraz liczby pozycji. Ta druga zależność jest źródłem większości nieporozumień.
Czego nie oznacza wysoka alfa
Nie oznacza, że skala mierzy jedną rzecz. To najczęstszy błąd. Alfa może być wysoka dla skali z dwoma lub trzema odrębnymi czynnikami, jeśli tylko pozycje ogólnie wystarczająco ze sobą korelują. Jednowymiarowość musi zostać ustalona za pomocą analizy czynnikowej; alfa nie może tego ustalić i nigdy nie była do tego przeznaczona.
Nie oznacza, że skala jest trafna. Alfa nic nie mówi o tym, co mierzą pozycje. Dwadzieścia pytań o rozmiar buta miałoby doskonałą spójność wewnętrzną i zerową trafność jako miara czegokolwiek psychologicznego.
Nie oznacza, że skala jest dobra. Ponieważ alfa rośnie wraz z liczbą pozycji, długa skala złożona z przeciętnych pozycji uzyska wyższy wynik niż krótka skala złożona z doskonałych pozycji. Skala z czterdziestoma pozycjami przy średniej korelacji międzypozycyjnej 0,2 osiąga wartość powyżej 0,90.
Bardzo wysoka alfa jest często ostrzeżeniem. Powyżej mniej więcej 0,95 pozycje są zazwyczaj niemal parafrazami siebie nawzajem. Kupuje się w ten sposób spójność kosztem pokrycia konstruktu: skala bardzo precyzyjnie mierzy jeden wąski aspekt, a pomija resztę konstruktu. Nazywa się to paradoksem osłabienia i dlatego większa spójność nie zawsze jest lepsza.
Co zakłada
Alfa stanowi dolną granicę rzetelności przy określonym założeniu, tau-ekwiwalencji, czyli że każda pozycja wnosi taki sam wkład w mierzoną cechę leżącą u podstaw skali. Rzeczywiste skale niemal nigdy tego nie spełniają. Pozycje różnią się siłą ładunku czynnikowego, a gdy tak się dzieje, alfa zaniża oszacowanie rzetelności.
Omega McDonalda rezygnuje z założenia równego wkładu i szacuje rzetelność na podstawie rzeczywistych ładunków czynnikowych. Metodolodzy zalecają jej stosowanie zamiast alfy od dwóch dekad. Praktyka raportowania podąża za tym powoli, głównie dlatego, że alfa to pojedyncza linijka w każdym pakiecie statystycznym, a omega nie.
Jak to czytać w praktyce
Orientacyjne konwencje: 0,70 i powyżej jest akceptowalne w badaniach porównujących grupy, 0,80 i powyżej w zastosowaniach praktycznych, 0,90 i powyżej tam, gdzie wynik wpływa na decyzję dotyczącą pojedynczej osoby. Traktuj to jako orientację, nie sztywne progi; wymagany poziom zależy od tego, jak wysoka jest stawka decyzji, którą wynik ma wspierać.
Bardziej informacyjne dane zwykle znajdują się gdzie indziej w tej samej publikacji. Średnia korelacja międzypozycyjna (zdrowy zakres to 0,15 do 0,50) mówi ci, czy wysoka alfa wynika z jakości pozycji, czy z ich liczby. Liczba pozycji mówi to samo z drugiej strony. Rzetelność test-retest mówi ci coś, czego alfa strukturalnie nie jest w stanie ujawnić: czy wynik jest stabilny u tej samej osoby w czasie.
Skala raportująca samą alfę podała najłatwiejszy do uzyskania wskaźnik rzetelności i ten, który najłatwiej jest spełnić.
Wypróbuj to sam
Czytanie o pomiarze to jedno. Zobaczenie własnego wyniku wraz z jego źródłem, próbą normalizacyjną i ograniczeniami to drugie. Bezpłatny test, bez rejestracji.
Czytaj dalej
- Czym jest psychometria?Dyscyplina, która rozstrzyga, czy pomiar psychologiczny jest dobry, i powód, dla którego dwa testy zadające podobne pytania mogą się ogromnie różnić pod względem wartości swoich wyników.
- Czym jest rzetelność w testach psychologicznych?Rzetelność to spójność pomiaru, nie poprawność. Test może być bardzo rzetelny i wciąż mierzyć niewłaściwą rzecz, dlatego jest to pierwsze pytanie, które się zadaje, i nigdy ostatnie.
- Czym jest trafność w testach psychologicznych?Trafność nie jest właściwością, którą test posiada. Jest to argument dotyczący tego, czy konkretna interpretacja konkretnego wyniku, dla konkretnego celu, jest uzasadniona i musi być odbudowywana na nowo dla każdego nowego zastosowania.
- Czym jest trafność konstruktu?Najtrudniejsze pytanie w pomiarze: czy rzecz, którą mierzysz, istnieje tak, jak ją zdefiniowałeś, i czy twoje narzędzie dociera do niej, a nie do czegoś zbliżonego.
- Trafność zbieżna i różnicowaDwa wymagania będące odbiciem siebie nawzajem: miara musi zgadzać się z tym, z czym powinna się zgadzać, i musi pozostać odrębna od tego, czym twierdzi, że nie jest. Większość słabych narzędzi zawodzi w drugim z nich.
- Standardowy błąd pomiaru: o ile twój wynik może się różnić od rzeczywistegoKażdy wynik niesie ze sobą margines błędu, a w przypadku większości testów psychologicznych jest on szerszy, niż się zwykle przypuszcza. To liczba, która mówi ci, kiedy różnica jest rzeczywista, a kiedy jest szumem.
- Normy i percentyle: z czym porównywany jest twój wynikWynik surowy jest niemożliwy do zinterpretowania sam w sobie. Nabiera znaczenia tylko w odniesieniu do grupy odniesienia, a to, która grupa została użyta, jest jednym z najbardziej istotnych i najmniej ujawnianych faktów o każdym teście.
- Jak faktycznie powstaje test psychometrycznyOd definicji konstruktu do opublikowanych norm, ta sekwencja trwa latami i odrzuca większość tego, co do niej wchodzi. Znajomość tych kroków sprawia, że oczywiste staje się, które z nich zostały pominięte w szybkim quizie online.
- Co to znaczy, że test jest zwalidowany?To słowo jest nieregulowane i swobodnie używane przez produkty, które nie wykonały żadnej z potrzebnej pracy. Oto co znaczy, gdy naprawdę coś znaczy, oraz cztery pytania, które oddzielają jeden przypadek od drugiego.
- Dlaczego większość internetowych testów osobowości nie jest rzetelnaNie dlatego, że są nieuczciwe, ale dlatego, że kroki, które czynią pomiar wiarygodnym, są niewidoczne, kosztowne i łatwe do pominięcia, a ich pominięcie niczego nie zmienia w wyglądzie wyniku.
- Co samoopis może, a czego nie może zmierzyćKwestionariusze proszą cię o bycie obserwatorem samego siebie, co działa lepiej w przypadku niektórych rzeczy niż innych. Wiedza o tym, gdzie ta metoda jest silna a gdzie zawodzi, zmienia sposób, w jaki odczytujesz jakikolwiek wynik.
- Co to znaczy, że test coś przewidujeKorelacja na poziomie 0,30 to silny wynik w badaniach osobowości i słaba podstawa do decyzji dotyczącej jednej osoby. Obie stwierdzenia są prawdziwe, a rozbieżność między nimi powoduje większość niewłaściwych zastosowań wyników testów.
- Badanie przesiewowe to nie diagnozaKwestionariusz przesiewowy jest skonstruowany tak, aby wychwycić jak najwięcej możliwych przypadków, przyjmując wysoki wskaźnik wyników fałszywie pozytywnych jako cenę. Odczytywanie wyniku przesiewowego jako diagnozy odwraca to, do czego został on stworzony.