Mitä reliabiliteetti on psykologisessa testauksessa?
Reliabiliteetti on mittauksen johdonmukaisuutta, ei oikeellisuutta. Testillä voi olla korkea reliabiliteetti, ja silti se voi mitata väärää asiaa. Siksi se on ensimmäinen kysymys, jonka esitämme, mutta ei koskaan viimeinen.
Reliabiliteetti kertoo, missä määrin mittaus on toistettavissa eikä pelkkää kohinaa. Jos punnitsisit itsesi kolme kertaa minuutin sisällä ja saisit tulokseksi 71, 78 ja 66 kilogrammaa, vaaka olisi epäluotettava, eikä sen avulla voisi mitenkään tietää todellista painoasi. Psykologinen mittaaminen kohtaa saman ongelman paljon epätarkemmilla välineillä.
Reliabiliteetissa on olennaista ymmärtää, mitä se ei väitä. Kylpyhuoneen vaaka, joka näyttää johdonmukaisesti kahdeksan kilogrammaa liikaa, on täysin reliaabeli ja täysin väärässä. Reliabiliteetti koskee johdonmukaisuutta; se, tarkoittaako luku oikeaa asiaa, on erillinen kysymys, jota kutsutaan validiteetiksi. Reliabiliteetti on validiteetin välttämätön ehto, mutta läheskään riittävä se ei ole.
Sen eri muodot
Sisäinen johdonmukaisuus kysyy, ovatko asteikon osiot keskenään yhtäpitäviä. Jos kymmenen kysymyksen on tarkoitus mitata samaa taustalla olevaa piirrettä, yhteen vastaavasti korkealla vastaavien pitäisi taipua vastaamaan korkealla myös muihin. Tämä raportoidaan yleensä Cronbachin alfana tai, mieluummin, McDonaldin omegana.
Test-retest-reliabiliteetti kysyy, saako sama henkilö samankaltaisen pistemäärän kahdella eri kerralla. Tämä muoto on tärkein piirteiden kannalta, sillä niiden on määritelmän mukaan tarkoitus olla pysyviä. Se on myös muoto, joka jätetään useimmiten raportoimatta, koska se edellyttää samojen osallistujien tavoittamista uudelleen viikkoja myöhemmin.
Arvioijien välinen reliabiliteetti tulee kyseeseen, kun mittarin pisteyttävät ihmiset: kliiniset haastattelut, projektiiviset menetelmät, käyttäytymisen havainnointi. Se kysyy, päätyvätkö kaksi koulutettua arvioijaa samaan johtopäätökseen tarkastellessaan samaa aineistoa.
Rinnakkaismuotojen reliabiliteetti kysyy, tuottavatko saman testin kaksi eri versiota, jotka on laadittu vastaamaan toisiaan, samat pistemäärät. Sillä on merkitystä aina, kun testi tehdään useammin kuin kerran ja osioiden tuttuus on huolenaihe.
Lukujen tulkinta
Reliabiliteettikertoimet vaihtelevat välillä 0-1. Käytännöt ovat karkeita ja niitä käytetään laajasti väärin, mutta suunnilleen: yli 0,90 vaaditaan, kun pistemäärä vaikuttaa yksilön elämään; 0,80-0,90 on vankka useimpaan soveltavaan käyttöön; 0,70-0,80 on hyväksyttävä tutkimuksessa ja ryhmävertailuissa; ja alle 0,70 tarkoittaa, että pistemäärässä on enemmän kohinaa kuin useimmat johtopäätökset kestävät.
Näihin raja-arvoihin liittyy kaksi varausta. Ensinnäkin ne ovat käytäntöjä eivätkä lakeja: hyväksyttävä taso riippuu täysin siitä, mihin pistemäärää käytetään. Toiseksi hyvin korkea alfa lyhyellä asteikolla viittaa yleensä siihen, että osiot ovat lähes toistensa uudelleenmuotoiluja, jolloin johdonmukaisuus saavutetaan konstruktin kattavuuden kustannuksella. Kymmenen kysymyksen asteikolla, jonka kaikki kysymykset kysyvät hieman eri sanoin "oletko järjestelmällinen?", on erinomainen sisäinen johdonmukaisuus ja kapea käsitys tunnollisuudesta.
Mitä se merkitsee omalle pistemäärällesi
Reliabiliteetti kertoo suoraan, kuinka paljon luottamusta yksittäinen luku ansaitsee. Testissä, jonka reliabiliteetti on 0,85, mittausvirhe on niin suuri, että muutaman pisteen ero kahden ihmisen välillä tai tämänpäiväisen ja viime kuun pistemääräsi välillä on hyvin todennäköisesti kohinaa eikä signaalia.
Tämä on käytännön seuraus: hyvä mittari raportoi reliabiliteettinsa, jotta tiedät, kuinka laaja epävarmuus pistemääräsi ympärillä on. Tämän epävarmuuden tekninen ilmaus on mittauksen keskivirhe, joka muuntaa reliabiliteettikertoimen pistemäärän ympärille plus-miinus-vaihteluväliksi.
Mittari, joka ei raportoi lainkaan reliabiliteettilukua, ei ole sen vuoksi tarkempi. Se on yksinkertaisesti jättänyt kertomatta, kuinka epätarkka se on.
Testaa itse
Mittaamisesta lukeminen on yksi asia. Oman pistemääräsi näkeminen lähteineen, normiotoksineen ja rajoituksineen on toinen. Maksuton, ei rekisteröitymistä.
Jatka lukemista
- Mitä on psykometriikka?Tieteenala, joka selvittää, onko psykologinen mittaus hyvä vai ei. Se myös selittää, miksi kahden samankaltaisia kysymyksiä esittävän testin tulosten arvo voi poiketa toisistaan valtavasti.
- Mitä validiteetti on psykologisessa testauksessa?Validiteetti ei ole testin ominaisuus. Se on perustelu sille, onko tietyn pistemäärän tietty tulkinta tiettyyn tarkoitukseen puolustettavissa, ja se on rakennettava uudelleen jokaista uutta käyttötarkoitusta varten.
- Mitä on konstruktivaliditeetti?Mittaamisen vaikein kysymys: onko mittaamasi asia olemassa sellaisena kuin olet sen määritellyt, ja tavoittaako mittarisi juuri sen eikä jotakin sen lähellä olevaa.
- Konvergentti ja diskriminantti validiteettiKaksi toistensa peilikuvana olevaa vaatimusta: mittarin on oltava yhtäpitävä sen kanssa, minkä kanssa sen pitääkin olla, ja sen on pysyttävä erillisenä siitä, mitä se väittää olevansa olematta. Useimmat heikot mittarit eivät täytä jälkimmäistä.
- Mitä Cronbachin alfa on ja mitä se ei olePsykologisen testauksen eniten raportoitu tunnusluku ja myös useimmin väärin tulkittu. Alfa ei kerro, että asteikko on yksiulotteinen, ja korkea arvo on usein pikemminkin oire kuin ansio.
- Mittauksen keskivirhe: kuinka paljon pistemääräsi voi poiketa todellisestaJokaiseen pistemäärään liittyy virhemarginaali, ja useimmissa psykologisissa testeissä se on suurempi kuin ihmiset olettavat. Tämä luku kertoo sinulle, milloin ero on todellinen ja milloin se on pelkkää kohinaa.
- Normit ja persentiilit: mihin pistemäärääsi verrataanRaakapistemäärä ei ole yksinään tulkittavissa. Se saa merkityksen vasta suhteessa viiteryhmään, ja se, mitä ryhmää käytettiin, on yksi minkä tahansa testin merkittävimmistä ja vähiten esille tuoduista seikoista.
- Miten psykometrinen testi oikeasti rakennetaanKonstruktin määrittelystä julkaistuihin normeihin prosessi kestää vuosia, ja suurin osa siihen syötetystä aineksesta karsitaan matkan varrella. Kun tunnet vaiheet, on helppo nähdä, mitkä niistä nopea verkkovisa jätti väliin.
- Mitä tarkoittaa, kun testiä kutsutaan validoiduksi?Sana on sääntelemätön, ja sitä käyttävät vapaasti tuotteet, jotka eivät ole tehneet mitään tarvittavasta työstä. Tässä on, mitä se tarkoittaa silloin, kun se tarkoittaa jotakin, ja neljä kysymystä, jotka erottavat nämä kaksi tapausta toisistaan.
- Miksi useimmat internetin persoonallisuustestit eivät ole reliaabeleitaEi siksi, että he olisivat epärehellisiä, vaan siksi, että ne vaiheet, jotka tekevät mittauksesta luotettavan, ovat näkymättömiä, kalliita ja helppoja ohittaa. Niiden ohittaminen ei muuta mitenkään sitä, miltä tulos näyttää.
- Mitä itsearvioinnilla voi mitata ja mitä eiKyselylomakkeet pyytävät sinua tarkkailemaan itseäsi, mikä toimii joissakin asioissa paremmin kuin toisissa. Kun tiedät, missä menetelmä on vahva ja missä se pettää, luet minkä tahansa tuloksen eri tavalla.
- Mitä tarkoittaa, kun testi ennustaa jotakinKorrelaatio 0,30 on persoonallisuustutkimuksessa vahva löydös mutta heikko peruste yhtä ihmistä koskevalle päätökselle. Kumpikin väite pitää paikkansa, ja niiden välinen ero aiheuttaa suurimman osan testitulosten väärinkäytöstä.
- Seulonta ei ole diagnoosiSeulontaan tarkoitettu kyselylomake on rakennettu tunnistamaan mahdollisimman monta mahdollista tapausta, ja korkea väärien positiivisten osuus hyväksytään sen hintana. Jos seulonnan pistemäärää luetaan diagnoosina, käännetään päinvastaiseksi se, mihin lomake on suunniteltu.