Ce este fidelitatea în testarea psihologică?
Fidelitatea este consecvența măsurării, nu corectitudinea ei. Un test poate avea o fidelitate ridicată și totuși să măsoare lucrul greșit, motiv pentru care este prima întrebare care se pune și niciodată ultima.
Fidelitatea reprezintă gradul în care o măsurătoare este repetabilă și nu simplu zgomot. Dacă te-ai cântări de trei ori într-un minut și ai obține 71, 78 și 66 de kilograme, cântarul ar fi nesigur, iar tu nu ai avea nicio modalitate de a-ți afla greutatea reală din el. Măsurarea psihologică se confruntă cu aceeași problemă, dar cu echipamente mult mai puțin precise.
Lucrul esențial de înțeles despre fidelitate este ce nu afirmă ea. Un cântar de baie care indică constant opt kilograme peste greutatea reală este perfect fidel și complet greșit. Fidelitatea se referă la consecvență; dacă numărul reprezintă lucrul corect este o întrebare separată, numită validitate. Fidelitatea este necesară pentru validitate, dar nu este nici pe departe suficientă pentru ea.
Formele pe care le poate lua
Consecvența internă verifică dacă itemii unei scale sunt de acord unii cu alții. Dacă zece întrebări au rolul de a măsura aceeași trăsătură subiacentă, persoanele care răspund cu un scor ridicat la una ar trebui să tindă să răspundă la fel și la celelalte. Aceasta este de obicei raportată ca alfa Cronbach sau, mai bine, omega McDonald.
Fidelitatea test-retest verifică dacă aceeași persoană obține scoruri similare în două momente diferite. Aceasta este forma care contează cel mai mult pentru trăsături, care prin definiție ar trebui să fie stabile. Este, de asemenea, forma care este cel mai frecvent neraportată, pentru că necesită regăsirea aceloraăși participanți la câteva săptămâni distanță.
Fidelitatea inter-evaluatori se aplică atunci când oamenii sunt cei care notează instrumentul, cum e cazul interviurilor clinice, tehnicilor proiective, observației comportamentale. Ea verifică dacă doi evaluatori instruiți, analizând același material, ajung la aceeași concluzie.
Fidelitatea formelor paralele verifică dacă două versiuni diferite ale aceluiași test, construite pentru a fi echivalente, produc aceleași scoruri. Este importantă oriunde un test este administrat de mai multe ori și expunerea la itemi constituie o problemă.
Cum se citesc cifrele
Coeficienții de fidelitate variază de la 0 la 1. Convențiile sunt aproximative și frecvent utilizate greșit, dar, în linii mari: peste 0,90 este necesar atunci când un scor afectează viața unei persoane, 0,80 până la 0,90 este solid pentru majoritatea utilizărilor aplicate, 0,70 până la 0,80 este acceptabil pentru cercetare și pentru comparații între grupuri, iar sub 0,70 înseamnă că scorul conține mai mult zgomot decât pot suporta majoritatea concluziilor.
Două avertismente privind aceste praguri. În primul rând, sunt convenții, nu legi; nivelul acceptabil depinde în întregime de scopul pentru care va fi folosit scorul. În al doilea rând, un alfa foarte ridicat pe o scală scurtă indică de obicei faptul că itemii sunt aproape reformulări unii ai altora, ceea ce cumpără consecvență cu prețul acoperirii construitului. O scală cu zece întrebări care toate întreabă "ești organizat?" cu cuvinte puțin diferite va avea o consecvență internă excelentă și o citire îngustă a conștiinciozității.
Ce înseamnă pentru scorul tău
Fidelitatea se traduce direct în cât de multă încredere merită un singur număr. Un test cu o fidelitate de 0,85 are o eroare de măsurare suficient de mare încât o diferență de câteva puncte între două persoane, sau între scorul tău de astăzi și cel de luna trecută, este foarte probabil să fie zgomot, nu semnal.
Aceasta este consecința practică: un instrument bun își raportează fidelitatea, astfel încât să știi cât de largă este incertitudinea din jurul scorului tău. Expresia tehnică a acestei incertitudini este eroarea standard de măsurare, care transformă un coeficient de fidelitate într-un interval de plus sau minus în jurul scorului.
Un instrument care nu raportează deloc o cifră de fidelitate nu este, prin urmare, mai precis. Pur și simplu a evitat să îți spună cât de imprecis este.
Testează-te
A citi despre măsurare este un lucru. A-ți vedea propriul scor raportat împreună cu sursa lui, eșantionul de normare și limitele sale este altceva. Gratuit, fără înregistrare.
Continuă lectura
- Ce este psihometria?Disciplina care stabilește dacă o măsurare psihologică este de valoare, și motivul pentru care două teste care pun întrebări similare pot diferi enorm în privința valorii rezultatelor lor.
- Ce este validitatea în testarea psihologică?Validitatea nu este o proprietate pe care o are un test. Este un argument privind dacă o anumită interpretare a unui anumit scor, pentru un anumit scop, este defendabilă, și trebuie reconstruită pentru fiecare utilizare nouă.
- Ce este validitatea de construct?Cea mai grea întrebare din măsurare: dacă lucrul pe care îl măsori există așa cum l-ai definit și dacă instrumentul tău îl atinge cu adevărat, și nu ceva adiacent.
- Validitate convergentă și discriminantăDouă cerințe în oglindă: o măsură trebuie să corespundă cu ceea ce ar trebui să corespundă și trebuie să rămână distinctă de ceea ce afirmă că nu este. Majoritatea instrumentelor slabe eșuează la a doua cerință.
- Ce este alfa Cronbach și ce nu esteCea mai raportată statistică în testarea psihologică, și cea mai greșit interpretată. Alpha nu îți spune că o scală este unidimensională, iar o valoare ridicată este adesea un simptom, nu o virtute.
- Eroarea standard de măsurare: cu cât poate varia scorul tăuFiecare scor are o marjă de eroare, iar pentru majoritatea testelor psihologice aceasta este mai largă decât își imaginează oamenii. Acesta este numărul care îți spune când o diferență este reală și când este doar zgomot.
- Norme și percentile: cu ce este comparat scorul tăuUn scor brut este neinterpretabil de la sine. Devine relevant doar în raport cu un grup de referință, și care grup a fost folosit este unul dintre cele mai importante și mai puțin cunoscute aspecte ale oricărui test.
- Cum este construit de fapt un test psihometricDe la definirea construct-ului până la normele publicate, procesul durează ani și elimină cea mai mare parte din ceea ce intră în el. Cunoașterea etapelor face evident care dintre ele au fost sărite de un chestionar online rapid.
- Ce înseamnă atunci când un test este numit validat?Cuvântul nu este reglementat și este folosit liber de produse care nu au făcut nimic din munca necesară. Iată ce înseamnă atunci când înseamnă ceva, și cele patru întrebări care separă cele două cazuri.
- De ce majoritatea testelor de personalitate de pe internet nu sunt fideleNu pentru că sunt necinstite, ci pentru că pașii care fac o măsurare demnă de încredere sunt invizibili, costisitori și ușor de omis, iar omiterea lor nu schimbă cu nimic modul în care apare rezultatul.
- Ce poate și ce nu poate să măsoare autoevaluareaChestionarele îți cer să fii propriul observator, ceea ce funcționează mai bine pentru unele lucruri decât pentru altele. Să știi unde metoda este puternică și unde eșuează schimbă modul în care citești orice rezultat.
- Ce înseamnă atunci când un test prezice cevaO corelație de 0,30 este o constatare solidă în cercetarea personalității și o bază șubredă pentru o decizie despre o singură persoană. Ambele afirmații sunt adevărate, iar diferența dintre ele cauzează cea mai mare parte a utilizării greșite a rezultatelor testelor.
- Screeningul nu este diagnosticUn chestionar de screening este construit să identifice cât mai multe cazuri posibile, acceptând o rată ridicată de fals-pozitive ca preț. Interpretarea unui scor de screening ca diagnostic răstoarnă exact scopul pentru care a fost conceput.