Ce este validitatea de construct?
Cea mai grea întrebare din măsurare: dacă lucrul pe care îl măsori există așa cum l-ai definit și dacă instrumentul tău îl atinge cu adevărat, și nu ceva adiacent.
Validitatea de construct pune întrebarea dacă un instrument măsoară constructul teoretic pe care pretinde că îl măsoară, mai degrabă decât ceva corelat cu acesta, ceva mai restrâns decât el sau nimic coerent. Este cea mai profundă formă de dovadă de validitate și cea care necesită ani, nu doar un studiu, pentru a fi stabilită.
Dificultatea este de natură structurală. Un construct precum reziliența sau inteligența emoțională nu este un obiect; este o regularitate propusă în comportament. Pentru a arăta că o scală îl măsoară, trebuie să susții simultan afirmația că constructul există așa cum este descris și că anume acești itemi ajung la el. Cele două afirmații nu pot fi separate, motiv pentru care Cronbach și Meehl, care au introdus ideea în 1955, au conceput-o ca testare a întregii rețele teoretice, nu doar a unui instrument.
Cum se construiește argumentul
Modele prezise de corelație. Teoria indică cu ce anume ar trebui să se coreleze constructul și cât de puternic. Autocompasiunea ar trebui să se coreleze pozitiv cu satisfacția față de viață, negativ cu depresia și doar moderat cu stima de sine, dacă s-ar corela cu 0.9 cu stima de sine, nu ar fi un construct distinct. Fiecare dintre aceste predicții este o afirmație testabilă, iar eșecul uneia dintre ele este informativ.
Diferențe de grup așteptate. Dacă teoria afirmă că o trăsătură se dezvoltă odată cu vârsta sau este mai ridicată într-o populație clinică, instrumentul ar trebui să arate acest lucru. Eșecul de a găsi o diferență pe care teoria o impune este o dovadă împotriva instrumentului, a teoriei sau a ambelor.
Răspunsul la intervenție. Dacă se presupune că un construct poate fi antrenat, scorurile ar trebui să se modifice după antrenament și să nu se modifice într-un grup de control. Constructele care nu răspund niciodată la nimic sunt greu de distins de artefacte.
Structura internă. Structura factorială ar trebui să corespundă structurii teoretizate, și, mai important, pe un eșantion nou. Analiza factorială exploratorie pe datele de dezvoltare va găsi orice structură a fost inclusă prin proiectare; analiza confirmatorie pe date noi este locul unde afirmația este de fapt testată.
Ideea multitrăsătură-multimetodă
Contribuția lui Campbell și Fiske din 1959 a fost aceea de a insista că validitatea de construct necesită două lucruri simultan: măsurătorile aceleiași trăsături prin metode diferite ar trebui să fie concordante, iar măsurătorile unor trăsături diferite prin aceeași metodă nu ar trebui să fie.
A doua jumătate este cea la care majoritatea instrumentelor întâmpină dificultăți. Dacă empatia ta autoevaluată se corelează cu 0.7 cu amabilitatea ta autoevaluată și cu 0.2 cu empatia evaluată de observatori, cel mai puternic lucru pe care îl măsoară chestionarul tău nu este empatia, ci modul tău general de a te descrie în chestionare. Varianța de metodă este una dintre cele mai persistente probleme din cercetarea bazată pe autoevaluare, și acesta este motivul pentru care lucrările serioase de validare caută, ori de câte ori există, un criteriu care nu este un chestionar.
De ce contează acest lucru când îți citești rezultatele
Validitatea de construct este ceea ce se interpune între un scor și interpretarea lui. Când un instrument bine validat raportează că obții un scor ridicat la o trăsătură, lanțul de raționament din spatele acestei afirmații include decenii de lucrări publicate care stabilesc că trăsătura se comportă ca o cantitate coerentă, că acești itemi o urmăresc și că scorul înseamnă ceva asemănător pentru toate persoanele care susțin testul.
Când un test fără validare de construct raportează același lucru, scorul este un număr generat de un algoritm pe care nimeni nu l-a verificat. Cele două arată identic pe ecranul de rezultate. Diferența constă în întregime în documentație, motiv pentru care merită să cauți documentația.
Testează-te
A citi despre măsurare este un lucru. A-ți vedea propriul scor raportat împreună cu sursa lui, eșantionul de normare și limitele sale este altceva. Gratuit, fără înregistrare.
Continuă lectura
- Ce este psihometria?Disciplina care stabilește dacă o măsurare psihologică este de valoare, și motivul pentru care două teste care pun întrebări similare pot diferi enorm în privința valorii rezultatelor lor.
- Ce este fidelitatea în testarea psihologică?Fidelitatea este consecvența măsurării, nu corectitudinea ei. Un test poate avea o fidelitate ridicată și totuși să măsoare lucrul greșit, motiv pentru care este prima întrebare care se pune și niciodată ultima.
- Ce este validitatea în testarea psihologică?Validitatea nu este o proprietate pe care o are un test. Este un argument privind dacă o anumită interpretare a unui anumit scor, pentru un anumit scop, este defendabilă, și trebuie reconstruită pentru fiecare utilizare nouă.
- Validitate convergentă și discriminantăDouă cerințe în oglindă: o măsură trebuie să corespundă cu ceea ce ar trebui să corespundă și trebuie să rămână distinctă de ceea ce afirmă că nu este. Majoritatea instrumentelor slabe eșuează la a doua cerință.
- Ce este alfa Cronbach și ce nu esteCea mai raportată statistică în testarea psihologică, și cea mai greșit interpretată. Alpha nu îți spune că o scală este unidimensională, iar o valoare ridicată este adesea un simptom, nu o virtute.
- Eroarea standard de măsurare: cu cât poate varia scorul tăuFiecare scor are o marjă de eroare, iar pentru majoritatea testelor psihologice aceasta este mai largă decât își imaginează oamenii. Acesta este numărul care îți spune când o diferență este reală și când este doar zgomot.
- Norme și percentile: cu ce este comparat scorul tăuUn scor brut este neinterpretabil de la sine. Devine relevant doar în raport cu un grup de referință, și care grup a fost folosit este unul dintre cele mai importante și mai puțin cunoscute aspecte ale oricărui test.
- Cum este construit de fapt un test psihometricDe la definirea construct-ului până la normele publicate, procesul durează ani și elimină cea mai mare parte din ceea ce intră în el. Cunoașterea etapelor face evident care dintre ele au fost sărite de un chestionar online rapid.
- Ce înseamnă atunci când un test este numit validat?Cuvântul nu este reglementat și este folosit liber de produse care nu au făcut nimic din munca necesară. Iată ce înseamnă atunci când înseamnă ceva, și cele patru întrebări care separă cele două cazuri.
- De ce majoritatea testelor de personalitate de pe internet nu sunt fideleNu pentru că sunt necinstite, ci pentru că pașii care fac o măsurare demnă de încredere sunt invizibili, costisitori și ușor de omis, iar omiterea lor nu schimbă cu nimic modul în care apare rezultatul.
- Ce poate și ce nu poate să măsoare autoevaluareaChestionarele îți cer să fii propriul observator, ceea ce funcționează mai bine pentru unele lucruri decât pentru altele. Să știi unde metoda este puternică și unde eșuează schimbă modul în care citești orice rezultat.
- Ce înseamnă atunci când un test prezice cevaO corelație de 0,30 este o constatare solidă în cercetarea personalității și o bază șubredă pentru o decizie despre o singură persoană. Ambele afirmații sunt adevărate, iar diferența dintre ele cauzează cea mai mare parte a utilizării greșite a rezultatelor testelor.
- Screeningul nu este diagnosticUn chestionar de screening este construit să identifice cât mai multe cazuri posibile, acceptând o rată ridicată de fals-pozitive ca preț. Interpretarea unui scor de screening ca diagnostic răstoarnă exact scopul pentru care a fost conceput.