Standard error of measurement: kung gaano kalaki ang posibleng paglihis ng iyong iskor
Bawat iskor ay may kaakibat na palugit ng pagkakamali, at sa karamihan ng mga sikolohikal na pagsusulit, mas malawak ito kaysa sa inaakala ng mga tao. Ito ang numerong nagsasabi sa iyo kung kailan totoo ang isang pagkakaiba at kung kailan ingay lamang ito.
Ginagawang konkreto ng standard error of measurement ang isang abstraktong koepisyent ng pagkamaaasahan: isang saklaw na plus-o-minus sa paligid ng isang iskor. Sinasagot nito ang tanong na hindi sinasagot ng karamihan sa mga screen ng resulta: gaano kalaki sana ang ipinagkaiba ng numerong ito kung sinagutan ko ang pagsusulit sa ibang hapon?
Simple ang pormula. I-multiply ang standard deviation ng sukatan sa square root ng isa bawas ang pagkamaaasahan nito. Para sa isang sukatan na may standard deviation na 10 at pagkamaaasahan na 0.85, ang standard error ay humigit-kumulang 3.9 na puntos.
Ano talaga ang sakop ng saklaw na iyon
Sa humigit-kumulang dalawang-katlo ng pagkakataon, ang tunay na katayuan ng isang tao ay nasa loob ng isang standard error mula sa naobserbahang iskor niya. Para maging humigit-kumulang 95 porsiyentong tiyak, kailangan mo ng mga dalawang standard error sa magkabilang panig.
Tingnan ang halimbawa sa itaas. May nakakuha ng iskor na 62. Ang 95 porsiyentong interval ay mula humigit-kumulang 54 hanggang 70. Iyan ay labing-anim na puntos na saklaw sa isang sukatan kung saan ang karaniwang agwat sa pagitan ng katamtaman at malinaw na higit sa katamtaman ay maaaring sampung puntos lamang.
Hindi ito depekto ng partikular na pagsusulit na iyon. Kagalang-galang ang pagkamaaasahan na 0.85. Ito ang normal na katumpakan ng sikolohikal na pagsukat, at ito ang dahilan kung bakit saklaw sa halip na iisang punto ang ipinapakita ng maingat na mga ulat.
Ang mga kahihinatnang hindi napapansin
Karaniwang walang kahulugan ang maliliit na pagkakaiba sa pagitan ng mga sukatan. Kung 58 ang iyong ekstrabersyon at 54 ang iyong pagkabukas, ang tapat na pagbasa ay hindi sila mapag-iiba. Ang mga interpretasyon ng profile na bumubuo ng salaysay mula sa apat na puntos na agwat ay nagbabasa ng ingay.
Karaniwang walang kahulugan din ang maliliit na pagbabago sa paglipas ng panahon. Ang muling pagsagot sa isang pagsusulit at paggalaw nang limang puntos ay nasa loob ng error para sa karamihan ng mga instrumento. Ang tunay na pagbabago ng katangian ay nangyayari sa loob ng mga taon at lumilitaw bilang paggalaw na malayo sa labas ng saklaw ng error, hindi bilang ilang puntos bawat buwan.
Pinalalala ng pagraranggo ang problema. Ang pagkakaiba ng ilang hilaw na puntos ay maaaring maglipat sa isang tao nang sampung puwesto ng percentile sa siksik na gitna ng distribusyon, dahil doon nakapuwesto ang karamihan ng tao. Mukhang tumpak ang mga ranggo ng percentile ngunit ito ang pinakahindi matatag na paraan ng pagpapahayag ng iskor.
Hindi pare-pareho ang katumpakan sa buong sukatan. Ipinapalagay ng classical test theory ang iisang halaga ng error para sa bawat iskor, na isang pagpapasimple. Hiwalay na minomodelo ng item response theory ang error sa bawat antas ng katangian, at halos palagi itong mas malaki sa mga dulo, mismong kung saan ginagawa ang mga interpretasyong may pinakamabigat na kahihinatnan. Ang napakataas o napakababang iskor ay karaniwang hindi gaanong tumpak kaysa sa iskor na nasa gitna, hindi mas tumpak.
Bakit hindi gaanong kahanga-hanga ang tapat na pag-uulat
Ang instrumentong nag-uulat ng mga confidence band ay mukhang mas malabo kaysa sa isang nag-uulat ng iisang numero hanggang isang decimal place. Ang mas malabo ang nagsasabi ng totoo. Ang mukhang tumpak ay may parehong nakapailalim na error at piniling huwag itong ipakita.
Mahalagang tandaan ito kapag inihahambing ang isang pagsusulit na may siyentipikong dokumentasyon sa isang komersyal na produkto na naglalagay sa iyo sa isang kategorya. Ang hangganan ng kategorya ay nasa isang tiyak na iskor, at ang taong isang puntos sa ibaba nito at ang taong isang puntos sa itaas ay, sa estadistika, iisang tao. Lubusang itinatago ito ng label ng uri; isa ito sa mas seryosong argumento laban sa mga instrumentong batay sa uri, at ang dahilan kung bakit ang tuloy-tuloy na mga iskor na may nakasaad na error ang pamantayan sa pananaliksik.
Subukan ito
Iba ang magbasa tungkol sa pagsukat. Iba rin ang makita ang sarili mong iskor na iniuulat kasama ang pinagmulan nito, ang sample ng pamantayang pangkat, at ang mga limitasyon nito. Libreng sagutan, hindi kailangang mag-sign up.
Magpatuloy sa pagbabasa
- Ano ang psychometrics?Ang disiplinang tumutukoy kung mahusay ba ang isang sikolohikal na pagsukat, at ang dahilan kung bakit ang dalawang pagsusulit na nagtatanong ng magkakahawig na tanong ay maaaring magkaiba nang malaki sa halaga ng kanilang mga resulta.
- Ano ang pagkamaaasahan sa sikolohikal na pagsusulit?Ang pagkamaaasahan ay ang pagkakapare-pareho ng pagsukat, hindi ang pagiging tama nito. Maaaring lubhang maaasahan ang isang pagsusulit ngunit mali pa rin ang sinusukat nito. Kaya ito ang unang tanong na itinatanong at hindi kailanman ang huli.
- Ano ang bisa sa sikolohikal na pagsusulit?Ang bisa ay hindi katangiang taglay ng isang pagsusulit. Ito ay isang argumento kung maipagtatanggol ba ang isang partikular na interpretasyon ng isang partikular na iskor, para sa isang partikular na layunin, at kailangan itong buuin muli sa bawat bagong paggamit.
- Ano ang bisa ng konstruk?Ang pinakamahirap na tanong sa pagsukat: kung umiiral ba ang iyong sinusukat ayon sa paraan ng pagkakalarawan mo rito, at kung naaabot ba ito ng iyong instrumento sa halip na ibang bagay na kalapit nito.
- Kumbergente at diskriminanteng bisaDalawang magkasalaming kahingian: ang isang sukatan ay dapat sumang-ayon sa dapat nitong sang-ayunan, at dapat manatiling hiwalay sa sinasabi nitong hindi siya. Karamihan sa mahihinang instrumento ay bumabagsak sa ikalawa.
- Ano ang Cronbach's alpha, at ano ang hindi nito kahuluganAng pinakamadalas iulat na estadistika sa sikolohikal na pagsusulit, at ang pinakamadalas mabigyan ng maling pagbasa. Hindi sinasabi ng alpha na iisa lamang ang dimensyon ng isang sukatan, at ang mataas na halaga nito ay kadalasang sintomas sa halip na kalakasan.
- Mga pamantayang pangkat at percentile: kung saan inihahambing ang iyong iskorAng hilaw na iskor ay hindi mabibigyang-kahulugan nang mag-isa. Nagkakaroon lamang ito ng kahulugan kapag inihambing sa isang pangkat ng sanggunian, at kung aling pangkat ang ginamit ay isa sa pinakamabibigat at pinakabihirang ipaalam na katotohanan tungkol sa anumang pagsusulit.
- Paano talaga binubuo ang isang sikometrikong pagsusulitMula sa pagbibigay-kahulugan sa konstruk hanggang sa paglalathala ng mga pamantayang pangkat, inaabot ng maraming taon ang prosesong ito at itinatapon nito ang karamihan sa mga ipinapasok dito. Kapag alam mo ang mga hakbang, nagiging malinaw kung alin ang nilaktawan ng isang mabilisang online na pagsusulit.
- Ano ang ibig sabihin kapag sinasabing may napatunayang bisa ang isang pagsusulit?Ang salitang ito ay walang regulasyon at malayang ginagamit ng mga produktong hindi gumawa ng anumang kinakailangang trabaho. Narito ang kahulugan nito kapag may tunay itong kahulugan, at ang apat na tanong na naghihiwalay sa dalawang kaso.
- Bakit hindi maaasahan ang karamihan sa mga pagsusulit ng personalidad sa internetHindi dahil hindi sila tapat, kundi dahil ang mga hakbang na nagpapaging mapagkakatiwalaan sa isang pagsukat ay hindi nakikita, magastos, at madaling laktawan; at ang paglaktaw sa mga ito ay walang binabago sa hitsura ng resulta.
- Ano ang kaya at hindi kayang sukatin ng sariling pag-uulatHinihiling ng mga palatanungan na ikaw mismo ang maging tagamasid ng iyong sarili, na mas mabisa para sa ilang bagay kaysa sa iba. Kapag alam mo kung saan malakas ang pamamaraang ito at kung saan ito nabibigo, nagbabago ang paraan ng pagbasa mo sa anumang resulta.
- Ano ang ibig sabihin kapag may hinuhulaan ang isang pagsusulitAng korelasyong 0.30 ay isang matibay na resulta sa pananaliksik sa personalidad ngunit mahinang batayan para sa isang desisyon tungkol sa iisang tao. Totoo ang dalawang pahayag na ito, at ang agwat sa pagitan nila ang sanhi ng karamihan sa maling paggamit ng mga resulta ng pagsusulit.
- Ang screening ay hindi diyagnosisAng isang palatanungan para sa screening ay binuo upang mahuli ang pinakamaraming posibleng kaso hangga't maaari, at tinatanggap ang mataas na antas ng maling positibo bilang kapalit nito. Ang pagbasa sa iskor ng screening bilang diyagnosis ay bumabaligtad sa layuning pinagdisenyuhan nito.