Ölçüm standart hatası: puanının ne kadar sapmış olabileceği
Her puan bir hata payı taşır, ve çoğu psikolojik test için bu, insanların varsaydığından daha geniştir. Bu, bir farkın ne zaman gerçek, ne zaman gürültü olduğunu söyleyen sayıdır.
Ölçüm standart hatası, soyut bir güvenirlik katsayısını somut bir şeye dönüştürür: bir puanın etrafındaki artı eksi bir bant. Çoğu sonuç ekranının cevapsız bıraktığı soruyu yanıtlar: testi başka bir öğleden sonra almış olsaydım bu sayı ne kadar farklı olabilirdi?
Formül basittir. Ölçeğin standart sapmasını, birden güvenirliğin çıkarılmasıyla elde edilen değerin kareköküyle çarparsın. Standart sapması 10 ve güvenirliği 0,85 olan bir ölçek için standart hata yaklaşık 3,9 puandır.
Bu bant gerçekte neyi kapsar
Zamanın kabaca üçte ikisinde, bir kişinin gerçek konumu, gözlenen puanının bir standart hata aralığı içinde kalır. Yaklaşık yüzde 95 güvenilir olmak için her iki yönde kabaca iki standart hataya ihtiyacın vardır.
Yukarıdaki örneği ele alalım. Biri 62 puan alıyor. Yüzde 95'lik aralık kabaca 54'ten 70'e kadar uzanır. Bu, ortalama ile belirgin şekilde ortalamanın üstü arasındaki tipik farkın on puan olabileceği bir ölçekte on altı puanlık bir penceredir.
Bu, o belirli testin bir kusuru değildir. 0,85 güvenirlik saygın bir değerdir. Bu, psikolojik ölçümün olağan hassasiyetidir ve dikkatli hazırlanmış raporların tek bir nokta yerine bant sunmasının nedeni budur.
İnsanların gözden kaçırdığı sonuçlar
Ölçekler arasındaki küçük farklar genellikle anlamsızdır. Dışadönüklüğün 58, açıklığın 54 ise, dürüst okuma bunların birbirinden ayırt edilemez olduğudur. Dört puanlık farklardan bir anlatı kuran profil yorumları, gürültüyü okumaktadır.
Zaman içindeki küçük değişimler de genellikle anlamsızdır. Bir testi yeniden alıp beş puan değişmek, çoğu ölçüm aracı için hata sınırları içindedir. Gerçek özellik değişimi yıllar içinde gerçekleşir ve ay be ay birkaç puanlık hareket olarak değil, hata bandının çok dışında bir hareket olarak ortaya çıkar.
Sıralama düzenleri sorunu büyütür. Birkaç ham puanlık bir fark, dağılımın yoğun ortasında birini on yüzdelik dilim kaydırabilir, çünkü çoğu insan orada bulunur. Yüzdelik dilim sıralamaları kesin görünür ama bir puanı ifade etmenin en kararsız yoludur.
Hassasiyet ölçek boyunca eşit değildir. Klasik test kuramı, her puan için tek bir hata değeri olduğunu varsayar; bu bir basitleştirmedir. Madde tepki kuramı, hatayı özelliğin her seviyesinde ayrı ayrı modeller ve bu hata neredeyse her zaman uç noktalarda daha büyüktür; tam da en sonuçları ağır yorumların yapıldığı yerlerde. Çok yüksek veya çok düşük bir puan, genellikle ortalama bir puandan daha az değil, daha çok belirsizdir.
Dürüst raporlamanın neden daha az etkileyici görünür
Güven bantları bildiren bir ölçüm aracı, tek bir sayıyı bir ondalık basamağa kadar bildiren bir araçtan daha belirsiz görünür. Belirsiz görünen doğruyu söylemektedir. Kesin görünen ise aynı temel hataya sahiptir ama bunu göstermemeyi seçmiştir.
Bilimsel olarak belgelenmiş bir testi, seni bir kategoriye atayan ticari bir ürünle karşılaştırırken bunu akılda tutmakta fayda var. Kategori sınırı belirli bir puanda yer alır ve bu sınırın bir puan altında olan biri ile bir puan üstünde olan biri istatistiksel olarak aynı kişidir. Tip etiketi bunu tamamen gizler; bu, tip temelli araçlara karşı öne sürülen daha ciddi argümanlardan biridir ve belirtilen hatasıyla birlikte sunulan sürekli puanların araştırmalarda standart olmasının nedenidir.
Sen de dene
Ölçüm hakkında okumak bir şey, kendi puanının kaynağıyla, norm örneklemiyle ve sınırlarıyla birlikte raporlandığını görmek başka bir şeydir. Katılmak ücretsiz, kayıt gerekmez.
Okumaya devam et
- Psikometri nedir?Bir psikolojik ölçümün iyi olup olmadığını belirleyen disiplin, ve benzer sorular soran iki testin sonuçlarının değeri açısından muazzam farklılık gösterebilmesinin nedeni.
- Psikolojik testte güvenirlik nedir?Güvenirlik, ölçümün tutarlılığıdır, doğruluğu değil. Bir test yüksek derecede güvenilir olabilir ve yine de yanlış şeyi ölçebilir, bu yüzden sorulan ilk soru budur ve asla son soru değildir.
- Psikolojik testte geçerlik nedir?Geçerlik, bir testin sahip olduğu bir özellik değildir. Belirli bir amaç için, belirli bir puanın belirli bir yorumunun savunulabilir olup olmadığına dair bir tartışmadır ve her yeni kullanım için yeniden inşa edilmesi gerekir.
- Yapı geçerliği nedir?Ölçümdeki en zor soru: tanımladığın şeyin var olup olmadığı, ve aracının ona mı yoksa yakın bir başka şeye mi ulaştığı.
- Yakınsak ve ayırt edici geçerlikBirbirinin aynası olan iki gereklilik: bir ölçüm, aynı fikirde olması gereken şeylerle uyum içinde olmalı, ve olmadığını iddia ettiği şeylerden ayrı durmalıdır. Zayıf araçların çoğu ikincisinde başarısız olur.
- Cronbach alfa nedir ve ne değildirPsikolojik testlerde en çok bildirilen istatistik, ve en çok yanlış okunan. Alfa bir ölçeğin tek boyutlu olduğunu göstermez, ve yüksek bir değer genellikle bir erdemden çok bir belirtidir.
- Normlar ve yüzdelik dilimler: puanın neyle karşılaştırılıyorHam bir puan kendi başına yorumlanamaz. Ancak bir referans grubuna karşı anlamlı hale gelir, ve hangi grubun kullanıldığı, herhangi bir testle ilgili en sonuç doğurucu ve en az duyurulan gerçeklerden biridir.
- Bir psikometrik test gerçekte nasıl oluşturulurYapı tanımından yayımlanmış normlara kadar, bu süreç yıllar sürer ve içine giren şeylerin çoğunu eler. Adımları bilmek, hızlı bir çevrimiçi testin hangilerini atladığını açıkça gösterir.
- Bir testin geçerliği kanıtlanmış olarak adlandırılması ne anlama gelir?Bu kelime düzenlenmemiştir ve hiçbir çalışma yapmamış ürünler tarafından serbestçe kullanılır. İşte bir anlamı olduğunda ne anlama geldiği, ve iki durumu birbirinden ayıran dört soru.
- Çoğu internet kişilik testinin neden güvenilir olmadığıDürüst olmadıkları için değil, bir ölçümü güvenilir kılan adımlar görünmez, maliyetli ve atlanması kolay olduğu için, ve bu adımları atlamak sonucun görünüşünde hiçbir şeyi değiştirmez.
- Öz bildirimin ölçebildiği ve ölçemediği şeylerAnketler senden kendi kendinin gözlemcisi olmanı ister, bu bazı şeyler için diğerlerinden daha iyi işler. Yöntemin nerede güçlü, nerede yetersiz olduğunu bilmek, herhangi bir sonucu okuma şeklini değiştirir.
- Bir testin bir şeyi öngörmesi ne anlama gelir0,30'luk bir korelasyon, kişilik araştırmalarında güçlü bir bulgudur ama bir kişi hakkında karar vermek için zayıf bir temeldir. Her iki ifade de doğrudur ve aralarındaki boşluk, test sonuçlarının çoğu kötüye kullanımına neden olur.
- Tarama, tanı değildirBir tarama anketi, olası vakaları yakalayabildiği kadar yakalamak için tasarlanmıştır ve bunun karşılığında yüksek bir yanlış pozitiflik oranını kabul eder. Bir tarama puanını tanı olarak okumak, tasarlandığı amacı tersine çevirir.