noesisnoesis
Ölçüm nasıl işler

Ölçüm standart hatası: puanının ne kadar sapmış olabileceği

Her puan bir hata payı taşır, ve çoğu psikolojik test için bu, insanların varsaydığından daha geniştir. Bu, bir farkın ne zaman gerçek, ne zaman gürültü olduğunu söyleyen sayıdır.

Ölçüm standart hatası, soyut bir güvenirlik katsayısını somut bir şeye dönüştürür: bir puanın etrafındaki artı eksi bir bant. Çoğu sonuç ekranının cevapsız bıraktığı soruyu yanıtlar: testi başka bir öğleden sonra almış olsaydım bu sayı ne kadar farklı olabilirdi?

Formül basittir. Ölçeğin standart sapmasını, birden güvenirliğin çıkarılmasıyla elde edilen değerin kareköküyle çarparsın. Standart sapması 10 ve güvenirliği 0,85 olan bir ölçek için standart hata yaklaşık 3,9 puandır.

Bu bant gerçekte neyi kapsar

Zamanın kabaca üçte ikisinde, bir kişinin gerçek konumu, gözlenen puanının bir standart hata aralığı içinde kalır. Yaklaşık yüzde 95 güvenilir olmak için her iki yönde kabaca iki standart hataya ihtiyacın vardır.

Yukarıdaki örneği ele alalım. Biri 62 puan alıyor. Yüzde 95'lik aralık kabaca 54'ten 70'e kadar uzanır. Bu, ortalama ile belirgin şekilde ortalamanın üstü arasındaki tipik farkın on puan olabileceği bir ölçekte on altı puanlık bir penceredir.

Bu, o belirli testin bir kusuru değildir. 0,85 güvenirlik saygın bir değerdir. Bu, psikolojik ölçümün olağan hassasiyetidir ve dikkatli hazırlanmış raporların tek bir nokta yerine bant sunmasının nedeni budur.

İnsanların gözden kaçırdığı sonuçlar

Ölçekler arasındaki küçük farklar genellikle anlamsızdır. Dışadönüklüğün 58, açıklığın 54 ise, dürüst okuma bunların birbirinden ayırt edilemez olduğudur. Dört puanlık farklardan bir anlatı kuran profil yorumları, gürültüyü okumaktadır.

Zaman içindeki küçük değişimler de genellikle anlamsızdır. Bir testi yeniden alıp beş puan değişmek, çoğu ölçüm aracı için hata sınırları içindedir. Gerçek özellik değişimi yıllar içinde gerçekleşir ve ay be ay birkaç puanlık hareket olarak değil, hata bandının çok dışında bir hareket olarak ortaya çıkar.

Sıralama düzenleri sorunu büyütür. Birkaç ham puanlık bir fark, dağılımın yoğun ortasında birini on yüzdelik dilim kaydırabilir, çünkü çoğu insan orada bulunur. Yüzdelik dilim sıralamaları kesin görünür ama bir puanı ifade etmenin en kararsız yoludur.

Hassasiyet ölçek boyunca eşit değildir. Klasik test kuramı, her puan için tek bir hata değeri olduğunu varsayar; bu bir basitleştirmedir. Madde tepki kuramı, hatayı özelliğin her seviyesinde ayrı ayrı modeller ve bu hata neredeyse her zaman uç noktalarda daha büyüktür; tam da en sonuçları ağır yorumların yapıldığı yerlerde. Çok yüksek veya çok düşük bir puan, genellikle ortalama bir puandan daha az değil, daha çok belirsizdir.

Dürüst raporlamanın neden daha az etkileyici görünür

Güven bantları bildiren bir ölçüm aracı, tek bir sayıyı bir ondalık basamağa kadar bildiren bir araçtan daha belirsiz görünür. Belirsiz görünen doğruyu söylemektedir. Kesin görünen ise aynı temel hataya sahiptir ama bunu göstermemeyi seçmiştir.

Bilimsel olarak belgelenmiş bir testi, seni bir kategoriye atayan ticari bir ürünle karşılaştırırken bunu akılda tutmakta fayda var. Kategori sınırı belirli bir puanda yer alır ve bu sınırın bir puan altında olan biri ile bir puan üstünde olan biri istatistiksel olarak aynı kişidir. Tip etiketi bunu tamamen gizler; bu, tip temelli araçlara karşı öne sürülen daha ciddi argümanlardan biridir ve belirtilen hatasıyla birlikte sunulan sürekli puanların araştırmalarda standart olmasının nedenidir.

Sen de dene

Ölçüm hakkında okumak bir şey, kendi puanının kaynağıyla, norm örneklemiyle ve sınırlarıyla birlikte raporlandığını görmek başka bir şeydir. Katılmak ücretsiz, kayıt gerekmez.

Okumaya devam et

Ölçüm standart hatası: puanının ne kadar sapmış olabileceği | NOESIS