noesisnoesis
Ölçüm nasıl işler

Çoğu internet kişilik testinin neden güvenilir olmadığı

Dürüst olmadıkları için değil, bir ölçümü güvenilir kılan adımlar görünmez, maliyetli ve atlanması kolay olduğu için, ve bu adımları atlamak sonucun görünüşünde hiçbir şeyi değiştirmez.

İnternette ücretsiz bir kişilik testi ile geçerliği kanıtlanmış bir psikometrik araç, birbirine benzer bir çıktı üretir: bir puan, bir yüzdelik dilim, seni tanımlayan bir paragraf. Aradaki fark, tamamen sonuç ekranında göremeyeceğin bir çalışmada gizlidir.

Bu konuda net olmakta fayda var, çünkü sık kullanılan çerçeve olan "internet testleri birer dolandırıcılıktır" iddiası, çoğunlukla yanlış ve pek işe yaramaz bir yaklaşımdır. Bunların çoğu, aldatma niyeti taşımayan kişiler tarafından hazırlanır. Güvenilmez olmalarının nedeni yapısaldır.

Genellikle atlanan adımlar

Madde analizi. Doğru şekilde oluşturulmuş bir ölçekte, taslak maddelerin çoğu pilot uygulamadan sonra elenir: kimsenin farklı yanıt vermediği maddeler, toplamla zayıf korelasyon gösteren maddeler, birden fazla faktöre yüklenen maddeler, yaş veya dil gruplarına göre farklı davranan maddeler. Pilot uygulama yapılmadan yazılıp yayımlanan bir test, işe yaramayan maddeler dahil her şeyi korumuş demektir.

Bağımsız yapısal doğrulama. Ölçeği oluşturduğun verilerle yapılan faktör analizi, zaten tasarladığın yapıyı geri verecektir. Bu yapıyı yeni bir örneklemde doğrulamak ayrı bir çalışmadır ve ölçeklerin büyük bir kısmının başarısız olduğu adım tam olarak budur.

Normlar. Yüzdelik dilimin bir kaynağı olması gerekir. Site referans popülasyonunu belirtmiyorsa, bu sayı ya önceki ziyaretçilerden (kompozisyonu bilinmeyen, kendi kendini seçmiş bir gruptan) ya da hiçbir belirli kaynaktan türetilmiş demektir.

Test-tekrar test verisi. İnsanların bir ay sonra da aynı puanı aldığını göstermek, onları tekrar bulmayı gerektirir. Neredeyse hiç kimse bunu yapmaz; bu da "özellik" kelimesinin ima ettiği kararlılığın kanıtlanmamış olduğu anlamına gelir.

Tasarım teşvikleri yanlış yönde işliyor

Etkileşim için tasarlanmış bir test, doğruluk için tasarlanmış bir testten farklı bir sonuca göre optimize edilir ve bu ikisi öngörülebilir biçimlerde birbirinden ayrışır.

Pohpohlayıcı sonuçlar daha iyi performans gösterir. Kişiye hoş gelmeyen bir şey söyleyen sonuç daha az paylaşılır, bu yüzden sonuçlar herkesin kendinde tanıdığı tanımlara doğru kayar. Bu, 1940'larda ortaya konmuş ve o zamandan beri güvenilir biçimde tekrarlanmış olan Barnum etkisidir: İnsanlar, genel geçer kişilik tanımlarını özellikle kendileri hakkında son derece doğru olarak değerlendirir.

Tipler, boyutlardan daha iyi performans gösterir. "Sen bir Mimar'sın" ifadesi, "açıklık boyutunda, geniş bir güven aralığıyla 68. yüzdelik dilimdesin" ifadesinden daha kolay paylaşılır. Tipler ayrıca ölçüm hatasını da gizler, çünkü bir kategori sınırının bir puan bu tarafında ya da diğer tarafında olan kişi tamamen farklı bir etiket alır.

Kısa olmak, yeterli olmaktan daha iyi performans gösterir. Her ek soru, yanıtlayan kaybettirir, bu yüzden testler yapıyı kapsayacak uzunlukta değil, tamamlanma oranını en üst düzeye çıkaracak uzunlukta kesilir.

Bunların hiçbiri yalan değildir. Bunlar, doğruluk dışında bir ölçüt için yapılan optimizasyonlardır.

Yaklaşık otuz saniyede nasıl anlaşılır

Yazarları ve yayın yılı belirtilmiş, adı verilmiş bir kaynak araç ara. Normların hangi popülasyondan geldiğine dair bir açıklama ara. Sınırlılıkların veya ölçüm hatasının kabul edildiğine dair herhangi bir ifade ara. Sonucun sürekli bir puan mı yoksa bir kategori mi olduğuna bak. Aynı sayfanın, yirmi soruyla ideal kariyerini, partnerini ya da hayat amacını da belirleyeceğini vaat edip etmediğine bak.

Kullandığı aracı adlandıran, kaynağını belirten, normlarını açıklayan ve sana neyi gösteremeyeceğini söyleyen bir test, gerekli çalışmayı yapmış demektir. Bunların hiçbirini yapmayan bir test, yine de beş dakikayı hoş geçirmenin bir yolu olabilir; ama ürettiği sayı yalnızca süstür.

NOESIS kataloğundaki her araç, hangi yayımlanmış testi uyguladığını, bunu kimin yazdığını, hangi yılda yazıldığını, nasıl puanlandığını ve sonuçlarının neyi kanıtlamadığını belirtir. Kıyaslamaya değer olan da tam olarak bu son kısımdır.

Sen de dene

Ölçüm hakkında okumak bir şey, kendi puanının kaynağıyla, norm örneklemiyle ve sınırlarıyla birlikte raporlandığını görmek başka bir şeydir. Katılmak ücretsiz, kayıt gerekmez.

Okumaya devam et