Çoğu internet kişilik testinin neden güvenilir olmadığı
Dürüst olmadıkları için değil, bir ölçümü güvenilir kılan adımlar görünmez, maliyetli ve atlanması kolay olduğu için, ve bu adımları atlamak sonucun görünüşünde hiçbir şeyi değiştirmez.
İnternette ücretsiz bir kişilik testi ile geçerliği kanıtlanmış bir psikometrik araç, birbirine benzer bir çıktı üretir: bir puan, bir yüzdelik dilim, seni tanımlayan bir paragraf. Aradaki fark, tamamen sonuç ekranında göremeyeceğin bir çalışmada gizlidir.
Bu konuda net olmakta fayda var, çünkü sık kullanılan çerçeve olan "internet testleri birer dolandırıcılıktır" iddiası, çoğunlukla yanlış ve pek işe yaramaz bir yaklaşımdır. Bunların çoğu, aldatma niyeti taşımayan kişiler tarafından hazırlanır. Güvenilmez olmalarının nedeni yapısaldır.
Genellikle atlanan adımlar
Madde analizi. Doğru şekilde oluşturulmuş bir ölçekte, taslak maddelerin çoğu pilot uygulamadan sonra elenir: kimsenin farklı yanıt vermediği maddeler, toplamla zayıf korelasyon gösteren maddeler, birden fazla faktöre yüklenen maddeler, yaş veya dil gruplarına göre farklı davranan maddeler. Pilot uygulama yapılmadan yazılıp yayımlanan bir test, işe yaramayan maddeler dahil her şeyi korumuş demektir.
Bağımsız yapısal doğrulama. Ölçeği oluşturduğun verilerle yapılan faktör analizi, zaten tasarladığın yapıyı geri verecektir. Bu yapıyı yeni bir örneklemde doğrulamak ayrı bir çalışmadır ve ölçeklerin büyük bir kısmının başarısız olduğu adım tam olarak budur.
Normlar. Yüzdelik dilimin bir kaynağı olması gerekir. Site referans popülasyonunu belirtmiyorsa, bu sayı ya önceki ziyaretçilerden (kompozisyonu bilinmeyen, kendi kendini seçmiş bir gruptan) ya da hiçbir belirli kaynaktan türetilmiş demektir.
Test-tekrar test verisi. İnsanların bir ay sonra da aynı puanı aldığını göstermek, onları tekrar bulmayı gerektirir. Neredeyse hiç kimse bunu yapmaz; bu da "özellik" kelimesinin ima ettiği kararlılığın kanıtlanmamış olduğu anlamına gelir.
Tasarım teşvikleri yanlış yönde işliyor
Etkileşim için tasarlanmış bir test, doğruluk için tasarlanmış bir testten farklı bir sonuca göre optimize edilir ve bu ikisi öngörülebilir biçimlerde birbirinden ayrışır.
Pohpohlayıcı sonuçlar daha iyi performans gösterir. Kişiye hoş gelmeyen bir şey söyleyen sonuç daha az paylaşılır, bu yüzden sonuçlar herkesin kendinde tanıdığı tanımlara doğru kayar. Bu, 1940'larda ortaya konmuş ve o zamandan beri güvenilir biçimde tekrarlanmış olan Barnum etkisidir: İnsanlar, genel geçer kişilik tanımlarını özellikle kendileri hakkında son derece doğru olarak değerlendirir.
Tipler, boyutlardan daha iyi performans gösterir. "Sen bir Mimar'sın" ifadesi, "açıklık boyutunda, geniş bir güven aralığıyla 68. yüzdelik dilimdesin" ifadesinden daha kolay paylaşılır. Tipler ayrıca ölçüm hatasını da gizler, çünkü bir kategori sınırının bir puan bu tarafında ya da diğer tarafında olan kişi tamamen farklı bir etiket alır.
Kısa olmak, yeterli olmaktan daha iyi performans gösterir. Her ek soru, yanıtlayan kaybettirir, bu yüzden testler yapıyı kapsayacak uzunlukta değil, tamamlanma oranını en üst düzeye çıkaracak uzunlukta kesilir.
Bunların hiçbiri yalan değildir. Bunlar, doğruluk dışında bir ölçüt için yapılan optimizasyonlardır.
Yaklaşık otuz saniyede nasıl anlaşılır
Yazarları ve yayın yılı belirtilmiş, adı verilmiş bir kaynak araç ara. Normların hangi popülasyondan geldiğine dair bir açıklama ara. Sınırlılıkların veya ölçüm hatasının kabul edildiğine dair herhangi bir ifade ara. Sonucun sürekli bir puan mı yoksa bir kategori mi olduğuna bak. Aynı sayfanın, yirmi soruyla ideal kariyerini, partnerini ya da hayat amacını da belirleyeceğini vaat edip etmediğine bak.
Kullandığı aracı adlandıran, kaynağını belirten, normlarını açıklayan ve sana neyi gösteremeyeceğini söyleyen bir test, gerekli çalışmayı yapmış demektir. Bunların hiçbirini yapmayan bir test, yine de beş dakikayı hoş geçirmenin bir yolu olabilir; ama ürettiği sayı yalnızca süstür.
NOESIS kataloğundaki her araç, hangi yayımlanmış testi uyguladığını, bunu kimin yazdığını, hangi yılda yazıldığını, nasıl puanlandığını ve sonuçlarının neyi kanıtlamadığını belirtir. Kıyaslamaya değer olan da tam olarak bu son kısımdır.
Sen de dene
Ölçüm hakkında okumak bir şey, kendi puanının kaynağıyla, norm örneklemiyle ve sınırlarıyla birlikte raporlandığını görmek başka bir şeydir. Katılmak ücretsiz, kayıt gerekmez.
Okumaya devam et
- Psikometri nedir?Bir psikolojik ölçümün iyi olup olmadığını belirleyen disiplin, ve benzer sorular soran iki testin sonuçlarının değeri açısından muazzam farklılık gösterebilmesinin nedeni.
- Psikolojik testte güvenirlik nedir?Güvenirlik, ölçümün tutarlılığıdır, doğruluğu değil. Bir test yüksek derecede güvenilir olabilir ve yine de yanlış şeyi ölçebilir, bu yüzden sorulan ilk soru budur ve asla son soru değildir.
- Psikolojik testte geçerlik nedir?Geçerlik, bir testin sahip olduğu bir özellik değildir. Belirli bir amaç için, belirli bir puanın belirli bir yorumunun savunulabilir olup olmadığına dair bir tartışmadır ve her yeni kullanım için yeniden inşa edilmesi gerekir.
- Yapı geçerliği nedir?Ölçümdeki en zor soru: tanımladığın şeyin var olup olmadığı, ve aracının ona mı yoksa yakın bir başka şeye mi ulaştığı.
- Yakınsak ve ayırt edici geçerlikBirbirinin aynası olan iki gereklilik: bir ölçüm, aynı fikirde olması gereken şeylerle uyum içinde olmalı, ve olmadığını iddia ettiği şeylerden ayrı durmalıdır. Zayıf araçların çoğu ikincisinde başarısız olur.
- Cronbach alfa nedir ve ne değildirPsikolojik testlerde en çok bildirilen istatistik, ve en çok yanlış okunan. Alfa bir ölçeğin tek boyutlu olduğunu göstermez, ve yüksek bir değer genellikle bir erdemden çok bir belirtidir.
- Ölçüm standart hatası: puanının ne kadar sapmış olabileceğiHer puan bir hata payı taşır, ve çoğu psikolojik test için bu, insanların varsaydığından daha geniştir. Bu, bir farkın ne zaman gerçek, ne zaman gürültü olduğunu söyleyen sayıdır.
- Normlar ve yüzdelik dilimler: puanın neyle karşılaştırılıyorHam bir puan kendi başına yorumlanamaz. Ancak bir referans grubuna karşı anlamlı hale gelir, ve hangi grubun kullanıldığı, herhangi bir testle ilgili en sonuç doğurucu ve en az duyurulan gerçeklerden biridir.
- Bir psikometrik test gerçekte nasıl oluşturulurYapı tanımından yayımlanmış normlara kadar, bu süreç yıllar sürer ve içine giren şeylerin çoğunu eler. Adımları bilmek, hızlı bir çevrimiçi testin hangilerini atladığını açıkça gösterir.
- Bir testin geçerliği kanıtlanmış olarak adlandırılması ne anlama gelir?Bu kelime düzenlenmemiştir ve hiçbir çalışma yapmamış ürünler tarafından serbestçe kullanılır. İşte bir anlamı olduğunda ne anlama geldiği, ve iki durumu birbirinden ayıran dört soru.
- Öz bildirimin ölçebildiği ve ölçemediği şeylerAnketler senden kendi kendinin gözlemcisi olmanı ister, bu bazı şeyler için diğerlerinden daha iyi işler. Yöntemin nerede güçlü, nerede yetersiz olduğunu bilmek, herhangi bir sonucu okuma şeklini değiştirir.
- Bir testin bir şeyi öngörmesi ne anlama gelir0,30'luk bir korelasyon, kişilik araştırmalarında güçlü bir bulgudur ama bir kişi hakkında karar vermek için zayıf bir temeldir. Her iki ifade de doğrudur ve aralarındaki boşluk, test sonuçlarının çoğu kötüye kullanımına neden olur.
- Tarama, tanı değildirBir tarama anketi, olası vakaları yakalayabildiği kadar yakalamak için tasarlanmıştır ve bunun karşılığında yüksek bir yanlış pozitiflik oranını kabul eder. Bir tarama puanını tanı olarak okumak, tasarlandığı amacı tersine çevirir.