Psikolojik testte geçerlik nedir?
Geçerlik, bir testin sahip olduğu bir özellik değildir. Belirli bir amaç için, belirli bir puanın belirli bir yorumunun savunulabilir olup olmadığına dair bir tartışmadır ve her yeni kullanım için yeniden inşa edilmesi gerekir.
Geçerlik, bir testin ölçtüğünü iddia ettiği şeyi gerçekten ölçüp ölçmediğini ve insanların puanlarından çıkardığı sonuçların haklı olup olmadığını sorgular. Bu, psikometrideki en temel sorudur ve genellikle kanıt yerine bir pazarlama iddiasıyla yanıtlanan sorudur.
1980'lerde Messick'in çalışmalarından bu yana geçerli olan modern anlayışa göre geçerlik, bir aracın sabit bir özelliği değildir. Geçerlik, puanların belirli bir kullanım için yapılan bir yorumunun özelliğidir. Aynı anket, bir kişinin öz algısını tanımlamak için iyi bir şekilde geçerli kılınmışken, o kişiyi işe alıp almama kararı için tamamen geçersiz olabilir. Neyin için geçerli olduğunu söylemeden "bu test geçerlidir" demek bir iddia değildir; bu bir slogandır.
Kanıt türleri
Geçerlik, birkaç türde biriken kanıtlardan inşa edilir. Eski metinler bunları ayrı geçerlik türleri olarak sunar; günümüz görüşü ise bunları tek bir savı destekleyen farklı argümanlar olarak ele alır.
İçerik kanıtı, maddelerin yapıyı gereğince kapsayıp kapsamadığını sorgular. Yalnızca uyku ve iştah hakkında soru soran bir depresyon ölçeği, somatik belirtileri kapsar ancak duygudurum ve bilişsel belirtileri gözden kaçırır. İçerik kapsamı genellikle konu uzmanları tarafından değerlendirilir ve bu, çok kısa ölçeklerin her zaman bir uzlaşma olmasının nedenidir.
İç yapı kanıtı, maddelerin kuramın öngördüğü şekilde gruplanıp gruplanmadığını sorgular. Bir model dört farklı alt boyut öne sürüyorsa, faktör analizi dört faktör ortaya çıkarmalıdır; hem de yalnızca ölçeğin geliştirildiği örneklemde değil, bağımsız bir örneklemde de. Pek çok araç, amaçlanan yapıyı geliştirme örnekleminde ortaya çıkarır ancak başka hiçbir örneklemde bunu başaramaz.
Diğer değişkenlerle ilişkiler, işin çoğunun gerçekleştiği yerdir. Yakınsak kanıt, ölçeğin ilişkili olması gereken şeylerle ilişkili olduğunu gösterir. Ayırt edici kanıt, ölçeğin ayrışması gereken şeylerle aşırı yüksek bir ilişki göstermediğini kanıtlar; bu, kronik olarak ihmal edilen bir gerekliliktir ve yeni markalanmış pek çok yapıyı batıran da budur. Kriter kanıtı, puanın önemli bir sonuçla ilişkili olduğunu gösterir; bu ilişki ya aynı anda ölçülür ya da önceden tahmin edilir.
Sonuçsal kanıt, test kullanıldığında ne olduğunu sorgular. Bir araç, yapıyla ilgisi olmayan nedenlerle sistematik olarak bir grubu dezavantajlı duruma düşürüyorsa, bu yalnızca etik bir sorun değil, bir geçerlik sorunudur.
Çoğu iddiayı açığa çıkaran soru
Bir geçerlik iddiasının en keskin sınavı artımlı geçerliktir: bu araç, daha ucuz, daha eski ve yerleşik bir ölçümün zaten sana söylediklerinin ötesinde bir şey ekliyor mu?
Dikkat çekici sayıda markalanmış yapı burada başarısız olur. Bunlar, mevcut bir Beş Faktör alanıyla 0,7 veya daha yüksek bir korelasyon gösterir, aynı sonuçları aynı büyüklükte tahmin eder ve eski ölçüm istatistiksel olarak kontrol edildiğinde hiçbir şey eklemez. Yapı yenidir; ölçüm değildir. Ciddi araç belgelerinin eleştiri bölümlerinin çoğu zaman yanlışlıktan ziyade fazlalık üzerinde durmasının nedeni budur.
Nelere dikkat etmeli
Birisi bir testin geçerli kılındığını iddia ettiğinde, sorulması gereken faydalı sorular somuttur. Hangi kritere karşı geçerli kılınmış? Hangi popülasyonda, ne büyüklükte bir örneklemde? Faktör yapısı bağımsız bir örneklemde doğrulanmış mı? Sonuçta ticari çıkarı olmayan araştırmacılardan yayımlanmış kanıt var mı? Yerleşik bir alternatife göre bir şey ekliyor mu?
Bu sorulara dürüst yanıtlar veren bir araç, sınırlılıklarıyla birlikte ciddiye alınmayı hak eder. Geçerliliği bir referans sayfasından ve milyonlarca kişinin testi tamamladığı iddiasından ibaret olan bir araç ise tamamen farklı bir soruyu yanıtlamıştır: popülerlik kanıt değildir ve bir testi kaç kişinin tamamladığı, puanlarının bir anlam ifade edip etmediği hakkında hiçbir şey söylemez.
Sen de dene
Ölçüm hakkında okumak bir şey, kendi puanının kaynağıyla, norm örneklemiyle ve sınırlarıyla birlikte raporlandığını görmek başka bir şeydir. Katılmak ücretsiz, kayıt gerekmez.
Okumaya devam et
- Psikometri nedir?Bir psikolojik ölçümün iyi olup olmadığını belirleyen disiplin, ve benzer sorular soran iki testin sonuçlarının değeri açısından muazzam farklılık gösterebilmesinin nedeni.
- Psikolojik testte güvenirlik nedir?Güvenirlik, ölçümün tutarlılığıdır, doğruluğu değil. Bir test yüksek derecede güvenilir olabilir ve yine de yanlış şeyi ölçebilir, bu yüzden sorulan ilk soru budur ve asla son soru değildir.
- Yapı geçerliği nedir?Ölçümdeki en zor soru: tanımladığın şeyin var olup olmadığı, ve aracının ona mı yoksa yakın bir başka şeye mi ulaştığı.
- Yakınsak ve ayırt edici geçerlikBirbirinin aynası olan iki gereklilik: bir ölçüm, aynı fikirde olması gereken şeylerle uyum içinde olmalı, ve olmadığını iddia ettiği şeylerden ayrı durmalıdır. Zayıf araçların çoğu ikincisinde başarısız olur.
- Cronbach alfa nedir ve ne değildirPsikolojik testlerde en çok bildirilen istatistik, ve en çok yanlış okunan. Alfa bir ölçeğin tek boyutlu olduğunu göstermez, ve yüksek bir değer genellikle bir erdemden çok bir belirtidir.
- Ölçüm standart hatası: puanının ne kadar sapmış olabileceğiHer puan bir hata payı taşır, ve çoğu psikolojik test için bu, insanların varsaydığından daha geniştir. Bu, bir farkın ne zaman gerçek, ne zaman gürültü olduğunu söyleyen sayıdır.
- Normlar ve yüzdelik dilimler: puanın neyle karşılaştırılıyorHam bir puan kendi başına yorumlanamaz. Ancak bir referans grubuna karşı anlamlı hale gelir, ve hangi grubun kullanıldığı, herhangi bir testle ilgili en sonuç doğurucu ve en az duyurulan gerçeklerden biridir.
- Bir psikometrik test gerçekte nasıl oluşturulurYapı tanımından yayımlanmış normlara kadar, bu süreç yıllar sürer ve içine giren şeylerin çoğunu eler. Adımları bilmek, hızlı bir çevrimiçi testin hangilerini atladığını açıkça gösterir.
- Bir testin geçerliği kanıtlanmış olarak adlandırılması ne anlama gelir?Bu kelime düzenlenmemiştir ve hiçbir çalışma yapmamış ürünler tarafından serbestçe kullanılır. İşte bir anlamı olduğunda ne anlama geldiği, ve iki durumu birbirinden ayıran dört soru.
- Çoğu internet kişilik testinin neden güvenilir olmadığıDürüst olmadıkları için değil, bir ölçümü güvenilir kılan adımlar görünmez, maliyetli ve atlanması kolay olduğu için, ve bu adımları atlamak sonucun görünüşünde hiçbir şeyi değiştirmez.
- Öz bildirimin ölçebildiği ve ölçemediği şeylerAnketler senden kendi kendinin gözlemcisi olmanı ister, bu bazı şeyler için diğerlerinden daha iyi işler. Yöntemin nerede güçlü, nerede yetersiz olduğunu bilmek, herhangi bir sonucu okuma şeklini değiştirir.
- Bir testin bir şeyi öngörmesi ne anlama gelir0,30'luk bir korelasyon, kişilik araştırmalarında güçlü bir bulgudur ama bir kişi hakkında karar vermek için zayıf bir temeldir. Her iki ifade de doğrudur ve aralarındaki boşluk, test sonuçlarının çoğu kötüye kullanımına neden olur.
- Tarama, tanı değildirBir tarama anketi, olası vakaları yakalayabildiği kadar yakalamak için tasarlanmıştır ve bunun karşılığında yüksek bir yanlış pozitiflik oranını kabul eder. Bir tarama puanını tanı olarak okumak, tasarlandığı amacı tersine çevirir.