심리검사에서 타당도란 무엇입니까?
타당도는 검사가 지니고 있는 속성이 아닙니다. 특정 목적을 위한 특정 점수의 특정 해석이 정당화될 수 있는지에 관한 논증이며, 새로운 용도마다 다시 구축되어야 합니다.
타당도는 검사가 측정하고자 하는 바를 실제로 측정하는지, 그리고 그 점수로부터 도출된 결론이 정당한지를 묻는 질문입니다. 이는 심리측정학에서 가장 핵심적인 질문이면서도, 증거보다는 마케팅 주장으로 답해지는 경우가 가장 흔한 질문이기도 합니다.
1980년대 메시크(Messick)의 연구 이후 유지되어 온 현대적 이해에 따르면, 타당도는 도구의 고정된 속성이 아닙니다. 이는 특정한 용도를 위한 점수의 해석이 지니는 속성입니다. 동일한 질문지가 자기 인식을 기술하는 데는 잘 타당화되어 있으면서도, 채용 여부를 결정하는 데는 전혀 타당화되어 있지 않을 수 있습니다. "이 검사는 타당하다"라고만 말하고 무엇에 대해 타당한지 말하지 않는 것은 주장이 아니라 슬로건에 불과합니다.
증거의 종류
타당도는 여러 유형의 증거가 축적되어 구축됩니다. 오래된 문헌들은 이를 서로 별개의 타당도 종류로 제시하지만, 현재의 관점은 이를 하나의 논지를 뒷받침하는 서로 다른 논증들로 취급합니다.
내용 증거는 문항들이 구성개념을 적절히 포괄하는지를 묻습니다. 수면과 식욕에 대해서만 묻는 우울 척도는 신체적 증상은 다루지만 기분과 인지적 증상은 놓치게 됩니다. 내용의 포괄성은 보통 해당 분야 전문가들이 판단하며, 이것이 매우 짧은 척도가 항상 타협의 산물인 이유입니다.
내적 구조 증거는 문항들이 이론이 말하는 방식대로 묶이는지를 묻습니다. 어떤 모델이 네 가지 구별되는 하위요인을 주장한다면, 요인분석은 네 개의 요인을 재현해야 합니다. 그리고 결정적으로, 척도가 개발된 표본이 아닌 독립적인 표본에서도 그래야 합니다. 매우 많은 도구들이 개발 표본에서는 의도된 구조를 재현하지만 다른 누구의 표본에서는 그렇지 못합니다.
다른 변수들과의 관계는 대부분의 작업이 이루어지는 영역입니다. 수렴 증거는 척도가 상관되어야 할 것들과 상관관계를 보인다는 것을 보여줍니다. 판별 증거는 구별되어야 할 것들과 지나치게 높은 상관을 보이지 않는다는 것을 보여줍니다. 이는 만성적으로 소홀히 다루어지는 요건이며, 새롭게 브랜드화된 구성개념들 다수를 침몰시키는 요건입니다. 기준 증거는 점수가 중요한 결과와 관련되어 있음을 보여주는데, 이는 동시에 측정되거나 사전에 예측될 수 있습니다.
결과적 증거는 검사가 사용될 때 무슨 일이 일어나는지를 묻습니다. 어떤 도구가 구성개념과 무관한 이유로 특정 집단에 체계적으로 불리하게 작용한다면, 이는 단순히 윤리적 문제가 아니라 타당도의 문제입니다.
대부분의 주장을 드러내는 질문
타당도 주장에 대한 가장 날카로운 검증은 증분 타당도입니다. 이 도구가 더 저렴하고 오래되고 확립된 측정도구가 이미 알려주는 것에 무언가를 더 추가하는가?
놀랍게도 많은 브랜드화된 구성개념들이 여기서 실패합니다. 이들은 기존의 빅파이브 영역과 0.7 이상의 상관을 보이고, 동일한 크기로 동일한 결과를 예측하며, 이전 측정도구를 통계적으로 통제하면 아무것도 추가하지 못합니다. 구성개념은 새롭지만, 측정은 새롭지 않습니다. 이것이 바로 진지한 도구 문서의 비판 섹션이 부정확성보다는 중복성을 문제 삼는 경우가 그토록 많은 이유입니다.
무엇을 살펴봐야 하는가
누군가가 어떤 검사가 타당화되었다고 주장할 때, 유용한 질문들은 구체적입니다. 어떤 기준에 대해 타당화되었는가? 어떤 규모의 어떤 모집단에서인가? 요인 구조가 독립적인 표본에서 확인되었는가? 그 답에 상업적 이해관계가 없는 연구자들의 발표된 증거가 있는가? 확립된 대안에 비해 무언가를 추가하는가?
이러한 질문들에 정직하게 답할 수 있는 도구는 한계를 포함하더라도 진지하게 받아들일 가치가 있습니다. 타당화 과정이 추천사 페이지와 수백만 명이 이 검사를 받았다는 주장으로만 이루어진 도구는 완전히 다른 질문에 답한 것입니다. 인기는 증거가 아니며, 어떤 검사를 받은 사람의 수는 그 점수가 무언가를 의미하는지에 대해 아무것도 말해주지 않습니다.
직접 검사해 보기
측정에 관한 글을 읽는 것과, 자신의 점수가 그 출처, 규준 표본, 한계와 함께 보고되는 것을 직접 확인하는 것은 다른 경험입니다. 무료로 응시할 수 있으며 가입도 필요하지 않습니다.
계속 읽기
- 심리측정학이란 무엇입니까?심리 측정이 좋은지 아닌지를 판단하는 학문 분야이며, 비슷한 질문을 하는 두 검사가 그 결과의 가치에서 크게 차이가 날 수 있는 이유입니다.
- 심리검사에서 신뢰도란 무엇입니까?신뢰도는 측정의 일관성이며, 정확성이 아닙니다. 검사는 신뢰도가 매우 높으면서도 여전히 잘못된 대상을 측정할 수 있습니다. 이것이 신뢰도가 가장 먼저 묻는 질문이지 결코 마지막 질문이 아닌 이유입니다.
- 구성 타당도란 무엇입니까?측정에서 가장 어려운 질문입니다. 귀하가 측정하는 대상이 귀하가 정의한 대로 실제로 존재하는지, 그리고 귀하의 도구가 그 대상에 도달하는지, 아니면 그와 유사한 다른 무언가에 도달하는지에 관한 질문입니다.
- 수렴 타당도와 판별 타당도거울처럼 대칭을 이루는 두 가지 요건이 있습니다. 측정치는 그것이 일치해야 하는 것과 일치해야 하며, 그것이 아니라고 주장하는 것과는 구별되어야 합니다. 대부분의 부실한 도구는 두 번째 요건을 충족하지 못합니다.
- 크론바흐 알파(Cronbach's alpha)란 무엇인가, 그리고 무엇이 아닌가심리 검사에서 가장 많이 보고되는 통계량이면서 가장 잘못 이해되는 통계량입니다. 알파 값은 척도가 단일 차원임을 알려주지 않으며, 높은 값은 흔히 장점이 아니라 증상입니다.
- 측정표준오차: 귀하의 점수가 어느 정도 오차를 가질 수 있는지모든 점수는 오차 범위를 지니며, 대부분의 심리 검사에서 이 범위는 사람들이 생각하는 것보다 넓습니다. 이 수치는 어떤 차이가 실제이고 어떤 차이가 잡음인지를 알려줍니다.
- 규준 및 백분위: 귀하의 점수를 비교하는 대상원점수는 그 자체로는 해석할 수 없습니다. 오직 준거 집단과 비교할 때에만 의미를 갖게 되며, 어떤 집단이 사용되었는지는 어떤 검사에서든 가장 중요하면서도 가장 잘 알려지지 않은 사실 중 하나입니다.
- 심리검사가 실제로 만들어지는 과정구성개념 정의부터 발표된 규준까지, 이 과정은 여러 해가 걸리며 그 안에 투입된 것의 대부분을 버립니다. 이 단계들을 알면 어떤 온라인 간이 퀴즈가 어떤 단계를 건너뛰었는지가 분명해집니다.
- 검사가 '타당화되었다'고 불리는 것은 무엇을 의미합니까?이 단어는 규제되지 않으며, 아무런 작업도 하지 않은 제품들이 자유롭게 사용합니다. 이 용어가 실제로 의미를 가질 때 무엇을 뜻하는지, 그리고 두 경우를 구분하는 네 가지 질문을 소개합니다.
- 인터넷상의 대부분의 성격 검사가 신뢰할 수 없는 이유이는 그들이 부정직해서가 아니라, 측정을 신뢰할 수 있게 만드는 단계들이 보이지 않고 비용이 많이 들며 건너뛰기 쉽기 때문입니다. 그리고 그 단계를 건너뛰어도 결과가 보이는 방식은 전혀 달라지지 않습니다.
- 자기보고가 측정할 수 있는 것과 측정할 수 없는 것설문지는 귀하에게 자기 자신을 관찰하는 역할을 요구하는데, 이 방식은 어떤 대상에는 더 잘 작동하고 어떤 대상에는 그렇지 않습니다. 이 방법이 어디에서 강력하고 어디에서 실패하는지 아는 것은 결과를 읽는 방식을 바꿉니다.
- 검사가 무엇인가를 예측한다는 것의 의미0.30의 상관관계는 성격 연구에서는 강력한 결과이지만, 한 개인에 대한 의사결정의 근거로는 약합니다. 두 진술 모두 참이며, 이 둘 사이의 간극이 검사 결과 오용의 대부분을 유발합니다.
- 선별검사는 진단이 아닙니다선별용 설문지는 가능한 많은 사례를 포착하도록 설계되며, 그 대가로 높은 위양성률을 받아들입니다. 선별 점수를 진단으로 해석하는 것은 그것이 설계된 목적을 정반대로 뒤집는 일입니다.