검사가 '타당화되었다'고 불리는 것은 무엇을 의미합니까?
이 단어는 규제되지 않으며, 아무런 작업도 하지 않은 제품들이 자유롭게 사용합니다. 이 용어가 실제로 의미를 가질 때 무엇을 뜻하는지, 그리고 두 경우를 구분하는 네 가지 질문을 소개합니다.
"과학적으로 검증됨"은 보호받는 용어가 아닙니다. 이를 인증하는 기관도 없고, 이를 감사하는 기구도 없으며, 이 표현은 전체 근거 기반이 '많은 사람들이 그것을 받아보았다'는 것뿐인 제품들에도 등장합니다. 이 표현이 제대로 사용될 때 무엇을 의미하는지 알아둘 필요가 있습니다.
요약
타당화된 도구에는 그것이 무엇을 측정하는지, 얼마나 정밀하게 측정하는지, 어떤 모집단에서 측정하는지, 그리고 그 점수가 어떤 용도로 정당하게 사용될 수 있는지를 보여주는 공개된 기록이 있습니다. 타당화는 인증서가 아닙니다. 그것은 보통 여러 해에 걸쳐 축적된 증거의 총체이며, 대개는 그 도구를 미화하기보다 그 사용 범위를 제한하는 발견들도 포함하고 있습니다.
문서화된 한계가 존재한다는 것은 더 나은 신호 중 하나입니다. 진정한 타당화 문헌에는 이러한 한계가 가득합니다. 이 척도는 청소년에게서는 성능이 떨어진다, 저 하위 요인은 재현되지 않는다, 절단점은 모집단에 따라 달라진다는 식입니다. 오직 강점만 보고하는 제품은 자신의 타당화를 발표한 것이 아니라 자신의 마케팅을 발표한 것입니다.
핵심이 되는 네 가지 질문
원 출처 논문은 무엇인가? 타당화된 도구에는 저자, 발행 연도, 그리고 보통 DOI가 포함된, 동료 심사를 거친 학술지에 실린 원 논문이 있습니다. 그 논문은 문항이 어떻게 개발되었는지, 초기 심리측정적 속성이 무엇이었는지를 보고합니다. 아무도 그 논문의 이름을 대지 못한다면, 논할 타당화 자체가 존재하지 않는 것입니다.
그 구조는 다른 사람에 의해 확인되었는가? 개발팀은 자신들이 설계한 구조를 당연히 재확인하게 됩니다. 중요한 것은 독립된 집단이 독립된 데이터를 가지고 같은 결과를 발견했는지 여부입니다. 이것은 귀하가 물어볼 수 있는 가장 유익한 단 하나의 질문이며, 동시에 가장 자주 답변되지 않은 채 남겨지는 질문입니다.
규준은 어떤 모집단을 기반으로, 언제 구축되었는가? 점수란 참조 분포 내에서의 위치입니다. 어떤 모집단을 지칭하는지 밝히지 않은 채 백분위를 보고하는 도구는 귀하에게 분모 없는 숫자를 건넨 것입니다.
이 도구는 무엇을 더해주는가? 기존에 확립된 측정치에 대한 증분 타당도가 그것입니다. 매우 많은 브랜드화된 구성개념들이 바로 이 지점에서 실패합니다. 기존 특성과 지나치게 높은 상관을 보여, 어떤 것에 대해서도 추가적인 분산을 설명하지 못하는 것입니다. 이는 과학적 검증의 정상적인 결과이지만, 누군가 검사를 실제로 시행하지 않으면 드러나지 않습니다.
번역이 문제를 복잡하게 만드는 지점
영어로 타당화된 도구가 그 사실만으로 독일어에서도 타당화되는 것은 아닙니다. 제대로 된 문화 간 적응에는 정방향 번역과 역번역, 전문가 검토, 인지적 인터뷰, 그리고 새로운 언어에서 요인 구조가 유지되는지, 개별 문항이 집단 간에 동등하게 기능하는지를 검증하는 새로운 심리측정 연구가 필요합니다.
이를 생략하는 도구가 흔합니다. 원 타당화가 완벽한 설문지라 하더라도, 핵심 문항이 다른 함의를 지니는 언어에서는 상당히 다르게 작동할 수 있으며, 그 연구 없이는 이를 알 방법이 없습니다. 어떤 검사가 열 개 언어로 제공될 때, 유용한 질문은 그것이 열 개 언어에서 타당화되었는지, 아니면 하나의 언어에서 타당화되고 아홉 개 언어로 번역되었는지입니다.
타당화가 보장하지 않는 것
타당화는 점수를 확실하게 만들어주지 않습니다. 타당화된 도구라도 여전히 측정 오차를 지니며, 여전히 개인의 운명이 아니라 모집단 수준의 규칙성을 기술할 뿐이고, 여전히 그 문항이 다다르는 범위까지만 측정합니다.
타당화가 보장하는 것은 알 수 있는 한계입니다. 귀하는 얼마나 많은 오차가, 어떤 모집단에서, 어떤 목적을 위해 존재하는지를 파악할 수 있습니다. 이는 "이 검사가 귀하가 진정 누구인지를 밝혀준다"는 주장보다 훨씬 작은 주장이며, 유일하게 성립하는 주장입니다.
그러한 문서화가 실제로 존재할 때 어떤 모습인지 보고 싶으시다면, NOESIS 카탈로그에 있는 모든 검사는 그것이 구현하는 도구의 명칭, 저자와 연도, 채점 방식, 그리고 그 뒤에 있는 근거를, 그 근거가 논쟁의 대상이 되는 부분까지 포함하여 명시하고 있습니다.
직접 검사해 보기
측정에 관한 글을 읽는 것과, 자신의 점수가 그 출처, 규준 표본, 한계와 함께 보고되는 것을 직접 확인하는 것은 다른 경험입니다. 무료로 응시할 수 있으며 가입도 필요하지 않습니다.
계속 읽기
- 심리측정학이란 무엇입니까?심리 측정이 좋은지 아닌지를 판단하는 학문 분야이며, 비슷한 질문을 하는 두 검사가 그 결과의 가치에서 크게 차이가 날 수 있는 이유입니다.
- 심리검사에서 신뢰도란 무엇입니까?신뢰도는 측정의 일관성이며, 정확성이 아닙니다. 검사는 신뢰도가 매우 높으면서도 여전히 잘못된 대상을 측정할 수 있습니다. 이것이 신뢰도가 가장 먼저 묻는 질문이지 결코 마지막 질문이 아닌 이유입니다.
- 심리검사에서 타당도란 무엇입니까?타당도는 검사가 지니고 있는 속성이 아닙니다. 특정 목적을 위한 특정 점수의 특정 해석이 정당화될 수 있는지에 관한 논증이며, 새로운 용도마다 다시 구축되어야 합니다.
- 구성 타당도란 무엇입니까?측정에서 가장 어려운 질문입니다. 귀하가 측정하는 대상이 귀하가 정의한 대로 실제로 존재하는지, 그리고 귀하의 도구가 그 대상에 도달하는지, 아니면 그와 유사한 다른 무언가에 도달하는지에 관한 질문입니다.
- 수렴 타당도와 판별 타당도거울처럼 대칭을 이루는 두 가지 요건이 있습니다. 측정치는 그것이 일치해야 하는 것과 일치해야 하며, 그것이 아니라고 주장하는 것과는 구별되어야 합니다. 대부분의 부실한 도구는 두 번째 요건을 충족하지 못합니다.
- 크론바흐 알파(Cronbach's alpha)란 무엇인가, 그리고 무엇이 아닌가심리 검사에서 가장 많이 보고되는 통계량이면서 가장 잘못 이해되는 통계량입니다. 알파 값은 척도가 단일 차원임을 알려주지 않으며, 높은 값은 흔히 장점이 아니라 증상입니다.
- 측정표준오차: 귀하의 점수가 어느 정도 오차를 가질 수 있는지모든 점수는 오차 범위를 지니며, 대부분의 심리 검사에서 이 범위는 사람들이 생각하는 것보다 넓습니다. 이 수치는 어떤 차이가 실제이고 어떤 차이가 잡음인지를 알려줍니다.
- 규준 및 백분위: 귀하의 점수를 비교하는 대상원점수는 그 자체로는 해석할 수 없습니다. 오직 준거 집단과 비교할 때에만 의미를 갖게 되며, 어떤 집단이 사용되었는지는 어떤 검사에서든 가장 중요하면서도 가장 잘 알려지지 않은 사실 중 하나입니다.
- 심리검사가 실제로 만들어지는 과정구성개념 정의부터 발표된 규준까지, 이 과정은 여러 해가 걸리며 그 안에 투입된 것의 대부분을 버립니다. 이 단계들을 알면 어떤 온라인 간이 퀴즈가 어떤 단계를 건너뛰었는지가 분명해집니다.
- 인터넷상의 대부분의 성격 검사가 신뢰할 수 없는 이유이는 그들이 부정직해서가 아니라, 측정을 신뢰할 수 있게 만드는 단계들이 보이지 않고 비용이 많이 들며 건너뛰기 쉽기 때문입니다. 그리고 그 단계를 건너뛰어도 결과가 보이는 방식은 전혀 달라지지 않습니다.
- 자기보고가 측정할 수 있는 것과 측정할 수 없는 것설문지는 귀하에게 자기 자신을 관찰하는 역할을 요구하는데, 이 방식은 어떤 대상에는 더 잘 작동하고 어떤 대상에는 그렇지 않습니다. 이 방법이 어디에서 강력하고 어디에서 실패하는지 아는 것은 결과를 읽는 방식을 바꿉니다.
- 검사가 무엇인가를 예측한다는 것의 의미0.30의 상관관계는 성격 연구에서는 강력한 결과이지만, 한 개인에 대한 의사결정의 근거로는 약합니다. 두 진술 모두 참이며, 이 둘 사이의 간극이 검사 결과 오용의 대부분을 유발합니다.
- 선별검사는 진단이 아닙니다선별용 설문지는 가능한 많은 사례를 포착하도록 설계되며, 그 대가로 높은 위양성률을 받아들입니다. 선별 점수를 진단으로 해석하는 것은 그것이 설계된 목적을 정반대로 뒤집는 일입니다.