검사가 무엇인가를 예측한다는 것의 의미
0.30의 상관관계는 성격 연구에서는 강력한 결과이지만, 한 개인에 대한 의사결정의 근거로는 약합니다. 두 진술 모두 참이며, 이 둘 사이의 간극이 검사 결과 오용의 대부분을 유발합니다.
성격 연구는 성실성이 직무 수행을 예측한다고 보고합니다. 이 문장을 읽으면 대부분의 사람들은 실제 데이터가 보여주는 것보다 훨씬 강한 무언가를 떠올립니다. 통계적 주장과 "예측한다"는 말의 일상적 의미 사이의 간극이야말로 심리검사 오용이 시작되는 지점입니다.
관련된 수치들
성격 연구에서 효과 크기는 보통 상관계수로 보고됩니다. 잘 확립된 관계에 대한 메타분석 값은 대체로 0.20에서 0.35 사이에 위치합니다. 성실성과 직무 수행은 약 0.20에서 0.25입니다. 직무 만족과 직무 수행은 약 0.30입니다. 이 분야에서 가장 강력한 단일 예측 변수인 일반 정신 능력은 복잡한 업무에서 대략 0.50에 이릅니다.
상관계수를 제곱하면 설명된 분산의 비율을 얻게 됩니다. 0.25의 상관계수는 사람들 간 차이의 약 6퍼센트를 설명합니다. 나머지 94퍼센트는 다른 것들입니다: 능력, 기회, 훈련, 관리, 건강, 운.
그럼에도 0.25가 실제 발견인 이유
모집단 규모에서는 작은 상관관계도 상당한 총합 효과를 만들어냅니다. 천 명을 선발하는 경우, 0.25의 예측 변수는 평균 결과를 측정 가능하고 반복적으로 개선합니다. 보험사와 역학자들은 이 정도 크기의 효과를 바탕으로 전체 실무 체계를 구축합니다.
문제는 총합적 이익과 개별 예측이 서로 다른 양이라는 점입니다. 0.25의 상관계수는 높은 점수를 받은 사람들 중에서 낮은 점수를 받은 사람들보다 더 많은 사람이 좋은 성과를 낸다는 것을 의미합니다. 그리고 동시에 매우 많은 고득점자들이 성과가 나쁘고 매우 많은 저득점자들이 우수한 성과를 낸다는 것도 의미합니다. 이 두 진술 모두 같은 수치에서 나옵니다.
개별 사례의 문제
이것이 흔히 생략되는 단계입니다. 상관계수는 두 분포 간의 관계를 기술합니다. 그것이 특정 개인에 대한 진술을 정당화하지는 않습니다.
성실성이 수행과 0.25의 상관을 보인다면, 누군가의 성실성 점수를 아는 것은 그 사람의 수행에 대한 타당한 범위를 약간만 좁혀줍니다. 한 개인에 대한 예측 구간은 거의 전체 결과 범위를 포함할 만큼 여전히 넓습니다. 성실성에서 상위 80번째 백분위에 있다는 말을 듣는 것은 특정 직무에서 귀하가 어떻게 해낼지에 대해 매우 적은 정보만을 알려줍니다.
이런 이유로, 기반 연구가 견고하더라도 성격 점수를 주요 선발 필터로 사용하는 것은 근거가 부족합니다. 연구는 그 특성이 중요하다는 주장을 지지합니다. 그러나 점수가 지원자가 어떻게 행동할지를 알려준다는 주장을 지지하지는 않습니다.
추가로 유의할 두 가지
예측하는 것과 원인이 되는 것은 다릅니다. 이 문헌의 거의 전부는 상관관계 연구입니다. 성실성이 건강 결과를 예측한다는 것은, 성실성이 더 나은 건강 행동을 유발한다는 것과도, 제3의 요인이 둘 다를 유발한다는 것과도, 역방향 인과관계와도 모두 일치합니다. 종단 설계는 가능성의 범위를 좁혀주지만, 그것들을 완전히 배제하는 경우는 드뭅니다.
자기보고 기준은 수치를 부풀립니다. 예측 변수와 결과 변수가 모두 같은 사람에 의해 같은 오후에 자기보고될 때, 공통방법분산은 상관계수를 끌어올립니다. 객관적 결과나 정보 제공자 평가를 사용하는 연구들은 보통 더 작은 효과를 보고하며, 바로 이런 연구들에 더 큰 비중을 두어야 합니다.
점수가 실제로 유용한 것은 무엇인가
예언이 아니라 기술로 읽을 때, 검사 점수는 진정으로 유용합니다. 그것은 문서화된 결과를 가진 어떤 특성에 대해 귀하가 참조 모집단과 비교해 어디에 위치하는지 알려주며, 귀하가 알아차렸을 수는 있지만 이름 붙이지 못했던 패턴에 대한 어휘를 제공합니다.
그것은 가질 만한 가치가 있습니다. 그것은 예측과는 다른 것이며, 이 구분은 정직한 보고서가 귀하를 위해 직접 짚어주어야 할 것이지, 귀하가 스스로 추론하도록 남겨두어서는 안 되는 것입니다.
직접 검사해 보기
측정에 관한 글을 읽는 것과, 자신의 점수가 그 출처, 규준 표본, 한계와 함께 보고되는 것을 직접 확인하는 것은 다른 경험입니다. 무료로 응시할 수 있으며 가입도 필요하지 않습니다.
계속 읽기
- 심리측정학이란 무엇입니까?심리 측정이 좋은지 아닌지를 판단하는 학문 분야이며, 비슷한 질문을 하는 두 검사가 그 결과의 가치에서 크게 차이가 날 수 있는 이유입니다.
- 심리검사에서 신뢰도란 무엇입니까?신뢰도는 측정의 일관성이며, 정확성이 아닙니다. 검사는 신뢰도가 매우 높으면서도 여전히 잘못된 대상을 측정할 수 있습니다. 이것이 신뢰도가 가장 먼저 묻는 질문이지 결코 마지막 질문이 아닌 이유입니다.
- 심리검사에서 타당도란 무엇입니까?타당도는 검사가 지니고 있는 속성이 아닙니다. 특정 목적을 위한 특정 점수의 특정 해석이 정당화될 수 있는지에 관한 논증이며, 새로운 용도마다 다시 구축되어야 합니다.
- 구성 타당도란 무엇입니까?측정에서 가장 어려운 질문입니다. 귀하가 측정하는 대상이 귀하가 정의한 대로 실제로 존재하는지, 그리고 귀하의 도구가 그 대상에 도달하는지, 아니면 그와 유사한 다른 무언가에 도달하는지에 관한 질문입니다.
- 수렴 타당도와 판별 타당도거울처럼 대칭을 이루는 두 가지 요건이 있습니다. 측정치는 그것이 일치해야 하는 것과 일치해야 하며, 그것이 아니라고 주장하는 것과는 구별되어야 합니다. 대부분의 부실한 도구는 두 번째 요건을 충족하지 못합니다.
- 크론바흐 알파(Cronbach's alpha)란 무엇인가, 그리고 무엇이 아닌가심리 검사에서 가장 많이 보고되는 통계량이면서 가장 잘못 이해되는 통계량입니다. 알파 값은 척도가 단일 차원임을 알려주지 않으며, 높은 값은 흔히 장점이 아니라 증상입니다.
- 측정표준오차: 귀하의 점수가 어느 정도 오차를 가질 수 있는지모든 점수는 오차 범위를 지니며, 대부분의 심리 검사에서 이 범위는 사람들이 생각하는 것보다 넓습니다. 이 수치는 어떤 차이가 실제이고 어떤 차이가 잡음인지를 알려줍니다.
- 규준 및 백분위: 귀하의 점수를 비교하는 대상원점수는 그 자체로는 해석할 수 없습니다. 오직 준거 집단과 비교할 때에만 의미를 갖게 되며, 어떤 집단이 사용되었는지는 어떤 검사에서든 가장 중요하면서도 가장 잘 알려지지 않은 사실 중 하나입니다.
- 심리검사가 실제로 만들어지는 과정구성개념 정의부터 발표된 규준까지, 이 과정은 여러 해가 걸리며 그 안에 투입된 것의 대부분을 버립니다. 이 단계들을 알면 어떤 온라인 간이 퀴즈가 어떤 단계를 건너뛰었는지가 분명해집니다.
- 검사가 '타당화되었다'고 불리는 것은 무엇을 의미합니까?이 단어는 규제되지 않으며, 아무런 작업도 하지 않은 제품들이 자유롭게 사용합니다. 이 용어가 실제로 의미를 가질 때 무엇을 뜻하는지, 그리고 두 경우를 구분하는 네 가지 질문을 소개합니다.
- 인터넷상의 대부분의 성격 검사가 신뢰할 수 없는 이유이는 그들이 부정직해서가 아니라, 측정을 신뢰할 수 있게 만드는 단계들이 보이지 않고 비용이 많이 들며 건너뛰기 쉽기 때문입니다. 그리고 그 단계를 건너뛰어도 결과가 보이는 방식은 전혀 달라지지 않습니다.
- 자기보고가 측정할 수 있는 것과 측정할 수 없는 것설문지는 귀하에게 자기 자신을 관찰하는 역할을 요구하는데, 이 방식은 어떤 대상에는 더 잘 작동하고 어떤 대상에는 그렇지 않습니다. 이 방법이 어디에서 강력하고 어디에서 실패하는지 아는 것은 결과를 읽는 방식을 바꿉니다.
- 선별검사는 진단이 아닙니다선별용 설문지는 가능한 많은 사례를 포착하도록 설계되며, 그 대가로 높은 위양성률을 받아들입니다. 선별 점수를 진단으로 해석하는 것은 그것이 설계된 목적을 정반대로 뒤집는 일입니다.