심리측정학이란 무엇입니까?
심리 측정이 좋은지 아닌지를 판단하는 학문 분야이며, 비슷한 질문을 하는 두 검사가 그 결과의 가치에서 크게 차이가 날 수 있는 이유입니다.
심리측정학은 측정 그 자체를 다루는 심리학의 한 분야입니다. 외향성이 무엇을 의미하는지가 아니라, 주어진 일련의 질문이 실제로 외향성을 측정하는지, 그 결과로 나온 수치에 얼마나 많은 오차가 포함되어 있는지, 그리고 그 수치가 무엇을 예측할 자격이 있는지를 다룹니다.
이 구분은 겉보기보다 훨씨 중요합니다. 누구나 어떤 사람이 얼마나 외향적인지에 관한 스무 개의 질문을 작성하고 그 답을 합산할 수 있습니다. 심리측정학은 그 이후에 이루어지는 작업입니다. 스무 개의 질문이 서로 연관되어 있음을 보여주고, 그것들이 세 가지가 아니라 하나를 측정한다는 것을 보여주며, 같은 사람이 한 달 후에도 대체로 비슷한 점수를 받는다는 것을 보여주고, 그 점수가 그 사람의 실제 행동과 관련이 있다는 것을 보여주며, 리스본의 22세와 뮌헨의 55세에게 그 전체 체계가 동일하게 작동한다는 것을 보여주는 작업입니다.
왜 하나의 학문 분야가 필요했는가
물리적 측정은 심리학이 갖지 못한 이점을 가지고 있습니다. 측정하려는 대상 옆에 미터 자를 대볼 수 있다는 것입니다. 성실성에는 미터 자가 없습니다. 이 특성은 직접 관찰할 수 없으며, 행동으로부터 추론되고, 질문지 응답은 그 위에 한 겹 더 추가된 추론일 뿐입니다.
이것이 바로 심리측정학자들이 잠재변수라고 부르는 것입니다. 결과를 낳을 만큼 충분히 실재하지만, 오직 간접적인 지표를 통해서만 도달할 수 있는 무언가입니다. 전체 방법론적 체계는 바로 이러한 간접성 때문에 존재합니다. 여러분이 접하게 될 모든 기법, 즉 요인분석, 신뢰도 계수, 문항반응이론, 규준 표본은 모두 누구도 직접 관찰할 수 없는 양에 대해 방어 가능한 무언가를 말하려는 시도입니다.
세 가지 질문
용어를 걸어내면, 심리측정학은 어떤 도구에든 세 가지를 묻습니다.
일관성이 있는가? 측정이 대부분 잡음이라면 다른 어떤 것도 중요하지 않습니다. 일관성은 문항 간(질문들이 서로 일치하는가?), 시간 간(같은 사람이 다음 달에도 같은 점수를 받는가?), 그리고 관련이 있는 경우 평가자 간에 검토됩니다. 이것이 신뢰도입니다.
주장하는 바를 측정하고 있는가? 질문지는 완벽하게 일관성이 있으면서도 여전히 잘못된 것을 측정할 수 있습니다. 리더십 잠재력을 측정한다고 주장하지만 단순한 자기존중감과 0.8의 상관을 보이는 척도는 자기존중감을 측정하고 있는 것입니다. 이것이 타당도이며, 이는 도구가 가지고 있거나 없거나 하는 속성이 아니라 축적된 증거로부터 구축되는 논증입니다.
누구와 비교해서인가? 34점이라는 원점수는 그 자체로는 아무 의미가 없습니다. 이는 오직 기준 집단과 대비할 때만 해석 가능해집니다. 34점은 어떤 모집단에 비해, 언제, 어디에서 측정했을 때 높은 것인가? 이것이 규준의 작업이며, 대부분의 소비자용 검사가 완전히 건너뛰는 단계입니다.
좋은 실무의 모습
잘 만들어진 도구는 기록의 흔적을 남깁니다. 누군가는 문항이 어떻게 작성되었고 어떤 것이 폐기되었는지 발표합니다. 누군가는 명명된 표본에서, 표본 크기와 함께 신뢰도 계수를 보고합니다. 누군가는 요인 구조가 그것을 구축하는 데 사용된 표본이 아니라 두 번째의 독립적인 표본에서도 유지되는지 검증합니다. 누군가는 문항들이 언어와 연령대에 걸쳐 동일하게 작동하는지 확인합니다. 그리고 또 다른 누군가는, 이상적으로는 그 도구에 이해관계가 없는 사람이, 그 결과를 재현하려 시도하고 그 결과를 보고합니다.
이 중 어느 것도 검사를 오류가 없는 것으로 만들지는 않습니다. 그것은 검사의 한계를 알 수 있게 만드는데, 이는 다르면서도 더 유용한 속성입니다. 측정 오차가 문서화된 도구는 두 점수 간의 작은 차이를 얼마나 신뢰해야 하는지 알려줍니다. 발표된 오차 추정치가 없는 도구는 더 정확한 것이 아닙니다. 단지 자신이 부정확하다는 사실에 대해 더 조용할 뿐입니다.
독자에게 남겨지는 것
심리측정학은 어떤 검사가 참이라고 말해주지 않습니다. 그것은 어떤 점수가 의미를 잃기 전까지 얼마나 밀어붙일 수 있는지, 어떤 질문에 답할 수 있는지, 어떤 모집단을 기준으로 보정되었는지, 그리고 두 점수 간의 차이가 주목할 만한 것이 되려면 얼마나 커야 하는지를 알려줄 것입니다.
이는 대부분의 성격 관련 상품들이 하는 약속보다 더 좁은 약속입니다. 하지만 이는 증거와의 접촉을 견뎌내는 유일한 약속이기도 합니다.
직접 검사해 보기
측정에 관한 글을 읽는 것과, 자신의 점수가 그 출처, 규준 표본, 한계와 함께 보고되는 것을 직접 확인하는 것은 다른 경험입니다. 무료로 응시할 수 있으며 가입도 필요하지 않습니다.
계속 읽기
- 심리검사에서 신뢰도란 무엇입니까?신뢰도는 측정의 일관성이며, 정확성이 아닙니다. 검사는 신뢰도가 매우 높으면서도 여전히 잘못된 대상을 측정할 수 있습니다. 이것이 신뢰도가 가장 먼저 묻는 질문이지 결코 마지막 질문이 아닌 이유입니다.
- 심리검사에서 타당도란 무엇입니까?타당도는 검사가 지니고 있는 속성이 아닙니다. 특정 목적을 위한 특정 점수의 특정 해석이 정당화될 수 있는지에 관한 논증이며, 새로운 용도마다 다시 구축되어야 합니다.
- 구성 타당도란 무엇입니까?측정에서 가장 어려운 질문입니다. 귀하가 측정하는 대상이 귀하가 정의한 대로 실제로 존재하는지, 그리고 귀하의 도구가 그 대상에 도달하는지, 아니면 그와 유사한 다른 무언가에 도달하는지에 관한 질문입니다.
- 수렴 타당도와 판별 타당도거울처럼 대칭을 이루는 두 가지 요건이 있습니다. 측정치는 그것이 일치해야 하는 것과 일치해야 하며, 그것이 아니라고 주장하는 것과는 구별되어야 합니다. 대부분의 부실한 도구는 두 번째 요건을 충족하지 못합니다.
- 크론바흐 알파(Cronbach's alpha)란 무엇인가, 그리고 무엇이 아닌가심리 검사에서 가장 많이 보고되는 통계량이면서 가장 잘못 이해되는 통계량입니다. 알파 값은 척도가 단일 차원임을 알려주지 않으며, 높은 값은 흔히 장점이 아니라 증상입니다.
- 측정표준오차: 귀하의 점수가 어느 정도 오차를 가질 수 있는지모든 점수는 오차 범위를 지니며, 대부분의 심리 검사에서 이 범위는 사람들이 생각하는 것보다 넓습니다. 이 수치는 어떤 차이가 실제이고 어떤 차이가 잡음인지를 알려줍니다.
- 규준 및 백분위: 귀하의 점수를 비교하는 대상원점수는 그 자체로는 해석할 수 없습니다. 오직 준거 집단과 비교할 때에만 의미를 갖게 되며, 어떤 집단이 사용되었는지는 어떤 검사에서든 가장 중요하면서도 가장 잘 알려지지 않은 사실 중 하나입니다.
- 심리검사가 실제로 만들어지는 과정구성개념 정의부터 발표된 규준까지, 이 과정은 여러 해가 걸리며 그 안에 투입된 것의 대부분을 버립니다. 이 단계들을 알면 어떤 온라인 간이 퀴즈가 어떤 단계를 건너뛰었는지가 분명해집니다.
- 검사가 '타당화되었다'고 불리는 것은 무엇을 의미합니까?이 단어는 규제되지 않으며, 아무런 작업도 하지 않은 제품들이 자유롭게 사용합니다. 이 용어가 실제로 의미를 가질 때 무엇을 뜻하는지, 그리고 두 경우를 구분하는 네 가지 질문을 소개합니다.
- 인터넷상의 대부분의 성격 검사가 신뢰할 수 없는 이유이는 그들이 부정직해서가 아니라, 측정을 신뢰할 수 있게 만드는 단계들이 보이지 않고 비용이 많이 들며 건너뛰기 쉽기 때문입니다. 그리고 그 단계를 건너뛰어도 결과가 보이는 방식은 전혀 달라지지 않습니다.
- 자기보고가 측정할 수 있는 것과 측정할 수 없는 것설문지는 귀하에게 자기 자신을 관찰하는 역할을 요구하는데, 이 방식은 어떤 대상에는 더 잘 작동하고 어떤 대상에는 그렇지 않습니다. 이 방법이 어디에서 강력하고 어디에서 실패하는지 아는 것은 결과를 읽는 방식을 바꿉니다.
- 검사가 무엇인가를 예측한다는 것의 의미0.30의 상관관계는 성격 연구에서는 강력한 결과이지만, 한 개인에 대한 의사결정의 근거로는 약합니다. 두 진술 모두 참이며, 이 둘 사이의 간극이 검사 결과 오용의 대부분을 유발합니다.
- 선별검사는 진단이 아닙니다선별용 설문지는 가능한 많은 사례를 포착하도록 설계되며, 그 대가로 높은 위양성률을 받아들입니다. 선별 점수를 진단으로 해석하는 것은 그것이 설계된 목적을 정반대로 뒤집는 일입니다.