심리검사에서 신뢰도란 무엇입니까?
신뢰도는 측정의 일관성이며, 정확성이 아닙니다. 검사는 신뢰도가 매우 높으면서도 여전히 잘못된 대상을 측정할 수 있습니다. 이것이 신뢰도가 가장 먼저 묻는 질문이지 결코 마지막 질문이 아닌 이유입니다.
신뢰도란 측정이 잡음이 아니라 반복 가능한 정도를 의미합니다. 만약 귀하가 1분 사이에 세 번 체중을 측정했는데 71킬로그램, 78킬로그램, 66킬로그램이 나왔다면, 그 저울은 신뢰할 수 없는 것이며, 귀하는 그것으로부터 실제 체중을 알 방법이 없을 것입니다. 심리적 측정은 훨씨 부정확한 도구로 동일한 문제에 직면합니다.
신뢰도에 대해 이해해야 할 핵심은 그것이 주장하지 않는 바입니다. 항상 8킬로그램 더 무겁게 측정되는 욕실 저울은 완벽하게 신뢰할 수 있지만 완전히 잘못된 것입니다. 신뢰도는 일관성에 관한 것이며, 그 수치가 올바른 것을 의미하는지는 별개의 문제로, 타당도라고 불립니다. 신뢰도는 타당도를 위한 필요조건이지만 충분조건과는 거리가 멉니다.
신뢰도의 형태
내적 일관성은 척도의 문항들이 서로 일치하는지를 묻습니다. 열 개의 문항이 모두 동일한 근본적 특성을 측정하도록 설계되었다면, 한 문항에서 높은 점수를 받은 사람은 다른 문항에서도 높은 점수를 받는 경향이 있어야 합니다. 이는 보통 크론바흐 알파(Cronbach's alpha), 또는 더 나은 방법으로 맥도날드 오메가(McDonald's omega)로 보고됩니다.
검사-재검사 신뢰도는 동일한 사람이 두 번의 다른 시점에서 유사한 점수를 받는지를 묻습니다. 이는 정의상 안정적이어야 하는 특성에 있어 가장 중요한 형태입니다. 또한 동일한 참가자를 몇 주 후에 다시 추적해야 하기 때문에 가장 자주 보고되지 않는 형태이기도 합니다.
평정자 간 신뢰도는 사람이 검사를 채점할 때, 즉 임상 면담, 투사적 기법, 행동 관찰 등에 적용됩니다. 이는 동일한 자료를 보는 두 명의 훈련된 평정자가 동일한 결론에 도달하는지를 묻습니다.
동형 검사 신뢰도는 동등하게 제작된 동일 검사의 두 가지 다른 버전이 동일한 점수를 산출하는지를 묻습니다. 이는 검사가 두 번 이상 시행되고 문항 노출이 우려되는 모든 경우에 중요합니다.
수치 읽는 법
신뢰도 계수는 0에서 1까지 분포합니다. 그 기준은 대략적이며 널리 오용되고 있지만, 대체로 다음과 같습니다. 0.90 이상은 점수가 개인의 삶에 영향을 미치는 경우 요구되며, 0.80에서 0.90은 대부분의 응용 목적에 견고한 수준이며, 0.70에서 0.80은 연구 및 집단 비교에 허용 가능한 수준이며, 0.70 미만은 그 점수에 대부분의 결론이 견뎌낼 수 없을 정도로 많은 잡음이 포함되어 있음을 의미합니다.
이 기준들에 대해 두 가지 주의할 점이 있습니다. 첫째, 이는 관례일 뿐 법칙이 아니며, 허용 가능한 수준은 그 점수가 어떤 용도로 사용될 것인지에 전적으로 달려 있습니다. 둘째, 짧은 척도에서 매우 높은 알파값은 보통 문항들이 서로 거의 같은 말을 바꿔 표현한 것에 불과함을 나타내며, 이는 구성개념을 폭넓게 다루는 것을 희생하여 일관성을 얻는 것입니다. "당신은 정리정돈을 잘합니까?"를 약간씩 다른 말로 묻는 열 개의 문항으로 이루어진 척도는 뛰어난 내적 일관성을 가지지만 성실성에 대한 좁은 해석을 제공할 것입니다.
귀하 자신의 점수에 대한 의미
신뢰도는 하나의 수치가 얼마나 많은 신뢰를 받을 자격이 있는지로 직접 환산됩니다. 신뢰도가 0.85인 검사는 두 사람 간의 몇 점 차이, 또는 오늘의 귀하 점수와 지난달 귀하 점수 간의 차이가 신호가 아니라 잡음일 가능성이 매우 높을 정도로 큰 측정 오차를 포함합니다.
이것이 실질적인 결론입니다. 좋은 도구는 자신의 신뢰도를 보고하여 귀하의 점수를 둘러싼 불확실성이 얼마나 넓은지 알 수 있게 합니다. 그 불확실성의 기술적 표현은 측정의 표준오차(standard error of measurement)이며, 이는 신뢰도 계수를 점수 주변의 플러스마이너스 범위로 변환합니다.
신뢰도 수치를 전혀 보고하지 않는 도구가 그렇다고 해서 더 정확한 것은 아닙니다. 그것은 단지 자신이 얼마나 부정확한지 귀하에게 말하기를 거부한 것일 뿐입니다.
직접 검사해 보기
측정에 관한 글을 읽는 것과, 자신의 점수가 그 출처, 규준 표본, 한계와 함께 보고되는 것을 직접 확인하는 것은 다른 경험입니다. 무료로 응시할 수 있으며 가입도 필요하지 않습니다.
계속 읽기
- 심리측정학이란 무엇입니까?심리 측정이 좋은지 아닌지를 판단하는 학문 분야이며, 비슷한 질문을 하는 두 검사가 그 결과의 가치에서 크게 차이가 날 수 있는 이유입니다.
- 심리검사에서 타당도란 무엇입니까?타당도는 검사가 지니고 있는 속성이 아닙니다. 특정 목적을 위한 특정 점수의 특정 해석이 정당화될 수 있는지에 관한 논증이며, 새로운 용도마다 다시 구축되어야 합니다.
- 구성 타당도란 무엇입니까?측정에서 가장 어려운 질문입니다. 귀하가 측정하는 대상이 귀하가 정의한 대로 실제로 존재하는지, 그리고 귀하의 도구가 그 대상에 도달하는지, 아니면 그와 유사한 다른 무언가에 도달하는지에 관한 질문입니다.
- 수렴 타당도와 판별 타당도거울처럼 대칭을 이루는 두 가지 요건이 있습니다. 측정치는 그것이 일치해야 하는 것과 일치해야 하며, 그것이 아니라고 주장하는 것과는 구별되어야 합니다. 대부분의 부실한 도구는 두 번째 요건을 충족하지 못합니다.
- 크론바흐 알파(Cronbach's alpha)란 무엇인가, 그리고 무엇이 아닌가심리 검사에서 가장 많이 보고되는 통계량이면서 가장 잘못 이해되는 통계량입니다. 알파 값은 척도가 단일 차원임을 알려주지 않으며, 높은 값은 흔히 장점이 아니라 증상입니다.
- 측정표준오차: 귀하의 점수가 어느 정도 오차를 가질 수 있는지모든 점수는 오차 범위를 지니며, 대부분의 심리 검사에서 이 범위는 사람들이 생각하는 것보다 넓습니다. 이 수치는 어떤 차이가 실제이고 어떤 차이가 잡음인지를 알려줍니다.
- 규준 및 백분위: 귀하의 점수를 비교하는 대상원점수는 그 자체로는 해석할 수 없습니다. 오직 준거 집단과 비교할 때에만 의미를 갖게 되며, 어떤 집단이 사용되었는지는 어떤 검사에서든 가장 중요하면서도 가장 잘 알려지지 않은 사실 중 하나입니다.
- 심리검사가 실제로 만들어지는 과정구성개념 정의부터 발표된 규준까지, 이 과정은 여러 해가 걸리며 그 안에 투입된 것의 대부분을 버립니다. 이 단계들을 알면 어떤 온라인 간이 퀴즈가 어떤 단계를 건너뛰었는지가 분명해집니다.
- 검사가 '타당화되었다'고 불리는 것은 무엇을 의미합니까?이 단어는 규제되지 않으며, 아무런 작업도 하지 않은 제품들이 자유롭게 사용합니다. 이 용어가 실제로 의미를 가질 때 무엇을 뜻하는지, 그리고 두 경우를 구분하는 네 가지 질문을 소개합니다.
- 인터넷상의 대부분의 성격 검사가 신뢰할 수 없는 이유이는 그들이 부정직해서가 아니라, 측정을 신뢰할 수 있게 만드는 단계들이 보이지 않고 비용이 많이 들며 건너뛰기 쉽기 때문입니다. 그리고 그 단계를 건너뛰어도 결과가 보이는 방식은 전혀 달라지지 않습니다.
- 자기보고가 측정할 수 있는 것과 측정할 수 없는 것설문지는 귀하에게 자기 자신을 관찰하는 역할을 요구하는데, 이 방식은 어떤 대상에는 더 잘 작동하고 어떤 대상에는 그렇지 않습니다. 이 방법이 어디에서 강력하고 어디에서 실패하는지 아는 것은 결과를 읽는 방식을 바꿉니다.
- 검사가 무엇인가를 예측한다는 것의 의미0.30의 상관관계는 성격 연구에서는 강력한 결과이지만, 한 개인에 대한 의사결정의 근거로는 약합니다. 두 진술 모두 참이며, 이 둘 사이의 간극이 검사 결과 오용의 대부분을 유발합니다.
- 선별검사는 진단이 아닙니다선별용 설문지는 가능한 많은 사례를 포착하도록 설계되며, 그 대가로 높은 위양성률을 받아들입니다. 선별 점수를 진단으로 해석하는 것은 그것이 설계된 목적을 정반대로 뒤집는 일입니다.