인터넷상의 대부분의 성격 검사가 신뢰할 수 없는 이유
이는 그들이 부정직해서가 아니라, 측정을 신뢰할 수 있게 만드는 단계들이 보이지 않고 비용이 많이 들며 건너뛰기 쉽기 때문입니다. 그리고 그 단계를 건너뛰어도 결과가 보이는 방식은 전혀 달라지지 않습니다.
무료 온라인 성격 검사와 타당화된 심리측정 도구는 동일하게 보이는 결과물을 산출합니다: 점수, 백분위, 귀하를 설명하는 문단. 그 차이는 결과 화면에서 볼 수 없는 작업에 전적으로 있습니다.
이는 정확히 짚고 넘어갈 필요가 있습니다. 흔히 통용되는 프레이밍, 즉 인터넷 검사는 사기라는 주장은 대체로 틀렸으며 그다지 유용하지도 않기 때문입니다. 대부분의 검사는 속이려는 의도가 없는 사람들에 의해 만들어집니다. 이들은 구조적인 이유로 신뢰할 수 없습니다.
흔히 생략되는 것들
문항 분석. 제대로 구축된 척도에서는 예비 조사 후 초안 문항 대부분이 폐기됩니다. 아무도 응답이 갈리지 않는 문항, 전체 점수와 상관이 낮은 문항, 하나 이상의 요인에 부하되는 문항, 연령대나 언어 집단에 따라 다르게 작동하는 문항 등이 그렇습니다. 예비 조사 없이 작성되어 공개된 검사는 작동하지 않는 문항까지 포함하여 모든 것을 그대로 남겨 둡니다.
독립적인 구조 검증. 척도를 구축한 바로 그 데이터에 대한 요인분석은 귀하가 설계한 구조를 그대로 다시 찾아낼 뿐입니다. 새로운 표본에서 그 구조를 확인하는 것은 별도의 연구이며, 상당수의 척도가 실패하는 단계가 바로 이 지점입니다.
규준. 백분위는 어딘가에서 도출되어야 합니다. 사이트가 참조 모집단을 명시하지 않는다면, 그 수치는 이전 방문자, 즉 구성이 알려지지 않은 자기선택 집단에서 도출되었거나 특별한 근거 없이 산출된 것입니다.
검사-재검사 데이터. 사람들이 다음 달에도 동일한 점수를 받는다는 것을 입증하려면 그들을 다시 찾아내야 합니다. 이를 수행하는 경우는 거의 없으며, 이는 '특성'이라는 단어가 암시하는 안정성이 입증되지 않았다는 의미입니다.
설계상의 인센티브는 잘못된 방향으로 작동한다
참여를 유도하기 위해 만들어진 검사는 정확성을 위해 만들어진 검사와는 다른 결과에 최적화되어 있으며, 이 둘은 예측 가능한 방식으로 서로 어긋납니다.
듣기 좋은 결과가 더 잘 작동합니다. 듣기 싫은 이야기를 하는 결과는 공유가 덜 되므로, 결과는 누구나 자신에게서 발견할 수 있는 설명 쪽으로 쏠리게 됩니다. 이것이 바로 바넘 효과로, 1940년대에 입증되었고 그 이후로도 꾸준히 재현되었습니다: 사람들은 일반적인 성격 설명을 자신에게 특별히 정확하게 들어맞는다고 평가합니다.
유형은 차원보다 더 잘 작동합니다. "귀하는 건축가형입니다"라는 표현은 "귀하는 개방성에서 넓은 신뢰구간을 가진 68백분위입니다"보다 공유하기 쉽습니다. 유형은 또한 측정 오차를 은폐합니다. 범주 경계선 양쪽에서 1점 차이가 나는 사람이 완전히 다른 라벨을 받게 되기 때문입니다.
짧은 검사가 적절한 검사보다 더 잘 작동합니다. 문항이 하나 늘어날 때마다 응답자를 잃게 되므로, 검사는 구성개념을 충분히 다루는 길이가 아니라 완료율을 최대화하는 길이로 잘려나갑니다.
이들 중 어느 것도 거짓말은 아닙니다. 이는 정확성이 아닌 다른 지표에 대한 최적화입니다.
약 30초 안에 판별하는 방법
저자와 연도가 명시된 원본 검사명이 있는지 확인하십시오. 규준이 어떤 모집단에서 나온 것인지에 대한 설명이 있는지 확인하십시오. 한계나 측정 오차에 대한 인정이 있는지 확인하십시오. 결과가 연속 점수인지 범주인지 확인하십시오. 같은 페이지에서 20개의 문항으로 이상적인 직업, 배우자, 인생의 목적까지 알아낼 수 있다고 약속하는지 확인하십시오.
자신의 검사명을 밝히고, 출처를 인용하며, 규준을 명시하고, 무엇을 알려줄 수 없는지 말하는 검사는 필요한 작업을 해낸 것입니다. 이 중 어느 것도 하지 않는 검사도 5분을 즐겁게 보내는 방법이 될 수는 있지만, 그것이 산출하는 수치는 장식일 뿐입니다.
NOESIS 카탈로그의 모든 도구는 어떤 공인된 검사를 구현한 것인지, 누가 작성했는지, 어느 해에 작성했는지, 어떻게 채점되는지, 그리고 그 결과가 무엇을 입증하지 못하는지를 명시합니다. 마지막 부분이야말로 비교해 볼 가치가 있는 부분입니다.
직접 검사해 보기
측정에 관한 글을 읽는 것과, 자신의 점수가 그 출처, 규준 표본, 한계와 함께 보고되는 것을 직접 확인하는 것은 다른 경험입니다. 무료로 응시할 수 있으며 가입도 필요하지 않습니다.
계속 읽기
- 심리측정학이란 무엇입니까?심리 측정이 좋은지 아닌지를 판단하는 학문 분야이며, 비슷한 질문을 하는 두 검사가 그 결과의 가치에서 크게 차이가 날 수 있는 이유입니다.
- 심리검사에서 신뢰도란 무엇입니까?신뢰도는 측정의 일관성이며, 정확성이 아닙니다. 검사는 신뢰도가 매우 높으면서도 여전히 잘못된 대상을 측정할 수 있습니다. 이것이 신뢰도가 가장 먼저 묻는 질문이지 결코 마지막 질문이 아닌 이유입니다.
- 심리검사에서 타당도란 무엇입니까?타당도는 검사가 지니고 있는 속성이 아닙니다. 특정 목적을 위한 특정 점수의 특정 해석이 정당화될 수 있는지에 관한 논증이며, 새로운 용도마다 다시 구축되어야 합니다.
- 구성 타당도란 무엇입니까?측정에서 가장 어려운 질문입니다. 귀하가 측정하는 대상이 귀하가 정의한 대로 실제로 존재하는지, 그리고 귀하의 도구가 그 대상에 도달하는지, 아니면 그와 유사한 다른 무언가에 도달하는지에 관한 질문입니다.
- 수렴 타당도와 판별 타당도거울처럼 대칭을 이루는 두 가지 요건이 있습니다. 측정치는 그것이 일치해야 하는 것과 일치해야 하며, 그것이 아니라고 주장하는 것과는 구별되어야 합니다. 대부분의 부실한 도구는 두 번째 요건을 충족하지 못합니다.
- 크론바흐 알파(Cronbach's alpha)란 무엇인가, 그리고 무엇이 아닌가심리 검사에서 가장 많이 보고되는 통계량이면서 가장 잘못 이해되는 통계량입니다. 알파 값은 척도가 단일 차원임을 알려주지 않으며, 높은 값은 흔히 장점이 아니라 증상입니다.
- 측정표준오차: 귀하의 점수가 어느 정도 오차를 가질 수 있는지모든 점수는 오차 범위를 지니며, 대부분의 심리 검사에서 이 범위는 사람들이 생각하는 것보다 넓습니다. 이 수치는 어떤 차이가 실제이고 어떤 차이가 잡음인지를 알려줍니다.
- 규준 및 백분위: 귀하의 점수를 비교하는 대상원점수는 그 자체로는 해석할 수 없습니다. 오직 준거 집단과 비교할 때에만 의미를 갖게 되며, 어떤 집단이 사용되었는지는 어떤 검사에서든 가장 중요하면서도 가장 잘 알려지지 않은 사실 중 하나입니다.
- 심리검사가 실제로 만들어지는 과정구성개념 정의부터 발표된 규준까지, 이 과정은 여러 해가 걸리며 그 안에 투입된 것의 대부분을 버립니다. 이 단계들을 알면 어떤 온라인 간이 퀴즈가 어떤 단계를 건너뛰었는지가 분명해집니다.
- 검사가 '타당화되었다'고 불리는 것은 무엇을 의미합니까?이 단어는 규제되지 않으며, 아무런 작업도 하지 않은 제품들이 자유롭게 사용합니다. 이 용어가 실제로 의미를 가질 때 무엇을 뜻하는지, 그리고 두 경우를 구분하는 네 가지 질문을 소개합니다.
- 자기보고가 측정할 수 있는 것과 측정할 수 없는 것설문지는 귀하에게 자기 자신을 관찰하는 역할을 요구하는데, 이 방식은 어떤 대상에는 더 잘 작동하고 어떤 대상에는 그렇지 않습니다. 이 방법이 어디에서 강력하고 어디에서 실패하는지 아는 것은 결과를 읽는 방식을 바꿉니다.
- 검사가 무엇인가를 예측한다는 것의 의미0.30의 상관관계는 성격 연구에서는 강력한 결과이지만, 한 개인에 대한 의사결정의 근거로는 약합니다. 두 진술 모두 참이며, 이 둘 사이의 간극이 검사 결과 오용의 대부분을 유발합니다.
- 선별검사는 진단이 아닙니다선별용 설문지는 가능한 많은 사례를 포착하도록 설계되며, 그 대가로 높은 위양성률을 받아들입니다. 선별 점수를 진단으로 해석하는 것은 그것이 설계된 목적을 정반대로 뒤집는 일입니다.