noesisnoesis
測定の仕組み

クロンバックのα係数とは何か、そして何でないか

心理テストで最も報告される統計量であり、最も誤読される統計量です。αは尺度が一次元であることを示すものではなく、高い値はしばしば美点ではなく症状です。

クロンバックのα係数は内的整合性の係数です。尺度上の項目が互いにどの程度相関しているかを示すものです。1951年に発表され、最も多く報告される心理測定統計量ですが、その普及ぶりは有用性を超えてしまっています。

αは0から1の範囲で、2つのものによって決まります。項目間の平均相関と、項目数です。この2番目の依存性が、ほとんどの誤解の原因です。

高いαが意味しないこと

尺度が一つのことを測定していることを意味しません。 これは最も一般的な誤りです。項目全体の相関が十分に高ければ、2つまたは3つの異なる因子を持つ尺度でもαは高くなり得ます。一次元性は因子分析によって確立する必要があります。αはそれを確立することができませんし、そのために作られたものでもありません。

尺度が妥当であることを意味しません。 αは項目が何を測定しているかについて何も語りません。靴のサイズに関する20の質問は、優れた内的整合性を持ちながら、心理学的なものの測定としてはゼロの妥当性を持つでしょう。

尺度が良いことを意味しません。 αは項目数とともに上昇するため、凡庸な項目の長い尺度が、優れた項目の短い尺度を上回ることがあります。項目間平均相関が0.2の40項目尺度でも、0.90を超えます。

非常に高いαはしばしば警告です。 おおよそ0.95を超えると、項目は通常ほぼ言い換えです。これは構成概念のカバレッジを犠牲にして整合性を得ているのです。つまり、尺度は一つの狭い側面を非常に精密に測定し、構成概念の残りを見逃しています。これは減衰のパラドックスと呼ばれ、より高い整合性が単調に良いわけではない理由です。

αが仮定すること

αは、特定の仮定の下での信頼性の下限です。タウ等価性、つまりすべての項目が基礎となる特性に等しく寄与するという仮定です。実際の尺度がこれを満たすことはほとんどありません。項目は因子への負荷量が異なり、そうなるとαは信頼性を過小評価します。

マクドナルドのオメガは等寄与の仮定を取り除き、実際の因子負荷量から信頼性を推定します。方法論者は20年にわたりαよりもオメガを推奨してきました。しかし、報告慣行の追随は遅く、主にαがすべての統計パッケージで1行で済むのにオメガはそうではないためです。

実践での読み方

おおよその慣例:0.70以上は集団比較の研究に許容可能、0.80以上は応用的使用に、0.90以上は得点が個人の意思決定に影響する場合に。これらは方向性として扱い、閾値としてではありません。必要なレベルは、得点が情報を提供する意思決定の重大さに依存します。

より情報量の多い数値は、通常同じ論文の他の場所にあります。項目間平均相関(0.15から0.50が健全な範囲)は、高いαが項目の質から来たのか量から来たのかを示します。項目数は反対の方向から同じことを示します。再テスト信頼性は、αが構造的に提供できないものを示します。同じ人物において得点が時間を通じて安定しているかどうかです。

αのみを報告する尺度は、取得が最も容易で、合格が最も容易な信頼性指標を報告しています。

実践で確かめる

測定について読むことと、自分のスコアがその出典、ノルムサンプル、限界とともに報告されるのを見ることは別物です。

続きを読む