noesisnoesis
كيف يعمل القياس

الخطأ المعياري للقياس: مقدار الانحراف المحتمل في درجتك

تحمل كل درجة هامش خطأ، وفي معظم الاختبارات النفسية يكون هذا الهامش أوسع مما يفترضه الناس. هذا هو الرقم الذي يُخبرك متى يكون الفرق حقيقياً ومتى يكون مجرد تشويش.

يحوّل الخطأ المعياري للقياس معامل الثبات المجرد إلى شيء ملموس: نطاق زائد أو ناقص حول الدرجة. وهو يجيب عن السؤال الذي تتركه معظم شاشات النتائج دون إجابة: إلى أي مدى كان يمكن أن يختلف هذا الرقم لو خضعت لهذا الاختبار في مساء آخر؟

المعادلة بسيطة. اضرب الانحراف المعياري للمقياس في الجذر التربيعي لواحد ناقص ثباته. بالنسبة إلى مقياس انحرافه المعياري 10 وثباته 0.85، يكون الخطأ المعياري نحو 3.9 نقطة.

ما الذي يمثله هذا النطاق بالفعل

في نحو ثلثي الحالات، تقع المنزلة الحقيقية للشخص ضمن خطأ معياري واحد من درجته المرصودة. وللوصول إلى ثقة تبلغ نحو 95 بالمائة، تحتاج إلى نحو خطأين معياريين على كل جانب.

لنأخذ المثال أعلاه. يحصل شخص على درجة 62. تمتد فترة الثقة البالغة 95 بالمائة من نحو 54 إلى 70. وهذه نافذة قدرها ست عشرة نقطة على مقياس قد يكون فيه الفرق النموذجي بين المتوسط وما هو أعلى من المتوسط بوضوح نحو عشر نقاط.

وهذا ليس عيبًا في ذلك الاختبار بعينه. فثبات قدره 0.85 يُعد جيدًا. إنه المستوى الطبيعي لدقة القياس النفسي، وهو السبب في أن التقارير الدقيقة تعرض نطاقات لا درجات مفردة.

نتائج يغفل عنها الناس

الفروق الصغيرة بين المقاييس غالبًا لا معنى لها. فإذا كانت درجتك في الانبساطية 58 ودرجتك في الانفتاح 54، فالقراءة الصادقة هي أنه لا يمكن التمييز بينهما. وتفسيرات الملامح الشخصية التي تبني سردًا من فروق قدرها أربع نقاط إنما تقرأ ضجيجًا إحصائيًا.

والتغيرات الصغيرة عبر الزمن غالبًا لا معنى لها أيضًا. فإعادة الخضوع لاختبار والتحرك خمس نقاط يقع ضمن حدود الخطأ في معظم الأدوات. أما التغير الحقيقي في السمة فيحدث على مدى سنوات ويظهر كحركة تتجاوز نطاق الخطأ بوضوح، وليس كبضع نقاط من شهر إلى آخر.

والترتيب النسبي يضخّم المشكلة. فقد يُحرّك فرقٌ من بضع نقاط خام شخصًا عشرة مراتب في المئين في الجزء الكثيف الأوسط من التوزيع، لأن معظم الناس يقعون هناك. وتبدو رتب المئين دقيقة في حين أنها أقل الطرق ثباتًا للتعبير عن الدرجة.

والدقة ليست موحدة عبر المقياس. فنظرية الاختبار الكلاسيكية تفترض قيمة خطأ واحدة لكل درجة، وهذا تبسيط. أما نظرية استجابة البند فتُنمذج الخطأ بشكل مستقل عند كل مستوى من السمة، وهو في الغالب أكبر عند الطرفين المتناهيين: أي عند النقطة التي تُصاغ فيها التفسيرات الأكثر أهمية. فالدرجة المرتفعة جدًا أو المنخفضة جدًا تكون عادة أقل دقة من الدرجة المتوسطة، لا أكثر دقة منها.

لماذا يبدو التقرير الصادق أقل إثارة للإعجاب

تبدو الأداة التي تعرض نطاقات ثقة أقل وضوحًا من تلك التي تعرض رقمًا مفردًا بمنزلة عشرية واحدة. والأداة الأقل وضوحًا هي التي تقول الحقيقة، أما الأداة التي تبدو دقيقة فتحمل نفس الخطأ الكامن وقد اختارت ألا تُظهره.

وهذا أمر يستحق أن يُستحضر عند مقارنة اختبار موثّق علميًا بمنتج تجاري يصنّفك في فئة معينة. فحدّ الفئة يقع عند درجة محددة، وشخص أدنى منها بنقطة واحدة وشخص أعلى منها بنقطة واحدة هما، من الناحية الإحصائية، الشخص نفسه. ويُخفي وسم النمط هذا الأمر تمامًا، وهذا أحد أكثر الحجج جدية ضد الأدوات القائمة على الأنماط، وهو السبب في أن الدرجات المتصلة مع بيان الخطأ هي المعيار المعتمد في البحث العلمي.

جرّب الأمر بنفسك

القراءة عن القياس شيء، ورؤية درجتك الخاصة موضّحة بمصدرها وعيّنتها المعيارية وحدودها شيء آخر. مجاني تماماً، دون حاجة إلى تسجيل.

استمر في القراءة