ماذا يعني أن يتنبأ اختبار بشيء ما
يُعد الارتباط بمقدار 0.30 نتيجة قوية في أبحاث الشخصية، وأساساً ضعيفاً لاتخاذ قرار بشأن شخص واحد. كلا القولين صحيح، والفجوة بينهما هي سبب معظم حالات سوء استخدام نتائج الاختبارات.
تشير أبحاث الشخصية إلى أن الضمير الحي يتنبأ بالأداء الوظيفي. عند قراءة هذه الجملة، يتخيل معظم الناس شيئاً أقوى بكثير مما تُظهره البيانات. الفجوة بين الزعم الإحصائي والمعنى اليومي لكلمة «يتنبأ» هي حيث يبدأ معظم سوء استخدام الاختبارات النفسية.
الأرقام المعنية
أحجام الأثر في أبحاث الشخصية تُعرض عادةً في صورة معاملات ارتباط. تميل قيم التحليل التلوي للعلاقات الراسخة إلى الانحصار بين 0.20 و0.35. يقع الارتباط بين الضمير الحي والأداء الوظيفي في حدود 0.20 إلى 0.25. ويقع الارتباط بين الرضا الوظيفي والأداء الوظيفي عند نحو 0.30. أما القدرة العقلية العامة، أقوى مؤشر منفرد في هذا الميدان، فتصل إلى نحو 0.50 في الأعمال المعقدة.
إذا رفعت معامل الارتباط إلى القوة الثانية حصلت على نسبة التباين المُفسَّر. فمعامل ارتباط قدره 0.25 يفسر نحو ستة بالمئة من الفروق بين الأشخاص. أما الأربعة والتسعون بالمئة الباقية فمصدرها أمور أخرى: القدرة، والفرصة، والتدريب، والإدارة، والصحة، والحظ.
لماذا يبقى 0.25 نتيجة حقيقية مع ذلك
على مستوى المجموعات السكانية، تُنتج معاملات الارتباط الصغيرة آثاراً تجميعية كبيرة. فإذا كنت تنتخب ألف شخص، فإن مؤشراً تنبؤياً بقيمة 0.25 يحسّن متوسط النتيجة بشكل قابل للقياس ومتكرر. وتبني شركات التأمين وعلماء الأوبئة ممارسات كاملة على آثار من هذا الحجم.
لكن المشكلة أن الفائدة التجميعية والتنبؤ الفردي كميتان مختلفتان. فمعامل ارتباط قدره 0.25 يعني أن عدد من يحققون أداءً جيداً بين أصحاب الدرجات المرتفعة أكبر من عددهم بين أصحاب الدرجات المنخفضة؛ ويعني أيضاً أن عدداً كبيراً من أصحاب الدرجات المرتفعة سيؤدون أداءً ضعيفاً، وأن عدداً كبيراً من أصحاب الدرجات المنخفضة سيتفوقون. وكلا القولين ينبع من نفس الرقم.
الحالة الفردية
هذه هي الخطوة التي يجري تجاوزها غالباً. فالارتباط يصف العلاقة بين توزيعين، ولا يخوّل إصدار أي قول بشأن شخص معين.
فإذا كان ارتباط الضمير الحي بالأداء يبلغ 0.25، فإن معرفة درجة شخص ما على الضمير الحي لا تُضيّق المدى المحتمل لأدائه إلا قليلاً. ويبقى فاصل التنبؤ الخاص بفرد واحد واسعاً بما يكفي ليشمل تقريباً كامل مدى النتائج. فإذا قيل لك إنك في المئين الثمانين على الضمير الحي، فإن ذلك لا يخبرك إلا بقدر ضئيل جداً عن كيفية أدائك في وظيفة معينة.
لهذا السبب فإن استخدام درجات الشخصية كمرشِّح رئيسي للاختيار لا يجد دعماً كافياً حتى عندما تكون الأبحاث الأساسية سليمة. فالأبحاث تدعم الزعم بأن السمة ذات أهمية، ولا تدعم الزعم بأن الدرجة تخبرك بما سيفعله المتقدم للوظيفة.
تحذيران إضافيان
التنبؤ والتسبب أمران مختلفان. فمعظم هذه الأدبيات ارتباطية. وكون الضمير الحي يتنبأ بنتائج صحية أمر يتوافق مع أن الضمير الحي يسبب سلوكاً صحياً أفضل، ومع أن عاملاً ثالثاً يسبب الاثنين معاً، ومع السببية العكسية. وتُضيّق التصاميم الطولية دائرة الاحتمالات؛ لكنها نادراً ما تغلقها تماماً.
معايير التقرير الذاتي تُضخّم الأرقام. فعندما يكون المؤشر التنبؤي والنتيجة كلاهما مُقيَّماً ذاتياً من الشخص نفسه في نفس فترة ما بعد الظهر، فإن تباين الطريقة المشتركة يرفع معامل الارتباط. وتفيد الدراسات التي تستخدم نتائج موضوعية أو تقييمات من مُخبِرين خارجيين عادةً بآثار أصغر، وهذه هي الدراسات التي ينبغي إعطاؤها الوزن الأكبر.
ما الذي تفيد فيه الدرجة فعلاً
إذا قُرئت درجة الاختبار كوصف لا كنبوءة، فإنها تكون مفيدة بحق. فهي تُبيّن لك موقعك بالنسبة إلى مجموعة مرجعية على سمة ذات نتائج موثّقة، وتمنحك مفردات لوصف نمط قد تكون لاحظته من قبل دون أن تستطيع تسميته.
وهذا أمر يستحق أن تحصل عليه. لكنه شيء مختلف عن التنبؤ، وهذا التمييز ينبغي أن يوضحه لك تقرير أمين لا أن يتركك تستنتجه بنفسك.
جرّب الأمر بنفسك
القراءة عن القياس شيء، ورؤية درجتك الخاصة موضّحة بمصدرها وعيّنتها المعيارية وحدودها شيء آخر. مجاني تماماً، دون حاجة إلى تسجيل.
استمر في القراءة
- ما هو علم القياس النفسي؟التخصص الذي يحدد ما إذا كان قياس نفسي جيداً أم لا، والسبب في أن اختبارين يطرحان أسئلة متشابهة قد يختلفان اختلافاً كبيراً في قيمة نتائجهما.
- ما هو الثبات في الاختبارات النفسية؟الثبات هو اتساق القياس، لا صحته. يمكن أن يكون الاختبار عالي الثبات ومع ذلك يقيس الشيء الخاطئ؛ وهذا هو السبب في أنه أول سؤال يُطرح وليس الأخير أبداً.
- ما هو الصدق في الاختبارات النفسية؟الصدق ليس خاصية يمتلكها الاختبار. إنه حجة حول ما إذا كان تفسير معين لدرجة معينة، لغرض معين، قابلاً للدفاع عنه؛ ويجب إعادة بنائه مع كل استخدام جديد.
- ما هو صدق البناء؟السؤال الأصعب في القياس: هل الشيء الذي تقيسه موجود كما عرّفته، وهل تصل أداتك إليه بدلاً من شيء مجاور له.
- الصدق التقاربي والصدق التمييزيشرطان متقابلان: يجب أن يتوافق المقياس مع ما ينبغي أن يتوافق معه، ويجب أن يبقى متمايزاً عما يزعم أنه ليسه. معظم الأدوات الضعيفة تفشل في الشرط الثاني.
- ما هو معامل ألفا لكرونباخ: وما لا يمثلهالإحصائية الأكثر ذكراً في الاختبارات النفسية، والأكثر سوء فهم. معامل ألفا لا يُخبرك بأن المقياس أحادي البُعد، والقيمة المرتفعة غالباً ما تكون عرَضاً وليست ميزة.
- الخطأ المعياري للقياس: مقدار الانحراف المحتمل في درجتكتحمل كل درجة هامش خطأ، وفي معظم الاختبارات النفسية يكون هذا الهامش أوسع مما يفترضه الناس. هذا هو الرقم الذي يُخبرك متى يكون الفرق حقيقياً ومتى يكون مجرد تشويش.
- المعايير والمئينات: ما تُقارَن به درجتكلا يمكن تفسير الدرجة الخام بمفردها. فهي لا تصبح ذات معنى إلا بالمقارنة مع مجموعة مرجعية؛ وأي مجموعة استُخدمت هي من أهم الحقائق وأقلها إعلاناً بشأن أي اختبار.
- كيف يُبنى الاختبار السيكومتري في الواقعمن تعريف البِنية إلى نشر المعايير، تستغرق هذه السلسلة سنوات وتتخلص من معظم ما يدخل فيها. معرفة هذه الخطوات تجعل من الواضح أيها تجاوزه اختبار سريع على الإنترنت.
- ما المقصود بأن يكون الاختبار موثوق الصدق؟هذا المصطلح غير منظّم ويُستخدم بحرية من منتجات لم تقم بأي من العمل اللازم. هذا هو معناه عندما يكون له معنى، والأسئلة الأربعة التي تفصل بين الحالتين.
- لماذا لا تُعد معظم اختبارات الشخصية على الإنترنت موثوقةليس لأنها غير أمينة، بل لأن الخطوات التي تجعل القياس موثوقاً غير مرئية ومكلفة وسهلة التجاوز، وتجاوزها لا يغيّر شيئاً في شكل النتيجة الظاهر.
- ما يمكن للتقرير الذاتي قياسه وما لا يمكنه قياسهتطلب منك الاستبيانات أن تكون المراقب لنفسك، وهذا ينجح في بعض الأمور أكثر من غيرها. معرفة أين تكون هذه الطريقة قوية وأين تفشل تغيّر طريقة قراءتك لأي نتيجة.
- الفحص المسحي ليس تشخيصًايُبنى استبيان الفحص لرصد أكبر عدد ممكن من الحالات المحتملة، متقبلاً معدل إيجابيات كاذبة مرتفعاً كثمن لذلك. قراءة درجة الفحص كتشخيص تعكس ما صُمم من أجله أصلاً.