لماذا لا تُعد معظم اختبارات الشخصية على الإنترنت موثوقة
ليس لأنها غير أمينة، بل لأن الخطوات التي تجعل القياس موثوقاً غير مرئية ومكلفة وسهلة التجاوز، وتجاوزها لا يغيّر شيئاً في شكل النتيجة الظاهر.
يُنتج اختبار شخصية مجاني على الإنترنت وأداة نفسية مقننة نتائج تبدو متطابقة: درجة، ونسبة مئين، وفقرة تصفك. لكن الفرق يكمن كلياً في عمل لا يمكنك رؤيته من شاشة النتائج.
هذا يستحق الدقة، لأن التوصيف المعتاد، وهو أن الاختبارات على الإنترنت عمليات نصب، خاطئ في معظمه وغير مفيد كثيراً. أغلبها يصنعه أشخاص لا نية خداع لديهم. إنها غير موثوقة لأسباب بنيوية.
ما يُتجاهَل غالباً
تحليل البنود. في مقياس مبني بشكل صحيح، تُستبعد معظم البنود المُعدَّة مسبقاً بعد التجربة الاستطلاعية: البنود التي لا يتباين الناس فيها، والبنود التي ترتبط ضعيفاً بالمجموع الكلي، والبنود التي تحمل على أكثر من عامل واحد، والبنود التي تتصرف بشكل مختلف بين الفئات العمرية أو اللغوية. اختبار كُتب ونُشر دون تجربة استطلاعية يحتفظ بكل شيء، بما في ذلك البنود التي لا تعمل.
التأكيد البنيوي المستقل. التحليل العاملي على البيانات التي بنيت المقياس منها سيستعيد البنية التي صممتها أنت. تأكيد ذلك في عينة جديدة هو دراسة منفصلة، وهي الخطوة التي تفشل فيها نسبة كبيرة من المقاييس.
المعايير. يجب أن تأتي النسبة المئين من مكان ما. إذا لم يذكر الموقع مجتمعه المرجعي، فإن الرقم مستمد إما من زوار سابقين، وهم مجموعة اختارت نفسها بتكوين غير معروف، أو من لا شيء محدد.
بيانات إعادة الاختبار. إثبات أن الأشخاص يحصلون على نفس الدرجة الشهر القادم يتطلب إيجادهم مرة أخرى. لا يفعل ذلك أحد تقريباً، وهذا يعني أن الاستقرار الذي تشير إليه كلمة «سمة» لم يُثبت.
حوافز التصميم تسير في الاتجاه الخاطئ
اختبار بُني من أجل التفاعل يُحسَّن لنتيجة مختلفة عن اختبار بُني من أجل الدقة، والاثنان يتباعدان بطرق يمكن التنبؤ بها.
النتائج المُطرية تحقق أداءً أفضل. النتيجة التي تخبرك بشيء غير مرغوب فيه تُشارَك أقل، فتنجرف النتائج نحو أوصاف يتعرف عليها الجميع في أنفسهم. هذا هو تأثير بارنوم، الذي أُثبت في الأربعينيات وأُعيد إثباته بثبات منذ ذلك الحين: يقيّم الناس الأوصاف العامة للشخصية على أنها دقيقة للغاية بشأنهم على وجه التحديد.
الأنماط تحقق أداءً أفضل من الأبعاد. عبارة «أنت مهندس معماري» أكثر قابلية للمشاركة من عبارة «أنت عند المئين 68 على الانفتاح بفاصل ثقة واسع». تُخفي الأنماط أيضاً خطأ القياس، إذ يحصل شخص يبعد نقطة واحدة عن أي جانب من حدود الفئة على تصنيف مختلف تماماً.
القصر يحقق أداءً أفضل من الكفاية. كل سؤال إضافي يفقد مستجيبين، فتُقلَّص الاختبارات إلى طول يُعظِّم نسبة الإكمال بدلاً من طول يغطي البنية المقاسة بشكل كافٍ.
لا شيء من هذا كذب. إنه تحسين لمقياس آخر غير الدقة.
كيف تعرف الفرق في نحو ثلاثين ثانية
ابحث عن أداة مصدرية مُسمّاة مع مؤلفين وسنة نشر. ابحث عن بيان يوضح من أي مجتمع أُخذت المعايير. ابحث عن أي إقرار بالقيود أو خطأ القياس. تحقق إن كانت النتيجة درجة متصلة أم فئة. تحقق إن كانت الصفحة نفسها تعد أيضاً بتحديد مهنتك المثالية أو شريكك أو هدفك في الحياة من عشرين سؤالاً.
الاختبار الذي يسمي أداته، ويذكر مصدره، ويوضح معاييره، ويبين ما لا يمكنه إثباته، قد قام بالعمل المطلوب. أما الذي لا يفعل شيئاً من ذلك فقد يظل طريقة لطيفة لقضاء خمس دقائق، لكن الرقم الذي يُنتجه مجرد زينة.
كل أداة في فهرس NOESIS تذكر أي اختبار منشور تطبقه، ومن كتبه، وفي أي سنة، وكيف يُحسب، وما لا تثبته نتائجه. هذا الجزء الأخير هو ما يستحق المقارنة.
جرّب الأمر بنفسك
القراءة عن القياس شيء، ورؤية درجتك الخاصة موضّحة بمصدرها وعيّنتها المعيارية وحدودها شيء آخر. مجاني تماماً، دون حاجة إلى تسجيل.
استمر في القراءة
- ما هو علم القياس النفسي؟التخصص الذي يحدد ما إذا كان قياس نفسي جيداً أم لا، والسبب في أن اختبارين يطرحان أسئلة متشابهة قد يختلفان اختلافاً كبيراً في قيمة نتائجهما.
- ما هو الثبات في الاختبارات النفسية؟الثبات هو اتساق القياس، لا صحته. يمكن أن يكون الاختبار عالي الثبات ومع ذلك يقيس الشيء الخاطئ؛ وهذا هو السبب في أنه أول سؤال يُطرح وليس الأخير أبداً.
- ما هو الصدق في الاختبارات النفسية؟الصدق ليس خاصية يمتلكها الاختبار. إنه حجة حول ما إذا كان تفسير معين لدرجة معينة، لغرض معين، قابلاً للدفاع عنه؛ ويجب إعادة بنائه مع كل استخدام جديد.
- ما هو صدق البناء؟السؤال الأصعب في القياس: هل الشيء الذي تقيسه موجود كما عرّفته، وهل تصل أداتك إليه بدلاً من شيء مجاور له.
- الصدق التقاربي والصدق التمييزيشرطان متقابلان: يجب أن يتوافق المقياس مع ما ينبغي أن يتوافق معه، ويجب أن يبقى متمايزاً عما يزعم أنه ليسه. معظم الأدوات الضعيفة تفشل في الشرط الثاني.
- ما هو معامل ألفا لكرونباخ: وما لا يمثلهالإحصائية الأكثر ذكراً في الاختبارات النفسية، والأكثر سوء فهم. معامل ألفا لا يُخبرك بأن المقياس أحادي البُعد، والقيمة المرتفعة غالباً ما تكون عرَضاً وليست ميزة.
- الخطأ المعياري للقياس: مقدار الانحراف المحتمل في درجتكتحمل كل درجة هامش خطأ، وفي معظم الاختبارات النفسية يكون هذا الهامش أوسع مما يفترضه الناس. هذا هو الرقم الذي يُخبرك متى يكون الفرق حقيقياً ومتى يكون مجرد تشويش.
- المعايير والمئينات: ما تُقارَن به درجتكلا يمكن تفسير الدرجة الخام بمفردها. فهي لا تصبح ذات معنى إلا بالمقارنة مع مجموعة مرجعية؛ وأي مجموعة استُخدمت هي من أهم الحقائق وأقلها إعلاناً بشأن أي اختبار.
- كيف يُبنى الاختبار السيكومتري في الواقعمن تعريف البِنية إلى نشر المعايير، تستغرق هذه السلسلة سنوات وتتخلص من معظم ما يدخل فيها. معرفة هذه الخطوات تجعل من الواضح أيها تجاوزه اختبار سريع على الإنترنت.
- ما المقصود بأن يكون الاختبار موثوق الصدق؟هذا المصطلح غير منظّم ويُستخدم بحرية من منتجات لم تقم بأي من العمل اللازم. هذا هو معناه عندما يكون له معنى، والأسئلة الأربعة التي تفصل بين الحالتين.
- ما يمكن للتقرير الذاتي قياسه وما لا يمكنه قياسهتطلب منك الاستبيانات أن تكون المراقب لنفسك، وهذا ينجح في بعض الأمور أكثر من غيرها. معرفة أين تكون هذه الطريقة قوية وأين تفشل تغيّر طريقة قراءتك لأي نتيجة.
- ماذا يعني أن يتنبأ اختبار بشيء مايُعد الارتباط بمقدار 0.30 نتيجة قوية في أبحاث الشخصية، وأساساً ضعيفاً لاتخاذ قرار بشأن شخص واحد. كلا القولين صحيح، والفجوة بينهما هي سبب معظم حالات سوء استخدام نتائج الاختبارات.
- الفحص المسحي ليس تشخيصًايُبنى استبيان الفحص لرصد أكبر عدد ممكن من الحالات المحتملة، متقبلاً معدل إيجابيات كاذبة مرتفعاً كثمن لذلك. قراءة درجة الفحص كتشخيص تعكس ما صُمم من أجله أصلاً.