noesisnoesis
اندازه‌گیری چگونه کار می‌کند

چرا بیشتر آزمون‌های شخصیت اینترنتی پایا نیستند

نه از آن رو که صادق نیستند، بلکه از آن رو که گام‌هایی که یک اندازه‌گیری را قابل‌اعتماد می‌کنند دیده نمی‌شوند، پرهزینه‌اند و نادیده گرفتنشان آسان است؛ و نادیده گرفتن آن‌ها هیچ تغییری در ظاهر نتیجه ایجاد نمی‌کند.

یک آزمون شخصیت رایگان آنلاین و یک ابزار روان‌سنجی اعتبارسنجی‌شده خروجی‌هایی تولید می‌کنند که ظاهراً یکسان‌اند: یک نمره، یک صدک، و یک پاراگراف که شما را توصیف می‌کند. تفاوت کاملاً در کاری است که از صفحهٔ نتایج دیده نمی‌شود.

دقیق بودن در این مورد اهمیت دارد، چون چارچوب رایج، یعنی اینکه آزمون‌های اینترنتی کلاهبرداری‌اند، بیشتر نادرست است و چندان کمکی نمی‌کند. بیشتر این آزمون‌ها را کسانی ساخته‌اند که قصد فریب نداشته‌اند. آن‌ها به دلایل ساختاری ناپایا هستند.

معمولاً چه چیزهایی نادیده گرفته می‌شود

تحلیل گویه‌ها. در یک مقیاس درست ساخته‌شده، بیشتر گویه‌های پیش‌نویس پس از اجرای آزمایشی کنار گذاشته می‌شوند: گویه‌هایی که هیچ‌کس در آن‌ها تفاوتی نشان نمی‌دهد، گویه‌هایی که همبستگی ضعیفی با نمرهٔ کل دارند، گویه‌هایی که روی بیش از یک عامل بار می‌گیرند، و گویه‌هایی که در گروه‌های سنی یا زبانی مختلف رفتار متفاوتی دارند. آزمونی که بدون اجرای آزمایشی نوشته و منتشر شده باشد، همه چیز را نگه داشته است، از جمله گویه‌هایی که کار نمی‌کنند.

تأیید مستقل ساختار. تحلیل عاملی روی دادهای که مقیاس از آن ساخته شده است، همان ساختاری را که طراحی کرده‌اید بازیابی می‌کند. تأیید آن در یک نمونهٔ تازه مطالعه‌ای جداگانه است، و این همان مرحله‌ای است که بخش بزرگی از مقیاس‌ها در آن شکست می‌خورند.

هنجارها. صدک باید از جایی آمده باشد. اگر سایت جامعهٔ مرجع خود را مشخص نکند، عدد یا از بازدیدکنندگان قبلی به دست آمده است، که گروهی خودانتخاب‌شده با ترکیبی نامعلوم هستند، یا از هیچ منبع مشخصی.

داده‌های بازآزمایی. اثبات اینکه افراد ماه بعد نیز همان نمره را می‌گیرند مستلزم دوباره پیدا کردن آن‌هاست. تقریباً هیچ‌کس این کار را نمی‌کند، یعنی پایداری‌ای که واژهٔ «صفت» القا می‌کند نشان داده نشده است.

انگیزه‌های طراحی در جهت اشتباه عمل می‌کنند

آزمونی که برای جلب مخاطب ساخته شده برای نتیجه‌ای متفاوت از آزمونی که برای دقت ساخته شده بهینه می‌شود، و این دو به شیوه‌هایی قابل پیش‌بینی از هم دور می‌شوند.

نتایج تملق‌آمیز عملکرد بهتری دارند. نتیجه‌ای که چیزی ناخوشایند به شما بگوید کمتر به اشتراک گذاشته می‌شود، بنابراین نتایج به سمت توصیف‌هایی میل می‌کنند که همه خود را در آن‌ها می‌بینند. این همان اثر بارنوم است که در دهه 1940 نشان داده شد و از آن زمان بارها تکرار شده است: افراد توصیف‌های کلی از شخصیت را دربارهٔ خودشان بسیار دقیق ارزیابی می‌کنند.

انواع (تیپ‌ها) بهتر از ابعاد عمل می‌کنند. «شما یک معمار هستید» بیشتر از «شما در صدک 68 گشودگی هستید، با فاصلهٔ اطمینان گسترده» قابل اشتراک‌گذاری است. انواع همچنین خطای اندازه‌گیری را پنهان می‌کنند، چون فردی که یک نمره بالاتر یا پایین‌تر از مرز یک دسته باشد برچسبی کاملاً متفاوت می‌گیرد.

کوتاه بودن بهتر از کافی بودن عمل می‌کند. هر پرسش اضافی تعدادی پاسخ‌دهنده را از دست می‌دهد، بنابراین آزمون‌ها به طولی کاهش می‌یابند که تکمیل را بیشینه کند، نه طولی که سازه را پوشش دهد.

هیچ‌کدام از این‌ها دروغ نیستند. آن‌ها بهینه‌سازی برای معیاری غیر از دقت‌اند.

چگونه در حدود سی ثانیه تشخیص دهیم

به دنبال یک ابزار منبع نام‌برده‌شده با نویسندگان و سال انتشار باشید. بررسی کنید که آیا جامعه‌ای که هنجارها از آن می‌آیند ذکر شده است. ببینید آیا به محدودیت‌ها یا خطای اندازه‌گیری اشاره‌ای شده است. ببینید نتیجه یک نمرهٔ پیوسته است یا یک دسته. ببینید آیا همان صفحه وعده می‌دهد که شغل ایده‌آل، شریک زندگی یا هدف زندگی شما را از روی بیست پرسش تشخیص دهد.

آزمونی که ابزار خود را نام ببرد، منبعش را ذکر کند، هنجارهایش را مشخص کند و بگوید چه چیزی را نمی‌تواند به شما بگوید، کار لازم را انجام داده است. آزمونی که هیچ‌یک از این‌ها را نداشته باشد، شاید همچنان راه خوشایندی برای گذراندن پنج دقیقه باشد، اما عددی که تولید می‌کند تزئینی است.

هر ابزار موجود در فهرست آزمون‌های NOESIS مشخص می‌کند که کدام آزمون منتشرشده را اجرا می‌کند، چه کسی آن را نوشته، در چه سالی، چگونه نمره‌گذاری می‌شود، و نتایج آن چه چیزهایی را اثبات نمی‌کنند. همان بخش آخر است که ارزش مقایسه دارد.

خودتان را بیازمایید

خواندن دربارهٔ سنجش یک چیز است و دیدن نمرهٔ خودتان همراه با منبع، نمونهٔ هنجار و محدودیت‌هایش چیز دیگری. شرکت در آزمون رایگان است و نیازی به ثبت‌نام نیست.

ادامه مطالعه