نفسیاتی ٹیسٹ میں صداقت کیا ہے؟
صداقت کوئی ایسی خصوصیت نہیں جو ٹیسٹ کے پاس ہوتی ہے۔ یہ ایک دلیل ہے کہ کسی مخصوص اسکور کی کسی مخصوص مقصد کے لیے کی گئی کوئی خاص تشریح کس حد تک قابلِ دفاع ہے، اور ہر نئے استعمال کے لیے اسے دوبارہ تعمیر کرنا پڑتا ہے۔
صداقت یہ سوال اٹھاتی ہے کہ کیا کوئی ٹیسٹ وہی چیز ناپتا ہے جس کے ناپنے کا وہ دعویٰ کرتا ہے، اور کیا اس کے اسکور سے لوگ جو نتائج اخذ کرتے ہیں وہ جائز ہیں۔ یہ نفسیاتی پیمائش کا مرکزی سوال ہے، اور اس کا جواب اکثر شواہد کے بجائے تشہیری دعوے سے دیا جاتا ہے۔
جدید فہم، جو 1980 کی دہائی میں Messick کے کام کے بعد سے قائم ہے، یہ ہے کہ صداقت کسی آلۂ پیمائش کی مستقل خصوصیت نہیں ہے۔ یہ اسکور کی ایک تشریح کی خصوصیت ہے جو کسی مخصوص استعمال کے لیے ہو۔ ایک ہی سوالنامہ کسی شخص کے اپنے بارے میں تاثر بیان کرنے کے لیے بخوبی جانچا ہوا ہو سکتا ہے اور یہ فیصلہ کرنے کے لیے کہ اسے ملازمت دی جائے یا نہیں، بالکل غیر جانچا ہوا۔ یہ کہنا کہ "یہ ٹیسٹ درست ہے" اور یہ نہ بتانا کہ کس مقصد کے لیے درست ہے، کوئی دعویٰ نہیں؛ یہ محض ایک نعرہ ہے۔
شواہد کی اقسام
صداقت کئی اقسام کے جمع شدہ شواہد سے تعمیر ہوتی ہے۔ پرانی کتابیں انہیں صداقت کی الگ الگ اقسام کے طور پر پیش کرتی ہیں؛ موجودہ نقطۂ نظر انہیں ایک ہی مقدمے کی تائید کرنے والی مختلف دلیلیں سمجھتا ہے۔
مواد سے متعلق شواہد یہ پوچھتے ہیں کہ کیا آئٹم تصور کا مناسب احاطہ کرتے ہیں۔ جو افسردگی کا پیمانہ صرف نیند اور بھوک کے بارے میں پوچھے وہ جسمانی علامات کا احاطہ کرتا ہے اور مزاج اور ادراک سے متعلق علامات کو چھوڑ دیتا ہے۔ مواد کے احاطے کا فیصلہ عموماً متعلقہ شعبے کے ماہرین کرتے ہیں، اور یہی وجہ ہے کہ بہت مختصر پیمانے ہمیشہ ایک سمجھوتہ ہوتے ہیں۔
اندرونی ساخت سے متعلق شواہد یہ پوچھتے ہیں کہ کیا آئٹم اسی طرح گروہ بند ہوتے ہیں جیسا نظریہ کہتا ہے۔ اگر کوئی ماڈل چار الگ پہلوؤں کا دعویٰ کرتا ہے تو فیکٹر تجزیے میں چار فیکٹر سامنے آنے چاہئیں، اور اہم بات یہ ہے کہ ایک آزاد نمونے میں، نہ کہ صرف اسی نمونے میں جس پر پیمانہ بنایا گیا تھا۔ بہت سے آلاتِ پیمائش تیاری کے نمونے میں اپنی مطلوبہ ساخت دکھا دیتے ہیں اور کسی اور کے نمونے میں ایسا نہیں کر پاتے۔
دیگر متغیرات سے تعلقات وہ مقام ہے جہاں زیادہ تر کام ہوتا ہے۔ ہم گرائی شواہد دکھاتے ہیں کہ پیمانے کا ان چیزوں سے تعلق ہے جن سے اسے ہونا چاہیے۔ امتیازی شواہد دکھاتے ہیں کہ اس کا ان چیزوں سے بہت زیادہ تعلق نہیں جن سے اسے الگ ہونا چاہیے؛ یہ ایسا تقاضا ہے جسے مسلسل نظرانداز کیا جاتا ہے، اور یہی بہت سے نئے نام والے تصورات کو ناکام کر دیتا ہے۔ معیاری شواہد دکھاتے ہیں کہ اسکور کا تعلق کسی اہم نتیجے سے ہے، خواہ وہ اسی وقت ناپا گیا ہو یا پہلے سے پیش گوئی کی گئی ہو۔
نتائجی شواہد یہ پوچھتے ہیں کہ ٹیسٹ کے استعمال سے کیا ہوتا ہے۔ اگر کوئی آلۂ پیمائش تصور سے غیر متعلق وجوہات کی بنا پر کسی گروہ کو منظم طور پر نقصان پہنچاتا ہے تو یہ صداقت کا مسئلہ ہے، محض اخلاقی مسئلہ نہیں۔
وہ سوال جو اکثر دعووں کو بے نقاب کر دیتا ہے
صداقت کے دعوے کی سب سے کڑی جانچ اضافی صداقت ہے: کیا یہ آلۂ پیمائش اس سے کچھ زیادہ بتاتا ہے جو کوئی سستا، پرانا اور مستند پیمانہ پہلے سے بتا دیتا ہے؟
براہِ نام تصورات کی ایک قابلِ ذکر تعداد یہاں ناکام ہو جاتی ہے۔ ان کا کسی موجودہ Big Five جہت سے 0.7 یا اس سے زیادہ ارتباط ہوتا ہے، وہ انہی نتائج کی اتنی ہی مقدار میں پیش گوئی کرتے ہیں، اور پرانے پیمانے کو شماریاتی طور پر قابو میں رکھنے کے بعد کچھ اضافہ نہیں کرتے۔ تصور نیا ہے؛ پیمائش نئی نہیں۔ یہی وجہ ہے کہ سنجیدہ آلاتِ پیمائش کی دستاویزات میں تنقیدی حصے اکثر غلطی کے بجائے تکرار پر مرکوز ہوتے ہیں۔
کن باتوں پر نظر رکھیں
جب کوئی دعویٰ کرے کہ ٹیسٹ کی صداقت جانچی جا چکی ہے تو کارآمد سوالات ٹھوس ہوتے ہیں۔ کس معیار کے مقابلے میں جانچی گئی؟ کس آبادی میں، کتنے حجم کے ساتھ؟ کیا فیکٹر ساخت کی تصدیق کسی آزاد نمونے میں ہوئی؟ کیا ایسے محققین کی شائع شدہ شہادت موجود ہے جن کا جواب میں کوئی تجارتی مفاد نہیں؟ کیا یہ کسی مستند متبادل کے مقابلے میں کچھ اضافہ کرتا ہے؟
جس آلۂ پیمائش کے پاس ان سوالوں کے دیانت دار جوابات ہوں، حدود سمیت، وہ سنجیدگی سے لینے کے لائق ہے۔ جس کی صداقت کی جانچ محض تعریفی بیانات کے صفحے اور اس دعوے پر مشتمل ہو کہ لاکھوں لوگ اسے دے چکے ہیں، اس نے کسی بالکل مختلف سوال کا جواب دیا ہے۔ مقبولیت شواہد نہیں ہے، اور ٹیسٹ دینے والوں کی تعداد اس بارے میں کچھ نہیں بتاتی کہ اس کے اسکور کا کوئی مطلب بھی ہے یا نہیں۔
خود آزمائیں
پیمائش کے بارے میں پڑھنا ایک بات ہے۔ اپنا اسکور اس کے ماخذ، معیاری گروہ کے نمونے اور حدود کے ساتھ دیکھنا بالکل دوسری بات ہے۔ دینا مفت ہے، سائن اپ کی ضرورت نہیں۔
پڑھنا جاری رکھیں
- نفسیاتی پیمائش (سائیکومیٹرکس) کیا ہے؟وہ شعبہ جو یہ طے کرتا ہے کہ کوئی نفسیاتی پیمائش کتنی معتبر ہے، اور وہ وجہ جس کے باعث ملتے جلتے سوالات پوچھنے والے دو ٹیسٹ اپنے نتائج کی قدر میں بے حد مختلف ہو سکتے ہیں۔
- نفسیاتی ٹیسٹ میں اعتباریت کیا ہے؟اعتباریت پیمائش کے تسلسل کا نام ہے، درستی کا نہیں۔ ایک ٹیسٹ بہت زیادہ قابلِ اعتبار ہو کر بھی غلط چیز کی پیمائش کر سکتا ہے؛ اسی لیے یہ پہلا سوال ہوتا ہے، آخری کبھی نہیں۔
- تصوراتی صداقت کیا ہے؟پیمائش کا سب سے مشکل سوال: کیا جس چیز کو آپ ناپ رہے ہیں وہ اسی طرح موجود ہے جیسے آپ نے اس کی تعریف کی ہے، اور کیا آپ کا آلۂ پیمائش واقعی اس تک پہنچتا ہے یا کسی قریبی چیز تک۔
- ارتکازی اور امتیازی صداقتیہ دو ایک دوسرے کے عکس تقاضے ہیں: پیمانے کو ان چیزوں سے مطابقت رکھنی چاہیے جن سے اسے رکھنی چاہیے، اور ان چیزوں سے الگ رہنا چاہیے جو وہ ہونے کا دعویٰ نہیں کرتا۔ زیادہ تر کمزور آلات دوسرے تقاضے پر پورا نہیں اترتے۔
- Cronbach's alpha کیا ہے، اور کیا نہیں ہےنفسیاتی ٹیسٹنگ میں سب سے زیادہ رپورٹ کیا جانے والا شماریہ، اور سب سے زیادہ غلط سمجھا جانے والا بھی۔ الفا یہ نہیں بتاتا کہ کوئی پیمانہ یک جہتی ہے، اور زیادہ قدر اکثر خوبی کے بجائے کسی خرابی کی علامت ہوتی ہے۔
- پیمائش کی معیاری غلطی: آپ کا اسکور کتنا مختلف ہو سکتا ہےہر اسکور کے ساتھ غلطی کا ایک دائرہ ہوتا ہے، اور بیشتر نفسیاتی ٹیسٹوں میں یہ لوگوں کے اندازے سے کہیں زیادہ وسیع ہوتا ہے۔ یہی عدد بتاتا ہے کہ کوئی فرق حقیقی ہے یا محض شور۔
- معیاری گروہ اور پرسنٹائل: آپ کے اسکور کا موازنہ کس سے کیا جاتا ہےخام اسکور اپنی جگہ پر قابلِ تشریح نہیں ہوتا۔ یہ صرف حوالہ جاتی گروہ کے مقابلے میں بامعنی بنتا ہے، اور یہ کہ کون سا گروہ استعمال ہوا، کسی بھی ٹیسٹ کے بارے میں سب سے زیادہ اثر انداز ہونے والی اور سب سے کم بتائی جانے والی حقیقتوں میں سے ایک ہے۔
- نفسیاتی ٹیسٹ دراصل کیسے تیار کیا جاتا ہےتصور کی تعریف سے لے کر شائع شدہ معیاری گروہ تک کا یہ سلسلہ برسوں پر محیط ہوتا ہے اور اس میں شامل بیشتر چیزیں رد کر دی جاتی ہیں۔ ان مراحل کو جان لینے سے صاف نظر آ جاتا ہے کہ کسی عام آن لائن کوئز نے کون سے مراحل چھوڑ دیے۔
- جب کسی ٹیسٹ کو مصدقہ کہا جاتا ہے تو اس کا کیا مطلب ہوتا ہے؟یہ لفظ کسی ضابطے کا پابند نہیں، اور ایسی مصنوعات بھی اسے کھلے عام استعمال کرتی ہیں جنہوں نے اس کے لیے کوئی کام نہیں کیا۔ یہاں بتایا گیا ہے کہ جب اس لفظ کا کوئی مطلب ہوتا ہے تو وہ کیا ہوتا ہے، اور وہ چار سوالات کون سے ہیں جو دونوں صورتوں میں فرق کرتے ہیں۔
- انٹرنیٹ پر موجود زیادہ تر شخصیت کے ٹیسٹ قابلِ اعتبار کیوں نہیں ہوتےاس لیے نہیں کہ وہ بددیانت ہیں، بلکہ اس لیے کہ جن مراحل سے پیمائش قابل اعتماد بنتی ہے وہ نظر نہیں آتے، مہنگے ہوتے ہیں اور انہیں چھوڑ دینا آسان ہوتا ہے؛ اور انہیں چھوڑ دینے سے نتیجے کی ظاہری شکل میں کوئی فرق نہیں پڑتا۔
- خود رپورٹ کیا ناپ سکتی ہے اور کیا نہیںسوالنامے آپ سے کہتے ہیں کہ آپ خود اپنے مبصر بنیں، جو کچھ چیزوں کے لیے دوسری چیزوں کے مقابلے میں بہتر کام کرتا ہے۔ یہ جاننا کہ یہ طریقہ کہاں مضبوط ہے اور کہاں ناکام رہتا ہے، آپ کے کسی بھی نتیجے کو پڑھنے کا انداز بدل دیتا ہے۔
- جب کوئی ٹیسٹ کسی چیز کی پیش گوئی کرتا ہے تو اس کا کیا مطلب ہوتا ہےشخصیت کی تحقیق میں 0.30 کا ارتباط ایک مضبوط نتیجہ ہے، لیکن کسی ایک فرد کے بارے میں فیصلے کے لیے یہ کمزور بنیاد ہے۔ دونوں باتیں درست ہیں، اور ٹیسٹ کے نتائج کے زیادہ تر غلط استعمال کی وجہ ان دونوں کے درمیان یہی فرق ہے۔
- اسکریننگ تشخیص نہیں ہےاسکریننگ سوالنامہ اس مقصد کے لیے بنایا جاتا ہے کہ زیادہ سے زیادہ ممکنہ کیسز پکڑ سکے، اور اس کی قیمت کے طور پر غلط مثبت نتائج کی بلند شرح قبول کی جاتی ہے۔ اسکریننگ اسکور کو تشخیص سمجھ کر پڑھنا اس کے اصل مقصد کو الٹ دیتا ہے۔