معیاری گروہ اور پرسنٹائل: آپ کے اسکور کا موازنہ کس سے کیا جاتا ہے
خام اسکور اپنی جگہ پر قابلِ تشریح نہیں ہوتا۔ یہ صرف حوالہ جاتی گروہ کے مقابلے میں بامعنی بنتا ہے، اور یہ کہ کون سا گروہ استعمال ہوا، کسی بھی ٹیسٹ کے بارے میں سب سے زیادہ اثر انداز ہونے والی اور سب سے کم بتائی جانے والی حقیقتوں میں سے ایک ہے۔
آپ کا اسکور ذمہ داری کے پیمانے پر 34 ہے۔ کیا یہ زیادہ ہے؟
اس سوال کا کوئی جواب موازنے کے بغیر ممکن نہیں۔ زیادہ سے زیادہ کتنے میں سے 34، کس کے مقابلے میں، اور کب ناپا گیا؟ معیاری گروہ وہ حوالہ جاتی ڈیٹا ہے جو خام اسکور کو قابلِ تشریح مقام میں بدلتا ہے، اور اس کا انتخاب ٹیسٹ سازی کے زیادہ اہم فیصلوں میں سے ایک ہے۔
تبدیلی کیسے ہوتی ہے
معیاری نمونہ ان لوگوں کا گروہ ہوتا ہے جنہوں نے آلۂ پیمائش کو معیاری حالات میں حل کیا ہو، اور جن کے اسکور کی تقسیم پیمانے کا کام دیتی ہے۔ پھر خام اسکور کو اسی تقسیم کے اندر ایک مقام کے طور پر ظاہر کیا جاتا ہے۔
پرسنٹائل درجہ یہ بتاتا ہے کہ معیاری نمونے کا کتنا حصہ آپ کے برابر یا آپ سے کم اسکور لایا۔ 70 واں پرسنٹائل کا مطلب ہے کہ اس حوالہ جاتی گروہ کے 70 فیصد لوگوں کا اسکور کم تھا۔ پرسنٹائل سمجھنے میں آسان ہیں، مگر ان میں ایک کم نظر آنے والی خامی ہے: یہ تقسیم کے گنجان درمیانی حصے میں فرق کو بڑھا کر دکھاتے ہیں اور سروں پر دبا دیتے ہیں۔ اوسط کے آس پاس چند خام نمبر آپ کو کئی پرسنٹائل درجے آگے پیچھے کر سکتے ہیں، جبکہ انہی چند نمبروں سے بالائی سرے کے قریب تقریباً کوئی فرق نہیں پڑتا۔
معیاری اسکور یعنی z اسکور، T اسکور، سٹینائن اور IQ طرز کے پیمانے، اوسط سے فاصلے کو معیاری انحراف کی اکائیوں میں ظاہر کرتے ہیں۔ یہ اسکور کے درمیان اصل فاصلہ برقرار رکھتے ہیں، اسی لیے نتائج پر کسی بھی حسابی عمل کے لیے انہیں ترجیح دی جاتی ہے۔
حوالہ جاتی گروہ ہی اصل بات کیوں ہے
ایک ہی خام اسکور معیاری نمونے کے لحاظ سے بالکل مختلف پرسنٹائل پر آ سکتا ہے۔ عام بالغ آبادی کے مقابلے میں ذمہ داری کا اسکور اور پیشہ ور اکاؤنٹنٹس کے نمونے کے مقابلے میں اسکور ایک جیسا پرسنٹائل نہیں دیں گے، اور ان میں سے کوئی بھی نمبر غلط نہیں ہے، کیونکہ وہ مختلف سوالوں کا جواب دیتے ہیں۔
اسی لیے معیاری نمونے کی کئی خصوصیات جاننا ضروری ہے۔
اس میں کون شامل تھا۔ نفسیات کے انڈرگریجویٹ طلبہ پر مبنی سہولت کے نمونے آج بھی عام ہیں اور یہ انسانیت کے ایک محدود حصے کی نمائندگی کرتے ہیں: کم عمر، تعلیم یافتہ، اور غیر متناسب طور پر امیر مغربی ممالک سے تعلق رکھنے والے۔ ان پر بنایا گیا معیاری گروہ دوسری آبادیوں پر اچھی طرح لاگو نہیں ہوتا۔
اس کا حجم کتنا تھا۔ سروں پر مستحکم پرسنٹائل اندازوں کے لیے بڑے نمونے درکار ہوتے ہیں۔ چند سو افراد سے یہ قابلِ اعتماد تصویر نہیں ملتی کہ 95 واں پرسنٹائل کیسا نظر آتا ہے۔
یہ کب جمع کیا گیا۔ معیاری گروہ وقت کے ساتھ بدلتے ہیں۔ نفسیاتی پیمانوں کی ایک وسیع رینج پر آبادی کی اوسطیں دہائیوں میں نمایاں طور پر تبدیل ہوئی ہیں، اور 1995 کا معیاری نمونہ اب 2026 میں ٹیسٹ دینے والی آبادی کی عکاسی نہیں کرتا۔
کیا یہ طبقہ وار ہے۔ بہت سی خصلتیں عمر اور جنس کے ساتھ منظم طور پر بدلتی ہیں۔ ہیجان طلبی عمر کے ساتھ تیزی سے کم ہوتی ہے، اور صبح یا شام کے مزاج کا رجحان زندگی بھر بدلتا رہتا ہے۔ 55 سال کے فرد کا موازنہ تمام عمروں کے معیاری گروہ سے کرنے سے دونوں لحاظ سے گمراہ کن مقام سامنے آتا ہے۔
کیا دیکھنا چاہیے، اور اس کی غیر موجودگی کا کیا مطلب ہے
ایک اچھی طرح دستاویزی آلۂ پیمائش اپنے معیاری نمونے کا حجم، ترکیب، ملک اور سال بیان کرتا ہے، اور یہ بھی بتاتا ہے کہ معیاری گروہ طبقہ وار ہیں یا نہیں۔ سنجیدہ ٹیسٹ مینوئلز میں اس موضوع پر پورے باب ہوتے ہیں۔
زیادہ تر مفت آن لائن ٹیسٹ ان میں سے کچھ بھی نہیں بتاتے۔ وہ آپ کو ایسا پرسنٹائل دیتے ہیں جس کے ساتھ یہ وضاحت نہیں ہوتی کہ وہ کس آبادی کا حوالہ ہے۔ وہ پرسنٹائل یا تو کسی غیر بیان کردہ سہولت کے نمونے سے نکالا گیا ہوتا ہے، یا کسی دوسری آبادی پر جمع کیے گئے شائع شدہ معیاری گروہ سے مستعار لیا گیا ہوتا ہے، یا اس ویب سائٹ کا ٹیسٹ پہلے دینے والے لوگوں سے تیار کیا گیا ہوتا ہے، جو خود کو منتخب کرنے والا گروہ ہے اور جس کی ترکیب خود سائٹ چلانے والے کو بھی معلوم نہیں ہوتی۔
پرسنٹائل پھر بھی اسکرین پر نظر آتا ہے اور اصلی پرسنٹائل جیسا ہی دکھائی دیتا ہے۔ ان دونوں کو الگ کرنے والی چیز صرف اس کے ساتھ موجود دستاویزات ہیں، اور کچھ نہیں۔
خود آزمائیں
پیمائش کے بارے میں پڑھنا ایک بات ہے۔ اپنا اسکور اس کے ماخذ، معیاری گروہ کے نمونے اور حدود کے ساتھ دیکھنا بالکل دوسری بات ہے۔ دینا مفت ہے، سائن اپ کی ضرورت نہیں۔
پڑھنا جاری رکھیں
- نفسیاتی پیمائش (سائیکومیٹرکس) کیا ہے؟وہ شعبہ جو یہ طے کرتا ہے کہ کوئی نفسیاتی پیمائش کتنی معتبر ہے، اور وہ وجہ جس کے باعث ملتے جلتے سوالات پوچھنے والے دو ٹیسٹ اپنے نتائج کی قدر میں بے حد مختلف ہو سکتے ہیں۔
- نفسیاتی ٹیسٹ میں اعتباریت کیا ہے؟اعتباریت پیمائش کے تسلسل کا نام ہے، درستی کا نہیں۔ ایک ٹیسٹ بہت زیادہ قابلِ اعتبار ہو کر بھی غلط چیز کی پیمائش کر سکتا ہے؛ اسی لیے یہ پہلا سوال ہوتا ہے، آخری کبھی نہیں۔
- نفسیاتی ٹیسٹ میں صداقت کیا ہے؟صداقت کوئی ایسی خصوصیت نہیں جو ٹیسٹ کے پاس ہوتی ہے۔ یہ ایک دلیل ہے کہ کسی مخصوص اسکور کی کسی مخصوص مقصد کے لیے کی گئی کوئی خاص تشریح کس حد تک قابلِ دفاع ہے، اور ہر نئے استعمال کے لیے اسے دوبارہ تعمیر کرنا پڑتا ہے۔
- تصوراتی صداقت کیا ہے؟پیمائش کا سب سے مشکل سوال: کیا جس چیز کو آپ ناپ رہے ہیں وہ اسی طرح موجود ہے جیسے آپ نے اس کی تعریف کی ہے، اور کیا آپ کا آلۂ پیمائش واقعی اس تک پہنچتا ہے یا کسی قریبی چیز تک۔
- ارتکازی اور امتیازی صداقتیہ دو ایک دوسرے کے عکس تقاضے ہیں: پیمانے کو ان چیزوں سے مطابقت رکھنی چاہیے جن سے اسے رکھنی چاہیے، اور ان چیزوں سے الگ رہنا چاہیے جو وہ ہونے کا دعویٰ نہیں کرتا۔ زیادہ تر کمزور آلات دوسرے تقاضے پر پورا نہیں اترتے۔
- Cronbach's alpha کیا ہے، اور کیا نہیں ہےنفسیاتی ٹیسٹنگ میں سب سے زیادہ رپورٹ کیا جانے والا شماریہ، اور سب سے زیادہ غلط سمجھا جانے والا بھی۔ الفا یہ نہیں بتاتا کہ کوئی پیمانہ یک جہتی ہے، اور زیادہ قدر اکثر خوبی کے بجائے کسی خرابی کی علامت ہوتی ہے۔
- پیمائش کی معیاری غلطی: آپ کا اسکور کتنا مختلف ہو سکتا ہےہر اسکور کے ساتھ غلطی کا ایک دائرہ ہوتا ہے، اور بیشتر نفسیاتی ٹیسٹوں میں یہ لوگوں کے اندازے سے کہیں زیادہ وسیع ہوتا ہے۔ یہی عدد بتاتا ہے کہ کوئی فرق حقیقی ہے یا محض شور۔
- نفسیاتی ٹیسٹ دراصل کیسے تیار کیا جاتا ہےتصور کی تعریف سے لے کر شائع شدہ معیاری گروہ تک کا یہ سلسلہ برسوں پر محیط ہوتا ہے اور اس میں شامل بیشتر چیزیں رد کر دی جاتی ہیں۔ ان مراحل کو جان لینے سے صاف نظر آ جاتا ہے کہ کسی عام آن لائن کوئز نے کون سے مراحل چھوڑ دیے۔
- جب کسی ٹیسٹ کو مصدقہ کہا جاتا ہے تو اس کا کیا مطلب ہوتا ہے؟یہ لفظ کسی ضابطے کا پابند نہیں، اور ایسی مصنوعات بھی اسے کھلے عام استعمال کرتی ہیں جنہوں نے اس کے لیے کوئی کام نہیں کیا۔ یہاں بتایا گیا ہے کہ جب اس لفظ کا کوئی مطلب ہوتا ہے تو وہ کیا ہوتا ہے، اور وہ چار سوالات کون سے ہیں جو دونوں صورتوں میں فرق کرتے ہیں۔
- انٹرنیٹ پر موجود زیادہ تر شخصیت کے ٹیسٹ قابلِ اعتبار کیوں نہیں ہوتےاس لیے نہیں کہ وہ بددیانت ہیں، بلکہ اس لیے کہ جن مراحل سے پیمائش قابل اعتماد بنتی ہے وہ نظر نہیں آتے، مہنگے ہوتے ہیں اور انہیں چھوڑ دینا آسان ہوتا ہے؛ اور انہیں چھوڑ دینے سے نتیجے کی ظاہری شکل میں کوئی فرق نہیں پڑتا۔
- خود رپورٹ کیا ناپ سکتی ہے اور کیا نہیںسوالنامے آپ سے کہتے ہیں کہ آپ خود اپنے مبصر بنیں، جو کچھ چیزوں کے لیے دوسری چیزوں کے مقابلے میں بہتر کام کرتا ہے۔ یہ جاننا کہ یہ طریقہ کہاں مضبوط ہے اور کہاں ناکام رہتا ہے، آپ کے کسی بھی نتیجے کو پڑھنے کا انداز بدل دیتا ہے۔
- جب کوئی ٹیسٹ کسی چیز کی پیش گوئی کرتا ہے تو اس کا کیا مطلب ہوتا ہےشخصیت کی تحقیق میں 0.30 کا ارتباط ایک مضبوط نتیجہ ہے، لیکن کسی ایک فرد کے بارے میں فیصلے کے لیے یہ کمزور بنیاد ہے۔ دونوں باتیں درست ہیں، اور ٹیسٹ کے نتائج کے زیادہ تر غلط استعمال کی وجہ ان دونوں کے درمیان یہی فرق ہے۔
- اسکریننگ تشخیص نہیں ہےاسکریننگ سوالنامہ اس مقصد کے لیے بنایا جاتا ہے کہ زیادہ سے زیادہ ممکنہ کیسز پکڑ سکے، اور اس کی قیمت کے طور پر غلط مثبت نتائج کی بلند شرح قبول کی جاتی ہے۔ اسکریننگ اسکور کو تشخیص سمجھ کر پڑھنا اس کے اصل مقصد کو الٹ دیتا ہے۔