پیمائش کی معیاری غلطی: آپ کا اسکور کتنا مختلف ہو سکتا ہے
ہر اسکور کے ساتھ غلطی کا ایک دائرہ ہوتا ہے، اور بیشتر نفسیاتی ٹیسٹوں میں یہ لوگوں کے اندازے سے کہیں زیادہ وسیع ہوتا ہے۔ یہی عدد بتاتا ہے کہ کوئی فرق حقیقی ہے یا محض شور۔
معیاری خطائے پیمائش اعتباریت کے ایک تجریدی عددی سے کو ایک ٹھوس چیز میں بدل دیتی ہے: اسکور کے گرد کم یا زیادہ کی ایک پٹی۔ یہ اس سوال کا جواب دیتی ہے جسے زیادہ تر نتائج کی اسکرینیں بغیر جواب چھوڑ دیتی ہیں: اگر میں یہ ٹیسٹ کسی اور دن دوپہر کو دیتا تو یہ عدد کتنا مختلف ہو سکتا تھا؟
فارمولا سادہ ہے۔ پیمانے کے معیاری انحراف کو ایک منفی اعتباریت کے جذر المربع سے ضرب دیں۔ جس پیمانے کا معیاری انحراف 10 اور اعتباریت 0.85 ہو، اس کی معیاری خطا تقریباً 3.9 پوائنٹ بنتی ہے۔
اس پٹی میں اصل میں کیا شامل ہے
تقریباً دو تہائی مواقع پر کسی شخص کا حقیقی مقام اس کے مشاہدہ شدہ اسکور کی ایک معیاری خطا کے اندر ہوتا ہے۔ تقریباً 95 فیصد اعتماد کے لیے دونوں طرف تقریباً دو معیاری خطاؤں کی ضرورت ہوتی ہے۔
اوپر کی مثال لیں۔ کسی کا اسکور 62 ہے۔ 95 فیصد وقفہ تقریباً 54 سے 70 تک جاتا ہے۔ یہ سولہ پوائنٹ کی گنجائش ہے، ایسے پیمانے پر جہاں اوسط اور واضح طور پر اوسط سے بلند کے درمیان عام فرق دس پوائنٹ کے قریب ہو سکتا ہے۔
یہ اس مخصوص ٹیسٹ کی خامی نہیں ہے۔ 0.85 کی اعتباریت قابل احترام ہے۔ یہ نفسیاتی پیمائش کی عام درستی ہے، اور اسی وجہ سے محتاط رپورٹیں نقطوں کے بجائے پٹیاں پیش کرتی ہیں۔
وہ نتائج جو لوگ نظر انداز کر دیتے ہیں
پیمانوں کے درمیان چھوٹے فرق عموماً بے معنی ہوتے ہیں۔ اگر آپ کی برون بینی 58 اور کشادگی 54 ہے، تو دیانت دارانہ مطلب یہ ہے کہ دونوں میں فرق نہیں کیا جا سکتا۔ جو پروفائل تشریحات چار پوائنٹ کے فرق سے کوئی کہانی بناتی ہیں، وہ محض شور کو پڑھ رہی ہوتی ہیں۔
وقت کے ساتھ چھوٹی تبدیلیاں بھی عموماً بے معنی ہوتی ہیں۔ ٹیسٹ دوبارہ دینے پر پانچ پوائنٹ کا فرق آنا زیادہ تر آلات کے لیے خطا کی حد کے اندر ہے۔ خصلت میں حقیقی تبدیلی برسوں میں آتی ہے اور خطا کی پٹی سے واضح طور پر باہر حرکت کی صورت میں ظاہر ہوتی ہے، مہینے بہ مہینے چند پوائنٹ کی صورت میں نہیں۔
درجہ بندی مسئلے کو بڑھا دیتی ہے۔ خام اسکور کے چند پوائنٹ کا فرق کسی شخص کو تقسیم کے گھنے درمیانی حصے میں دس پرسنٹائل درجے آگے پیچھے کر سکتا ہے، کیونکہ زیادہ تر لوگ وہیں ہوتے ہیں۔ پرسنٹائل درجے درست نظر آتے ہیں مگر اسکور کے اظہار کا سب سے کم مستحکم طریقہ ہیں۔
درستی پورے پیمانے پر یکساں نہیں ہوتی۔ کلاسیکی نظریہ ٹیسٹ فرض کرتا ہے کہ ہر اسکور کے لیے خطا کی ایک ہی قدر ہے، جو ایک سادہ کاری ہے۔ آئٹم رسپانس تھیوری خصلت کی ہر سطح پر خطا کو الگ سے ماڈل کرتی ہے، اور یہ تقریباً ہمیشہ انتہاؤں پر زیادہ ہوتی ہے، یعنی عین وہاں جہاں سب سے زیادہ نتیجہ خیز تشریحات کی جاتی ہیں۔ بہت زیادہ یا بہت کم اسکور عموماً درمیانے اسکور کے مقابلے میں کم درست ہوتا ہے، زیادہ درست نہیں۔
دیانت دارانہ رپورٹنگ کم متاثر کن کیوں لگتی ہے
جو آلہ اعتماد کی پٹیاں بتاتا ہے وہ اس آلے کے مقابلے میں مبہم لگتا ہے جو ایک اعشاریہ تک ایک ہی عدد دیتا ہے۔ مبہم نظر آنے والا سچ بول رہا ہے۔ درست نظر آنے والے میں بھی وہی بنیادی خطا ہے، مگر اس نے اسے دکھانا نہ دکھانا اپنی مرضی پر رکھا ہے۔
یہ بات اس وقت یاد رکھنے کے قابل ہے جب سائنسی طور پر دستاویزی ٹیسٹ کا موازنہ کسی تجارتی پروڈکٹ سے کیا جائے جو آپ کو کسی زمرے میں رکھ دیتی ہے۔ زمرے کی حد ایک مخصوص اسکور پر ہوتی ہے، اور اس سے ایک پوائنٹ نیچے اور ایک پوائنٹ اوپر والے شخص شماریاتی طور پر ایک ہی شخص ہیں۔ قسم کا لیبل اسے مکمل طور پر چھپا دیتا ہے۔ یہ قسم پر مبنی آلات کے خلاف زیادہ سنجیدہ دلائل میں سے ایک ہے، اور اسی وجہ سے تحقیق میں بیان کردہ خطا کے ساتھ مسلسل اسکور معیار ہیں۔
خود آزمائیں
پیمائش کے بارے میں پڑھنا ایک بات ہے۔ اپنا اسکور اس کے ماخذ، معیاری گروہ کے نمونے اور حدود کے ساتھ دیکھنا بالکل دوسری بات ہے۔ دینا مفت ہے، سائن اپ کی ضرورت نہیں۔
پڑھنا جاری رکھیں
- نفسیاتی پیمائش (سائیکومیٹرکس) کیا ہے؟وہ شعبہ جو یہ طے کرتا ہے کہ کوئی نفسیاتی پیمائش کتنی معتبر ہے، اور وہ وجہ جس کے باعث ملتے جلتے سوالات پوچھنے والے دو ٹیسٹ اپنے نتائج کی قدر میں بے حد مختلف ہو سکتے ہیں۔
- نفسیاتی ٹیسٹ میں اعتباریت کیا ہے؟اعتباریت پیمائش کے تسلسل کا نام ہے، درستی کا نہیں۔ ایک ٹیسٹ بہت زیادہ قابلِ اعتبار ہو کر بھی غلط چیز کی پیمائش کر سکتا ہے؛ اسی لیے یہ پہلا سوال ہوتا ہے، آخری کبھی نہیں۔
- نفسیاتی ٹیسٹ میں صداقت کیا ہے؟صداقت کوئی ایسی خصوصیت نہیں جو ٹیسٹ کے پاس ہوتی ہے۔ یہ ایک دلیل ہے کہ کسی مخصوص اسکور کی کسی مخصوص مقصد کے لیے کی گئی کوئی خاص تشریح کس حد تک قابلِ دفاع ہے، اور ہر نئے استعمال کے لیے اسے دوبارہ تعمیر کرنا پڑتا ہے۔
- تصوراتی صداقت کیا ہے؟پیمائش کا سب سے مشکل سوال: کیا جس چیز کو آپ ناپ رہے ہیں وہ اسی طرح موجود ہے جیسے آپ نے اس کی تعریف کی ہے، اور کیا آپ کا آلۂ پیمائش واقعی اس تک پہنچتا ہے یا کسی قریبی چیز تک۔
- ارتکازی اور امتیازی صداقتیہ دو ایک دوسرے کے عکس تقاضے ہیں: پیمانے کو ان چیزوں سے مطابقت رکھنی چاہیے جن سے اسے رکھنی چاہیے، اور ان چیزوں سے الگ رہنا چاہیے جو وہ ہونے کا دعویٰ نہیں کرتا۔ زیادہ تر کمزور آلات دوسرے تقاضے پر پورا نہیں اترتے۔
- Cronbach's alpha کیا ہے، اور کیا نہیں ہےنفسیاتی ٹیسٹنگ میں سب سے زیادہ رپورٹ کیا جانے والا شماریہ، اور سب سے زیادہ غلط سمجھا جانے والا بھی۔ الفا یہ نہیں بتاتا کہ کوئی پیمانہ یک جہتی ہے، اور زیادہ قدر اکثر خوبی کے بجائے کسی خرابی کی علامت ہوتی ہے۔
- معیاری گروہ اور پرسنٹائل: آپ کے اسکور کا موازنہ کس سے کیا جاتا ہےخام اسکور اپنی جگہ پر قابلِ تشریح نہیں ہوتا۔ یہ صرف حوالہ جاتی گروہ کے مقابلے میں بامعنی بنتا ہے، اور یہ کہ کون سا گروہ استعمال ہوا، کسی بھی ٹیسٹ کے بارے میں سب سے زیادہ اثر انداز ہونے والی اور سب سے کم بتائی جانے والی حقیقتوں میں سے ایک ہے۔
- نفسیاتی ٹیسٹ دراصل کیسے تیار کیا جاتا ہےتصور کی تعریف سے لے کر شائع شدہ معیاری گروہ تک کا یہ سلسلہ برسوں پر محیط ہوتا ہے اور اس میں شامل بیشتر چیزیں رد کر دی جاتی ہیں۔ ان مراحل کو جان لینے سے صاف نظر آ جاتا ہے کہ کسی عام آن لائن کوئز نے کون سے مراحل چھوڑ دیے۔
- جب کسی ٹیسٹ کو مصدقہ کہا جاتا ہے تو اس کا کیا مطلب ہوتا ہے؟یہ لفظ کسی ضابطے کا پابند نہیں، اور ایسی مصنوعات بھی اسے کھلے عام استعمال کرتی ہیں جنہوں نے اس کے لیے کوئی کام نہیں کیا۔ یہاں بتایا گیا ہے کہ جب اس لفظ کا کوئی مطلب ہوتا ہے تو وہ کیا ہوتا ہے، اور وہ چار سوالات کون سے ہیں جو دونوں صورتوں میں فرق کرتے ہیں۔
- انٹرنیٹ پر موجود زیادہ تر شخصیت کے ٹیسٹ قابلِ اعتبار کیوں نہیں ہوتےاس لیے نہیں کہ وہ بددیانت ہیں، بلکہ اس لیے کہ جن مراحل سے پیمائش قابل اعتماد بنتی ہے وہ نظر نہیں آتے، مہنگے ہوتے ہیں اور انہیں چھوڑ دینا آسان ہوتا ہے؛ اور انہیں چھوڑ دینے سے نتیجے کی ظاہری شکل میں کوئی فرق نہیں پڑتا۔
- خود رپورٹ کیا ناپ سکتی ہے اور کیا نہیںسوالنامے آپ سے کہتے ہیں کہ آپ خود اپنے مبصر بنیں، جو کچھ چیزوں کے لیے دوسری چیزوں کے مقابلے میں بہتر کام کرتا ہے۔ یہ جاننا کہ یہ طریقہ کہاں مضبوط ہے اور کہاں ناکام رہتا ہے، آپ کے کسی بھی نتیجے کو پڑھنے کا انداز بدل دیتا ہے۔
- جب کوئی ٹیسٹ کسی چیز کی پیش گوئی کرتا ہے تو اس کا کیا مطلب ہوتا ہےشخصیت کی تحقیق میں 0.30 کا ارتباط ایک مضبوط نتیجہ ہے، لیکن کسی ایک فرد کے بارے میں فیصلے کے لیے یہ کمزور بنیاد ہے۔ دونوں باتیں درست ہیں، اور ٹیسٹ کے نتائج کے زیادہ تر غلط استعمال کی وجہ ان دونوں کے درمیان یہی فرق ہے۔
- اسکریننگ تشخیص نہیں ہےاسکریننگ سوالنامہ اس مقصد کے لیے بنایا جاتا ہے کہ زیادہ سے زیادہ ممکنہ کیسز پکڑ سکے، اور اس کی قیمت کے طور پر غلط مثبت نتائج کی بلند شرح قبول کی جاتی ہے۔ اسکریننگ اسکور کو تشخیص سمجھ کر پڑھنا اس کے اصل مقصد کو الٹ دیتا ہے۔