نفسیاتی ٹیسٹ میں اعتباریت کیا ہے؟
اعتباریت پیمائش کے تسلسل کا نام ہے، درستی کا نہیں۔ ایک ٹیسٹ بہت زیادہ قابلِ اعتبار ہو کر بھی غلط چیز کی پیمائش کر سکتا ہے؛ اسی لیے یہ پہلا سوال ہوتا ہے، آخری کبھی نہیں۔
اعتباریت اس بات کی حد ہے کہ کوئی پیمائش دہرائی جا سکتی ہے یا محض شور ہے۔ اگر آپ ایک منٹ میں تین بار اپنا وزن کریں اور 71، 78 اور 66 کلوگرام آئے، تو وہ پیمانہ ناقابل اعتبار ہوگا، اور آپ اس سے اپنا اصل وزن جان ہی نہیں سکتے۔ نفسیاتی پیمائش کو بھی یہی مسئلہ درپیش ہوتا ہے، مگر کہیں کم درست آلات کے ساتھ۔
اعتباریت کے بارے میں سمجھنے کی سب سے اہم بات یہ ہے کہ وہ کس چیز کا دعویٰ نہیں کرتی۔ گھر کا وہ وزنی پیمانہ جو ہمیشہ آٹھ کلوگرام زیادہ وزن بتائے، بالکل قابل اعتبار ہے اور مکمل طور پر غلط بھی۔ اعتباریت کا تعلق یکسانیت سے ہے؛ یہ کہ عدد درست مفہوم رکھتا ہے یا نہیں، ایک الگ سوال ہے جسے صداقت کہتے ہیں۔ اعتباریت صداقت کے لیے ضروری ہے، مگر اس کے لیے کافی ہونے سے بہت دور ہے۔
اس کی صورتیں
اندرونی ہم آہنگی یہ پوچھتی ہے کہ کیا پیمانے کے آئٹم ایک دوسرے سے متفق ہیں۔ اگر دس سوالات سب ایک ہی بنیادی خصلت کو جانچنے کے لیے ہیں، تو جو لوگ ایک میں زیادہ جواب دیں وہ باقی میں بھی زیادہ جواب دیں گے۔ اسے عموماً Cronbach's alpha یا، بہتر طور پر، McDonald's omega کی صورت میں بیان کیا جاتا ہے۔
ٹیسٹ اور دوبارہ ٹیسٹ کی اعتباریت یہ پوچھتی ہے کہ کیا ایک ہی شخص دو مواقع پر ملتا جلتا اسکور حاصل کرتا ہے۔ خصلتوں کے لیے یہی صورت سب سے زیادہ اہم ہے، کیونکہ تعریف کے لحاظ سے انہیں مستحکم ہونا چاہیے۔ یہی صورت سب سے زیادہ بغیر رپورٹ کے بھی رہ جاتی ہے، کیونکہ اس کے لیے ہفتوں بعد انہی شرکاء کو دوبارہ تلاش کرنا پڑتا ہے۔
جانچ کنندگان کے درمیان اعتباریت اس وقت لاگو ہوتی ہے جب آلے کا اسکور انسان دیتے ہوں، جیسے کلینیکل انٹرویو، اسقاطی تکنیکیں اور رویے کا مشاہدہ۔ یہ پوچھتی ہے کہ کیا دو تربیت یافتہ جانچ کنندگان ایک ہی مواد دیکھ کر ایک ہی نتیجے پر پہنچتے ہیں۔
متوازی صورتوں کی اعتباریت یہ پوچھتی ہے کہ کیا ایک ہی ٹیسٹ کے دو مختلف ورژن، جو مساوی بنائے گئے ہوں، ایک جیسے اسکور دیتے ہیں۔ یہ وہاں اہم ہے جہاں ٹیسٹ ایک سے زیادہ بار لیا جاتا ہو اور آئٹم کے افشا ہونے کا خدشہ ہو۔
اعداد کو پڑھنا
اعتباریت کے عددی سروں کی قدر 0 سے 1 تک ہوتی ہے۔ اصول موٹے اندازے کے ہیں اور اکثر غلط استعمال ہوتے ہیں، لیکن تقریباً یوں ہیں: 0.90 سے اوپر وہاں درکار ہے جہاں اسکور کسی فرد کی زندگی پر اثر ڈالے، 0.80 سے 0.90 زیادہ تر عملی استعمال کے لیے مضبوط ہے، 0.70 سے 0.80 تحقیق اور گروہوں کے موازنے کے لیے قابل قبول ہے، اور 0.70 سے کم کا مطلب ہے کہ اسکور میں اتنا شور ہے جتنا زیادہ تر نتائج برداشت نہیں کر سکتے۔
ان حدوں کے بارے میں دو احتیاطیں ہیں۔ پہلی، یہ رواج ہیں، قانون نہیں؛ قابل قبول سطح مکمل طور پر اس پر منحصر ہے کہ اسکور کس مقصد کے لیے استعمال ہوگا۔ دوسری، چھوٹے پیمانے پر بہت زیادہ alpha عموماً اس بات کی علامت ہوتا ہے کہ آئٹم ایک دوسرے کی تقریباً دوسری عبارت ہیں، جو تصور کا احاطہ کھو کر یکسانیت خریدتی ہے۔ دس سوالات کا ایسا پیمانہ جو سب قدرے مختلف الفاظ میں پوچھیں کہ "کیا آپ منظم ہیں؟"، اندرونی ہم آہنگی میں شاندار ہوگا مگر فرض شناسی کی محدود تصویر دے گا۔
آپ کے اپنے اسکور کے لیے اس کا مطلب
اعتباریت براہ راست طے کرتی ہے کہ ایک عدد پر کتنا اعتماد کیا جا سکتا ہے۔ 0.85 اعتباریت والے ٹیسٹ میں پیمائش کی غلطی اتنی بڑی ہوتی ہے کہ دو افراد کے درمیان، یا آپ کے آج کے اور پچھلے مہینے کے اسکور کے درمیان چند پوائنٹس کا فرق بہت امکان سے سگنل کے بجائے شور ہوتا ہے۔
عملی نتیجہ یہ ہے: اچھا آلۂ پیمائش اپنی اعتباریت بتاتا ہے تاکہ آپ جان سکیں کہ آپ کے اسکور کے گرد غیر یقینی کتنی وسیع ہے۔ اس غیر یقینی کا تکنیکی اظہار پیمائش کی معیاری غلطی ہے، جو اعتباریت کے عددی سر کو اسکور کے گرد جمع اور منفی کی ایک پٹی میں بدل دیتی ہے۔
جو آلۂ پیمائش اعتباریت کا کوئی عدد بتاتا ہی نہ ہو، وہ اس بنا پر زیادہ درست نہیں ہو جاتا۔ اس نے صرف یہ بتانے سے انکار کیا ہے کہ وہ کتنا غیر درست ہے۔
خود آزمائیں
پیمائش کے بارے میں پڑھنا ایک بات ہے۔ اپنا اسکور اس کے ماخذ، معیاری گروہ کے نمونے اور حدود کے ساتھ دیکھنا بالکل دوسری بات ہے۔ دینا مفت ہے، سائن اپ کی ضرورت نہیں۔
پڑھنا جاری رکھیں
- نفسیاتی پیمائش (سائیکومیٹرکس) کیا ہے؟وہ شعبہ جو یہ طے کرتا ہے کہ کوئی نفسیاتی پیمائش کتنی معتبر ہے، اور وہ وجہ جس کے باعث ملتے جلتے سوالات پوچھنے والے دو ٹیسٹ اپنے نتائج کی قدر میں بے حد مختلف ہو سکتے ہیں۔
- نفسیاتی ٹیسٹ میں صداقت کیا ہے؟صداقت کوئی ایسی خصوصیت نہیں جو ٹیسٹ کے پاس ہوتی ہے۔ یہ ایک دلیل ہے کہ کسی مخصوص اسکور کی کسی مخصوص مقصد کے لیے کی گئی کوئی خاص تشریح کس حد تک قابلِ دفاع ہے، اور ہر نئے استعمال کے لیے اسے دوبارہ تعمیر کرنا پڑتا ہے۔
- تصوراتی صداقت کیا ہے؟پیمائش کا سب سے مشکل سوال: کیا جس چیز کو آپ ناپ رہے ہیں وہ اسی طرح موجود ہے جیسے آپ نے اس کی تعریف کی ہے، اور کیا آپ کا آلۂ پیمائش واقعی اس تک پہنچتا ہے یا کسی قریبی چیز تک۔
- ارتکازی اور امتیازی صداقتیہ دو ایک دوسرے کے عکس تقاضے ہیں: پیمانے کو ان چیزوں سے مطابقت رکھنی چاہیے جن سے اسے رکھنی چاہیے، اور ان چیزوں سے الگ رہنا چاہیے جو وہ ہونے کا دعویٰ نہیں کرتا۔ زیادہ تر کمزور آلات دوسرے تقاضے پر پورا نہیں اترتے۔
- Cronbach's alpha کیا ہے، اور کیا نہیں ہےنفسیاتی ٹیسٹنگ میں سب سے زیادہ رپورٹ کیا جانے والا شماریہ، اور سب سے زیادہ غلط سمجھا جانے والا بھی۔ الفا یہ نہیں بتاتا کہ کوئی پیمانہ یک جہتی ہے، اور زیادہ قدر اکثر خوبی کے بجائے کسی خرابی کی علامت ہوتی ہے۔
- پیمائش کی معیاری غلطی: آپ کا اسکور کتنا مختلف ہو سکتا ہےہر اسکور کے ساتھ غلطی کا ایک دائرہ ہوتا ہے، اور بیشتر نفسیاتی ٹیسٹوں میں یہ لوگوں کے اندازے سے کہیں زیادہ وسیع ہوتا ہے۔ یہی عدد بتاتا ہے کہ کوئی فرق حقیقی ہے یا محض شور۔
- معیاری گروہ اور پرسنٹائل: آپ کے اسکور کا موازنہ کس سے کیا جاتا ہےخام اسکور اپنی جگہ پر قابلِ تشریح نہیں ہوتا۔ یہ صرف حوالہ جاتی گروہ کے مقابلے میں بامعنی بنتا ہے، اور یہ کہ کون سا گروہ استعمال ہوا، کسی بھی ٹیسٹ کے بارے میں سب سے زیادہ اثر انداز ہونے والی اور سب سے کم بتائی جانے والی حقیقتوں میں سے ایک ہے۔
- نفسیاتی ٹیسٹ دراصل کیسے تیار کیا جاتا ہےتصور کی تعریف سے لے کر شائع شدہ معیاری گروہ تک کا یہ سلسلہ برسوں پر محیط ہوتا ہے اور اس میں شامل بیشتر چیزیں رد کر دی جاتی ہیں۔ ان مراحل کو جان لینے سے صاف نظر آ جاتا ہے کہ کسی عام آن لائن کوئز نے کون سے مراحل چھوڑ دیے۔
- جب کسی ٹیسٹ کو مصدقہ کہا جاتا ہے تو اس کا کیا مطلب ہوتا ہے؟یہ لفظ کسی ضابطے کا پابند نہیں، اور ایسی مصنوعات بھی اسے کھلے عام استعمال کرتی ہیں جنہوں نے اس کے لیے کوئی کام نہیں کیا۔ یہاں بتایا گیا ہے کہ جب اس لفظ کا کوئی مطلب ہوتا ہے تو وہ کیا ہوتا ہے، اور وہ چار سوالات کون سے ہیں جو دونوں صورتوں میں فرق کرتے ہیں۔
- انٹرنیٹ پر موجود زیادہ تر شخصیت کے ٹیسٹ قابلِ اعتبار کیوں نہیں ہوتےاس لیے نہیں کہ وہ بددیانت ہیں، بلکہ اس لیے کہ جن مراحل سے پیمائش قابل اعتماد بنتی ہے وہ نظر نہیں آتے، مہنگے ہوتے ہیں اور انہیں چھوڑ دینا آسان ہوتا ہے؛ اور انہیں چھوڑ دینے سے نتیجے کی ظاہری شکل میں کوئی فرق نہیں پڑتا۔
- خود رپورٹ کیا ناپ سکتی ہے اور کیا نہیںسوالنامے آپ سے کہتے ہیں کہ آپ خود اپنے مبصر بنیں، جو کچھ چیزوں کے لیے دوسری چیزوں کے مقابلے میں بہتر کام کرتا ہے۔ یہ جاننا کہ یہ طریقہ کہاں مضبوط ہے اور کہاں ناکام رہتا ہے، آپ کے کسی بھی نتیجے کو پڑھنے کا انداز بدل دیتا ہے۔
- جب کوئی ٹیسٹ کسی چیز کی پیش گوئی کرتا ہے تو اس کا کیا مطلب ہوتا ہےشخصیت کی تحقیق میں 0.30 کا ارتباط ایک مضبوط نتیجہ ہے، لیکن کسی ایک فرد کے بارے میں فیصلے کے لیے یہ کمزور بنیاد ہے۔ دونوں باتیں درست ہیں، اور ٹیسٹ کے نتائج کے زیادہ تر غلط استعمال کی وجہ ان دونوں کے درمیان یہی فرق ہے۔
- اسکریننگ تشخیص نہیں ہےاسکریننگ سوالنامہ اس مقصد کے لیے بنایا جاتا ہے کہ زیادہ سے زیادہ ممکنہ کیسز پکڑ سکے، اور اس کی قیمت کے طور پر غلط مثبت نتائج کی بلند شرح قبول کی جاتی ہے۔ اسکریننگ اسکور کو تشخیص سمجھ کر پڑھنا اس کے اصل مقصد کو الٹ دیتا ہے۔