Cronbach's alpha کیا ہے، اور کیا نہیں ہے
نفسیاتی ٹیسٹنگ میں سب سے زیادہ رپورٹ کیا جانے والا شماریہ، اور سب سے زیادہ غلط سمجھا جانے والا بھی۔ الفا یہ نہیں بتاتا کہ کوئی پیمانہ یک جہتی ہے، اور زیادہ قدر اکثر خوبی کے بجائے کسی خرابی کی علامت ہوتی ہے۔
کرون باخ کا الفا اندرونی ہم آہنگی کا ایک عددی سر ہے: یعنی کسی پیمانے کے آئٹمز ایک دوسرے سے کس حد تک وابستہ ہیں۔ یہ 1951 میں شائع ہوا تھا اور آج سب سے زیادہ رپورٹ کیا جانے والا نفسیاتی پیمائشی شماریہ ہے، مگر اس کا استعمال اس کی افادیت سے کہیں آگے نکل چکا ہے۔
الفا 0 سے 1 کے درمیان ہوتا ہے اور اس کا انحصار دو چیزوں پر ہے: آئٹمز کے درمیان اوسط ارتباط اور آئٹمز کی تعداد۔ یہی دوسرا انحصار زیادہ تر غلط فہمیوں کی جڑ ہے۔
بلند الفا کا مطلب کیا نہیں ہے
اس کا مطلب یہ نہیں کہ پیمانہ ایک ہی چیز کی پیمائش کرتا ہے۔ یہ سب سے عام غلطی ہے۔ الفا ایسے پیمانے کے لیے بھی بلند ہو سکتا ہے جس میں دو یا تین الگ عوامل ہوں، بشرطیکہ آئٹمز مجموعی طور پر کافی حد تک باہم وابستہ ہوں۔ یک جہتی کو عاملی تجزیے سے ثابت کرنا پڑتا ہے؛ الفا اسے ثابت نہیں کر سکتا اور اس کا مقصد کبھی یہ تھا بھی نہیں۔
اس کا مطلب یہ نہیں کہ پیمانہ صادق ہے۔ الفا یہ نہیں بتاتا کہ آئٹمز کس چیز کی پیمائش کر رہے ہیں۔ جوتے کے سائز کے بارے میں بیس سوالات کی اندرونی ہم آہنگی بہترین ہو گی، مگر کسی بھی نفسیاتی پہلو کی پیمائش کے طور پر ان کی صداقت صفر ہو گی۔
اس کا مطلب یہ نہیں کہ پیمانہ اچھا ہے۔ چونکہ الفا آئٹمز کی تعداد بڑھنے سے بڑھتا ہے، اس لیے معمولی آئٹمز پر مشتمل ایک طویل پیمانہ بہترین آئٹمز پر مشتمل مختصر پیمانے سے آگے نکل جائے گا۔ چالیس آئٹمز کا ایسا پیمانہ جس میں آئٹمز کے درمیان اوسط ارتباط 0.2 ہو، 0.90 سے اوپر پہنچ جاتا ہے۔
بہت بلند الفا اکثر ایک انتباہ ہوتا ہے۔ تقریباً 0.95 سے اوپر آئٹمز عموماً ایک دوسرے کی تقریباً ہو بہو دہرائی ہوتے ہیں۔ اس سے ہم آہنگی تو حاصل ہو جاتی ہے، مگر تصور کی جامع نمائندگی کی قیمت پر: پیمانہ ایک تنگ پہلو کی پیمائش بہت درستی سے کرتا ہے اور تصور کے باقی حصے سے محروم رہ جاتا ہے۔ اسے تخفیفی تضاد کہا جاتا ہے، اور اسی لیے ہم آہنگی کا زیادہ ہونا ہر حال میں بہتر نہیں ہوتا۔
یہ کیا فرض کرتا ہے
الفا اعتباریت کی ایک نچلی حد ہے، اور یہ ایک مخصوص مفروضے کے تحت ہے: ٹاؤ ہم قیمتی، یعنی ہر آئٹم بنیادی خصلت میں برابر حصہ ڈالتا ہے۔ حقیقی پیمانے اس مفروضے پر شاذ و نادر ہی پورے اترتے ہیں۔ آئٹمز اس بات میں مختلف ہوتے ہیں کہ وہ عامل پر کتنی شدت سے لدے ہوتے ہیں، اور جب ایسا ہو تو الفا اعتباریت کو کم تخمینہ کرتا ہے۔
میک ڈونلڈ کا اومیگا برابر حصہ ڈالنے کا مفروضہ ترک کر دیتا ہے اور اعتباریت کا تخمینہ عامل پر اصل لدان سے لگاتا ہے۔ ماہرینِ طریقیات دو دہائیوں سے الفا کے مقابلے میں اسے تجویز کرتے آ رہے ہیں۔ رپورٹنگ کے عمل میں اس کی پیروی سست رہی ہے، جس کی بڑی وجہ یہ ہے کہ الفا ہر شماریاتی پیکیج میں ایک سطر میں نکل آتا ہے جبکہ اومیگا ایسا نہیں۔
عملی طور پر اسے کیسے پڑھیں
موٹے طور پر مروجہ اصول یہ ہیں: گروہوں کا موازنہ کرنے والی تحقیق کے لیے 0.70 اور اس سے اوپر قابلِ قبول ہے، عملی استعمال کے لیے 0.80 اور اس سے اوپر، اور جہاں اسکور کسی فرد کے بارے میں فیصلے پر اثر انداز ہو وہاں 0.90 اور اس سے اوپر۔ انہیں حد فاصل نہیں بلکہ رہنمائی سمجھیں، کیونکہ مطلوبہ سطح اس فیصلے کی اہمیت پر منحصر ہے جس کے لیے اسکور استعمال ہو رہا ہے۔
زیادہ معلومات افزا اعداد و شمار عموماً اسی مقالے میں کہیں اور ہوتے ہیں۔ آئٹمز کے درمیان اوسط ارتباط (0.15 سے 0.50 صحت مند دائرہ ہے) بتاتا ہے کہ بلند الفا آئٹمز کے معیار سے آیا ہے یا ان کی تعداد سے۔ آئٹمز کی تعداد دوسری جانب سے وہی بات بتاتی ہے۔ ٹیسٹ اور دوبارہ ٹیسٹ کی اعتباریت وہ بات بتاتی ہے جو الفا ساختی طور پر نہیں بتا سکتا: کہ کیا ایک ہی شخص میں اسکور وقت کے ساتھ مستحکم رہتا ہے۔
جو پیمانہ صرف الفا رپورٹ کرے، اس نے اعتباریت کے اعداد و شمار میں سے وہ حاصل کیا ہے جو سب سے آسانی سے مل جاتا ہے اور جس پر پورا اترنا سب سے کم مشکل ہے۔
خود آزمائیں
پیمائش کے بارے میں پڑھنا ایک بات ہے۔ اپنا اسکور اس کے ماخذ، معیاری گروہ کے نمونے اور حدود کے ساتھ دیکھنا بالکل دوسری بات ہے۔ دینا مفت ہے، سائن اپ کی ضرورت نہیں۔
پڑھنا جاری رکھیں
- نفسیاتی پیمائش (سائیکومیٹرکس) کیا ہے؟وہ شعبہ جو یہ طے کرتا ہے کہ کوئی نفسیاتی پیمائش کتنی معتبر ہے، اور وہ وجہ جس کے باعث ملتے جلتے سوالات پوچھنے والے دو ٹیسٹ اپنے نتائج کی قدر میں بے حد مختلف ہو سکتے ہیں۔
- نفسیاتی ٹیسٹ میں اعتباریت کیا ہے؟اعتباریت پیمائش کے تسلسل کا نام ہے، درستی کا نہیں۔ ایک ٹیسٹ بہت زیادہ قابلِ اعتبار ہو کر بھی غلط چیز کی پیمائش کر سکتا ہے؛ اسی لیے یہ پہلا سوال ہوتا ہے، آخری کبھی نہیں۔
- نفسیاتی ٹیسٹ میں صداقت کیا ہے؟صداقت کوئی ایسی خصوصیت نہیں جو ٹیسٹ کے پاس ہوتی ہے۔ یہ ایک دلیل ہے کہ کسی مخصوص اسکور کی کسی مخصوص مقصد کے لیے کی گئی کوئی خاص تشریح کس حد تک قابلِ دفاع ہے، اور ہر نئے استعمال کے لیے اسے دوبارہ تعمیر کرنا پڑتا ہے۔
- تصوراتی صداقت کیا ہے؟پیمائش کا سب سے مشکل سوال: کیا جس چیز کو آپ ناپ رہے ہیں وہ اسی طرح موجود ہے جیسے آپ نے اس کی تعریف کی ہے، اور کیا آپ کا آلۂ پیمائش واقعی اس تک پہنچتا ہے یا کسی قریبی چیز تک۔
- ارتکازی اور امتیازی صداقتیہ دو ایک دوسرے کے عکس تقاضے ہیں: پیمانے کو ان چیزوں سے مطابقت رکھنی چاہیے جن سے اسے رکھنی چاہیے، اور ان چیزوں سے الگ رہنا چاہیے جو وہ ہونے کا دعویٰ نہیں کرتا۔ زیادہ تر کمزور آلات دوسرے تقاضے پر پورا نہیں اترتے۔
- پیمائش کی معیاری غلطی: آپ کا اسکور کتنا مختلف ہو سکتا ہےہر اسکور کے ساتھ غلطی کا ایک دائرہ ہوتا ہے، اور بیشتر نفسیاتی ٹیسٹوں میں یہ لوگوں کے اندازے سے کہیں زیادہ وسیع ہوتا ہے۔ یہی عدد بتاتا ہے کہ کوئی فرق حقیقی ہے یا محض شور۔
- معیاری گروہ اور پرسنٹائل: آپ کے اسکور کا موازنہ کس سے کیا جاتا ہےخام اسکور اپنی جگہ پر قابلِ تشریح نہیں ہوتا۔ یہ صرف حوالہ جاتی گروہ کے مقابلے میں بامعنی بنتا ہے، اور یہ کہ کون سا گروہ استعمال ہوا، کسی بھی ٹیسٹ کے بارے میں سب سے زیادہ اثر انداز ہونے والی اور سب سے کم بتائی جانے والی حقیقتوں میں سے ایک ہے۔
- نفسیاتی ٹیسٹ دراصل کیسے تیار کیا جاتا ہےتصور کی تعریف سے لے کر شائع شدہ معیاری گروہ تک کا یہ سلسلہ برسوں پر محیط ہوتا ہے اور اس میں شامل بیشتر چیزیں رد کر دی جاتی ہیں۔ ان مراحل کو جان لینے سے صاف نظر آ جاتا ہے کہ کسی عام آن لائن کوئز نے کون سے مراحل چھوڑ دیے۔
- جب کسی ٹیسٹ کو مصدقہ کہا جاتا ہے تو اس کا کیا مطلب ہوتا ہے؟یہ لفظ کسی ضابطے کا پابند نہیں، اور ایسی مصنوعات بھی اسے کھلے عام استعمال کرتی ہیں جنہوں نے اس کے لیے کوئی کام نہیں کیا۔ یہاں بتایا گیا ہے کہ جب اس لفظ کا کوئی مطلب ہوتا ہے تو وہ کیا ہوتا ہے، اور وہ چار سوالات کون سے ہیں جو دونوں صورتوں میں فرق کرتے ہیں۔
- انٹرنیٹ پر موجود زیادہ تر شخصیت کے ٹیسٹ قابلِ اعتبار کیوں نہیں ہوتےاس لیے نہیں کہ وہ بددیانت ہیں، بلکہ اس لیے کہ جن مراحل سے پیمائش قابل اعتماد بنتی ہے وہ نظر نہیں آتے، مہنگے ہوتے ہیں اور انہیں چھوڑ دینا آسان ہوتا ہے؛ اور انہیں چھوڑ دینے سے نتیجے کی ظاہری شکل میں کوئی فرق نہیں پڑتا۔
- خود رپورٹ کیا ناپ سکتی ہے اور کیا نہیںسوالنامے آپ سے کہتے ہیں کہ آپ خود اپنے مبصر بنیں، جو کچھ چیزوں کے لیے دوسری چیزوں کے مقابلے میں بہتر کام کرتا ہے۔ یہ جاننا کہ یہ طریقہ کہاں مضبوط ہے اور کہاں ناکام رہتا ہے، آپ کے کسی بھی نتیجے کو پڑھنے کا انداز بدل دیتا ہے۔
- جب کوئی ٹیسٹ کسی چیز کی پیش گوئی کرتا ہے تو اس کا کیا مطلب ہوتا ہےشخصیت کی تحقیق میں 0.30 کا ارتباط ایک مضبوط نتیجہ ہے، لیکن کسی ایک فرد کے بارے میں فیصلے کے لیے یہ کمزور بنیاد ہے۔ دونوں باتیں درست ہیں، اور ٹیسٹ کے نتائج کے زیادہ تر غلط استعمال کی وجہ ان دونوں کے درمیان یہی فرق ہے۔
- اسکریننگ تشخیص نہیں ہےاسکریننگ سوالنامہ اس مقصد کے لیے بنایا جاتا ہے کہ زیادہ سے زیادہ ممکنہ کیسز پکڑ سکے، اور اس کی قیمت کے طور پر غلط مثبت نتائج کی بلند شرح قبول کی جاتی ہے۔ اسکریننگ اسکور کو تشخیص سمجھ کر پڑھنا اس کے اصل مقصد کو الٹ دیتا ہے۔