मनोवैज्ञानिक परीक्षण में विश्वसनीयता क्या है?
विश्वसनीयता का मतलब माप में निरंतरता है, सही होना नहीं। कोई परीक्षण बहुत विश्वसनीय हो सकता है और फिर भी गलत चीज़ माप सकता है। इसीलिए यह पहला सवाल होता है, लेकिन आखिरी कभी नहीं।
विश्वसनीयता बताती है कि कोई माप बार-बार करने पर कितना एक जैसा रहता है, बजाय इसके कि उसमें बेतरतीब उतार-चढ़ाव हो। अगर आप एक मिनट में अपना वज़न तीन बार मापें और नतीजे 71, 78 और 66 किलोग्राम आएँ, तो वह तराज़ू विश्वसनीय नहीं होगा। उससे आपको अपना वास्तविक वज़न जानने का कोई तरीका नहीं मिलेगा। मनोवैज्ञानिक मापन में भी यही समस्या है, जबकि उसके उपकरण कहीं कम सटीक होते हैं।
विश्वसनीयता के बारे में सबसे ज़रूरी बात यह समझना है कि इससे क्या साबित नहीं होता। अगर घर का तराज़ू हर बार आपका वज़न वास्तविक वज़न से आठ किलोग्राम अधिक दिखाए, तो वह पूरी तरह विश्वसनीय होगा, लेकिन पूरी तरह गलत भी। विश्वसनीयता का संबंध एक जैसे नतीजे मिलने से है; संख्या सही बात बताती है या नहीं, यह अलग सवाल है, जिसे वैधता कहते हैं। वैधता के लिए विश्वसनीयता ज़रूरी है, लेकिन केवल विश्वसनीयता होना काफ़ी नहीं है।
विश्वसनीयता के रूप
आंतरिक संगति यह देखती है कि किसी पैमाने के प्रश्न आपस में कितने मेल खाते हैं। अगर दस प्रश्नों का उद्देश्य एक ही अंतर्निहित गुण को मापना है, तो एक प्रश्न पर अधिक अंक पाने वाले लोगों को दूसरे प्रश्नों पर भी अधिक अंक मिलने की प्रवृत्ति होनी चाहिए। इसे आमतौर पर क्रोनबाख अल्फ़ा या, बेहतर विकल्प के रूप में, मैकडॉनल्ड ओमेगा से बताया जाता है।
पुनः परीक्षण विश्वसनीयता यह देखती है कि एक ही व्यक्ति को दो अलग अवसरों पर मिलते-जुलते अंक मिलते हैं या नहीं। गुणों के लिए यह सबसे महत्वपूर्ण रूप है, क्योंकि गुणों को परिभाषा के अनुसार स्थिर होना चाहिए। यही वह रूप भी है जिसके आँकड़े अक्सर नहीं दिए जाते, क्योंकि इसके लिए कई हफ़्तों बाद उन्हीं प्रतिभागियों से दोबारा संपर्क करना पड़ता है।
मूल्यांकनकर्ताओं के बीच विश्वसनीयता तब लागू होती है जब उपकरण का मूल्यांकन लोग करते हैं, जैसे नैदानिक साक्षात्कार, प्रक्षेपी तकनीकें और व्यवहार का अवलोकन। यह देखती है कि एक ही सामग्री को देखकर दो प्रशिक्षित मूल्यांकनकर्ता एक ही निष्कर्ष पर पहुँचते हैं या नहीं।
समांतर रूपों की विश्वसनीयता यह देखती है कि एक ही परीक्षण के दो अलग संस्करण, जिन्हें समकक्ष बनाया गया है, समान अंक देते हैं या नहीं। यह वहाँ महत्वपूर्ण है जहाँ कोई परीक्षण एक से अधिक बार लिया जाता है और प्रश्नों से पहले ही परिचित हो जाने की चिंता होती है।
संख्याओं को समझना
विश्वसनीयता गुणांक 0 से 1 के बीच होते हैं। इनके लिए प्रचलित सीमाएँ मोटे तौर पर तय की गई हैं और अक्सर उनका गलत इस्तेमाल होता है, लेकिन सामान्य रूप से: जहाँ किसी व्यक्ति का जीवन उसके अंकों से प्रभावित होता है, वहाँ 0.90 से अधिक आवश्यक है; अधिकांश व्यावहारिक उपयोगों के लिए 0.80 से 0.90 अच्छा है; शोध और समूहों की तुलना के लिए 0.70 से 0.80 स्वीकार्य है; और 0.70 से कम का मतलब है कि अंकों में इतना बेतरतीब उतार-चढ़ाव है कि ज़्यादातर निष्कर्ष भरोसेमंद नहीं रहेंगे।
इन सीमाओं के बारे में दो सावधानियाँ हैं। पहली, ये प्रचलित मान्यताएँ हैं, नियम नहीं; स्वीकार्य स्तर पूरी तरह इस पर निर्भर करता है कि अंकों का उपयोग किस लिए होगा। दूसरी, छोटे पैमाने पर बहुत अधिक अल्फ़ा आमतौर पर यह दिखाता है कि प्रश्न लगभग एक ही बात को अलग शब्दों में पूछते हैं। इससे एक जैसे नतीजे तो मिलते हैं, लेकिन मापी जा रही संरचना के पहलू छूट जाते हैं। दस प्रश्नों वाला कोई पैमाना अगर हर प्रश्न में थोड़े अलग शब्दों से केवल "क्या आप व्यवस्थित हैं?" पूछे, तो उसकी आंतरिक संगति शानदार होगी, लेकिन वह कर्तव्यनिष्ठा के सीमित पहलू को ही मापेगा।
आपके अपने अंकों के लिए इसका अर्थ
विश्वसनीयता से सीधे पता चलता है कि किसी एक संख्या पर कितना भरोसा किया जा सकता है। 0.85 विश्वसनीयता वाले परीक्षण में भी मापन की त्रुटि इतनी हो सकती है कि दो लोगों के अंकों में कुछ अंकों का अंतर, या आपके आज और पिछले महीने के अंकों में ऐसा अंतर, वास्तविक बदलाव के बजाय बेतरतीब उतार-चढ़ाव होने की बहुत संभावना रखता है।
इसका व्यावहारिक नतीजा यह है: एक अच्छा उपकरण अपनी विश्वसनीयता बताता है, ताकि आप जान सकें कि आपके अंकों के आसपास कितनी अनिश्चितता है। इस अनिश्चितता को तकनीकी रूप से मापन की मानक त्रुटि से व्यक्त किया जाता है। यह विश्वसनीयता गुणांक के आधार पर अंकों के आसपास संभावित कमी या बढ़ोतरी की सीमा बताती है।
जो उपकरण विश्वसनीयता का कोई आँकड़ा नहीं बताता, वह इस वजह से अधिक सटीक नहीं हो जाता। उसने बस यह बताने से परहेज़ किया है कि उसमें कितनी अशुद्धि है।
इसे आज़माकर देखें
मापन के बारे में पढ़ना एक बात है। अपने अंक को उसके स्रोत, उसके मानक नमूने और उसकी सीमाओं के साथ देखना दूसरी बात है। देने में निःशुल्क, साइन अप की आवश्यकता नहीं।
पढ़ना जारी रखें
- मनोमिति क्या है?वह विधा जो जाँचती है कि कोई मनोवैज्ञानिक माप कितना अच्छा है। इसी से समझ आता है कि मिलते-जुलते प्रश्न पूछने वाले दो परीक्षणों के परिणामों की उपयोगिता में इतना बड़ा अंतर क्यों हो सकता है।
- मनोवैज्ञानिक परीक्षण में वैधता क्या है?वैधता परीक्षण का कोई स्थायी गुण नहीं है। यह इस बात का तर्क है कि किसी खास उद्देश्य के लिए, किसी खास अंक की खास व्याख्या कितनी उचित है। हर नए उपयोग के लिए यह तर्क फिर से तैयार करना पड़ता है।
- संरचना की वैधता क्या है?मापन का सबसे कठिन सवाल: क्या जिस चीज़ को आप माप रहे हैं, वह आपके तय किए हुए अर्थ में मौजूद है, और क्या आपका उपकरण उसी को मापता है, न कि उससे मिलती-जुलती किसी दूसरी चीज़ को।
- अभिसारी और विभेदी वैधतादो एक-दूसरे के पूरक मानदंड हैं: किसी माप को उन चीज़ों से मेल खाना चाहिए जिनसे मेल खाने की अपेक्षा है, और उन चीज़ों से अलग रहना चाहिए जिनसे वह अलग होने का दावा करता है। अधिकांश कमज़ोर उपकरण दूसरे मानदंड पर खरे नहीं उतरते।
- क्रोनबाख का अल्फ़ा क्या है, और क्या नहीं हैमनोवैज्ञानिक परीक्षणों में सबसे अधिक बताई जाने वाली सांख्यिकीय संख्या, और सबसे अधिक गलत समझी जाने वाली भी। अल्फ़ा से यह पता नहीं चलता कि कोई पैमाना केवल एक आयाम मापता है, और उसका उच्च मान अक्सर गुण नहीं, बल्कि किसी समस्या का संकेत होता है।
- मापन की मानक त्रुटि: आपके अंक में कितना अंतर हो सकता हैहर अंक में कुछ त्रुटि की गुंजाइश होती है, और अधिकांश मनोवैज्ञानिक परीक्षणों में यह लोगों की अपेक्षा से अधिक होती है। यही संख्या बताती है कि अंकों में अंतर कब वास्तविक है और कब केवल माप में उतार-चढ़ाव है।
- मानक और प्रतिशतक: आपके अंकों की तुलना किससे की जाती हैकच्चे अंकों की अपने आप में व्याख्या नहीं की जा सकती। वे केवल किसी संदर्भ समूह से तुलना करने पर अर्थपूर्ण होते हैं। किस समूह का इस्तेमाल हुआ, यह किसी भी परीक्षण के बारे में सबसे महत्वपूर्ण, लेकिन सबसे कम बताया जाने वाला तथ्य है।
- मनोमितीय परीक्षण वास्तव में कैसे बनाया जाता हैसंरचना की परिभाषा से लेकर प्रकाशित मानकों तक की प्रक्रिया में कई साल लगते हैं, और इस दौरान तैयार की गई अधिकांश सामग्री हटा दी जाती है। इन चरणों को जानने से स्पष्ट हो जाता है कि एक त्वरित ऑनलाइन प्रश्नोत्तरी ने कौन-से चरण छोड़ दिए।
- किसी परीक्षण को वैधता-प्रमाणित कहने का क्या अर्थ है?इस शब्द के इस्तेमाल पर कोई नियंत्रण नहीं है और ऐसे उत्पाद भी इसे बेझिझक इस्तेमाल करते हैं जिन्होंने इसके पीछे का कोई काम नहीं किया है। जब इस शब्द का कोई ठोस अर्थ होता है, तो वह क्या होता है, और कौन-से चार सवाल इन दोनों स्थितियों में फ़र्क बताते हैं, यहाँ जानें।
- इंटरनेट पर उपलब्ध अधिकांश व्यक्तित्व परीक्षण विश्वसनीय क्यों नहीं हैंइसलिए नहीं कि वे बेईमान हैं, बल्कि इसलिए कि किसी माप को भरोसेमंद बनाने वाले चरण दिखाई नहीं देते, महँगे होते हैं और उन्हें छोड़ देना आसान होता है। उन्हें छोड़ देने से परिणाम कैसा दिखता है, इसमें कोई बदलाव नहीं आता।
- स्व-रिपोर्ट से क्या मापा जा सकता है और क्या नहींप्रश्नावलियाँ आपसे अपने व्यवहार का खुद निरीक्षण करने को कहती हैं। यह तरीका कुछ बातों के लिए दूसरों की तुलना में बेहतर काम करता है। यह जानने से कि यह तरीका कहाँ कारगर है और कहाँ नहीं, किसी भी परिणाम को समझने का आपका तरीका बदल जाता है।
- जब कोई परीक्षण किसी बात का पूर्वानुमान करता है, तो इसका क्या अर्थ होता हैव्यक्तित्व संबंधी शोध में 0.30 का सहसंबंध एक ठोस निष्कर्ष है, लेकिन किसी एक व्यक्ति के बारे में निर्णय लेने के लिए यह कमज़ोर आधार है। दोनों बातें सही हैं, और इनके बीच के अंतर के कारण ही परीक्षण के परिणामों का सबसे अधिक गलत उपयोग होता है।
- प्रारंभिक जाँच निदान नहीं हैजाँच प्रश्नावली इस तरह बनाई जाती है कि वह अधिक से अधिक संभावित मामलों की पहचान कर सके। इसके लिए गलत ढंग से किसी को संभावित मामला मान लेने की ऊँची दर स्वीकार की जाती है। जाँच के अंकों को निदान मानना उसके उद्देश्य को उलट देना है।