noesisnoesis
পরিমাপ কীভাবে কাজ করে

মনস্তাত্ত্বিক পরীক্ষায় নির্ভরযোগ্যতা কী?

নির্ভরযোগ্যতা হলো পরিমাপের ধারাবাহিকতা, সঠিকতা নয়। একটি পরীক্ষা অত্যন্ত নির্ভরযোগ্য হয়েও ভুল জিনিস পরিমাপ করতে পারে। এ কারণেই এটি সবার আগে জিজ্ঞাসা করা প্রশ্ন, কিন্তু কখনোই শেষ প্রশ্ন নয়।

নির্ভরযোগ্যতা হলো একটি পরিমাপ কতটা পুনরাবৃত্তিযোগ্য, অর্থাৎ তা কতটা আসল ফলাফল এবং কতটা নিছক গোলমাল (নয়েজ)। এক মিনিটে তিনবার নিজের ওজন মেপে যদি 71, 78 ও 66 কিলোগ্রাম পান, তাহলে স্কেলটি নির্ভরযোগ্য নয়, আর তা থেকে আপনার প্রকৃত ওজন জানার কোনো উপায় থাকে না। মনস্তাত্ত্বিক পরিমাপও একই সমস্যার মুখোমুখি হয়, তবে তার যন্ত্র অনেক কম নিখুঁত।

নির্ভরযোগ্যতা সম্পর্কে সবচেয়ে গুরুত্বপূর্ণ বিষয় হলো, এটি কী দাবি করে না। যে বাথরুম স্কেল প্রতিবারই আট কিলোগ্রাম বেশি দেখায়, সেটি পুরোপুরি নির্ভরযোগ্য, অথচ সম্পূর্ণ ভুল। নির্ভরযোগ্যতা মানে সামঞ্জস্য; সংখ্যাটি সঠিক জিনিস বোঝাচ্ছে কি না, সেটি আলাদা প্রশ্ন, যাকে বলা হয় বৈধতা। বৈধতার জন্য নির্ভরযোগ্যতা অপরিহার্য, কিন্তু তা মোটেও যথেষ্ট নয়।

এর বিভিন্ন রূপ

অভ্যন্তরীণ সামঞ্জস্য জানতে চায়, একটি স্কেলের আইটেমগুলো পরস্পরের সঙ্গে মেলে কি না। দশটি প্রশ্নই যদি একই অন্তর্নিহিত বৈশিষ্ট্য মাপার কথা হয়, তাহলে যাঁরা একটিতে উচ্চ উত্তর দেন, তাঁদের বাকিগুলোতেও উচ্চ উত্তর দেওয়ার প্রবণতা থাকার কথা। এটি সাধারণত Cronbach's alpha, বা আরও ভালো হলে McDonald's omega হিসেবে জানানো হয়।

টেস্ট-রিটেস্ট নির্ভরযোগ্যতা জানতে চায়, একই ব্যক্তি দুটি ভিন্ন সময়ে একই রকম স্কোর করেন কি না। বৈশিষ্ট্যের ক্ষেত্রে এটিই সবচেয়ে গুরুত্বপূর্ণ, কারণ সংজ্ঞা অনুযায়ী বৈশিষ্ট্য স্থিতিশীল হওয়ার কথা। অথচ এটিই সবচেয়ে বেশি অপ্রকাশিত থাকে, কারণ কয়েক সপ্তাহ পরে একই অংশগ্রহণকারীদের খুঁজে বের করতে হয়।

আন্তঃমূল্যায়নকারী নির্ভরযোগ্যতা প্রযোজ্য হয় যখন মানুষ নিজে পরিমাপক স্কোর করেন, যেমন ক্লিনিক্যাল সাক্ষাৎকার, প্রজেক্টিভ কৌশল ও আচরণ পর্যবেক্ষণে। এটি জানতে চায়, একই উপাদান দেখে দুজন প্রশিক্ষিত মূল্যায়নকারী একই সিদ্ধান্তে পৌঁছান কি না।

সমান্তরাল ফর্মের নির্ভরযোগ্যতা জানতে চায়, একই পরীক্ষার সমতুল্য হিসেবে তৈরি দুটি ভিন্ন সংস্করণ একই স্কোর দেয় কি না। যেখানে একটি পরীক্ষা একাধিকবার নেওয়া হয় এবং আইটেম আগে থেকে জানা হয়ে যাওয়ার আশঙ্কা থাকে, সেখানে এটি গুরুত্বপূর্ণ।

সংখ্যাগুলো পড়ার উপায়

নির্ভরযোগ্যতার সহগ 0 থেকে 1 পর্যন্ত হয়। প্রচলিত মানদণ্ডগুলো মোটামুটি এবং প্রায়ই ভুলভাবে ব্যবহৃত হয়, তবে মোটামুটি এ রকম: কোনো স্কোর একজন ব্যক্তির জীবনে প্রভাব ফেললে 0.90-এর বেশি প্রয়োজন, বেশিরভাগ ব্যবহারিক কাজে 0.80 থেকে 0.90 ভালো, গবেষণা ও গোষ্ঠীগত তুলনার জন্য 0.70 থেকে 0.80 গ্রহণযোগ্য, আর 0.70-এর নিচে মানে স্কোরে এত বেশি গোলমাল থাকে যে বেশিরভাগ সিদ্ধান্তই টেকে না।

এই সীমারেখা নিয়ে দুটি সতর্কতা। প্রথমত, এগুলো প্রথা, আইন নয়; গ্রহণযোগ্য মাত্রা সম্পূর্ণ নির্ভর করে স্কোরটি কী কাজে ব্যবহৃত হবে তার ওপর। দ্বিতীয়ত, ছোট স্কেলে খুব উচ্চ alpha সাধারণত বোঝায় যে আইটেমগুলো প্রায় একই কথার ভিন্ন রূপ। এতে সামঞ্জস্য পাওয়া যায়, কিন্তু কনস্ট্রাক্টের পরিধি কমে যায়। দশটি প্রশ্নই যদি সামান্য ভিন্ন শব্দে কেবল জিজ্ঞেস করে "আপনি কি গোছানো?", তাহলে অভ্যন্তরীণ সামঞ্জস্য চমৎকার হবে, কিন্তু বিবেকবোধের চিত্র হবে সংকীর্ণ।

আপনার নিজের স্কোরের জন্য এর অর্থ

নির্ভরযোগ্যতা সরাসরি নির্ধারণ করে, একটি সংখ্যার ওপর কতটা আস্থা রাখা যায়। 0.85 নির্ভরযোগ্যতার একটি পরীক্ষায় পরিমাপের ত্রুটি এতটা থাকে যে দুজন ব্যক্তির মধ্যে, বা আজকের ও গত মাসের স্কোরের মধ্যে কয়েক পয়েন্টের পার্থক্য সম্ভবত গোলমালই, কোনো প্রকৃত সংকেত নয়।

ব্যবহারিক পরিণতি হলো: একটি ভালো পরিমাপক তার নির্ভরযোগ্যতা জানিয়ে দেয়, যাতে আপনি বুঝতে পারেন আপনার স্কোরের চারপাশে অনিশ্চয়তা কতটা। এই অনিশ্চয়তার প্রযুক্তিগত প্রকাশ হলো পরিমাপের প্রমিত ত্রুটি, যা নির্ভরযোগ্যতার সহগকে স্কোরের চারপাশে একটি প্লাস-মাইনাস পরিসরে রূপান্তর করে।

যে পরিমাপক নির্ভরযোগ্যতার কোনো সংখ্যাই জানায় না, সে তাই বেশি নিখুঁত হয়ে যায় না। সে কেবল জানাতে অস্বীকার করেছে যে সে কতটা অনিখুঁত।

নিজেই যাচাই করুন

পরিমাপ নিয়ে পড়া এক কথা। আপনার নিজের স্কোর তার উৎস, নর্ম নমুনা ও সীমাবদ্ধতাসহ দেখা আরেক কথা। বিনামূল্যে দেওয়া যায়, সাইনআপ লাগে না।

পড়তে থাকুন

মনস্তাত্ত্বিক পরীক্ষায় নির্ভরযোগ্যতা কী? | NOESIS