কোনো পরীক্ষা কিছু পূর্বাভাস দেয় বলতে কী বোঝায়
ব্যক্তিত্ব গবেষণায় 0.30 সহসম্বন্ধ একটি শক্তিশালী ফলাফল, অথচ একজন ব্যক্তির সম্পর্কে সিদ্ধান্ত নেওয়ার জন্য এটি দুর্বল ভিত্তি। দুটি কথাই সত্য, আর এই দুইয়ের ফারাকই পরীক্ষার ফলাফলের বেশিরভাগ অপব্যবহারের কারণ।
ব্যক্তিত্ব গবেষণায় বলা হয় যে দায়িত্বশীলতা কর্মক্ষেত্রে কাজের দক্ষতার পূর্বাভাস দেয়। এই বাক্য পড়ে বেশিরভাগ মানুষ ডেটা যতটা দেখায় তার চেয়ে অনেক জোরালো কিছু কল্পনা করেন। পরিসংখ্যানগত দাবি এবং "পূর্বাভাস দেয়" কথাটির দৈনন্দিন অর্থের মধ্যকার এই ফারাক থেকেই মনস্তাত্ত্বিক পরীক্ষার বেশিরভাগ অপব্যবহারের শুরু।
সংশ্লিষ্ট সংখ্যাগুলো
ব্যক্তিত্ব গবেষণায় প্রভাবের মাত্রা সাধারণত সহসম্বন্ধ হিসেবে প্রকাশ করা হয়। সুপ্রতিষ্ঠিত সম্পর্কগুলোর মেটা-বিশ্লেষণভিত্তিক মান সাধারণত 0.20 থেকে 0.35 এর মধ্যে থাকে। দায়িত্বশীলতা ও কাজের দক্ষতার সম্পর্ক প্রায় 0.20 থেকে 0.25। কাজে সন্তুষ্টি ও কাজের দক্ষতার সম্পর্ক প্রায় 0.30। সাধারণ মানসিক সক্ষমতা এই ক্ষেত্রের সবচেয়ে শক্তিশালী একক পূর্বাভাসক, জটিল কাজের ক্ষেত্রে যা মোটামুটি 0.50 পর্যন্ত পৌঁছায়।
সহসম্বন্ধের বর্গ করলে ব্যাখ্যাত ভেদাঙ্কের অনুপাত পাওয়া যায়। 0.25 সহসম্বন্ধ মানুষে মানুষে পার্থক্যের প্রায় ছয় শতাংশ ব্যাখ্যা করে। বাকি চুরানব্বই শতাংশ অন্য কিছুর ফল: সক্ষমতা, সুযোগ, প্রশিক্ষণ, ব্যবস্থাপনা, স্বাস্থ্য, ভাগ্য।
তবু 0.25 কেন একটি বাস্তব ফলাফল
জনসংখ্যার স্তরে ছোট সহসম্বন্ধও উল্লেখযোগ্য সামগ্রিক প্রভাব তৈরি করে। আপনি যদি এক হাজার মানুষকে বেছে নেন, তাহলে 0.25 মানের একটি পূর্বাভাসক আপনার গড় ফলাফলকে পরিমাপযোগ্যভাবে এবং বারবার উন্নত করে। বিমা কোম্পানি ও রোগতত্ত্ববিদরা এই মাত্রার প্রভাবের ওপর ভিত্তি করেই পুরো কার্যক্রম গড়ে তোলেন।
মুশকিল হলো, সামগ্রিক সুবিধা আর ব্যক্তিগত পূর্বাভাস দুটি ভিন্ন জিনিস। 0.25 সহসম্বন্ধের অর্থ হলো, যাঁরা উচ্চ স্কোর করেন তাঁদের মধ্যে নিম্ন স্কোরকারীদের তুলনায় বেশি মানুষ ভালো করবেন; আবার এর অর্থ এ-ও যে বহু উচ্চ স্কোরকারী খারাপ করবেন এবং বহু নিম্ন স্কোরকারী দুর্দান্ত করবেন। দুটি কথাই একই সংখ্যা থেকে আসে।
ব্যক্তিগত ক্ষেত্র
এই ধাপটিই সাধারণত বাদ পড়ে যায়। সহসম্বন্ধ দুটি বণ্টনের মধ্যকার সম্পর্ক বর্ণনা করে। এটি কোনো নির্দিষ্ট ব্যক্তি সম্পর্কে কিছু বলার অনুমতি দেয় না।
দায়িত্বশীলতা যদি কাজের দক্ষতার সঙ্গে 0.25 সহসম্বন্ধযুক্ত হয়, তাহলে কারও দায়িত্বশীলতার স্কোর জানলে তার দক্ষতার সম্ভাব্য পরিসর খুব সামান্যই সংকুচিত হয়। একজন ব্যক্তির জন্য পূর্বাভাস ব্যবধান এত প্রশস্ত থাকে যে তাতে ফলাফলের প্রায় পুরো পরিসরই ধরা পড়ে। দায়িত্বশীলতায় আপনি 80তম পার্সেন্টাইলে আছেন, এটা জানলে কোনো নির্দিষ্ট কাজে আপনি কেমন করবেন সে সম্পর্কে খুব কমই জানা যায়।
এ কারণেই মূল গবেষণা সঠিক হলেও ব্যক্তিত্বের স্কোরকে নিয়োগের প্রধান ছাঁকনি হিসেবে ব্যবহার করার পক্ষে সমর্থন দুর্বল। গবেষণা এই দাবিকে সমর্থন করে যে বৈশিষ্ট্যটি গুরুত্বপূর্ণ। কিন্তু একটি স্কোর থেকে জানা যায় যে একজন প্রার্থী কী করবেন, এই দাবিকে তা সমর্থন করে না।
আরও দুটি সতর্কতা
পূর্বাভাস দেওয়া আর কারণ হওয়া ভিন্ন জিনিস। এই গবেষণার প্রায় সবটাই সহসম্বন্ধভিত্তিক। দায়িত্বশীলতা স্বাস্থ্যের ফলাফলের পূর্বাভাস দেয়, এ কথা এই সম্ভাবনার সঙ্গে সামঞ্জস্যপূর্ণ যে দায়িত্বশীলতা ভালো স্বাস্থ্য-আচরণের কারণ, কিংবা তৃতীয় কোনো কারণ দুটোকেই ঘটায়, কিংবা কার্যকারণ উল্টো দিকে কাজ করছে। দীর্ঘমেয়াদি নকশা সম্ভাবনাগুলো সংকুচিত করে; কিন্তু খুব কমই সেগুলো সম্পূর্ণ বন্ধ করে।
স্ব-প্রতিবেদনভিত্তিক মানদণ্ড সংখ্যাগুলোকে ফুলিয়ে দেয়। পূর্বাভাসক আর ফলাফল, দুটিই যখন একই ব্যক্তি একই বিকেলে নিজে জানান, তখন সাধারণ-পদ্ধতিগত ভেদাঙ্ক সহসম্বন্ধকে বাড়িয়ে দেয়। বস্তুনিষ্ঠ ফলাফল বা তথ্যদাতাদের মূল্যায়ন ব্যবহার করা গবেষণায় সাধারণত প্রভাব ছোট পাওয়া যায়, আর সেগুলোকেই বেশি গুরুত্ব দেওয়া উচিত।
একটি স্কোর আসলে কীসের জন্য কাজের
ভবিষ্যদ্বাণী নয়, বর্ণনা হিসেবে পড়লে একটি পরীক্ষার স্কোর সত্যিই কাজে লাগে। এটি আপনাকে জানায় যে প্রমাণিত ফলাফলযুক্ত একটি বৈশিষ্ট্যে একটি রেফারেন্স জনগোষ্ঠীর তুলনায় আপনি কোথায় আছেন, এবং এমন একটি ধরনের জন্য শব্দভাণ্ডার দেয় যা আপনি হয়তো লক্ষ করেছেন কিন্তু নাম দিতে পারেননি।
এটি পাওয়ার মতো জিনিস। তবে এটি পূর্বাভাস থেকে আলাদা, আর একটি সৎ প্রতিবেদনের উচিত এই পার্থক্য আপনার জন্য স্পষ্ট করে দেওয়া, আপনাকে নিজে অনুমান করতে ছেড়ে দেওয়া নয়।
নিজেই যাচাই করুন
পরিমাপ নিয়ে পড়া এক কথা। আপনার নিজের স্কোর তার উৎস, নর্ম নমুনা ও সীমাবদ্ধতাসহ দেখা আরেক কথা। বিনামূল্যে দেওয়া যায়, সাইনআপ লাগে না।
পড়তে থাকুন
- সাইকোমেট্রিক্স কী?যে শাখা বিচার করে একটি মনস্তাত্ত্বিক পরিমাপ আদৌ ভালো কি না; আর যে কারণে একই ধরনের প্রশ্ন করা দুটি পরীক্ষার ফলাফলের মূল্য বিপুলভাবে আলাদা হতে পারে।
- মনস্তাত্ত্বিক পরীক্ষায় নির্ভরযোগ্যতা কী?নির্ভরযোগ্যতা হলো পরিমাপের ধারাবাহিকতা, সঠিকতা নয়। একটি পরীক্ষা অত্যন্ত নির্ভরযোগ্য হয়েও ভুল জিনিস পরিমাপ করতে পারে। এ কারণেই এটি সবার আগে জিজ্ঞাসা করা প্রশ্ন, কিন্তু কখনোই শেষ প্রশ্ন নয়।
- মনস্তাত্ত্বিক পরীক্ষায় বৈধতা কী?বৈধতা কোনো পরীক্ষার নিজস্ব বৈশিষ্ট্য নয়। এটি একটি যুক্তি: কোনো নির্দিষ্ট উদ্দেশ্যে, কোনো নির্দিষ্ট স্কোরের একটি নির্দিষ্ট ব্যাখ্যা গ্রহণযোগ্য কি না, সেই প্রশ্নের যুক্তি। আর প্রতিটি নতুন ব্যবহারের জন্য এটি নতুন করে গড়ে তুলতে হয়।
- কনস্ট্রাক্ট বৈধতা কী?পরিমাপের সবচেয়ে কঠিন প্রশ্ন: আপনি যা পরিমাপ করছেন তা আপনার সংজ্ঞায়িত রূপে সত্যিই আছে কি না, এবং আপনার পরিমাপক সেটিকে ধরছে, নাকি তার কাছাকাছি অন্য কিছুকে।
- অভিসারী ও পৃথকীকারী বৈধতাদুটি পরস্পর-প্রতিবিম্ব শর্ত: একটি পরিমাপকে তার সঙ্গে মিলতে হবে যার সঙ্গে মেলা উচিত, আবার যা সে নয় বলে দাবি করে তার থেকে আলাদাও থাকতে হবে। বেশিরভাগ দুর্বল পরিমাপক দ্বিতীয় শর্তে ব্যর্থ হয়।
- Cronbach's alpha কী, এবং এটি কী নয়মনস্তাত্ত্বিক পরীক্ষায় সবচেয়ে বেশি উল্লেখ করা পরিসংখ্যান, এবং সবচেয়ে বেশি ভুল বোঝা। আলফা থেকে জানা যায় না যে একটি স্কেল এক-মাত্রিক, আর উচ্চ মান প্রায়ই গুণ নয়, বরং একটি লক্ষণ।
- পরিমাপের পরিমাণগত ত্রুটি (Standard error of measurement): আপনার স্কোরে কতটা তারতম্য থাকতে পারেপ্রতিটি স্কোরের সঙ্গে একটি ত্রুটির সীমা থাকে, এবং বেশিরভাগ মনস্তাত্ত্বিক পরীক্ষায় তা মানুষের ধারণার চেয়ে বড়। এই সংখ্যাটিই আপনাকে বলে দেয় কখন একটি পার্থক্য সত্যিকারের, আর কখন তা নিছক বিচ্যুতি।
- নর্ম ও পার্সেন্টাইল: আপনার স্কোর কীসের সঙ্গে তুলনা করা হয়একটি কাঁচা স্কোর নিজে থেকে ব্যাখ্যা করা যায় না। এটি অর্থবহ হয় কেবল একটি রেফারেন্স গোষ্ঠীর সঙ্গে তুলনা করলে; আর কোন গোষ্ঠী ব্যবহার করা হয়েছে, সেটি যেকোনো পরীক্ষা সম্পর্কে সবচেয়ে গুরুত্বপূর্ণ অথচ সবচেয়ে কম প্রচারিত তথ্যগুলোর একটি।
- একটি সাইকোমেট্রিক পরীক্ষা আসলে কীভাবে তৈরি হয়কনস্ট্রাক্টের সংজ্ঞা নির্ধারণ থেকে শুরু করে প্রকাশিত নর্ম পর্যন্ত, এই ধাপগুলো সম্পন্ন করতে বছরের পর বছর লাগে এবং শুরুর উপকরণের বেশিরভাগই বাদ পড়ে যায়। ধাপগুলো জানলে সহজেই বোঝা যায়, দ্রুত বানানো অনলাইন কুইজ কোনগুলো এড়িয়ে গেছে।
- কোনো পরীক্ষাকে যখন যাচাইকৃত বলা হয়, তখন তার অর্থ কী?শব্দটি নিয়ন্ত্রিত নয়, আর যেসব পণ্য এর জন্য কোনো কাজই করেনি, তারাও এটি অবাধে ব্যবহার করে। শব্দটি যখন সত্যিই কিছু বোঝায়, তখন এর অর্থ কী, আর দুই ক্ষেত্রকে আলাদা করার চারটি প্রশ্ন এখানে দেওয়া হলো।
- ইন্টারনেটের বেশিরভাগ ব্যক্তিত্বের পরীক্ষা কেন নির্ভরযোগ্য নয়তারা অসৎ বলে নয়, বরং যে ধাপগুলো একটি পরিমাপকে নির্ভরযোগ্য করে তোলে সেগুলো চোখে পড়ে না, ব্যয়বহুল এবং এড়িয়ে যাওয়া সহজ; আর সেগুলো এড়িয়ে গেলেও ফলাফল দেখতে একটুও বদলায় না।
- স্ব-প্রতিবেদন কী পরিমাপ করতে পারে এবং কী পারে নাপ্রশ্নাবলি আপনাকে নিজের পর্যবেক্ষক হতে বলে, যা কিছু বিষয়ে অন্যগুলোর চেয়ে ভালো কাজ করে। পদ্ধতিটি কোথায় শক্তিশালী আর কোথায় ব্যর্থ হয়, তা জানলে যেকোনো ফলাফল পড়ার দৃষ্টিভঙ্গি বদলে যায়।
- স্ক্রিনিং মানে রোগ নির্ণয় নয়একটি স্ক্রিনিং প্রশ্নাবলি তৈরি করা হয় যতগুলো সম্ভব ক্ষেত্র শনাক্ত করার জন্য, এর মূল্য হিসেবে উচ্চ ফলস-পজিটিভ হার মেনে নেওয়া হয়। স্ক্রিনিং স্কোরকে রোগনির্ণয় হিসেবে পড়লে এর নকশার উদ্দেশ্যই উল্টে যায়।