noesisnoesis
পরিমাপ কীভাবে কাজ করে

ইন্টারনেটের বেশিরভাগ ব্যক্তিত্বের পরীক্ষা কেন নির্ভরযোগ্য নয়

তারা অসৎ বলে নয়, বরং যে ধাপগুলো একটি পরিমাপকে নির্ভরযোগ্য করে তোলে সেগুলো চোখে পড়ে না, ব্যয়বহুল এবং এড়িয়ে যাওয়া সহজ; আর সেগুলো এড়িয়ে গেলেও ফলাফল দেখতে একটুও বদলায় না।

অনলাইনের একটি বিনামূল্যের ব্যক্তিত্বের পরীক্ষা আর যাচাইকৃত একটি সাইকোমেট্রিক পরিমাপকের ফলাফল দেখতে একই রকম: একটি স্কোর, একটি পার্সেন্টাইল, আপনাকে নিয়ে একটি অনুচ্ছেদ। পার্থক্যটা পুরোপুরি এমন কাজে, যা ফলাফলের পর্দা থেকে দেখা যায় না।

বিষয়টি নিয়ে সুনির্দিষ্ট হওয়া জরুরি, কারণ প্রচলিত ধারণা, অর্থাৎ ইন্টারনেটের পরীক্ষা মানেই প্রতারণা, বেশিরভাগ ক্ষেত্রে ভুল এবং খুব একটা কাজেরও নয়। বেশিরভাগ পরীক্ষা এমন মানুষ বানান, যাঁদের ঠকানোর কোনো উদ্দেশ্য নেই। এগুলো নির্ভরযোগ্য নয় কাঠামোগত কারণে।

সাধারণত কী বাদ পড়ে

আইটেম বিশ্লেষণ। সঠিকভাবে তৈরি স্কেলে খসড়া করা বেশিরভাগ আইটেম পাইলটের পর বাদ দেওয়া হয়: যেসব আইটেমে কারও উত্তরে পার্থক্য হয় না, যেগুলো মোট স্কোরের সঙ্গে দুর্বলভাবে সম্পর্কিত, যেগুলো একাধিক ফ্যাক্টরে যুক্ত হয়, এবং যেগুলো বয়স বা ভাষার গোষ্ঠীভেদে ভিন্নভাবে আচরণ করে। পাইলট ছাড়া লিখে প্রকাশ করা পরীক্ষা সবকিছুই রেখে দিয়েছে, যেসব আইটেম কাজ করে না সেগুলোও।

স্বতন্ত্র কাঠামোগত নিশ্চিতকরণ। যে ডেটা দিয়ে স্কেল বানানো হয়েছে, তার ওপর ফ্যাক্টর বিশ্লেষণ করলে আপনার নকশা করা কাঠামোই ফিরে আসবে। নতুন নমুনায় সেটি নিশ্চিত করা একটি আলাদা গবেষণা, আর অনেক স্কেল ঠিক এই ধাপেই ব্যর্থ হয়।

নর্ম। পার্সেন্টাইল কোথাও থেকে আসতে হবে। সাইট যদি তার রেফারেন্স জনগোষ্ঠী উল্লেখ না করে, তাহলে সংখ্যাটি আসে আগের দর্শকদের থেকে, যাঁরা নিজে থেকে অংশ নেওয়া এমন একটি গোষ্ঠী যার গঠন অজানা, অথবা বিশেষ কিছু থেকেই নয়।

পুনঃপরীক্ষার ডেটা। মানুষ আগামী মাসেও একই স্কোর করে কি না তা প্রতিষ্ঠিত করতে তাঁদের আবার খুঁজে বের করতে হয়। প্রায় কেউই এটি করে না, অর্থাৎ "বৈশিষ্ট্য" শব্দটি যে স্থিতিশীলতা বোঝায়, তা প্রমাণিত হয়নি।

নকশার প্রণোদনা উল্টো দিকে চলে

যে পরীক্ষা বানানো হয় অংশগ্রহণ বাড়ানোর জন্য, তার অপ্টিমাইজেশনের লক্ষ্য সেই পরীক্ষার থেকে আলাদা, যেটি বানানো হয় নির্ভুলতার জন্য, আর দুটি লক্ষ্য অনুমেয় উপায়ে বিপরীত দিকে টানে।

তোষামোদি ফলাফল ভালো চলে। অপ্রিয় কিছু বললে ফলাফল কম শেয়ার হয়, তাই ফলাফল ধীরে ধীরে এমন বর্ণনার দিকে সরে যায় যা সবাই নিজের মধ্যে চিনতে পারে। এটিই বার্নাম প্রভাব, যা 1940-এর দশকে প্রদর্শিত হয়েছিল এবং তারপর নির্ভরযোগ্যভাবে বারবার পাওয়া গেছে: মানুষ সাধারণ ব্যক্তিত্বের বর্ণনাকে নিজের সম্পর্কে অত্যন্ত সঠিক বলে মূল্যায়ন করে।

মাত্রার চেয়ে ধরন ভালো চলে। "আপনি একজন স্থপতি" কথাটি "উন্মুক্ততায় আপনি 68তম পার্সেন্টাইলে, আস্থা ব্যবধান প্রশস্ত" কথাটির চেয়ে বেশি শেয়ারযোগ্য। ধরন পরিমাপের ত্রুটিও আড়াল করে, কারণ বিভাগের সীমারেখার এক পয়েন্ট এপাশে বা ওপাশে থাকা কেউ সম্পূর্ণ ভিন্ন লেবেল পান।

পর্যাপ্তের চেয়ে সংক্ষিপ্ত ভালো চলে। প্রতিটি অতিরিক্ত প্রশ্নে উত্তরদাতা কমে যায়, তাই পরীক্ষা এমন দৈর্ঘ্যে কেটে ফেলা হয় যা সম্পূর্ণ করার হার সর্বোচ্চ করে, কনস্ট্রাক্টটি কতটা কভার করা হলো তা নয়।

এগুলোর কোনোটিই মিথ্যা নয়। এগুলো নির্ভুলতা ছাড়া অন্য একটি মাপকাঠির জন্য অপ্টিমাইজেশন।

প্রায় ত্রিশ সেকেন্ডে কীভাবে বুঝবেন

লেখক ও বছরসহ একটি নামকরা উৎস পরিমাপক আছে কি না দেখুন। নর্ম কোন জনগোষ্ঠী থেকে এসেছে তার উল্লেখ আছে কি না দেখুন। সীমাবদ্ধতা বা পরিমাপের ত্রুটির কোনো স্বীকৃতি আছে কি না দেখুন। ফলাফল একটি অবিচ্ছিন্ন স্কোর, না একটি বিভাগ, তা দেখুন। একই পাতায় কুড়িটি প্রশ্ন থেকে আপনার আদর্শ পেশা, সঙ্গী বা জীবনের উদ্দেশ্য চিহ্নিত করার প্রতিশ্রুতি আছে কি না, তাও দেখুন।

যে পরীক্ষা তার পরিমাপকের নাম বলে, উৎস উল্লেখ করে, নর্ম জানায় এবং কোন বিষয় সে বলতে পারে না তা-ও জানায়, সে কাজটি করেছে। যে পরীক্ষা এর কিছুই করে না, সেটি হয়তো পাঁচ মিনিট কাটানোর একটি মনোরম উপায় হতে পারে, কিন্তু তার দেওয়া সংখ্যাটি শুধুই সাজসজ্জা।

NOESIS তালিকার প্রতিটি পরিমাপক জানায় সেটি কোন প্রকাশিত পরীক্ষা বাস্তবায়ন করে, কে লিখেছেন, কোন বছরে, কীভাবে স্কোর করা হয়, এবং এর ফলাফল কী প্রতিষ্ঠিত করে না। শেষ অংশটিই তুলনা করার মতো।

নিজেই যাচাই করুন

পরিমাপ নিয়ে পড়া এক কথা। আপনার নিজের স্কোর তার উৎস, নর্ম নমুনা ও সীমাবদ্ধতাসহ দেখা আরেক কথা। বিনামূল্যে দেওয়া যায়, সাইনআপ লাগে না।

পড়তে থাকুন