আইটেম রেসপন্স থিওরি
Lord, F. M. · 1980
অন্য নামেও পরিচিত: IRT · Rasch · Rasch Measurement Theory · Latent Trait Theory
আইটেম রেসপন্স থিওরি একগুচ্ছ গাণিতিক মডেল, যা সুপ্ত বৈশিষ্ট্য (সক্ষমতা, মনোভাব) ও পরীক্ষার আইটেমের উত্তরের মধ্যে সম্পর্ক বর্ণনা করে এবং নমুনা-নিরপেক্ষ আইটেম ক্যালিব্রেশন ও পরীক্ষা-নিরপেক্ষ ব্যক্তি পরিমাপ সম্ভব করে। ক্লাসিক্যাল টেস্ট থিওরির বিপরীতে IRT আইটেম-স্তরের বৈশিষ্ট্য (কাঠিন্য, পার্থক্যকরণ ক্ষমতা, অনুমান) এবং ব্যক্তির সক্ষমতাকে একই স্কেলে মডেল করে এবং প্রতিটি সক্ষমতা স্তরে পরিমাপের নির্ভুলতার অনুমান দেয়। IRT আধুনিক কম্পিউটারভিত্তিক অভিযোজিত পরীক্ষা, বৃহৎ পরিসরের শিক্ষাগত মূল্যায়ন (PISA, GRE, GMAT) এবং ক্লিনিকাল রোগী-প্রতিবেদিত ফলাফল পরিমাপের ভিত্তি।
একটি পদ্ধতিগত (বৈশিষ্ট্যের বিষয়বস্তুভিত্তিক নয়) কাঠামো, যা সুপ্ত বৈশিষ্ট্যের স্তর এবং আইটেমের প্যারামিটার (কাঠিন্য, বৈষম্যমূলকতা, অনুমান) এর ফাংশন হিসেবে উত্তরের সম্ভাবনা মডেল করে। এটি কোনো একক পরিমাপকের বিষয়বস্তুর চেয়ে অভিযোজিত/CAT পরীক্ষা গ্রহণকে সমর্থন করে।
- উৎস:
- Lord, F. M. (1980). Applications of Item Response Theory to Practical Testing Problems.
এক নজরে প্রমাণ
- অভিজ্ঞতামূলক সমর্থন
- জোরালো প্রমাণ
- পুনরাবৃত্তি
- ভালোভাবে পুনরাবৃত্ত
- আন্তঃসাংস্কৃতিক
- সার্বজনীন
- মেটা-বিশ্লেষণ
- 10টি ইনডেক্স হয়েছে
এই রেটিংগুলো তত্ত্বটি নিয়ে প্রকাশিত গবেষণার সারসংক্ষেপ, এর ওপর ভিত্তি করে তৈরি কোনো একক পরীক্ষার মান নয়। এগুলো নিচে তালিকাভুক্ত সূত্রের ভিত্তিতে সম্পাদকীয় মূল্যায়ন, এবং প্রমাণ জমা হওয়ার সঙ্গে সঙ্গে এগুলো বদলায়।
ঐতিহাসিক প্রেক্ষাপট
IRT-র ভিত্তি স্বাধীনভাবে স্থাপন করেন ডেনমার্কে জর্জ রাশ (1960) এবং যুক্তরাষ্ট্রে ফ্রেডারিক লর্ড ও অ্যালান বার্নবাউম (1960-এর দশক), আর লর্ড ও নোভিকের 1968 সালের 'Statistical Theories of Mental Test Scores' গাণিতিক ভিত্তি জোগায়। লর্ডের 1980 সালের 'Applications of Item Response Theory to Practical Testing Problems' পরীক্ষা নির্মাণ, সমীকরণ ও পক্ষপাত শনাক্তকরণে ব্যবহারিক প্রয়োগ দেখিয়ে ক্ষেত্রটিকে সুসংহত করে। গণনাক্ষমতা বাড়ার সাথে 1980-1990-এর দশকে তত্ত্বটি ব্যাপক গ্রহণযোগ্যতা পায়, যা বৃহৎ পরিসরের পরীক্ষা কর্মসূচির জন্য প্যারামিটার নির্ণয় সম্ভব করে তোলে।
কনস্ট্রাক্টসমূহ
এখনো কোনো কনস্ট্রাক্ট নথিভুক্ত হয়নি।
পরিমাপকসমূহ
এই তত্ত্বের উপর ভিত্তি করে এখনো কোনো পরিমাপক নেই।
এই তত্ত্বের ভিত্তিতে তৈরি পরীক্ষা
এই তত্ত্বের উপর ভিত্তি করে এখনো কোনো পরীক্ষা নেই।
ব্যবহারিক প্রয়োগ
IRT হলো কম্পিউটারভিত্তিক অভিযোজিত পরীক্ষা (CAT)-র ভিত্তি, যা GRE, GMAT, NCLEX নার্সিং লাইসেন্স পরীক্ষা এবং CAT-ASVAB সামরিক ব্যাটারির মতো উচ্চ-ঝুঁকির মূল্যায়নে ব্যবহৃত হয়। প্রতিটি পরীক্ষার্থীর সক্ষমতার স্তর অনুযায়ী আইটেম বেছে নিয়ে এটি ছোট অথচ আরও নির্ভুল পরীক্ষা সম্ভব করে। ক্লিনিকাল ক্ষেত্রে IRT PROMIS (Patient-Reported Outcomes Measurement Information System) উদ্যোগকে চালিত করে, যা স্বাস্থ্য-ফলাফলের কার্যকর পরিমাপ সম্ভব করে। IRT পদ্ধতি বিভিন্ন ফর্মের মধ্যে পরীক্ষা সমীকরণ, ন্যায্যতা বিশ্লেষণের জন্য ডিফারেনশিয়াল আইটেম ফাংশনিং (DIF) শনাক্তকরণ এবং বিশ্বব্যাপী মানসম্মত পরীক্ষা কর্মসূচির জন্য আইটেম ব্যাংক তৈরিতেও সহায়তা করে।
কীভাবে পরিমাপ করা হয়
IRT নিজেই একটি পরিমাপ পদ্ধতি, কোনো মূলগত মনস্তাত্ত্বিক তত্ত্ব নয়। প্রচলিত মডেলের মধ্যে রয়েছে দ্বিমুখী আইটেমের জন্য এক-প্যারামিটার (1PL/Rasch), দুই-প্যারামিটার (2PL) ও তিন-প্যারামিটার (3PL) লজিস্টিক মডেল, এবং বহুমুখী আইটেমের জন্য Graded Response Model ও Partial Credit Model। প্যারামিটার নির্ণয়ে সর্বোচ্চ সম্ভাবনা বা বেয়েসীয় পদ্ধতি ব্যবহৃত হয়।
সমালোচনা ও সীমাবদ্ধতা
একটি প্রধান সমালোচনা হলো IRT মডেলগুলোর জন্য প্রয়োজনীয় শক্তিশালী প্যারামেট্রিক অনুমান (যেমন একমাত্রিকতা ও স্থানীয় স্বাধীনতা), যা জটিল মনস্তাত্ত্বিক কনস্ট্রাক্টের ক্ষেত্রে নাও খাটতে পারে, ফলে মডেলের অসামঞ্জস্য দেখা দেয়। মডেলটি ডেটার সঙ্গে খাপ খাওয়ানো হবে (IRT পদ্ধতি) নাকি মৌলিক পরিমাপের জন্য ডেটাকে মডেলের শর্ত পূরণ করতে হবে (Rasch পদ্ধতি), এ নিয়ে Rasch মডেল সম্প্রদায় ও বৃহত্তর IRT সম্প্রদায়ের মধ্যে মৌলিক মতভেদ রয়েছে। স্থিতিশীল প্যারামেটার নির্ণয়ের জন্য IRT-র তুলনামূলকভাবে বড় নমুনা প্রয়োজন (মডেলভেদে সাধারণত 200-1000+ পরীক্ষার্থী), যা ছোট পরিসরের মূল্যায়নে এর প্রয়োগ সীমিত করে।
প্রধান প্রকাশনা
- Lord, F. M.. (1980). Applications of Item Response Theory to Practical Testing Problems.
- Lord, F. M. & Novick, M. R.. (1968). Statistical Theories of Mental Test Scores.
- Rasch, G.. (1960). Probabilistic Models for Some Intelligence and Attainment Tests.
- Hambleton, R. K., Swaminathan, H. & Rogers, H. J.. (1991). Fundamentals of Item Response Theory.
- Embretson, S. E. & Reise, S. P.. (2000). Item Response Theory for Psychologists. 10.4324/9781410605269