نظریه پاسخ به گویه
Lord, F. M. · 1980
با نامهای دیگر: IRT · Rasch · Rasch Measurement Theory · Latent Trait Theory
نظریه پاسخ به گویه خانوادهای از مدلهای ریاضی است که رابطه میان صفات نهفته (تواناییها، نگرشها) و پاسخ به گویههای آزمون را توصیف میکنند و کالیبراسیون گویه مستقل از نمونه و اندازهگیری فرد مستقل از آزمون را ممکن میسازند. برخلاف نظریه کلاسیک آزمون، IRT ویژگیهای سطح گویه (دشواری، تمایز، حدسزنی) و توانایی فرد را روی یک مقیاس مشترک مدلسازی میکند و برآورد دقت اندازهگیری را در هر سطح توانایی فراهم میآورد. IRT زیربنای آزموندهی انطباقی رایانهای مدرن، ارزیابیهای آموزشی در مقیاس بزرگ (PISA، GRE، GMAT) و سنجههای پیامد گزارششده توسط بیمار در بالین است.
چارچوبی روششناختی (نه مبتنی بر محتوای صفت) که احتمال پاسخ را بهصورت تابعی از سطح صفت نهفته و پارامترهای گویه (دشواری، قدرت تمایز، حدس) مدل میکند. این چارچوب پشتوانهٔ اجرای انطباقی/CAT است و به محتوای هیچ ابزار خاصی وابسته نیست.
- منبع:
- Lord, F. M. (1980). Applications of Item Response Theory to Practical Testing Problems.
شواهد در یک نگاه
- پشتوانهٔ تجربی
- شواهد قوی
- تکرارپذیری
- تکرارپذیری قوی
- بینفرهنگی
- جهانی
- فراتحلیلها
- 10 مورد فهرستشده
این رتبهبندیها خلاصهٔ پژوهشهای منتشرشده دربارهٔ نظریه هستند، نه کیفیت هر آزمونی که بر پایهٔ آن ساخته شده است. اینها قضاوتهای سردبیری بر اساس منابع فهرستشده در زیر هستند و با انباشته شدن شواهد تغییر میکنند.
زمینه تاریخی
شالوده IRT بهطور مستقل توسط گئورگ راش در دانمارک (1960) و فردریک لرد و آلن بیرنبام در ایالات متحده (دهه 1960) گذاشته شد و کتاب «نظریههای آماری نمرات آزمونهای ذهنی» لرد و نویک در سال 1968 زیربنای ریاضی آن را فراهم کرد. کتاب «کاربردهای نظریه پاسخ به گویه در مسائل عملی آزمونسازی» لرد در سال 1980 با نشان دادن کاربردهای عملی در ساخت آزمون، همتراز کردن و تشخیص سوگیری، این حوزه را یکپارچه کرد. این نظریه در دهههای 1980 و 1990 با افزایش توان محاسباتی، که برآورد پارامتر را برای برنامههای آزمون در مقیاس بزرگ ممکن ساخت، بهطور گسترده پذیرفته شد.
سازهها
هنوز سازهای مستند نشده است.
ابزارها
هنوز ابزاری بر پایه این نظریه ساخته نشده است.
آزمونهای مبتنی بر این نظریه
هنوز آزمونی بر پایه این نظریه ساخته نشده است.
کاربردهای عملی
IRT شالوده آزموندهی انطباقی رایانهای (CAT) است که در ارزیابیهای پرمخاطرهای مانند GRE، GMAT، آزمون صدور پروانه پرستاری NCLEX و مجموعه آزمون نظامی CAT-ASVAB به کار میرود و با انتخاب گویههای متناسب با سطح توانایی هر آزمودنی، آزمونهایی کوتاهتر و در عین حال دقیقتر ممکن میسازد. در محیطهای بالینی، IRT زیربنای طرح PROMIS (سامانه اطلاعات اندازهگیری پیامدهای گزارششده توسط بیمار) است و اندازهگیری کارآمد پیامدهای سلامت را ممکن میکند. روشهای IRT همچنین از همتراز کردن آزمونها در فرمهای مختلف، تشخیص عملکرد افتراقی گویه (DIF) برای تحلیل انصاف، و توسعه بانک گویه برای برنامههای آزمون استاندارد در سراسر جهان پشتیبانی میکنند.
چگونه سنجیده میشود
IRT خود یک روششناسی اندازهگیری است، نه نظریهای روانشناختی با محتوای مستقل. مدلهای رایج شامل مدلهای لجستیک یکپارامتری (1PL/راش)، دوپارامتری (2PL) و سهپارامتری (3PL) برای گویههای دوارزشی، و مدل پاسخ مدرج و مدل نمره جزئی برای گویههای چندارزشی هستند. برآورد پارامترها از روشهای بیشینه درستنمایی یا بیزی استفاده میکند.
انتقادها و محدودیتها
یکی از انتقادهای کلیدی، مفروضات پارامتریک قوی مدلهای IRT است (مانند تکبُعدی بودن و استقلال موضعی) که ممکن است دربارهٔ سازههای روانشناختی پیچیده برقرار نباشد و به برازش نامناسب مدل منجر شود. جامعهٔ مدل راش و جامعهٔ گستردهتر IRT در این مورد اختلاف بنیادی دارند که آیا مدل باید با دادهها برازش داده شود (رویکرد IRT) یا دادهها باید الزامات مدل را برای اندازهگیری بنیادین برآورده کنند (رویکرد راش). IRT برای برآورد پایدار پارامترها به حجم نمونهٔ نسبتاً بزرگی نیاز دارد (بسته به مدل، معمولاً 200 تا بیش از 1000 آزمودنی) و این امر کاربرد آن را در ارزیابیهای کوچکمقیاس محدود میکند.
انتشارات کلیدی
- Lord, F. M.. (1980). Applications of Item Response Theory to Practical Testing Problems.
- Lord, F. M. & Novick, M. R.. (1968). Statistical Theories of Mental Test Scores.
- Rasch, G.. (1960). Probabilistic Models for Some Intelligence and Attainment Tests.
- Hambleton, R. K., Swaminathan, H. & Rogers, H. J.. (1991). Fundamentals of Item Response Theory.
- Embretson, S. E. & Reise, S. P.. (2000). Item Response Theory for Psychologists. 10.4324/9781410605269