noesisnoesis
ترکیبیشواهد قوی

نظریه پاسخ به گویه

Lord, F. M. · 1980

با نام‌های دیگر: IRT · Rasch · Rasch Measurement Theory · Latent Trait Theory

نظریه پاسخ به گویه خانواده‌ای از مدل‌های ریاضی است که رابطه میان صفات نهفته (توانایی‌ها، نگرش‌ها) و پاسخ به گویه‌های آزمون را توصیف می‌کنند و کالیبراسیون گویه مستقل از نمونه و اندازه‌گیری فرد مستقل از آزمون را ممکن می‌سازند. برخلاف نظریه کلاسیک آزمون، IRT ویژگی‌های سطح گویه (دشواری، تمایز، حدس‌زنی) و توانایی فرد را روی یک مقیاس مشترک مدل‌سازی می‌کند و برآورد دقت اندازه‌گیری را در هر سطح توانایی فراهم می‌آورد. IRT زیربنای آزمون‌دهی انطباقی رایانه‌ای مدرن، ارزیابی‌های آموزشی در مقیاس بزرگ (PISA، GRE، GMAT) و سنجه‌های پیامد گزارش‌شده توسط بیمار در بالین است.

چارچوبی روش‌شناختی (نه مبتنی بر محتوای صفت) که احتمال پاسخ را به‌صورت تابعی از سطح صفت نهفته و پارامترهای گویه (دشواری، قدرت تمایز، حدس) مدل می‌کند. این چارچوب پشتوانهٔ اجرای انطباقی/CAT است و به محتوای هیچ ابزار خاصی وابسته نیست.

منبع:
Lord, F. M. (1980). Applications of Item Response Theory to Practical Testing Problems.

شواهد در یک نگاه

پشتوانهٔ تجربی
شواهد قوی
تکرارپذیری
تکرارپذیری قوی
بین‌فرهنگی
جهانی
فراتحلیل‌ها
10 مورد فهرست‌شده
حوزه‌های پژوهشیروان‌سنجیسنجش آموزشیارزیابی بالینیتوسعهٔ آزمونآزمون‌دهی تطبیقی رایانه‌ای

این رتبه‌بندی‌ها خلاصهٔ پژوهش‌های منتشرشده دربارهٔ نظریه هستند، نه کیفیت هر آزمونی که بر پایهٔ آن ساخته شده است. این‌ها قضاوت‌های سردبیری بر اساس منابع فهرست‌شده در زیر هستند و با انباشته شدن شواهد تغییر می‌کنند.

زمینه تاریخی

شالوده IRT به‌طور مستقل توسط گئورگ راش در دانمارک (1960) و فردریک لرد و آلن بیرنبام در ایالات متحده (دهه 1960) گذاشته شد و کتاب «نظریه‌های آماری نمرات آزمون‌های ذهنی» لرد و نویک در سال 1968 زیربنای ریاضی آن را فراهم کرد. کتاب «کاربردهای نظریه پاسخ به گویه در مسائل عملی آزمون‌سازی» لرد در سال 1980 با نشان دادن کاربردهای عملی در ساخت آزمون، همتراز کردن و تشخیص سوگیری، این حوزه را یکپارچه کرد. این نظریه در دهه‌های 1980 و 1990 با افزایش توان محاسباتی، که برآورد پارامتر را برای برنامه‌های آزمون در مقیاس بزرگ ممکن ساخت، به‌طور گسترده پذیرفته شد.

سازه‌ها

هنوز سازه‌ای مستند نشده است.

ابزارها

هنوز ابزاری بر پایه این نظریه ساخته نشده است.

آزمون‌های مبتنی بر این نظریه

هنوز آزمونی بر پایه این نظریه ساخته نشده است.

کاربردهای عملی

IRT شالوده آزمون‌دهی انطباقی رایانه‌ای (CAT) است که در ارزیابی‌های پرمخاطره‌ای مانند GRE، GMAT، آزمون صدور پروانه پرستاری NCLEX و مجموعه آزمون نظامی CAT-ASVAB به کار می‌رود و با انتخاب گویه‌های متناسب با سطح توانایی هر آزمودنی، آزمون‌هایی کوتاه‌تر و در عین حال دقیق‌تر ممکن می‌سازد. در محیط‌های بالینی، IRT زیربنای طرح PROMIS (سامانه اطلاعات اندازه‌گیری پیامدهای گزارش‌شده توسط بیمار) است و اندازه‌گیری کارآمد پیامدهای سلامت را ممکن می‌کند. روش‌های IRT همچنین از همتراز کردن آزمون‌ها در فرم‌های مختلف، تشخیص عملکرد افتراقی گویه (DIF) برای تحلیل انصاف، و توسعه بانک گویه برای برنامه‌های آزمون استاندارد در سراسر جهان پشتیبانی می‌کنند.

چگونه سنجیده می‌شود

IRT خود یک روش‌شناسی اندازه‌گیری است، نه نظریه‌ای روان‌شناختی با محتوای مستقل. مدل‌های رایج شامل مدل‌های لجستیک یک‌پارامتری (1PL/راش)، دوپارامتری (2PL) و سه‌پارامتری (3PL) برای گویه‌های دوارزشی، و مدل پاسخ مدرج و مدل نمره جزئی برای گویه‌های چندارزشی هستند. برآورد پارامترها از روش‌های بیشینه درستنمایی یا بیزی استفاده می‌کند.

انتقادها و محدودیت‌ها

یکی از انتقادهای کلیدی، مفروضات پارامتریک قوی مدل‌های IRT است (مانند تک‌بُعدی بودن و استقلال موضعی) که ممکن است دربارهٔ سازه‌های روان‌شناختی پیچیده برقرار نباشد و به برازش نامناسب مدل منجر شود. جامعهٔ مدل راش و جامعهٔ گسترده‌تر IRT در این مورد اختلاف بنیادی دارند که آیا مدل باید با داده‌ها برازش داده شود (رویکرد IRT) یا داده‌ها باید الزامات مدل را برای اندازه‌گیری بنیادین برآورده کنند (رویکرد راش). IRT برای برآورد پایدار پارامترها به حجم نمونهٔ نسبتاً بزرگی نیاز دارد (بسته به مدل، معمولاً 200 تا بیش از 1000 آزمودنی) و این امر کاربرد آن را در ارزیابی‌های کوچک‌مقیاس محدود می‌کند.

انتشارات کلیدی

  • Lord, F. M.. (1980). Applications of Item Response Theory to Practical Testing Problems.
  • Lord, F. M. & Novick, M. R.. (1968). Statistical Theories of Mental Test Scores.
  • Rasch, G.. (1960). Probabilistic Models for Some Intelligence and Attainment Tests.
  • Hambleton, R. K., Swaminathan, H. & Rogers, H. J.. (1991). Fundamentals of Item Response Theory.
  • Embretson, S. E. & Reise, S. P.. (2000). Item Response Theory for Psychologists. 10.4324/9781410605269

نظریه‌های مرتبط

Classical Test TheoryRasch Measurement TheoryGeneralizability TheoryLatent Trait TheoryFactor Analysis
نظریه پاسخ به گویه: تعریف، شواهد و شیوهٔ سنجش | NOESIS