noesisnoesis
מעורבראיות חזקות

תאוריית תגובת פריטים

Lord, F. M. · 1980

ידועה גם בשם: IRT · Rasch · Rasch Measurement Theory · Latent Trait Theory

תיאוריית תגובת הפריט היא משפחה של מודלים מתמטיים המתארים את הקשר בין תכונות סמויות (יכולות, עמדות) לתגובות לפריטי מבחן, ומאפשרים כיול פריטים ללא תלות במדגם ומדידת אדם ללא תלות במבחן. בניגוד לתיאוריית המבחן הקלאסית, IRT מודלת מאפיינים ברמת הפריט (קושי, אבחנה, ניחוש) ויכולת אדם על סולם משותף, ומספקת הערכות דיוק מדידה בכל רמת יכולת. IRT מבססת בדיקה אדפטיבית ממוחשבת מודרנית, הערכות חינוכיות בקנה מידה גדול (PISA, GRE, GMAT), ומדדי תוצאות מטופל קליניות מדווחות.

מסגרת מתודולוגית (לא תוכן-תכונה) המודלת את הסתברות התגובה כפונקציה של רמת תכונה סמויה ופרמטרי פריט (קושי, אבחנה, ניחוש). מבססת מסירה אדפטיבית/CAT ולא את התוכן של כלי בודד כלשהו.

מקור:
Lord, F. M. (1980). Applications of Item Response Theory to Practical Testing Problems.

ראיות במבט חטוף

תמיכה אמפירית
ראיות חזקות
שכפול
משוכפל היטב
בין-תרבותי
אוניברסלי
מטא-אנליזות
10 מאונדקסות
תחומי מחקרפסיכומטריהמדידה חינוכיתהערכה קליניתפיתוח מבחניםבדיקה ממוחשבת אדפטיבית

דירוגים אלה מסכמים את הספרות המדעית שפורסמה על התאוריה, לא את איכות מבחן בודד כלשהו המבוסס עליה. מדובר בשיפוטים עריכתיים המבוססים על המקורות המפורטים להלן, והם משתנים ככל שהראיות מצטברות.

הקשר היסטורי

יסודות IRT הונחו באופן עצמאי על ידי גאורג ראש בדנמרק (1960) ופרדריק לורד ואלן בירנבאום בארצות הברית (שנות ה-60), כאשר 'Statistical Theories of Mental Test Scores' של לורד ונוביק מ-1968 סיפק את היסוד המתמטי. 'Applications of Item Response Theory to Practical Testing Problems' של לורד מ-1980 איחד את התחום בכך שהדגים יישומים מעשיים בבניית מבחנים, השוואה וזיהוי הטיה. התיאוריה זכתה לאימוץ נרחב בשנות ה-80-90 עם כוח חישוב הולך וגדל, מה שהפך הערכת פרמטרים לישימה עבור תוכניות בדיקה בקנה מידה גדול.

קונסטרוקטים

טרם תועדו קונסטרוקטים.

כלי מדידה

טרם נבנו כלי מדידה על בסיס תאוריה זו.

מבחנים המבוססים על תאוריה זו

טרם נבנו מבחנים על בסיס תאוריה זו.

יישומים מעשיים

IRT הוא הבסיס לבדיקה אדפטיבית ממוחשבת (CAT), המשמשת בהערכות בעלות סיכון גבוה כמו GRE, GMAT, מבחן רישוי הסיעוד NCLEX, וסוללת CAT-ASVAB הצבאית, ומאפשרת מבחנים קצרים יותר אך מדויקים יותר על ידי בחירת פריטים המותאמים לרמת היכולת של כל נבחן. במסגרות קליניות, IRT מפעיל את יוזמת PROMIS (מערכת מידע מדידת תוצאות מדווחות-מטופל), ומאפשר מדידה יעילה של תוצאות בריאות. שיטות IRT תומכות גם בהשוואת מבחנים בין צורות, זיהוי תפקוד פריט דיפרנציאלי (DIF) לניתוח הוגנות, ופיתוח מאגרי פריטים לתוכניות בדיקה סטנדרטיות ברחבי העולם.

כיצד היא נמדדת

IRT הוא עצמו מתודולוגיית מדידה ולא תיאוריה פסיכולוגית מהותית. מודלים נפוצים כוללים את המודל החד-פרמטרי (1PL/ראש), הדו-פרמטרי (2PL) והתלת-פרמטרי (3PL) הלוגיסטיים עבור פריטים דיכוטומיים, ואת מודל התגובה המדורגת ומודל הזיכוי החלקי עבור פריטים פוליטומיים. הערכת פרמטרים משתמשת בשיטות סבירות מרבית או בייסיאניות.

ביקורות ומגבלות

ביקורת מרכזית היא ההנחות הפרמטריות החזקות הנדרשות על ידי מודלי IRT (כמו חד-ממדיות ועצמאות מקומית), שעשויות לא להתקיים עבור מבנים פסיכולוגיים מורכבים, מה שמוביל לאי-התאמת מודל. קהילת מודל ראש וקהילת IRT הרחבה יותר חלוקות באופן יסודי בשאלה האם המודל צריך להתאים לנתונים (גישת IRT) או שהנתונים צריכים לעמוד בדרישות המודל למדידה יסודית (גישת ראש). IRT דורש גדלי מדגם גדולים יחסית להערכת פרמטרים יציבה (בדרך כלל 200-1000+ נבחנים בהתאם למודל), מה שמגביל את ישימותו להערכות בקנה מידה קטן.

פרסומים מרכזיים

  • Lord, F. M.. (1980). Applications of Item Response Theory to Practical Testing Problems.
  • Lord, F. M. & Novick, M. R.. (1968). Statistical Theories of Mental Test Scores.
  • Rasch, G.. (1960). Probabilistic Models for Some Intelligence and Attainment Tests.
  • Hambleton, R. K., Swaminathan, H. & Rogers, H. J.. (1991). Fundamentals of Item Response Theory.
  • Embretson, S. E. & Reise, S. P.. (2000). Item Response Theory for Psychologists. 10.4324/9781410605269

תאוריות קשורות

Classical Test TheoryRasch Measurement TheoryGeneralizability TheoryLatent Trait TheoryFactor Analysis
תאוריית תגובת פריטים — הגדרה, ראיות וכיצד הוא נמדד | NOESIS