noesisnoesis
การวัดผลทำงานอย่างไร

ความตรงในการทดสอบทางจิตวิทยาคืออะไร

ความตรงไม่ใช่คุณสมบัติที่แบบทดสอบมี แต่เป็นข้อโต้แย้งว่าการตีความคะแนนเฉพาะด้าน เพื่อจุดประสงค์เฉพาะนั้น สามารถปกป้องได้หรือไม่ และต้องสร้างใหม่สำหรับการใช้งานใหม่ทุกครั้ง

ความตรงถามว่าแบบทดสอบวัดสิ่งที่อ้างว่าวัดหรือไม่ และข้อสรุปที่ผู้คนได้จากคะแนนนั้นสมเหตุสมผลหรือไม่ มันเป็นคำถามหลักในจิตวิทยาการวัดและเป็นคำถามที่มักได้รับคำตอบด้วยข้ออ้างทางการตลาดแทนที่จะเป็นหลักฐาน

ความเข้าใจสมัยใหม่ ซึ่งยืนยันมาตั้งแต่งานของ Messick ในทศวรรษ 1980 คือความตรงไม่ใช่คุณสมบัติที่คงที่ของเครื่องมือ มันเป็นคุณสมบัติของ การตีความ คะแนนสำหรับ การใช้งานเฉพาะ แบบสอบถามเดียวกันสามารถผ่านการตรวจสอบอย่างดีสำหรับการอธิบายการรับรู้ตนเองของบุคคลและไม่ผ่านการตรวจสอบเลยสำหรับการตัดสินใจว่าจะจ้างเขาหรือไม่ การพูดว่า "แบบทดสอบนี้มีความตรง" โดยไม่บอกว่าตรงสำหรับอะไรไม่ใช่ข้ออ้าง แต่เป็นคำขวัญ

ประเภทของหลักฐาน

ความตรงถูกสร้างจากหลักฐานสะสมหลายประเภท ตำราเก่านำเสนอสิ่งเหล่านี้เป็นความตรงชนิดแยก มุมมองปัจจุบันปฏิบัติกับมันเป็นข้อโต้แย้งที่แตกต่างกันสนับสนุนกรณีเดียว

หลักฐานเนื้อหา ถามว่าข้อคำถามครอบคลุมโครงสร้างอย่างเหมาะสมหรือไม่ มาตรวัดภาวะซึมเศร้าที่ถามเฉพาะเรื่องการนอนและความอยากอาหารครอบคลุมอาการทางกายและพลาดอาการทางอารมณ์และการรับรู้ การครอบคลุมเนื้อหามักได้รับการตัดสินโดยผู้เชี่ยวชาญเฉพาะด้าน และเป็นเหตุผลที่มาตรวัดสั้นมากเป็นการประนีประนอมเสมอ

หลักฐานโครงสร้างภายใน ถามว่าข้อคำถามจัดกลุ่มตามที่ทฤษฎีบอกหรือไม่ หากแบบจำลองอ้างว่ามีสี่ด้านที่แตกต่าง การวิเคราะห์ปัจจัยควรกู้คืนสี่ปัจจัย และที่สำคัญคือในกลุ่มตัวอย่างอิสระ ไม่ใช่แค่กลุ่มที่สร้างมาตรวัด เครื่องมือจำนวนมากกู้คืนโครงสร้างที่ตั้งใจไว้ในกลุ่มตัวอย่างพัฒนาแต่ล้มเหลวในของคนอื่น

ความสัมพันธ์กับตัวแปรอื่น คือจุดที่งานส่วนใหญ่เกิดขึ้น หลักฐานเชิงสอดคล้องแสดงว่ามาตรวัดมีสหสัมพันธ์กับสิ่งที่ควรมี หลักฐานเชิงจำแนกแสดงว่ามันไม่มีสหสัมพันธ์สูงเกินไปกับสิ่งที่ควรแตกต่าง ซึ่งเป็นข้อกำหนดที่ถูกละเลยอย่างเรื้อรังและเป็นสิ่งที่ทำลายโครงสร้างที่เพิ่งมีแบรนด์จำนวนมาก หลักฐานเกณฑ์แสดงว่าคะแนนเกี่ยวข้องกับผลลัพธ์ที่สำคัญ ไม่ว่าจะวัดในเวลาเดียวกันหรือทำนายล่วงหน้า

หลักฐานผลกระทบ ถามว่าเกิดอะไรขึ้นเมื่อแบบทดสอบถูกใช้ หากเครื่องมือเสียเปรียบกลุ่มใดกลุ่มหนึ่งอย่างเป็นระบบด้วยเหตุผลที่ไม่เกี่ยวข้องกับโครงสร้าง นั่นเป็นปัญหาความตรง ไม่ใช่เพียงปัญหาจริยธรรม

คำถามที่เปิดเผยข้ออ้างส่วนใหญ่

การทดสอบที่เฉียบที่สุดของข้ออ้างความตรงคือความตรงเชิงเพิ่มขึ้น: เครื่องมือนี้เพิ่มอะไรเหนือสิ่งที่เครื่องมือที่ถูกกว่า เก่ากว่า และเป็นที่ยอมรับบอกคุณแล้วหรือไม่

โครงสร้างที่มีแบรนด์จำนวนมากอย่างน่าทึ่งล้มเหลวตรงนี้ พวกมันมีสหสัมพันธ์ 0.7 หรือสูงกว่ากับโดเมน Big Five ที่มีอยู่ ทำนายผลลัพธ์เดียวกันในขนาดเดียวกัน และไม่เพิ่มอะไรเมื่อควบคุมเครื่องมือเก่าทางสถิติ โครงสร้างใหม่ การวัดไม่ใช่ นี่คือเหตุผลที่ส่วนวิจารณ์ของเอกสารเครื่องมือที่จริงจังมักเน้นความซ้ำซ้อนมากกว่าความไม่แม่นยำ

สิ่งที่ควรมองหา

เมื่อใครอ้างว่าแบบทดสอบผ่านการตรวจสอบ คำถามที่มีประโยชน์เป็นรูปธรรม ตรวจสอบเทียบกับเกณฑ์ใด ในกลุ่มประชากรใด ขนาดเท่าไร โครงสร้างปัจจัยได้รับการยืนยันในกลุ่มตัวอย่างอิสระหรือไม่ มีหลักฐานที่เผยแพร่จากนักวิจัยที่ไม่มีผลประโยชน์ทางการค้าในคำตอบหรือไม่ มันเพิ่มอะไรเหนือทางเลือกที่เป็นที่ยอมรับหรือไม่

เครื่องมือที่มีคำตอบที่ตรงไปตรงมาต่อคำถามเหล่านั้นคุ้มค่าที่จะพิจารณาอย่างจริงจัง รวมถึงข้อจำกัด เครื่องมือที่การตรวจสอบประกอบด้วยหน้าคำรับรองและข้ออ้างว่ามีคนหลายล้านคนเคยทำได้ตอบคำถามที่แตกต่างกันอย่างสิ้นเชิง ความนิยมไม่ใช่หลักฐาน และจำนวนคนที่ทำแบบทดสอบไม่ได้บอกอะไรว่าคะแนนมีความหมายหรือไม่

ลองทำแบบทดสอบดู

การอ่านเกี่ยวกับการวัดผลเป็นเรื่องหนึ่ง การเห็นคะแนนของคุณเองที่รายงานพร้อมแหล่งที่มา กลุ่มตัวอย่างเกณฑ์ปกติ และข้อจำกัดของมันเป็นอีกเรื่องหนึ่ง ทำได้ฟรี ไม่ต้องสมัครสมาชิก

อ่านต่อ