ความตรงในการทดสอบทางจิตวิทยาคืออะไร
ความตรงไม่ใช่คุณสมบัติที่แบบทดสอบมี แต่เป็นข้อโต้แย้งว่าการตีความคะแนนเฉพาะด้าน เพื่อจุดประสงค์เฉพาะนั้น สามารถปกป้องได้หรือไม่ และต้องสร้างใหม่สำหรับการใช้งานใหม่ทุกครั้ง
ความตรงถามว่าแบบทดสอบวัดสิ่งที่อ้างว่าวัดหรือไม่ และข้อสรุปที่ผู้คนได้จากคะแนนนั้นสมเหตุสมผลหรือไม่ มันเป็นคำถามหลักในจิตวิทยาการวัดและเป็นคำถามที่มักได้รับคำตอบด้วยข้ออ้างทางการตลาดแทนที่จะเป็นหลักฐาน
ความเข้าใจสมัยใหม่ ซึ่งยืนยันมาตั้งแต่งานของ Messick ในทศวรรษ 1980 คือความตรงไม่ใช่คุณสมบัติที่คงที่ของเครื่องมือ มันเป็นคุณสมบัติของ การตีความ คะแนนสำหรับ การใช้งานเฉพาะ แบบสอบถามเดียวกันสามารถผ่านการตรวจสอบอย่างดีสำหรับการอธิบายการรับรู้ตนเองของบุคคลและไม่ผ่านการตรวจสอบเลยสำหรับการตัดสินใจว่าจะจ้างเขาหรือไม่ การพูดว่า "แบบทดสอบนี้มีความตรง" โดยไม่บอกว่าตรงสำหรับอะไรไม่ใช่ข้ออ้าง แต่เป็นคำขวัญ
ประเภทของหลักฐาน
ความตรงถูกสร้างจากหลักฐานสะสมหลายประเภท ตำราเก่านำเสนอสิ่งเหล่านี้เป็นความตรงชนิดแยก มุมมองปัจจุบันปฏิบัติกับมันเป็นข้อโต้แย้งที่แตกต่างกันสนับสนุนกรณีเดียว
หลักฐานเนื้อหา ถามว่าข้อคำถามครอบคลุมโครงสร้างอย่างเหมาะสมหรือไม่ มาตรวัดภาวะซึมเศร้าที่ถามเฉพาะเรื่องการนอนและความอยากอาหารครอบคลุมอาการทางกายและพลาดอาการทางอารมณ์และการรับรู้ การครอบคลุมเนื้อหามักได้รับการตัดสินโดยผู้เชี่ยวชาญเฉพาะด้าน และเป็นเหตุผลที่มาตรวัดสั้นมากเป็นการประนีประนอมเสมอ
หลักฐานโครงสร้างภายใน ถามว่าข้อคำถามจัดกลุ่มตามที่ทฤษฎีบอกหรือไม่ หากแบบจำลองอ้างว่ามีสี่ด้านที่แตกต่าง การวิเคราะห์ปัจจัยควรกู้คืนสี่ปัจจัย และที่สำคัญคือในกลุ่มตัวอย่างอิสระ ไม่ใช่แค่กลุ่มที่สร้างมาตรวัด เครื่องมือจำนวนมากกู้คืนโครงสร้างที่ตั้งใจไว้ในกลุ่มตัวอย่างพัฒนาแต่ล้มเหลวในของคนอื่น
ความสัมพันธ์กับตัวแปรอื่น คือจุดที่งานส่วนใหญ่เกิดขึ้น หลักฐานเชิงสอดคล้องแสดงว่ามาตรวัดมีสหสัมพันธ์กับสิ่งที่ควรมี หลักฐานเชิงจำแนกแสดงว่ามันไม่มีสหสัมพันธ์สูงเกินไปกับสิ่งที่ควรแตกต่าง ซึ่งเป็นข้อกำหนดที่ถูกละเลยอย่างเรื้อรังและเป็นสิ่งที่ทำลายโครงสร้างที่เพิ่งมีแบรนด์จำนวนมาก หลักฐานเกณฑ์แสดงว่าคะแนนเกี่ยวข้องกับผลลัพธ์ที่สำคัญ ไม่ว่าจะวัดในเวลาเดียวกันหรือทำนายล่วงหน้า
หลักฐานผลกระทบ ถามว่าเกิดอะไรขึ้นเมื่อแบบทดสอบถูกใช้ หากเครื่องมือเสียเปรียบกลุ่มใดกลุ่มหนึ่งอย่างเป็นระบบด้วยเหตุผลที่ไม่เกี่ยวข้องกับโครงสร้าง นั่นเป็นปัญหาความตรง ไม่ใช่เพียงปัญหาจริยธรรม
คำถามที่เปิดเผยข้ออ้างส่วนใหญ่
การทดสอบที่เฉียบที่สุดของข้ออ้างความตรงคือความตรงเชิงเพิ่มขึ้น: เครื่องมือนี้เพิ่มอะไรเหนือสิ่งที่เครื่องมือที่ถูกกว่า เก่ากว่า และเป็นที่ยอมรับบอกคุณแล้วหรือไม่
โครงสร้างที่มีแบรนด์จำนวนมากอย่างน่าทึ่งล้มเหลวตรงนี้ พวกมันมีสหสัมพันธ์ 0.7 หรือสูงกว่ากับโดเมน Big Five ที่มีอยู่ ทำนายผลลัพธ์เดียวกันในขนาดเดียวกัน และไม่เพิ่มอะไรเมื่อควบคุมเครื่องมือเก่าทางสถิติ โครงสร้างใหม่ การวัดไม่ใช่ นี่คือเหตุผลที่ส่วนวิจารณ์ของเอกสารเครื่องมือที่จริงจังมักเน้นความซ้ำซ้อนมากกว่าความไม่แม่นยำ
สิ่งที่ควรมองหา
เมื่อใครอ้างว่าแบบทดสอบผ่านการตรวจสอบ คำถามที่มีประโยชน์เป็นรูปธรรม ตรวจสอบเทียบกับเกณฑ์ใด ในกลุ่มประชากรใด ขนาดเท่าไร โครงสร้างปัจจัยได้รับการยืนยันในกลุ่มตัวอย่างอิสระหรือไม่ มีหลักฐานที่เผยแพร่จากนักวิจัยที่ไม่มีผลประโยชน์ทางการค้าในคำตอบหรือไม่ มันเพิ่มอะไรเหนือทางเลือกที่เป็นที่ยอมรับหรือไม่
เครื่องมือที่มีคำตอบที่ตรงไปตรงมาต่อคำถามเหล่านั้นคุ้มค่าที่จะพิจารณาอย่างจริงจัง รวมถึงข้อจำกัด เครื่องมือที่การตรวจสอบประกอบด้วยหน้าคำรับรองและข้ออ้างว่ามีคนหลายล้านคนเคยทำได้ตอบคำถามที่แตกต่างกันอย่างสิ้นเชิง ความนิยมไม่ใช่หลักฐาน และจำนวนคนที่ทำแบบทดสอบไม่ได้บอกอะไรว่าคะแนนมีความหมายหรือไม่
ลองทำแบบทดสอบดู
การอ่านเกี่ยวกับการวัดผลเป็นเรื่องหนึ่ง การเห็นคะแนนของคุณเองที่รายงานพร้อมแหล่งที่มา กลุ่มตัวอย่างเกณฑ์ปกติ และข้อจำกัดของมันเป็นอีกเรื่องหนึ่ง ทำได้ฟรี ไม่ต้องสมัครสมาชิก
อ่านต่อ
- จิตวิทยาการวัดคืออะไรศาสตร์ที่พิจารณาว่าการวัดทางจิตวิทยานั้นดีหรือไม่ และเหตุผลที่แบบทดสอบสองชุดที่ถามคำถามคล้ายกันอาจแตกต่างกันอย่างมากในคุณค่าของผลลัพธ์
- ความเที่ยงในการทดสอบทางจิตวิทยาคืออะไรความเที่ยงคือความสม่ำเสมอของการวัด ไม่ใช่ความถูกต้อง แบบทดสอบอาจมีความเที่ยงสูงแต่ยังคงวัดสิ่งผิด ด้วยเหตุนี้จึงเป็นคำถามแรกที่ถูกถามและไม่เคยเป็นคำถามสุดท้าย
- ความตรงเชิงโครงสร้างคืออะไรคำถามที่ยากที่สุดในการวัด: สิ่งที่คุณกำลังวัดมีอยู่จริงตามที่คุณกำหนดหรือไม่ และเครื่องมือของคุณเข้าถึงมันแทนที่จะเป็นสิ่งที่อยู่ข้างเคียงหรือไม่
- ความตรงเชิงสอดคล้องและความตรงเชิงจำแนกข้อกำหนดสองด้านที่สะท้อนกัน: เครื่องมือวัดต้องสอดคล้องกับสิ่งที่ควรสอดคล้อง และต้องแตกต่างจากสิ่งที่อ้างว่าไม่ใช่ เครื่องมือที่อ่อนแอส่วนใหญ่ล้มเหลวในข้อที่สอง
- ค่าอัลฟาของครอนบาคคืออะไร และไม่ใช่อะไรสถิติที่ถูกรายงานมากที่สุดในการทดสอบทางจิตวิทยา และถูกอ่านผิดมากที่สุด อัลฟาไม่ได้บอกว่ามาตรวัดเป็นมิติเดียว และค่าที่สูงมักเป็นอาการมากกว่าคุณธรรม
- ความคลาดเคลื่อนมาตรฐานของการวัด: คะแนนของคุณอาจคลาดเคลื่อนได้มากเพียงใดทุกคะแนนมีช่วงความคลาดเคลื่อน และสำหรับแบบทดสอบทางจิตวิทยาส่วนใหญ่จะกว้างกว่าที่คนคิด นี่คือตัวเลขที่บอกคุณว่าความแตกต่างเป็นของจริงหรือเป็นเพียงสัญญาณรบกวน
- เกณฑ์ปกติและเปอร์เซ็นไทล์: คะแนนของคุณถูกเปรียบเทียบกับอะไรคะแนนดิบไม่สามารถตีความได้ด้วยตัวเอง มันมีความหมายก็ต่อเมื่อเทียบกับกลุ่มอ้างอิง และกลุ่มที่ใช้คือข้อเท็จจริงที่สำคัญที่สุดและถูกโฆษณาน้อยที่สุดเกี่ยวกับแบบทดสอบใดๆ
- แบบทดสอบทางจิตวิทยาถูกสร้างขึ้นอย่างไรตั้งแต่การกำหนดโครงสร้างจนถึงเกณฑ์ปกติที่เผยแพร่ ลำดับขั้นตอนใช้เวลาหลายปีและทิ้งสิ่งที่ใส่เข้าไปส่วนใหญ่ การรู้ขั้นตอนทำให้เห็นชัดว่าแบบทดสอบออนไลน์ด่วนข้ามขั้นตอนไหน
- การเรียกแบบทดสอบว่าผ่านการตรวจสอบหมายความว่าอย่างไรคำนี้ไม่ได้ถูกควบคุมและถูกใช้อย่างเสรีโดยผลิตภัณฑ์ที่ไม่ได้ทำงานใดๆ เลย นี่คือความหมายเมื่อมันมีความหมาย และคำถามสี่ข้อที่แยกสองกรณีออกจากกัน
- ทำไมแบบทดสอบบุคลิกภาพออนไลน์ส่วนใหญ่จึงไม่น่าเชื่อถือไม่ใช่เพราะไม่สุจริต แต่เพราะขั้นตอนที่ทำให้การวัดน่าเชื่อถือนั้นมองไม่เห็น มีราคาแพง และง่ายต่อการข้าม และการข้ามไม่เปลี่ยนแปลงอะไรเกี่ยวกับรูปลักษณ์ของผลลัพธ์
- แบบรายงานตนเองสามารถวัดอะไรได้และไม่ได้แบบสอบถามขอให้คุณเป็นผู้สังเกตตนเอง ซึ่งได้ผลดีกับบางสิ่งมากกว่าสิ่งอื่น การรู้ว่าวิธีนี้แข็งแกร่งตรงไหนและล้มเหลวตรงไหนจะเปลี่ยนวิธีที่คุณอ่านผลลัพธ์ใดก็ตาม
- การที่แบบทดสอบทำนายบางสิ่งได้หมายความว่าอย่างไรสหสัมพันธ์ 0.30 เป็นผลการค้นพบที่แข็งแกร่งในการวิจัยบุคลิกภาพ แต่เป็นพื้นฐานที่อ่อนแอสำหรับการตัดสินใจเกี่ยวกับคนคนเดียว ทั้งสองข้อความเป็นจริง และช่องว่างระหว่างนั้นทำให้เกิดการใช้ผลทดสอบในทางที่ผิดส่วนใหญ่
- การคัดกรองไม่ใช่การวินิจฉัยแบบสอบถามคัดกรองถูกสร้างขึ้นเพื่อจับกรณีที่เป็นไปได้ให้ได้มากที่สุด โดยยอมรับอัตราบวกเท็จที่สูงเป็นราคาที่ต้องจ่าย การอ่านคะแนนคัดกรองเป็นการวินิจฉัยนั้นกลับข้างสิ่งที่มันถูกออกแบบมาให้ทำ