การที่แบบทดสอบทำนายบางสิ่งได้หมายความว่าอย่างไร
สหสัมพันธ์ 0.30 เป็นผลการค้นพบที่แข็งแกร่งในการวิจัยบุคลิกภาพ แต่เป็นพื้นฐานที่อ่อนแอสำหรับการตัดสินใจเกี่ยวกับคนคนเดียว ทั้งสองข้อความเป็นจริง และช่องว่างระหว่างนั้นทำให้เกิดการใช้ผลทดสอบในทางที่ผิดส่วนใหญ่
งานวิจัยบุคลิกภาพรายงานว่าความรับผิดชอบทำนายผลงาน เมื่ออ่านประโยคนี้ คนส่วนใหญ่จินตนาการถึงสิ่งที่แข็งแกร่งกว่าที่ข้อมูลแสดงมาก ช่องว่างระหว่างข้อเรียกร้องทางสถิติและความหมายในชีวิตประจำวันของ "ทำนาย" คือจุดที่การใช้แบบทดสอบจิตวิทยาผิดส่วนใหญ่เริ่มต้น
ตัวเลขที่เกี่ยวข้อง
ขนาดผลในงานวิจัยบุคลิกภาพมักรายงานเป็นสหสัมพันธ์ ค่าจากการวิเคราะห์อภิมานสำหรับความสัมพันธ์ที่เป็นที่ยอมรับมักอยู่ระหว่าง 0.20 ถึง 0.35 ความรับผิดชอบกับผลงานอยู่ที่ประมาณ 0.20 ถึง 0.25 ความพึงพอใจในงานกับผลงานอยู่ที่ประมาณ 0.30 ความสามารถทางจิตทั่วไป ซึ่งเป็นตัวทำนายเดียวที่แข็งแกร่งที่สุดในสาขา ถึงประมาณ 0.50 สำหรับงานที่ซับซ้อน
ยกกำลังสองของสหสัมพันธ์จะได้สัดส่วนของความแปรปรวนที่อธิบายได้ สหสัมพันธ์ 0.25 อธิบายความแตกต่างระหว่างคนได้ประมาณ 6 เปอร์เซ็นต์ อีก 94 เปอร์เซ็นต์เป็นสิ่งอื่น: ความสามารถ โอกาส การฝึก การบริหาร สุขภาพ โชค
ทำไม 0.25 ยังเป็นผลการค้นพบจริง
ในระดับประชากร สหสัมพันธ์ขนาดเล็กสร้างผลรวมที่สำคัญ หากคุณกำลังคัดเลือกคนพันคน ตัวทำนายที่ 0.25 ปรับปรุงผลลัพธ์เฉลี่ยอย่างวัดได้และซ้ำได้ บริษัทประกันและนักระบาดวิทยาสร้างแนวปฏิบัติทั้งหมดบนผลขนาดนี้
ข้อจำกัดคือผลประโยชน์รวมและการทำนายรายบุคคลเป็นปริมาณที่ต่างกัน สหสัมพันธ์ 0.25 หมายความว่าในบรรดาคนที่ได้คะแนนสูง จะมีคนทำงานได้ดีมากกว่าในบรรดาคนที่ได้คะแนนต่ำ และยังหมายความว่าคนที่ได้คะแนนสูงจำนวนมากจะทำงานได้ไม่ดี และคนที่ได้คะแนนต่ำจำนวนมากจะทำได้ดีเยี่ยม ทั้งสองข้อความมาจากตัวเลขเดียวกัน
กรณีรายบุคคล
นี่คือขั้นตอนที่ถูกข้าม สหสัมพันธ์อธิบายความสัมพันธ์ระหว่างสองการกระจาย มันไม่ได้อนุญาตให้กล่าวเกี่ยวกับบุคคลใดบุคคลหนึ่ง
หากความรับผิดชอบสัมพันธ์ 0.25 กับผลงาน การรู้คะแนนความรับผิดชอบของใครสักคนจะทำให้ช่วงที่เป็นไปได้ของผลงานแคบลงเพียงเล็กน้อย ช่วงการทำนายสำหรับบุคคลหนึ่งยังคงกว้างพอที่จะรวมเกือบทุกช่วงผลลัพธ์ การถูกบอกว่าคุณอยู่ที่เปอร์เซ็นไทล์ที่ 80 ด้านความรับผิดชอบบอกคุณน้อยมากเกี่ยวกับว่าคุณจะทำได้อย่างไรในงานเฉพาะ
นี่คือเหตุผลที่การใช้คะแนนบุคลิกภาพเป็นตัวกรองหลักในการคัดเลือกได้รับการสนับสนุนไม่ดี แม้เมื่องานวิจัยพื้นฐานจะมีคุณภาพ งานวิจัยสนับสนุนข้อเรียกร้องว่าลักษณะมีความสำคัญ มันไม่สนับสนุนข้อเรียกร้องว่าคะแนนบอกคุณว่าผู้สมัครจะทำอะไร
ข้อควรระวังเพิ่มเติมสองประการ
การทำนายและการเป็นสาเหตุแตกต่างกัน วรรณกรรมเกือบทั้งหมดเป็นเชิงสหสัมพันธ์ ความรับผิดชอบทำนายผลลัพธ์ด้านสุขภาพสอดคล้องกับว่าความรับผิดชอบทำให้เกิดพฤติกรรมสุขภาพที่ดีขึ้น กับปัจจัยที่สามที่ทำให้เกิดทั้งสอง และกับสาเหตุย้อนกลับ การออกแบบตามยาวทำให้ความเป็นไปได้แคบลง แต่แทบไม่เคยปิด
เกณฑ์ที่รายงานตนเองพองตัวเลข เมื่อทั้งตัวทำนายและผลลัพธ์ถูกรายงานตนเองโดยคนเดียวกันในบ่ายเดียวกัน ความแปรปรวนจากวิธีร่วมผลักสหสัมพันธ์ขึ้น การศึกษาที่ใช้ผลลัพธ์เชิงวัตถุวิสัยหรือการให้คะแนนจากผู้ให้ข้อมูลมักรายงานผลที่น้อยกว่า และเหล่านั้นเป็นสิ่งที่ควรให้น้ำหนัก
คะแนนดีสำหรับอะไรจริง
เมื่ออ่านเป็นคำอธิบายแทนการพยากรณ์ คะแนนจากแบบทดสอบมีประโยชน์จริง มันบอกว่าคุณอยู่ตรงไหนเมื่อเทียบกับประชากรอ้างอิงในลักษณะที่มีผลกระทบที่บันทึกไว้ และให้คำศัพท์สำหรับรูปแบบที่คุณอาจสังเกตเห็นโดยไม่สามารถเรียกชื่อ
สิ่งนั้นคุ้มค่า มันเป็นสิ่งที่ต่างจากการพยากรณ์ และความแตกต่างนั้นเป็นสิ่งที่รายงานที่ซื่อสัตย์ควรทำให้คุณแทนที่จะปล่อยให้คุณอนุมานเอง
ลองทำแบบทดสอบดู
การอ่านเกี่ยวกับการวัดผลเป็นเรื่องหนึ่ง การเห็นคะแนนของคุณเองที่รายงานพร้อมแหล่งที่มา กลุ่มตัวอย่างเกณฑ์ปกติ และข้อจำกัดของมันเป็นอีกเรื่องหนึ่ง ทำได้ฟรี ไม่ต้องสมัครสมาชิก
อ่านต่อ
- จิตวิทยาการวัดคืออะไรศาสตร์ที่พิจารณาว่าการวัดทางจิตวิทยานั้นดีหรือไม่ และเหตุผลที่แบบทดสอบสองชุดที่ถามคำถามคล้ายกันอาจแตกต่างกันอย่างมากในคุณค่าของผลลัพธ์
- ความเที่ยงในการทดสอบทางจิตวิทยาคืออะไรความเที่ยงคือความสม่ำเสมอของการวัด ไม่ใช่ความถูกต้อง แบบทดสอบอาจมีความเที่ยงสูงแต่ยังคงวัดสิ่งผิด ด้วยเหตุนี้จึงเป็นคำถามแรกที่ถูกถามและไม่เคยเป็นคำถามสุดท้าย
- ความตรงในการทดสอบทางจิตวิทยาคืออะไรความตรงไม่ใช่คุณสมบัติที่แบบทดสอบมี แต่เป็นข้อโต้แย้งว่าการตีความคะแนนเฉพาะด้าน เพื่อจุดประสงค์เฉพาะนั้น สามารถปกป้องได้หรือไม่ และต้องสร้างใหม่สำหรับการใช้งานใหม่ทุกครั้ง
- ความตรงเชิงโครงสร้างคืออะไรคำถามที่ยากที่สุดในการวัด: สิ่งที่คุณกำลังวัดมีอยู่จริงตามที่คุณกำหนดหรือไม่ และเครื่องมือของคุณเข้าถึงมันแทนที่จะเป็นสิ่งที่อยู่ข้างเคียงหรือไม่
- ความตรงเชิงสอดคล้องและความตรงเชิงจำแนกข้อกำหนดสองด้านที่สะท้อนกัน: เครื่องมือวัดต้องสอดคล้องกับสิ่งที่ควรสอดคล้อง และต้องแตกต่างจากสิ่งที่อ้างว่าไม่ใช่ เครื่องมือที่อ่อนแอส่วนใหญ่ล้มเหลวในข้อที่สอง
- ค่าอัลฟาของครอนบาคคืออะไร และไม่ใช่อะไรสถิติที่ถูกรายงานมากที่สุดในการทดสอบทางจิตวิทยา และถูกอ่านผิดมากที่สุด อัลฟาไม่ได้บอกว่ามาตรวัดเป็นมิติเดียว และค่าที่สูงมักเป็นอาการมากกว่าคุณธรรม
- ความคลาดเคลื่อนมาตรฐานของการวัด: คะแนนของคุณอาจคลาดเคลื่อนได้มากเพียงใดทุกคะแนนมีช่วงความคลาดเคลื่อน และสำหรับแบบทดสอบทางจิตวิทยาส่วนใหญ่จะกว้างกว่าที่คนคิด นี่คือตัวเลขที่บอกคุณว่าความแตกต่างเป็นของจริงหรือเป็นเพียงสัญญาณรบกวน
- เกณฑ์ปกติและเปอร์เซ็นไทล์: คะแนนของคุณถูกเปรียบเทียบกับอะไรคะแนนดิบไม่สามารถตีความได้ด้วยตัวเอง มันมีความหมายก็ต่อเมื่อเทียบกับกลุ่มอ้างอิง และกลุ่มที่ใช้คือข้อเท็จจริงที่สำคัญที่สุดและถูกโฆษณาน้อยที่สุดเกี่ยวกับแบบทดสอบใดๆ
- แบบทดสอบทางจิตวิทยาถูกสร้างขึ้นอย่างไรตั้งแต่การกำหนดโครงสร้างจนถึงเกณฑ์ปกติที่เผยแพร่ ลำดับขั้นตอนใช้เวลาหลายปีและทิ้งสิ่งที่ใส่เข้าไปส่วนใหญ่ การรู้ขั้นตอนทำให้เห็นชัดว่าแบบทดสอบออนไลน์ด่วนข้ามขั้นตอนไหน
- การเรียกแบบทดสอบว่าผ่านการตรวจสอบหมายความว่าอย่างไรคำนี้ไม่ได้ถูกควบคุมและถูกใช้อย่างเสรีโดยผลิตภัณฑ์ที่ไม่ได้ทำงานใดๆ เลย นี่คือความหมายเมื่อมันมีความหมาย และคำถามสี่ข้อที่แยกสองกรณีออกจากกัน
- ทำไมแบบทดสอบบุคลิกภาพออนไลน์ส่วนใหญ่จึงไม่น่าเชื่อถือไม่ใช่เพราะไม่สุจริต แต่เพราะขั้นตอนที่ทำให้การวัดน่าเชื่อถือนั้นมองไม่เห็น มีราคาแพง และง่ายต่อการข้าม และการข้ามไม่เปลี่ยนแปลงอะไรเกี่ยวกับรูปลักษณ์ของผลลัพธ์
- แบบรายงานตนเองสามารถวัดอะไรได้และไม่ได้แบบสอบถามขอให้คุณเป็นผู้สังเกตตนเอง ซึ่งได้ผลดีกับบางสิ่งมากกว่าสิ่งอื่น การรู้ว่าวิธีนี้แข็งแกร่งตรงไหนและล้มเหลวตรงไหนจะเปลี่ยนวิธีที่คุณอ่านผลลัพธ์ใดก็ตาม
- การคัดกรองไม่ใช่การวินิจฉัยแบบสอบถามคัดกรองถูกสร้างขึ้นเพื่อจับกรณีที่เป็นไปได้ให้ได้มากที่สุด โดยยอมรับอัตราบวกเท็จที่สูงเป็นราคาที่ต้องจ่าย การอ่านคะแนนคัดกรองเป็นการวินิจฉัยนั้นกลับข้างสิ่งที่มันถูกออกแบบมาให้ทำ