ความคลาดเคลื่อนมาตรฐานของการวัด: คะแนนของคุณอาจคลาดเคลื่อนได้มากเพียงใด
ทุกคะแนนมีช่วงความคลาดเคลื่อน และสำหรับแบบทดสอบทางจิตวิทยาส่วนใหญ่จะกว้างกว่าที่คนคิด นี่คือตัวเลขที่บอกคุณว่าความแตกต่างเป็นของจริงหรือเป็นเพียงสัญญาณรบกวน
ค่าความคลาดเคลื่อนมาตรฐานของการวัดเปลี่ยนค่าสัมประสิทธิ์ความเที่ยงที่เป็นนามธรรมให้เป็นสิ่งที่เป็นรูปธรรม: แถบบวกลบรอบคะแนน มันตอบคำถามที่หน้าจอผลลัพธ์ส่วนใหญ่ไม่ได้ตอบ คือ ตัวเลขนี้อาจแตกต่างไปเท่าไรหากทำแบบทดสอบในบ่ายวันอื่น?
สูตรเรียบง่าย คูณส่วนเบี่ยงเบนมาตรฐานของมาตรวัดด้วยรากที่สองของหนึ่งลบค่าความเที่ยง สำหรับมาตรวัดที่มีส่วนเบี่ยงเบนมาตรฐาน 10 และความเที่ยง 0.85 ค่าความคลาดเคลื่อนมาตรฐานจะอยู่ที่ประมาณ 3.9 คะแนน
แถบนั้นครอบคลุมอะไรจริง
ประมาณสองในสามของเวลา ตำแหน่งที่แท้จริงของบุคคลอยู่ภายในหนึ่งค่าความคลาดเคลื่อนมาตรฐานจากคะแนนที่สังเกตได้ เพื่อให้มั่นใจประมาณ 95 เปอร์เซ็นต์ ต้องใช้ประมาณสองค่าความคลาดเคลื่อนมาตรฐานทั้งสองด้าน
ใช้ตัวอย่างข้างต้น ผู้ใดได้คะแนน 62 ช่วง 95 เปอร์เซ็นต์จะอยู่ที่ประมาณ 54 ถึง 70 นั่นคือช่วงกว้าง 16 คะแนนบนมาตรวัดที่ช่องว่างทั่วไประหว่างระดับเฉลี่ยและสูงกว่าเฉลี่ยอย่างชัดเจนอาจเป็น 10 คะแนน
นี่ไม่ใช่ข้อบกพร่องของแบบทดสอบนั้นโดยเฉพาะ ความเที่ยง 0.85 ถือว่าน่าเชื่อถือ นี่คือความแม่นยำปกติของการวัดทางจิตวิทยา และเป็นเหตุผลที่รายงานที่รอบคอบนำเสนอแถบแทนจุด
ผลที่ตามมาที่คนมักมองข้าม
ความแตกต่างเล็กน้อยระหว่างมาตรวัดมักไม่มีความหมาย หากความเปิดเผยของคุณเป็น 58 และการเปิดรับประสบการณ์เป็น 54 การอ่านที่ซื่อสัตย์คือพวกมันแยกไม่ออก การตีความโปรไฟล์ที่สร้างเรื่องราวจากช่องว่าง 4 คะแนนกำลังอ่านสัญญาณรบกวน
การเปลี่ยนแปลงเล็กน้อยตามเวลามักไม่มีความหมายเช่นกัน การทำแบบทดสอบซ้ำและเลื่อน 5 คะแนนอยู่ในช่วงความคลาดเคลื่อนสำหรับเครื่องมือส่วนใหญ่ การเปลี่ยนแปลงลักษณะที่แท้จริงเกิดขึ้นในช่วงหลายปีและแสดงออกเป็นการเคลื่อนที่ที่อยู่นอกแถบความคลาดเคลื่อนอย่างชัดเจน ไม่ใช่ไม่กี่คะแนนในแต่ละเดือน
การจัดอันดับขยายปัญหา ความแตกต่างของคะแนนดิบไม่กี่คะแนนสามารถเลื่อนตำแหน่งเปอร์เซ็นไทล์ไป 10 อันดับในส่วนกลางที่หนาแน่นของการกระจาย เพราะนั่นคือจุดที่คนส่วนใหญ่อยู่ อันดับเปอร์เซ็นไทล์ดูแม่นยำแต่เป็นวิธีที่มีเสถียรภาพน้อยที่สุดในการแสดงคะแนน
ความแม่นยำไม่สม่ำเสมอทั่วมาตรวัด ทฤษฎีการทดสอบแบบคลาสสิกสมมติค่าความคลาดเคลื่อนเดียวสำหรับทุกคะแนน ซึ่งเป็นการทำให้ง่ายเกินไป ทฤษฎีการตอบสนองข้อสอบจำลองความคลาดเคลื่อนแยกกันที่แต่ละระดับของลักษณะ และมันมากขึ้นเกือบเสมอที่ส่วนปลาย ซึ่งเป็นจุดที่การตีความที่สำคัญที่สุดเกิดขึ้น คะแนนที่สูงมากหรือต่ำมากมักมีความแม่นยำน้อยกว่าคะแนนปานกลาง ไม่ใช่มากกว่า
ทำไมการรายงานที่ซื่อสัตย์ดูน่าประทับใจน้อยกว่า
เครื่องมือที่รายงานแถบความเชื่อมั่นดูคลุมเครือกว่าเครื่องมือที่รายงานตัวเลขเดียวถึงทศนิยมหนึ่งตำแหน่ง เครื่องมือที่ดูคลุมเครือกำลังบอกความจริง เครื่องมือที่ดูแม่นยำมีความคลาดเคลื่อนพื้นฐานเท่ากันและเลือกที่จะไม่แสดงมัน
สิ่งนี้ควรจดจำเมื่อเปรียบเทียบแบบทดสอบที่มีเอกสารทางวิทยาศาสตร์กับผลิตภัณฑ์เชิงพาณิชย์ที่จัดคุณเข้าประเภท ขอบเขตของประเภทอยู่ที่คะแนนเฉพาะ และคนที่อยู่ต่ำกว่า 1 คะแนนกับคนที่อยู่สูงกว่า 1 คะแนน ในเชิงสถิติคือคนเดียวกัน ป้ายประเภทปกปิดสิ่งนี้ทั้งหมด ซึ่งเป็นหนึ่งในข้อโต้แย้งที่รุนแรงกว่าต่อเครื่องมือแบบประเภท และเป็นเหตุผลที่คะแนนต่อเนื่องพร้อมค่าความคลาดเคลื่อนที่ระบุเป็นมาตรฐานในการวิจัย
ลองทำแบบทดสอบดู
การอ่านเกี่ยวกับการวัดผลเป็นเรื่องหนึ่ง การเห็นคะแนนของคุณเองที่รายงานพร้อมแหล่งที่มา กลุ่มตัวอย่างเกณฑ์ปกติ และข้อจำกัดของมันเป็นอีกเรื่องหนึ่ง ทำได้ฟรี ไม่ต้องสมัครสมาชิก
อ่านต่อ
- จิตวิทยาการวัดคืออะไรศาสตร์ที่พิจารณาว่าการวัดทางจิตวิทยานั้นดีหรือไม่ และเหตุผลที่แบบทดสอบสองชุดที่ถามคำถามคล้ายกันอาจแตกต่างกันอย่างมากในคุณค่าของผลลัพธ์
- ความเที่ยงในการทดสอบทางจิตวิทยาคืออะไรความเที่ยงคือความสม่ำเสมอของการวัด ไม่ใช่ความถูกต้อง แบบทดสอบอาจมีความเที่ยงสูงแต่ยังคงวัดสิ่งผิด ด้วยเหตุนี้จึงเป็นคำถามแรกที่ถูกถามและไม่เคยเป็นคำถามสุดท้าย
- ความตรงในการทดสอบทางจิตวิทยาคืออะไรความตรงไม่ใช่คุณสมบัติที่แบบทดสอบมี แต่เป็นข้อโต้แย้งว่าการตีความคะแนนเฉพาะด้าน เพื่อจุดประสงค์เฉพาะนั้น สามารถปกป้องได้หรือไม่ และต้องสร้างใหม่สำหรับการใช้งานใหม่ทุกครั้ง
- ความตรงเชิงโครงสร้างคืออะไรคำถามที่ยากที่สุดในการวัด: สิ่งที่คุณกำลังวัดมีอยู่จริงตามที่คุณกำหนดหรือไม่ และเครื่องมือของคุณเข้าถึงมันแทนที่จะเป็นสิ่งที่อยู่ข้างเคียงหรือไม่
- ความตรงเชิงสอดคล้องและความตรงเชิงจำแนกข้อกำหนดสองด้านที่สะท้อนกัน: เครื่องมือวัดต้องสอดคล้องกับสิ่งที่ควรสอดคล้อง และต้องแตกต่างจากสิ่งที่อ้างว่าไม่ใช่ เครื่องมือที่อ่อนแอส่วนใหญ่ล้มเหลวในข้อที่สอง
- ค่าอัลฟาของครอนบาคคืออะไร และไม่ใช่อะไรสถิติที่ถูกรายงานมากที่สุดในการทดสอบทางจิตวิทยา และถูกอ่านผิดมากที่สุด อัลฟาไม่ได้บอกว่ามาตรวัดเป็นมิติเดียว และค่าที่สูงมักเป็นอาการมากกว่าคุณธรรม
- เกณฑ์ปกติและเปอร์เซ็นไทล์: คะแนนของคุณถูกเปรียบเทียบกับอะไรคะแนนดิบไม่สามารถตีความได้ด้วยตัวเอง มันมีความหมายก็ต่อเมื่อเทียบกับกลุ่มอ้างอิง และกลุ่มที่ใช้คือข้อเท็จจริงที่สำคัญที่สุดและถูกโฆษณาน้อยที่สุดเกี่ยวกับแบบทดสอบใดๆ
- แบบทดสอบทางจิตวิทยาถูกสร้างขึ้นอย่างไรตั้งแต่การกำหนดโครงสร้างจนถึงเกณฑ์ปกติที่เผยแพร่ ลำดับขั้นตอนใช้เวลาหลายปีและทิ้งสิ่งที่ใส่เข้าไปส่วนใหญ่ การรู้ขั้นตอนทำให้เห็นชัดว่าแบบทดสอบออนไลน์ด่วนข้ามขั้นตอนไหน
- การเรียกแบบทดสอบว่าผ่านการตรวจสอบหมายความว่าอย่างไรคำนี้ไม่ได้ถูกควบคุมและถูกใช้อย่างเสรีโดยผลิตภัณฑ์ที่ไม่ได้ทำงานใดๆ เลย นี่คือความหมายเมื่อมันมีความหมาย และคำถามสี่ข้อที่แยกสองกรณีออกจากกัน
- ทำไมแบบทดสอบบุคลิกภาพออนไลน์ส่วนใหญ่จึงไม่น่าเชื่อถือไม่ใช่เพราะไม่สุจริต แต่เพราะขั้นตอนที่ทำให้การวัดน่าเชื่อถือนั้นมองไม่เห็น มีราคาแพง และง่ายต่อการข้าม และการข้ามไม่เปลี่ยนแปลงอะไรเกี่ยวกับรูปลักษณ์ของผลลัพธ์
- แบบรายงานตนเองสามารถวัดอะไรได้และไม่ได้แบบสอบถามขอให้คุณเป็นผู้สังเกตตนเอง ซึ่งได้ผลดีกับบางสิ่งมากกว่าสิ่งอื่น การรู้ว่าวิธีนี้แข็งแกร่งตรงไหนและล้มเหลวตรงไหนจะเปลี่ยนวิธีที่คุณอ่านผลลัพธ์ใดก็ตาม
- การที่แบบทดสอบทำนายบางสิ่งได้หมายความว่าอย่างไรสหสัมพันธ์ 0.30 เป็นผลการค้นพบที่แข็งแกร่งในการวิจัยบุคลิกภาพ แต่เป็นพื้นฐานที่อ่อนแอสำหรับการตัดสินใจเกี่ยวกับคนคนเดียว ทั้งสองข้อความเป็นจริง และช่องว่างระหว่างนั้นทำให้เกิดการใช้ผลทดสอบในทางที่ผิดส่วนใหญ่
- การคัดกรองไม่ใช่การวินิจฉัยแบบสอบถามคัดกรองถูกสร้างขึ้นเพื่อจับกรณีที่เป็นไปได้ให้ได้มากที่สุด โดยยอมรับอัตราบวกเท็จที่สูงเป็นราคาที่ต้องจ่าย การอ่านคะแนนคัดกรองเป็นการวินิจฉัยนั้นกลับข้างสิ่งที่มันถูกออกแบบมาให้ทำ