เกณฑ์ปกติและเปอร์เซ็นไทล์: คะแนนของคุณถูกเปรียบเทียบกับอะไร
คะแนนดิบไม่สามารถตีความได้ด้วยตัวเอง มันมีความหมายก็ต่อเมื่อเทียบกับกลุ่มอ้างอิง และกลุ่มที่ใช้คือข้อเท็จจริงที่สำคัญที่สุดและถูกโฆษณาน้อยที่สุดเกี่ยวกับแบบทดสอบใดๆ
คุณได้คะแนน 34 ในมาตรวัดความรับผิดชอบ นั่นสูงหรือไม่?
คำถามนี้ไม่มีคำตอบหากปราศจากการเปรียบเทียบ 34 จากคะแนนเต็มเท่าไร เทียบกับใคร วัดเมื่อไร? เกณฑ์ปกติคือข้อมูลอ้างอิงที่เปลี่ยนคะแนนดิบให้เป็นตำแหน่งที่ตีความได้ และการเลือกเกณฑ์เหล่านี้เป็นหนึ่งในการตัดสินใจที่สำคัญที่สุดในการสร้างแบบทดสอบ
การแปลงคะแนนทำงานอย่างไร
กลุ่มตัวอย่างเกณฑ์ปกติคือกลุ่มคนที่ทำเครื่องมือวัดภายใต้เงื่อนไขมาตรฐาน ซึ่งการกระจายคะแนนของพวกเขาจะกลายเป็นมาตรฐานเปรียบเทียบ คะแนนดิบจะถูกแสดงเป็นตำแหน่งภายในการกระจายนั้น
อันดับเปอร์เซ็นไทล์ ระบุสัดส่วนของกลุ่มตัวอย่างเกณฑ์ปกติที่ได้คะแนนเท่ากับหรือต่ำกว่าคุณ เปอร์เซ็นไทล์ที่ 70 หมายความว่า 70 เปอร์เซ็นต์ของกลุ่มอ้างอิงได้คะแนนต่ำกว่า เปอร์เซ็นไทล์เข้าใจง่ายและมีข้อบกพร่องที่มักถูกมองข้าม: มันขยายความแตกต่างในส่วนกลางที่แออัดของการกระจาย และบีบอัดความแตกต่างที่ปลายทั้งสอง คะแนนดิบต่างกันไม่กี่คะแนนรอบค่าเฉลี่ยสามารถเลื่อนตำแหน่งเปอร์เซ็นไทล์ไปหลายอันดับ ในขณะที่จำนวนคะแนนเท่ากันใกล้ส่วนบนแทบไม่เลื่อนเลย
คะแนนมาตรฐาน ได้แก่ z-scores, T-scores, stanines, มาตราแบบ IQ ซึ่งแสดงระยะห่างจากค่าเฉลี่ยในหน่วยส่วนเบี่ยงเบนมาตรฐาน คะแนนเหล่านี้รักษาระยะห่างจริงระหว่างคะแนน จึงเป็นที่นิยมสำหรับงานที่เกี่ยวข้องกับการคำนวณผลลัพธ์
ทำไมกลุ่มอ้างอิงจึงสำคัญที่สุด
คะแนนดิบเดียวกันอาจอยู่ที่เปอร์เซ็นไทล์ที่แตกต่างกันมากขึ้นอยู่กับกลุ่มตัวอย่างเกณฑ์ปกติ ความรับผิดชอบที่เทียบกับประชากรผู้ใหญ่ทั่วไปและเทียบกับกลุ่มตัวอย่างของนักบัญชีที่ประกอบวิชาชีพจะไม่ให้เปอร์เซ็นไทล์เดียวกัน และทั้งสองตัวเลขไม่ผิด เพียงแต่ตอบคำถามที่ต่างกัน
สิ่งนี้ทำให้คุณสมบัติหลายอย่างของกลุ่มตัวอย่างเกณฑ์ปกติควรค่าแก่การรู้
ใครอยู่ในกลุ่ม กลุ่มตัวอย่างสะดวกจากนักศึกษาจิตวิทยาระดับปริญญาตรียังคงพบได้บ่อยและเป็นตัวแทนของมนุษย์เพียงส่วนเล็ก: อายุน้อย มีการศึกษา และมาจากประเทศตะวันตกที่ร่ำรวยเป็นสัดส่วนที่ไม่สมดุล เกณฑ์ปกติที่สร้างจากกลุ่มเหล่านี้ใช้ได้ไม่ดีในบริบทอื่น
ขนาดกลุ่มเท่าไร การประมาณเปอร์เซ็นไทล์ที่เสถียรในส่วนปลายต้องการกลุ่มตัวอย่างขนาดใหญ่ คนเพียงไม่กี่ร้อยให้ภาพที่ไม่น่าเชื่อถือว่าเปอร์เซ็นไทล์ที่ 95 เป็นอย่างไร
เก็บข้อมูลเมื่อไร เกณฑ์ปกติเปลี่ยนแปลงตามเวลา ค่าเฉลี่ยประชากรในการวัดทางจิตวิทยาหลายอย่างเปลี่ยนแปลงอย่างชัดเจนในช่วงหลายทศวรรษ และกลุ่มตัวอย่างเกณฑ์ปกติจากปี 1995 ไม่ได้อธิบายประชากรที่ทำแบบทดสอบในปี 2026 อีกต่อไป
มีการแบ่งชั้นหรือไม่ ลักษณะหลายอย่างแตกต่างอย่างเป็นระบบตามอายุและเพศ การแสวงหาความตื่นเต้นลดลงอย่างมากตามอายุ จังหวะชีวภาพเปลี่ยนแปลงตลอดช่วงชีวิต การเปรียบเทียบคนอายุ 55 ปีกับเกณฑ์ปกติทุกวัยให้ตำแหน่งที่ทำให้เข้าใจผิดในทั้งสองมิติ
สิ่งที่ควรมองหา และการขาดหายไปหมายความว่าอย่างไร
เครื่องมือวัดที่มีเอกสารดีจะระบุขนาด องค์ประกอบ ประเทศ และปีของกลุ่มตัวอย่างเกณฑ์ปกติ และบอกว่าเกณฑ์มีการแบ่งชั้นหรือไม่ คู่มือแบบทดสอบที่จริงจังจะอุทิศหลายบทให้กับเรื่องนี้
แบบทดสอบออนไลน์ฟรีส่วนใหญ่ไม่รายงานข้อมูลใดเลย พวกเขาให้เปอร์เซ็นไทล์โดยไม่ระบุว่าอ้างอิงจากประชากรใด เปอร์เซ็นไทล์นั้นอาจมาจากกลุ่มตัวอย่างสะดวกที่ไม่เปิดเผย ยืมมาจากเกณฑ์ปกติที่เผยแพร่ซึ่งเก็บจากประชากรอื่น หรือสร้างจากคนที่เคยทำแบบทดสอบของเว็บไซต์นั้นมาก่อน ซึ่งเป็นกลุ่มที่เลือกตัวเองที่แม้แต่ผู้ดำเนินการเว็บไซต์ก็ไม่รู้จักองค์ประกอบ
เปอร์เซ็นไทล์ยังคงปรากฏบนหน้าจอและดูเหมือนกับของจริง เอกสารประกอบเท่านั้น และเฉพาะสิ่งนั้น ที่แยกทั้งสองออกจากกัน
ลองทำแบบทดสอบดู
การอ่านเกี่ยวกับการวัดผลเป็นเรื่องหนึ่ง การเห็นคะแนนของคุณเองที่รายงานพร้อมแหล่งที่มา กลุ่มตัวอย่างเกณฑ์ปกติ และข้อจำกัดของมันเป็นอีกเรื่องหนึ่ง ทำได้ฟรี ไม่ต้องสมัครสมาชิก
อ่านต่อ
- จิตวิทยาการวัดคืออะไรศาสตร์ที่พิจารณาว่าการวัดทางจิตวิทยานั้นดีหรือไม่ และเหตุผลที่แบบทดสอบสองชุดที่ถามคำถามคล้ายกันอาจแตกต่างกันอย่างมากในคุณค่าของผลลัพธ์
- ความเที่ยงในการทดสอบทางจิตวิทยาคืออะไรความเที่ยงคือความสม่ำเสมอของการวัด ไม่ใช่ความถูกต้อง แบบทดสอบอาจมีความเที่ยงสูงแต่ยังคงวัดสิ่งผิด ด้วยเหตุนี้จึงเป็นคำถามแรกที่ถูกถามและไม่เคยเป็นคำถามสุดท้าย
- ความตรงในการทดสอบทางจิตวิทยาคืออะไรความตรงไม่ใช่คุณสมบัติที่แบบทดสอบมี แต่เป็นข้อโต้แย้งว่าการตีความคะแนนเฉพาะด้าน เพื่อจุดประสงค์เฉพาะนั้น สามารถปกป้องได้หรือไม่ และต้องสร้างใหม่สำหรับการใช้งานใหม่ทุกครั้ง
- ความตรงเชิงโครงสร้างคืออะไรคำถามที่ยากที่สุดในการวัด: สิ่งที่คุณกำลังวัดมีอยู่จริงตามที่คุณกำหนดหรือไม่ และเครื่องมือของคุณเข้าถึงมันแทนที่จะเป็นสิ่งที่อยู่ข้างเคียงหรือไม่
- ความตรงเชิงสอดคล้องและความตรงเชิงจำแนกข้อกำหนดสองด้านที่สะท้อนกัน: เครื่องมือวัดต้องสอดคล้องกับสิ่งที่ควรสอดคล้อง และต้องแตกต่างจากสิ่งที่อ้างว่าไม่ใช่ เครื่องมือที่อ่อนแอส่วนใหญ่ล้มเหลวในข้อที่สอง
- ค่าอัลฟาของครอนบาคคืออะไร และไม่ใช่อะไรสถิติที่ถูกรายงานมากที่สุดในการทดสอบทางจิตวิทยา และถูกอ่านผิดมากที่สุด อัลฟาไม่ได้บอกว่ามาตรวัดเป็นมิติเดียว และค่าที่สูงมักเป็นอาการมากกว่าคุณธรรม
- ความคลาดเคลื่อนมาตรฐานของการวัด: คะแนนของคุณอาจคลาดเคลื่อนได้มากเพียงใดทุกคะแนนมีช่วงความคลาดเคลื่อน และสำหรับแบบทดสอบทางจิตวิทยาส่วนใหญ่จะกว้างกว่าที่คนคิด นี่คือตัวเลขที่บอกคุณว่าความแตกต่างเป็นของจริงหรือเป็นเพียงสัญญาณรบกวน
- แบบทดสอบทางจิตวิทยาถูกสร้างขึ้นอย่างไรตั้งแต่การกำหนดโครงสร้างจนถึงเกณฑ์ปกติที่เผยแพร่ ลำดับขั้นตอนใช้เวลาหลายปีและทิ้งสิ่งที่ใส่เข้าไปส่วนใหญ่ การรู้ขั้นตอนทำให้เห็นชัดว่าแบบทดสอบออนไลน์ด่วนข้ามขั้นตอนไหน
- การเรียกแบบทดสอบว่าผ่านการตรวจสอบหมายความว่าอย่างไรคำนี้ไม่ได้ถูกควบคุมและถูกใช้อย่างเสรีโดยผลิตภัณฑ์ที่ไม่ได้ทำงานใดๆ เลย นี่คือความหมายเมื่อมันมีความหมาย และคำถามสี่ข้อที่แยกสองกรณีออกจากกัน
- ทำไมแบบทดสอบบุคลิกภาพออนไลน์ส่วนใหญ่จึงไม่น่าเชื่อถือไม่ใช่เพราะไม่สุจริต แต่เพราะขั้นตอนที่ทำให้การวัดน่าเชื่อถือนั้นมองไม่เห็น มีราคาแพง และง่ายต่อการข้าม และการข้ามไม่เปลี่ยนแปลงอะไรเกี่ยวกับรูปลักษณ์ของผลลัพธ์
- แบบรายงานตนเองสามารถวัดอะไรได้และไม่ได้แบบสอบถามขอให้คุณเป็นผู้สังเกตตนเอง ซึ่งได้ผลดีกับบางสิ่งมากกว่าสิ่งอื่น การรู้ว่าวิธีนี้แข็งแกร่งตรงไหนและล้มเหลวตรงไหนจะเปลี่ยนวิธีที่คุณอ่านผลลัพธ์ใดก็ตาม
- การที่แบบทดสอบทำนายบางสิ่งได้หมายความว่าอย่างไรสหสัมพันธ์ 0.30 เป็นผลการค้นพบที่แข็งแกร่งในการวิจัยบุคลิกภาพ แต่เป็นพื้นฐานที่อ่อนแอสำหรับการตัดสินใจเกี่ยวกับคนคนเดียว ทั้งสองข้อความเป็นจริง และช่องว่างระหว่างนั้นทำให้เกิดการใช้ผลทดสอบในทางที่ผิดส่วนใหญ่
- การคัดกรองไม่ใช่การวินิจฉัยแบบสอบถามคัดกรองถูกสร้างขึ้นเพื่อจับกรณีที่เป็นไปได้ให้ได้มากที่สุด โดยยอมรับอัตราบวกเท็จที่สูงเป็นราคาที่ต้องจ่าย การอ่านคะแนนคัดกรองเป็นการวินิจฉัยนั้นกลับข้างสิ่งที่มันถูกออกแบบมาให้ทำ