ทำไมแบบทดสอบบุคลิกภาพออนไลน์ส่วนใหญ่จึงไม่น่าเชื่อถือ
ไม่ใช่เพราะไม่สุจริต แต่เพราะขั้นตอนที่ทำให้การวัดน่าเชื่อถือนั้นมองไม่เห็น มีราคาแพง และง่ายต่อการข้าม และการข้ามไม่เปลี่ยนแปลงอะไรเกี่ยวกับรูปลักษณ์ของผลลัพธ์
แบบทดสอบบุคลิกภาพออนไลน์ฟรีและเครื่องมือจิตวิทยาการวัดที่ผ่านการตรวจสอบความถูกต้องให้ผลลัพธ์ที่ดูเหมือนกัน: คะแนน เปอร์เซ็นไทล์ ย่อหน้าอธิบายตัวคุณ ความแตกต่างอยู่ทั้งหมดในงานที่คุณมองไม่เห็นจากหน้าจอผลลัพธ์
สิ่งนี้ควรระบุให้ชัดเจน เพราะกรอบคิดปกติที่ว่าแบบทดสอบอินเทอร์เน็ตเป็นการหลอกลวงนั้นผิดเป็นส่วนใหญ่และไม่ค่อยมีประโยชน์ ส่วนมากสร้างโดยคนที่ไม่มีเจตนาหลอกลวง พวกมันไม่น่าเชื่อถือด้วยเหตุผลเชิงโครงสร้าง
สิ่งที่มักถูกข้าม
การวิเคราะห์ข้อคำถาม ในมาตรวัดที่สร้างอย่างถูกต้อง ข้อคำถามร่างส่วนใหญ่ถูกตัดออกหลังการทดลองใช้: ข้อที่ไม่มีใครตอบแตกต่าง ข้อที่สัมพันธ์ไม่ดีกับคะแนนรวม ข้อที่โหลดบนมากกว่าหนึ่งองค์ประกอบ ข้อที่ทำงานต่างกันข้ามอายุหรือกลุ่มภาษา แบบทดสอบที่เขียนและเผยแพร่โดยไม่ผ่านการทดลองใช้ได้เก็บทุกอย่างไว้ รวมถึงข้อที่ใช้ไม่ได้
การยืนยันโครงสร้างอิสระ การวิเคราะห์องค์ประกอบบนข้อมูลที่คุณใช้สร้างมาตรวัดจะคืนโครงสร้างที่คุณออกแบบ การยืนยันในกลุ่มตัวอย่างใหม่เป็นการศึกษาแยก และเป็นขั้นตอนที่มาตรวัดจำนวนมากล้มเหลว
เกณฑ์ปกติ เปอร์เซ็นไทล์ต้องมาจากที่ไหนสักแห่ง หากเว็บไซต์ไม่ระบุประชากรอ้างอิง ตัวเลขนั้นมาจากผู้เข้าชมก่อนหน้า ซึ่งเป็นกลุ่มที่เลือกตัวเองที่ไม่ทราบองค์ประกอบ หรือไม่ได้มาจากอะไรเป็นพิเศษ
ข้อมูลการทดสอบซ้ำ การพิสูจน์ว่าคนได้คะแนนเท่ากันเดือนถัดไปต้องตามหาพวกเขาอีกครั้ง แทบไม่มีใครทำ ซึ่งหมายความว่าความเสถียรที่คำว่า "ลักษณะ" สื่อไม่ได้รับการพิสูจน์
แรงจูงใจในการออกแบบทำงานผิดทาง
แบบทดสอบที่สร้างเพื่อความน่าสนใจถูกปรับให้เหมาะสมสำหรับผลลัพธ์ที่แตกต่างจากแบบทดสอบที่สร้างเพื่อความแม่นยำ และทั้งสองดึงออกจากกันในทางที่คาดการณ์ได้
ผลลัพธ์ที่ยกยอทำงานได้ดีกว่า ผลลัพธ์ที่บอกสิ่งไม่น่ายินดีถูกแชร์น้อยกว่า ดังนั้นผลลัพธ์จึงเลื่อนไปสู่คำอธิบายที่ทุกคนจำตัวเองได้ นี่คือปรากฏการณ์ Barnum ที่พิสูจน์ในทศวรรษ 1940 และทำซ้ำได้อย่างน่าเชื่อถือตั้งแต่นั้นมา: ผู้คนให้คะแนนคำอธิบายบุคลิกภาพทั่วไปว่าแม่นยำสูงเกี่ยวกับตัวเองโดยเฉพาะ
ประเภทได้ผลดีกว่ามิติ "คุณเป็นสถาปนิก" แชร์ได้มากกว่า "คุณอยู่ที่เปอร์เซ็นไทล์ที่ 68 ด้านการเปิดรับประสบการณ์ด้วยช่วงความเชื่อมั่นกว้าง" ประเภทยังปกปิดความคลาดเคลื่อนของการวัด เนื่องจากคนที่อยู่ห่างกันหนึ่งคะแนนจากขอบเขตหมวดหมู่จะได้ป้ายที่ต่างกันทั้งหมด
สั้นได้ผลดีกว่าเพียงพอ ทุกคำถามเพิ่มเติมสูญเสียผู้ตอบ ดังนั้นแบบทดสอบจึงถูกตัดให้สั้นเพื่อเพิ่มอัตราการทำจนจบแทนที่จะครอบคลุมโครงสร้าง
สิ่งเหล่านี้ไม่มีอะไรเป็นการโกหก เป็นการปรับให้เหมาะสมสำหรับตัวชี้วัดอื่นที่ไม่ใช่ความแม่นยำ
วิธีบอกได้ในประมาณ 30 วินาที
มองหาเครื่องมือต้นทางที่ระบุชื่อพร้อมผู้แต่งและปี มองหาข้อความว่าเกณฑ์ปกติมาจากประชากรใด มองหาการยอมรับข้อจำกัดหรือความคลาดเคลื่อนของการวัด ดูว่าผลลัพธ์เป็นคะแนนต่อเนื่องหรือหมวดหมู่ ดูว่าหน้าเดียวกันสัญญาด้วยหรือไม่ว่าจะระบุอาชีพ คู่ครอง หรือเป้าหมายชีวิตในอุดมคติจาก 20 คำถาม
แบบทดสอบที่ระบุชื่อเครื่องมือ อ้างแหล่งที่มา ระบุเกณฑ์ปกติ และบอกว่าไม่สามารถบอกอะไรได้ ทำงานแล้ว แบบที่ไม่ทำสิ่งใดเลยอาจยังเป็นวิธีที่น่ารื่นรมย์ในการใช้เวลา 5 นาที แต่ตัวเลขที่มันสร้างเป็นเพียงการตกแต่ง
ทุกเครื่องมือในแคตตาล็อก NOESIS ระบุว่าใช้แบบทดสอบที่เผยแพร่ใด ใครเขียน ปีใด ให้คะแนนอย่างไร และผลลัพธ์ไม่ได้พิสูจน์อะไร ส่วนสุดท้ายนั้นคือสิ่งที่ควรเปรียบเทียบ
ลองทำแบบทดสอบดู
การอ่านเกี่ยวกับการวัดผลเป็นเรื่องหนึ่ง การเห็นคะแนนของคุณเองที่รายงานพร้อมแหล่งที่มา กลุ่มตัวอย่างเกณฑ์ปกติ และข้อจำกัดของมันเป็นอีกเรื่องหนึ่ง ทำได้ฟรี ไม่ต้องสมัครสมาชิก
อ่านต่อ
- จิตวิทยาการวัดคืออะไรศาสตร์ที่พิจารณาว่าการวัดทางจิตวิทยานั้นดีหรือไม่ และเหตุผลที่แบบทดสอบสองชุดที่ถามคำถามคล้ายกันอาจแตกต่างกันอย่างมากในคุณค่าของผลลัพธ์
- ความเที่ยงในการทดสอบทางจิตวิทยาคืออะไรความเที่ยงคือความสม่ำเสมอของการวัด ไม่ใช่ความถูกต้อง แบบทดสอบอาจมีความเที่ยงสูงแต่ยังคงวัดสิ่งผิด ด้วยเหตุนี้จึงเป็นคำถามแรกที่ถูกถามและไม่เคยเป็นคำถามสุดท้าย
- ความตรงในการทดสอบทางจิตวิทยาคืออะไรความตรงไม่ใช่คุณสมบัติที่แบบทดสอบมี แต่เป็นข้อโต้แย้งว่าการตีความคะแนนเฉพาะด้าน เพื่อจุดประสงค์เฉพาะนั้น สามารถปกป้องได้หรือไม่ และต้องสร้างใหม่สำหรับการใช้งานใหม่ทุกครั้ง
- ความตรงเชิงโครงสร้างคืออะไรคำถามที่ยากที่สุดในการวัด: สิ่งที่คุณกำลังวัดมีอยู่จริงตามที่คุณกำหนดหรือไม่ และเครื่องมือของคุณเข้าถึงมันแทนที่จะเป็นสิ่งที่อยู่ข้างเคียงหรือไม่
- ความตรงเชิงสอดคล้องและความตรงเชิงจำแนกข้อกำหนดสองด้านที่สะท้อนกัน: เครื่องมือวัดต้องสอดคล้องกับสิ่งที่ควรสอดคล้อง และต้องแตกต่างจากสิ่งที่อ้างว่าไม่ใช่ เครื่องมือที่อ่อนแอส่วนใหญ่ล้มเหลวในข้อที่สอง
- ค่าอัลฟาของครอนบาคคืออะไร และไม่ใช่อะไรสถิติที่ถูกรายงานมากที่สุดในการทดสอบทางจิตวิทยา และถูกอ่านผิดมากที่สุด อัลฟาไม่ได้บอกว่ามาตรวัดเป็นมิติเดียว และค่าที่สูงมักเป็นอาการมากกว่าคุณธรรม
- ความคลาดเคลื่อนมาตรฐานของการวัด: คะแนนของคุณอาจคลาดเคลื่อนได้มากเพียงใดทุกคะแนนมีช่วงความคลาดเคลื่อน และสำหรับแบบทดสอบทางจิตวิทยาส่วนใหญ่จะกว้างกว่าที่คนคิด นี่คือตัวเลขที่บอกคุณว่าความแตกต่างเป็นของจริงหรือเป็นเพียงสัญญาณรบกวน
- เกณฑ์ปกติและเปอร์เซ็นไทล์: คะแนนของคุณถูกเปรียบเทียบกับอะไรคะแนนดิบไม่สามารถตีความได้ด้วยตัวเอง มันมีความหมายก็ต่อเมื่อเทียบกับกลุ่มอ้างอิง และกลุ่มที่ใช้คือข้อเท็จจริงที่สำคัญที่สุดและถูกโฆษณาน้อยที่สุดเกี่ยวกับแบบทดสอบใดๆ
- แบบทดสอบทางจิตวิทยาถูกสร้างขึ้นอย่างไรตั้งแต่การกำหนดโครงสร้างจนถึงเกณฑ์ปกติที่เผยแพร่ ลำดับขั้นตอนใช้เวลาหลายปีและทิ้งสิ่งที่ใส่เข้าไปส่วนใหญ่ การรู้ขั้นตอนทำให้เห็นชัดว่าแบบทดสอบออนไลน์ด่วนข้ามขั้นตอนไหน
- การเรียกแบบทดสอบว่าผ่านการตรวจสอบหมายความว่าอย่างไรคำนี้ไม่ได้ถูกควบคุมและถูกใช้อย่างเสรีโดยผลิตภัณฑ์ที่ไม่ได้ทำงานใดๆ เลย นี่คือความหมายเมื่อมันมีความหมาย และคำถามสี่ข้อที่แยกสองกรณีออกจากกัน
- แบบรายงานตนเองสามารถวัดอะไรได้และไม่ได้แบบสอบถามขอให้คุณเป็นผู้สังเกตตนเอง ซึ่งได้ผลดีกับบางสิ่งมากกว่าสิ่งอื่น การรู้ว่าวิธีนี้แข็งแกร่งตรงไหนและล้มเหลวตรงไหนจะเปลี่ยนวิธีที่คุณอ่านผลลัพธ์ใดก็ตาม
- การที่แบบทดสอบทำนายบางสิ่งได้หมายความว่าอย่างไรสหสัมพันธ์ 0.30 เป็นผลการค้นพบที่แข็งแกร่งในการวิจัยบุคลิกภาพ แต่เป็นพื้นฐานที่อ่อนแอสำหรับการตัดสินใจเกี่ยวกับคนคนเดียว ทั้งสองข้อความเป็นจริง และช่องว่างระหว่างนั้นทำให้เกิดการใช้ผลทดสอบในทางที่ผิดส่วนใหญ่
- การคัดกรองไม่ใช่การวินิจฉัยแบบสอบถามคัดกรองถูกสร้างขึ้นเพื่อจับกรณีที่เป็นไปได้ให้ได้มากที่สุด โดยยอมรับอัตราบวกเท็จที่สูงเป็นราคาที่ต้องจ่าย การอ่านคะแนนคัดกรองเป็นการวินิจฉัยนั้นกลับข้างสิ่งที่มันถูกออกแบบมาให้ทำ