แบบทดสอบทางจิตวิทยาถูกสร้างขึ้นอย่างไร
ตั้งแต่การกำหนดโครงสร้างจนถึงเกณฑ์ปกติที่เผยแพร่ ลำดับขั้นตอนใช้เวลาหลายปีและทิ้งสิ่งที่ใส่เข้าไปส่วนใหญ่ การรู้ขั้นตอนทำให้เห็นชัดว่าแบบทดสอบออนไลน์ด่วนข้ามขั้นตอนไหน
เครื่องมือวัดทางจิตวิทยาที่ได้รับการตีพิมพ์มักผ่านการทำงานมาห้าถึงหกปีและทิ้งสิ่งที่เขียนไว้ส่วนใหญ่ไป ลำดับขั้นตอนเหล่านี้น่ารู้ เพราะแต่ละขั้นตอนสอดคล้องกับวิธีที่แบบทดสอบอาจไม่เพียงพอ
1. นิยามโครงสร้างเชิงทฤษฎี
ก่อนที่จะเขียนข้อคำถามใดๆ โครงสร้างเชิงทฤษฎีต้องถูกกำหนดอย่างชัดเจนเพียงพอที่จะบอกได้ว่าอะไรอยู่นอกขอบเขต ซึ่งหมายถึงคำนิยาม คำอธิบายโครงสร้างมิติ ว่ามีมิติเดียวหรือหลายมิติ และหากมีหลายมิติ มิติเหล่านั้นเกี่ยวข้องกันอย่างไร รวมถึงการอธิบายอย่างชัดเจนว่าโครงสร้างใกล้เคียงใดที่ตั้งใจให้แตกต่าง
การข้ามขั้นตอนนี้เป็นต้นกำเนิดของเครื่องมือซ้ำซ้อนส่วนใหญ่ มาตรวัดที่สร้างจากความรู้สึกตามสัญชาตญาณของแนวคิดมักจะวัดลักษณะที่มีอยู่แล้วภายใต้ชื่อใหม่
2. สร้างคลังข้อคำถาม
ข้อคำถามถูกร่างขึ้นมากเกินกว่าที่จะเหลือรอด โดยทั่วไปสามถึงห้าเท่าของจำนวนสุดท้าย ข้อคำถามเหล่านี้มาจากทฤษฎี จากเครื่องมือที่มีอยู่ จากการสัมภาษณ์ผู้ที่มีประสบการณ์ที่กำลังอธิบาย และจากผู้เชี่ยวชาญเฉพาะด้าน
ในขั้นตอนนี้ คลังข้อคำถามจะถูกตรวจสอบความครอบคลุมเนื้อหา (ครอบคลุมทั้งโครงสร้างหรือกระจุกอยู่ด้านเดียว?) ระดับการอ่าน ข้อคำถามที่ถามสองเรื่องพร้อมกัน และข้อคำถามที่จริงๆ แล้วถามเกี่ยวกับสิ่งอื่น
3. ทดสอบนำร่องและตัดทิ้ง
คลังข้อคำถามถูกนำไปใช้กับกลุ่มตัวอย่างแรก การวิเคราะห์ส่วนใหญ่เป็นการตัดทิ้ง
ข้อคำถามที่แทบไม่มีความแปรปรวนถูกตัดออก คำถามที่ทุกคนตอบเหมือนกันไม่สามารถแยกแยะใครได้ ข้อคำถามที่มีสหสัมพันธ์ต่ำกับคะแนนรวมถูกตัดออก ข้อคำถามที่มีน้ำหนักข้ามไปยังมากกว่าหนึ่งปัจจัยถูกตัดออก ข้อคำถามที่ทำงานแตกต่างกันในกลุ่มประชากรด้วยเหตุผลที่ไม่เกี่ยวกับลักษณะ ซึ่งเรียกว่าการทำงานเชิงอนุพันธ์ของข้อคำถาม ถูกตัดออก และการตรวจสอบนี้เป็นหนึ่งในสิ่งที่ถูกข้ามบ่อยที่สุด
สิ่งที่เหลือรอดมักเป็นหนึ่งในสามของสิ่งที่เขียนไว้
4. ยืนยันโครงสร้างในกลุ่มตัวอย่างใหม่
นี่คือขั้นตอนที่แยกเครื่องมือที่จริงจังออกจากส่วนที่เหลือ การวิเคราะห์ปัจจัยในกลุ่มตัวอย่างพัฒนาจะค้นพบโครงสร้างที่ออกแบบไว้อย่างแน่นอน เพราะข้อคำถามถูกเลือกมาเพื่อผลิตมัน การทดสอบจริงคือการวิเคราะห์ปัจจัยเชิงยืนยันในกลุ่มตัวอย่างอิสระ
มาตรวัดที่ตีพิมพ์จำนวนมากค้นพบโครงสร้างที่ตั้งใจไว้เฉพาะในข้อมูลที่ใช้สร้าง เมื่อมีคนอื่นเก็บข้อมูลใหม่ ปัจจัยไม่ปรากฏ ความล้มเหลวนั้นพบได้บ่อยมากจนว่า "โครงสร้างได้รับการยืนยันในกลุ่มตัวอย่างอิสระหรือไม่?" เป็นหนึ่งในคำถามที่มีประสิทธิภาพที่สุดที่จะถามเกี่ยวกับเครื่องมือใดๆ
5. สะสมหลักฐานความตรง
สหสัมพันธ์กับมาตรวัดที่เป็นที่ยอมรับของโครงสร้างเดียวกัน สหสัมพันธ์กับโครงสร้างที่ควรจะแตกต่าง ซึ่งควรจะต่ำกว่า ความสัมพันธ์กับผลลัพธ์ที่สำคัญ ความตรงเชิงเพิ่มพูนเหนือสิ่งที่มีอยู่ ความเสถียรของการทดสอบซ้ำในช่วงเวลาที่เหมาะสมกับโครงสร้าง
ขั้นตอนนี้ไม่มีวันสิ้นสุด ดำเนินต่อไปตราบเท่าที่เครื่องมือยังถูกใช้งาน และเป็นจุดที่เครื่องมือมักถูกพบว่าขาดตกบกพร่องหลายปีหลังจากตีพิมพ์
6. สร้างเกณฑ์ปกติ
กลุ่มตัวอย่างอ้างอิงที่มีขนาดใหญ่เพียงพอและเป็นตัวแทนเพียงพอสำหรับประชากรที่ตั้งเป้าหมาย แบ่งชั้นเมื่อลักษณะแตกต่างตามอายุหรือเพศ บันทึกปีและประเทศ จากนั้นทำซ้ำเป็นระยะ เพราะเกณฑ์ปกติเปลี่ยนแปลงตามเวลา
7. แปล หากจะใช้ในที่อื่น
การแปลไม่ใช่แบบฝึกหัดทางภาษาศาสตร์ การปรับใช้อย่างถูกต้องหมายถึงการแปลไปข้างหน้า การแปลกลับอิสระ การตรวจสอบโดยผู้เชี่ยวชาญ การสัมภาษณ์เชิงปัญญากับผู้พูดภาษาเป้าหมาย จากนั้นทำการศึกษาทางจิตวิทยาใหม่ในภาษาใหม่เพื่อทดสอบว่าโครงสร้างยังคงอยู่และข้อคำถามทำงานเทียบเท่ากันหรือไม่ เครื่องมือที่แปลโดยไม่มีการศึกษานั้นคือเครื่องมือที่ยังไม่ได้ทดสอบในภาษานั้น ไม่ว่าจะมีเครื่องรับรองใดในภาษาต้นฉบับ
นี่หมายความว่าอย่างไรเกี่ยวกับแบบทดสอบด่วน
แบบทดสอบที่เขียนในบ่ายวันเดียวได้ทำขั้นตอนที่สองเสร็จ อาจให้ผลลัพธ์ที่ดูสมเหตุสมผล เปอร์เซ็นไทล์และย่อหน้าอธิบาย ขั้นตอนที่มันข้ามไปคือขั้นตอนที่จะยืนยันว่าสิ่งเหล่านั้นมีความหมายจริงหรือไม่
ลองทำแบบทดสอบดู
การอ่านเกี่ยวกับการวัดผลเป็นเรื่องหนึ่ง การเห็นคะแนนของคุณเองที่รายงานพร้อมแหล่งที่มา กลุ่มตัวอย่างเกณฑ์ปกติ และข้อจำกัดของมันเป็นอีกเรื่องหนึ่ง ทำได้ฟรี ไม่ต้องสมัครสมาชิก
อ่านต่อ
- จิตวิทยาการวัดคืออะไรศาสตร์ที่พิจารณาว่าการวัดทางจิตวิทยานั้นดีหรือไม่ และเหตุผลที่แบบทดสอบสองชุดที่ถามคำถามคล้ายกันอาจแตกต่างกันอย่างมากในคุณค่าของผลลัพธ์
- ความเที่ยงในการทดสอบทางจิตวิทยาคืออะไรความเที่ยงคือความสม่ำเสมอของการวัด ไม่ใช่ความถูกต้อง แบบทดสอบอาจมีความเที่ยงสูงแต่ยังคงวัดสิ่งผิด ด้วยเหตุนี้จึงเป็นคำถามแรกที่ถูกถามและไม่เคยเป็นคำถามสุดท้าย
- ความตรงในการทดสอบทางจิตวิทยาคืออะไรความตรงไม่ใช่คุณสมบัติที่แบบทดสอบมี แต่เป็นข้อโต้แย้งว่าการตีความคะแนนเฉพาะด้าน เพื่อจุดประสงค์เฉพาะนั้น สามารถปกป้องได้หรือไม่ และต้องสร้างใหม่สำหรับการใช้งานใหม่ทุกครั้ง
- ความตรงเชิงโครงสร้างคืออะไรคำถามที่ยากที่สุดในการวัด: สิ่งที่คุณกำลังวัดมีอยู่จริงตามที่คุณกำหนดหรือไม่ และเครื่องมือของคุณเข้าถึงมันแทนที่จะเป็นสิ่งที่อยู่ข้างเคียงหรือไม่
- ความตรงเชิงสอดคล้องและความตรงเชิงจำแนกข้อกำหนดสองด้านที่สะท้อนกัน: เครื่องมือวัดต้องสอดคล้องกับสิ่งที่ควรสอดคล้อง และต้องแตกต่างจากสิ่งที่อ้างว่าไม่ใช่ เครื่องมือที่อ่อนแอส่วนใหญ่ล้มเหลวในข้อที่สอง
- ค่าอัลฟาของครอนบาคคืออะไร และไม่ใช่อะไรสถิติที่ถูกรายงานมากที่สุดในการทดสอบทางจิตวิทยา และถูกอ่านผิดมากที่สุด อัลฟาไม่ได้บอกว่ามาตรวัดเป็นมิติเดียว และค่าที่สูงมักเป็นอาการมากกว่าคุณธรรม
- ความคลาดเคลื่อนมาตรฐานของการวัด: คะแนนของคุณอาจคลาดเคลื่อนได้มากเพียงใดทุกคะแนนมีช่วงความคลาดเคลื่อน และสำหรับแบบทดสอบทางจิตวิทยาส่วนใหญ่จะกว้างกว่าที่คนคิด นี่คือตัวเลขที่บอกคุณว่าความแตกต่างเป็นของจริงหรือเป็นเพียงสัญญาณรบกวน
- เกณฑ์ปกติและเปอร์เซ็นไทล์: คะแนนของคุณถูกเปรียบเทียบกับอะไรคะแนนดิบไม่สามารถตีความได้ด้วยตัวเอง มันมีความหมายก็ต่อเมื่อเทียบกับกลุ่มอ้างอิง และกลุ่มที่ใช้คือข้อเท็จจริงที่สำคัญที่สุดและถูกโฆษณาน้อยที่สุดเกี่ยวกับแบบทดสอบใดๆ
- การเรียกแบบทดสอบว่าผ่านการตรวจสอบหมายความว่าอย่างไรคำนี้ไม่ได้ถูกควบคุมและถูกใช้อย่างเสรีโดยผลิตภัณฑ์ที่ไม่ได้ทำงานใดๆ เลย นี่คือความหมายเมื่อมันมีความหมาย และคำถามสี่ข้อที่แยกสองกรณีออกจากกัน
- ทำไมแบบทดสอบบุคลิกภาพออนไลน์ส่วนใหญ่จึงไม่น่าเชื่อถือไม่ใช่เพราะไม่สุจริต แต่เพราะขั้นตอนที่ทำให้การวัดน่าเชื่อถือนั้นมองไม่เห็น มีราคาแพง และง่ายต่อการข้าม และการข้ามไม่เปลี่ยนแปลงอะไรเกี่ยวกับรูปลักษณ์ของผลลัพธ์
- แบบรายงานตนเองสามารถวัดอะไรได้และไม่ได้แบบสอบถามขอให้คุณเป็นผู้สังเกตตนเอง ซึ่งได้ผลดีกับบางสิ่งมากกว่าสิ่งอื่น การรู้ว่าวิธีนี้แข็งแกร่งตรงไหนและล้มเหลวตรงไหนจะเปลี่ยนวิธีที่คุณอ่านผลลัพธ์ใดก็ตาม
- การที่แบบทดสอบทำนายบางสิ่งได้หมายความว่าอย่างไรสหสัมพันธ์ 0.30 เป็นผลการค้นพบที่แข็งแกร่งในการวิจัยบุคลิกภาพ แต่เป็นพื้นฐานที่อ่อนแอสำหรับการตัดสินใจเกี่ยวกับคนคนเดียว ทั้งสองข้อความเป็นจริง และช่องว่างระหว่างนั้นทำให้เกิดการใช้ผลทดสอบในทางที่ผิดส่วนใหญ่
- การคัดกรองไม่ใช่การวินิจฉัยแบบสอบถามคัดกรองถูกสร้างขึ้นเพื่อจับกรณีที่เป็นไปได้ให้ได้มากที่สุด โดยยอมรับอัตราบวกเท็จที่สูงเป็นราคาที่ต้องจ่าย การอ่านคะแนนคัดกรองเป็นการวินิจฉัยนั้นกลับข้างสิ่งที่มันถูกออกแบบมาให้ทำ