ค่าอัลฟาของครอนบาคคืออะไร และไม่ใช่อะไร
สถิติที่ถูกรายงานมากที่สุดในการทดสอบทางจิตวิทยา และถูกอ่านผิดมากที่สุด อัลฟาไม่ได้บอกว่ามาตรวัดเป็นมิติเดียว และค่าที่สูงมักเป็นอาการมากกว่าคุณธรรม
Cronbach alpha เป็นสัมประสิทธิ์ความสอดคล้องภายใน: ระดับที่ข้อคำถามในมาตรวัดสัมพันธ์กัน ตีพิมพ์ในปี 1951 เป็นสถิติทางจิตวิทยาการวัดที่รายงานมากที่สุดตัวเดียว และความแพร่หลายของมันก้าวล้ำความมีประโยชน์
Alpha อยู่ในช่วง 0 ถึง 1 และถูกขับเคลื่อนโดยสองสิ่ง: ค่าเฉลี่ยสหสัมพันธ์ระหว่างข้อคำถาม และจำนวนข้อคำถาม การพึ่งพาตัวที่สองเป็นแหล่งที่มาของความเข้าใจผิดส่วนใหญ่
Alpha สูงไม่ได้หมายความว่าอะไร
ไม่ได้หมายความว่ามาตรวัดวัดสิ่งเดียว นี่คือความผิดพลาดที่พบบ่อยที่สุด Alpha สามารถสูงสำหรับมาตรวัดที่มีสองหรือสามองค์ประกอบที่แตกต่างกัน หากข้อคำถามสัมพันธ์กันเพียงพอโดยรวม ความเป็นหนึ่งมิติต้องถูกพิสูจน์โดยการวิเคราะห์องค์ประกอบ alpha ไม่สามารถพิสูจน์ได้และไม่เคยตั้งใจจะทำ
ไม่ได้หมายความว่ามาตรวัดมีความตรง Alpha ไม่ได้บอกอะไรเกี่ยวกับสิ่งที่ข้อคำถามวัด คำถาม 20 ข้อเกี่ยวกับขนาดรองเท้าจะมีความสอดคล้องภายในดีเยี่ยมและความตรงเป็นศูนย์ในฐานะการวัดสิ่งใดทางจิตวิทยา
ไม่ได้หมายความว่ามาตรวัดดี เพราะ alpha เพิ่มขึ้นตามจำนวนข้อ มาตรวัดยาวที่มีข้อคำถามคุณภาพปานกลางจะได้คะแนนสูงกว่ามาตรวัดสั้นที่มีข้อดีเยี่ยม มาตรวัด 40 ข้อที่มีค่าเฉลี่ยสหสัมพันธ์ระหว่างข้อ 0.2 จะอยู่เหนือ 0.90
Alpha สูงมากมักเป็นสัญญาณเตือน เหนือประมาณ 0.95 ข้อคำถามมักเป็นการถอดความกัน ซึ่งซื้อความสอดคล้องแลกกับการครอบคลุมโครงสร้าง: มาตรวัดวัดแง่มุมแคบหนึ่งอย่างแม่นยำมากและพลาดส่วนที่เหลือ นี่เรียกว่า attenuation paradox และเป็นเหตุผลที่ความสอดคล้องมากขึ้นไม่ได้ดีขึ้นเสมอ
สิ่งที่มันสมมติ
Alpha เป็นขอบเขตล่างของความเที่ยงภายใต้สมมติฐานเฉพาะ คือ tau-equivalence หมายความว่าทุกข้อมีส่วนร่วมเท่ากันกับลักษณะพื้นฐาน มาตรวัดจริงแทบไม่เคยเป็นไปตามนี้ ข้อคำถามแตกต่างกันในความแรงที่โหลดบนองค์ประกอบ และเมื่อเป็นเช่นนั้น alpha ประเมินความเที่ยงต่ำเกินไป
McDonald omega ตัดสมมติฐานการมีส่วนร่วมเท่ากันและประเมินความเที่ยงจากน้ำหนักองค์ประกอบจริง นักระเบียบวิธีแนะนำมาแทน alpha มาสองทศวรรษ แนวปฏิบัติการรายงานตามช้า ส่วนใหญ่เพราะ alpha เป็นบรรทัดเดียวในทุกโปรแกรมสถิติและ omega ไม่ใช่
การอ่านในทางปฏิบัติ
แนวทางคร่าว: 0.70 ขึ้นไปเป็นที่ยอมรับสำหรับการวิจัยเปรียบเทียบกลุ่ม 0.80 ขึ้นไปสำหรับการใช้งานประยุกต์ 0.90 ขึ้นไปเมื่อคะแนนมีผลต่อการตัดสินใจรายบุคคล ปฏิบัติต่อสิ่งเหล่านี้เป็นแนวทาง ไม่ใช่เกณฑ์ ระดับที่ต้องการขึ้นอยู่กับความเสี่ยงของการตัดสินใจที่คะแนนใช้
ตัวเลขที่ให้ข้อมูลมากกว่ามักอยู่ที่อื่นในบทความเดียวกัน ค่าเฉลี่ยสหสัมพันธ์ระหว่างข้อ (0.15 ถึง 0.50 เป็นช่วงที่ดี) บอกว่า alpha สูงมาจากคุณภาพของข้อหรือจำนวนข้อ จำนวนข้อบอกสิ่งเดียวกันจากอีกทิศทาง ความเที่ยงจากการทดสอบซ้ำบอกสิ่งที่ alpha ไม่สามารถบอกโครงสร้างได้: ว่าคะแนนเสถียรในคนเดียวกันตามเวลาหรือไม่
มาตรวัดที่รายงานเฉพาะ alpha ได้รายงานตัวเลขความเที่ยงที่ง่ายที่สุดในการได้มา และเรียกร้องน้อยที่สุดในการผ่าน
ลองทำแบบทดสอบดู
การอ่านเกี่ยวกับการวัดผลเป็นเรื่องหนึ่ง การเห็นคะแนนของคุณเองที่รายงานพร้อมแหล่งที่มา กลุ่มตัวอย่างเกณฑ์ปกติ และข้อจำกัดของมันเป็นอีกเรื่องหนึ่ง ทำได้ฟรี ไม่ต้องสมัครสมาชิก
อ่านต่อ
- จิตวิทยาการวัดคืออะไรศาสตร์ที่พิจารณาว่าการวัดทางจิตวิทยานั้นดีหรือไม่ และเหตุผลที่แบบทดสอบสองชุดที่ถามคำถามคล้ายกันอาจแตกต่างกันอย่างมากในคุณค่าของผลลัพธ์
- ความเที่ยงในการทดสอบทางจิตวิทยาคืออะไรความเที่ยงคือความสม่ำเสมอของการวัด ไม่ใช่ความถูกต้อง แบบทดสอบอาจมีความเที่ยงสูงแต่ยังคงวัดสิ่งผิด ด้วยเหตุนี้จึงเป็นคำถามแรกที่ถูกถามและไม่เคยเป็นคำถามสุดท้าย
- ความตรงในการทดสอบทางจิตวิทยาคืออะไรความตรงไม่ใช่คุณสมบัติที่แบบทดสอบมี แต่เป็นข้อโต้แย้งว่าการตีความคะแนนเฉพาะด้าน เพื่อจุดประสงค์เฉพาะนั้น สามารถปกป้องได้หรือไม่ และต้องสร้างใหม่สำหรับการใช้งานใหม่ทุกครั้ง
- ความตรงเชิงโครงสร้างคืออะไรคำถามที่ยากที่สุดในการวัด: สิ่งที่คุณกำลังวัดมีอยู่จริงตามที่คุณกำหนดหรือไม่ และเครื่องมือของคุณเข้าถึงมันแทนที่จะเป็นสิ่งที่อยู่ข้างเคียงหรือไม่
- ความตรงเชิงสอดคล้องและความตรงเชิงจำแนกข้อกำหนดสองด้านที่สะท้อนกัน: เครื่องมือวัดต้องสอดคล้องกับสิ่งที่ควรสอดคล้อง และต้องแตกต่างจากสิ่งที่อ้างว่าไม่ใช่ เครื่องมือที่อ่อนแอส่วนใหญ่ล้มเหลวในข้อที่สอง
- ความคลาดเคลื่อนมาตรฐานของการวัด: คะแนนของคุณอาจคลาดเคลื่อนได้มากเพียงใดทุกคะแนนมีช่วงความคลาดเคลื่อน และสำหรับแบบทดสอบทางจิตวิทยาส่วนใหญ่จะกว้างกว่าที่คนคิด นี่คือตัวเลขที่บอกคุณว่าความแตกต่างเป็นของจริงหรือเป็นเพียงสัญญาณรบกวน
- เกณฑ์ปกติและเปอร์เซ็นไทล์: คะแนนของคุณถูกเปรียบเทียบกับอะไรคะแนนดิบไม่สามารถตีความได้ด้วยตัวเอง มันมีความหมายก็ต่อเมื่อเทียบกับกลุ่มอ้างอิง และกลุ่มที่ใช้คือข้อเท็จจริงที่สำคัญที่สุดและถูกโฆษณาน้อยที่สุดเกี่ยวกับแบบทดสอบใดๆ
- แบบทดสอบทางจิตวิทยาถูกสร้างขึ้นอย่างไรตั้งแต่การกำหนดโครงสร้างจนถึงเกณฑ์ปกติที่เผยแพร่ ลำดับขั้นตอนใช้เวลาหลายปีและทิ้งสิ่งที่ใส่เข้าไปส่วนใหญ่ การรู้ขั้นตอนทำให้เห็นชัดว่าแบบทดสอบออนไลน์ด่วนข้ามขั้นตอนไหน
- การเรียกแบบทดสอบว่าผ่านการตรวจสอบหมายความว่าอย่างไรคำนี้ไม่ได้ถูกควบคุมและถูกใช้อย่างเสรีโดยผลิตภัณฑ์ที่ไม่ได้ทำงานใดๆ เลย นี่คือความหมายเมื่อมันมีความหมาย และคำถามสี่ข้อที่แยกสองกรณีออกจากกัน
- ทำไมแบบทดสอบบุคลิกภาพออนไลน์ส่วนใหญ่จึงไม่น่าเชื่อถือไม่ใช่เพราะไม่สุจริต แต่เพราะขั้นตอนที่ทำให้การวัดน่าเชื่อถือนั้นมองไม่เห็น มีราคาแพง และง่ายต่อการข้าม และการข้ามไม่เปลี่ยนแปลงอะไรเกี่ยวกับรูปลักษณ์ของผลลัพธ์
- แบบรายงานตนเองสามารถวัดอะไรได้และไม่ได้แบบสอบถามขอให้คุณเป็นผู้สังเกตตนเอง ซึ่งได้ผลดีกับบางสิ่งมากกว่าสิ่งอื่น การรู้ว่าวิธีนี้แข็งแกร่งตรงไหนและล้มเหลวตรงไหนจะเปลี่ยนวิธีที่คุณอ่านผลลัพธ์ใดก็ตาม
- การที่แบบทดสอบทำนายบางสิ่งได้หมายความว่าอย่างไรสหสัมพันธ์ 0.30 เป็นผลการค้นพบที่แข็งแกร่งในการวิจัยบุคลิกภาพ แต่เป็นพื้นฐานที่อ่อนแอสำหรับการตัดสินใจเกี่ยวกับคนคนเดียว ทั้งสองข้อความเป็นจริง และช่องว่างระหว่างนั้นทำให้เกิดการใช้ผลทดสอบในทางที่ผิดส่วนใหญ่
- การคัดกรองไม่ใช่การวินิจฉัยแบบสอบถามคัดกรองถูกสร้างขึ้นเพื่อจับกรณีที่เป็นไปได้ให้ได้มากที่สุด โดยยอมรับอัตราบวกเท็จที่สูงเป็นราคาที่ต้องจ่าย การอ่านคะแนนคัดกรองเป็นการวินิจฉัยนั้นกลับข้างสิ่งที่มันถูกออกแบบมาให้ทำ