ระบบวิเคราะห์ข้อสอบเป็นเครื่องมือที่ช่วยครูและบุคลากรทางการศึกษาตรวจข้อสอบและวิเคราะห์คุณภาพข้อสอบ
| ข้อ | มิติย่อย | ความง่าย (p) | แปลผล | จำแนก (r) | r (item-rest) | Alpha (Del) | Sato* (Cj) | สถานะ |
|---|
| ตัวชี้วัด/มิติย่อย | จำนวนข้อ | ข้อที่ | คะแนนเต็ม | คะแนนเฉลี่ย | ความเชื่อมั่น (Alpha) |
|---|
ระบบรองรับไฟล์นามสกุล .csv โดยจัดเตรียมข้อมูลดังนี้:
Key,A,B,C,... เพื่อเติมอัตโนมัติในการอิงกลุ่ม หากมีผู้สอบคะแนนเท่ากันที่รอยต่อจุดตัด (เช่น คนที่ได้คะแนนเท่ากันมีทั้งอยู่ในกลุ่มเก่งและกลุ่มปานกลาง) ระบบจะใช้ Strict Cutoff โดยยึดลำดับที่ปรากฏในไฟล์ข้อมูล (First-come, first-served) เพื่อให้ขนาดของกลุ่มสูงและกลุ่มต่ำเท่ากันพอดีตามสูตรทฤษฎีการทดสอบ
| ช่วงค่า $p$ | ความหมาย (การแปลผล) |
|---|---|
| 0.81 - 1.00 | ง่ายมาก (ควรปรับปรุง) |
| 0.60 - 0.80 | ค่อนข้างง่าย (ใช้ได้) |
| 0.40 - 0.59 | ปานกลาง (ดีมาก) |
| 0.20 - 0.39 | ค่อนข้างยาก (ใช้ได้) |
| 0.00 - 0.19 | ยากมาก (ควรปรับปรุง) |
| ช่วงค่า $D$ (อิงกลุ่ม) | ความหมาย (การแปลผลเบื้องต้น) |
|---|---|
| $\ge 0.40$ | จำแนกได้ดีมาก |
| 0.20 - 0.39 | จำแนกได้พอใช้ |
| $< 0.20$ | จำแนกไม่ได้ (ควรปรับปรุง/ตัดทิ้ง) |
ใช้วิเคราะห์ความสัมพันธ์ระหว่างคะแนนข้อสอบรายข้อกับ คะแนนรวมที่ตัดคะแนนข้อนั้นออกแล้ว (Corrected Item-Total Correlation) จึงไม่เกิดการนับคะแนนข้อนั้นซ้ำ และใช้ข้อมูลผู้สอบทุกคนโดยไม่ต้องแบ่งกลุ่ม
ระบบใช้สูตร Cronbach's Alpha ($\alpha$) เป็นสูตรหลัก (ครอบคลุมทั้งข้อสอบอัตนัยและปรนัย หากข้อสอบเป็นแบบ 0,1 ทั้งหมด ค่าที่ได้จะเท่ากับ KR-20 ทางคณิตศาสตร์)
ใช้สูตร Livingston's Coefficient ($k^2$) เพื่อดูความคงเส้นคงวาในการตัดสินใจรอบจุดตัด (Cut-Score)
เป็นการประมาณค่าความเชื่อมั่นขั้นต่ำ (Lower Bound) ใช้ได้เฉพาะเมื่อข้อสอบทุกข้อมีคะแนนเต็มเท่ากับ 1
SEM ใช้ Alpha หรือ KR-20 ซึ่งเป็นค่าความเชื่อมั่นของคะแนนวัด ไม่ใช้ Livingston k² ซึ่งเป็นดัชนีความคงเส้นคงวาของการตัดสินผ่าน/ไม่ผ่าน
ระบบรายงาน Modified Caution Index ($C^*$) ของ Harnisch และ Linn ซึ่งปรับจาก Sato Caution Index ให้มีช่วง 0–1 และใช้ได้เฉพาะคะแนน 0/1 ทุกข้อ ใช้เพื่อคัดกรองรูปแบบตอบที่ควรตรวจทาน ไม่ใช้ยืนยันการเดา ลอก หรือเฉลยผิดด้วยตัวเลขเพียงค่าเดียว ข้อที่ทุกคนตอบเหมือนกัน และผู้สอบที่ได้ 0 หรือเต็ม จะรายงาน “–” เพราะดัชนีนี้นิยามไม่ได้ในกรณีนั้น
ตรวจจับข้อสอบที่มีปัญหา (เช่น คนเก่งตอบผิด แต่คนอ่อนดันตอบถูก ซึ่งอาจเกิดจากตัวลวงกำกวม หรือเฉลยผิด)
ตรวจจับพฤติกรรมผู้สอบที่ผิดปกติ (เช่น ทำข้อสอบระดับยากมากๆ ได้ แต่กลับทำข้อสอบระดับง่ายมากๆ ผิด ซึ่งอาจเกิดจากการเดาอย่างรุนแรง หรือการทุจริตลอกข้อสอบ)