Seongeun Kim
Author directory2026
Score Comparability Limits with Common AES Validation Measures
Tim Moses | Seongeun Kim | Nick Trout
Proceedings of the Artificial Intelligence in Measurement and Education Conference (AIME-Con): Works in Progress
Tim Moses | Seongeun Kim | Nick Trout
Proceedings of the Artificial Intelligence in Measurement and Education Conference (AIME-Con): Works in Progress
This study considers measures commonly used to validate AES scoring and their limitations for indicating comparability with human rater scoring. In data simulated to reflect validation results achieved by AES national competition winners, scoring standard differences can occur across AES and human rater scoring (especially for 4-point scales vs. 2- and 3-point scales). Equipercentile methods are described and recommended for resolving the scoring differences.