1 paper
Xuansheng Wu, Padmaja Pravin Saraf, Gyeonggeon Lee +3
Large language models (LLMs) have demonstrated strong potential in performing automatic scoring for constructed response assessments. While constructed responses graded by humans a…