1 paper · 1 filter
Hongfei Yan, Jiangkai Xiong, Yiqing Li +1
Difficulty differences across parallel-class programming examinations affect the fairness of course assessment. This study repositions large language models from benchmark evaluati…