1 paper
Hongfei Yan, Jiangkai Xiong, Yiqing Li +1
Difficulty differences across parallel-class programming examinations affect the fairness of course assessment. This study repositions large language models from benchmark evaluati…