Showing cs.CLShow all
2 papers · 1 filter
cs.CL2026
Benchmarking Educational LLMs with Analytics: A Case Study on Gender Bias in Feedback
Yishan Du, Conrad Borchers, Mutlu Cukurova
As teachers increasingly turn to GenAI in their educational practice, we need robust methods to benchmark large language models (LLMs) for pedagogical purposes. This article presen…
cs.CL2025
Towards Mining Effective Pedagogical Strategies from Learner-LLM Educational Dialogues
Liqun He, Manolis Mavrikis, Mutlu Cukurova
Dialogue plays a crucial role in educational settings, yet existing evaluation methods for educational applications of large language models (LLMs) primarily focus on technical per…