1 paper
Yingying Guo, Zhuoxuan Ju, Ruibo Ming +2
Large language model agents are increasingly evaluated through games, but most benchmarks emphasize final outcomes rather than how players learn from repeated interaction. We study…