1 paper
Daeheon Jeong, Yoonjoo Lee, Eugene Choi +2
LLM-based user simulators are increasingly used to evaluate autonomous agents at scale, in place of costly human evaluations. Despite this promise, these simulators exhibit "assist…