1 paper
Kaijie Chen, Chenyu Fang, Liang Yan +3
Test-time self-evolving agents improve by reusing past experience, yet sparse-reward trajectories contain failures, loops, and detours, while summaries often omit the state conditi…