1 paper · 1 filter
Dianxing Shi, Bowen Wang, Junqi He +2
Self-evolving agents improve through continual self-play and self-generated learning signals, but their internally generated tasks and verifier signals provide limited coverage of…