2 papers
cs.LG2026
Adaptive Problem Generation via Symbolic Representations
Teresa Yeo, Myeongho Jeon, Dulaj Weerakoon +4
We present a method for generating training data for reinforcement learning with verifiable rewards to improve small open-weights language models on mathematical tasks. Existing da…
cs.RO2026
Towards Adaptive Environment Generation for Training Embodied Agents
Teresa Yeo, Dulaj Weerakoon, Dulanga Weerakoon +1
Embodied agents struggle to generalize to new environments, even when those environments share similar underlying structures to their training settings. Most current approaches to…