Showing cs.AIShow all
2 papers · 1 filter
cs.AI2026
Diagnosing Task Insensitivity in Language Agents
Jingyu Liu, Xiaopeng Wu, Kehan Chen +2
Large language models can serve as capable long-horizon agents, but their out-of-distribution (OOD) generalization remains weak. We identify a key source of this failure as task in…
cs.AI2026
Gradient Coupling: The Hidden Barrier to Generalization in Agentic Reinforcement Learning
Jingyu Liu, Xiaopeng Wu, Jingquan Peng +4
Reinforcement learning (RL) is a dominant paradigm for training autonomous agents, yet these agents often exhibit poor generalization, failing to adapt to scenarios not seen during…